Baran Tekin — ai security

Ich greife KI-Systeme an.

KI-Systeme laufen in vielen Firmen als Blackbox. Als Sicherheitsforscher zerlege ich die Angriffe, die sie treffen, und zeige, wie man sie schützt. Im Journal dokumentiere ich, was bricht und was standhält.

Scrollen, um zu ermitteln ↓

These 01

Jede neue Technologie wirft neue Schatten.

These 02

Wer KI einsetzt, trägt Verantwortung für das, was er nicht sieht.

These 03

Meine Arbeit: Licht hineinbringen, bevor es jemand anderes tut.

Die Akten

08 Dossiers · horizontal ermitteln

Akte 01vertraulich

Prompt Injection

Sprachmodelle folgen jedem, der überzeugend genug fragt. Wie Angreifer mit reiner Sprache Regeln aushebeln, Daten abziehen und Werkzeuge kapern. Und was dagegen hält.

Akte 02vertraulich

Jailbreaks

Rollenspiele, Kodierungen, mehrstufige Dialoge: die Techniken, mit denen Schutzvorgaben von Sprachmodellen fallen. Und was ihre Stabilität wirklich bestimmt.

Akte 03vertraulich

KI-Agenten

Sprachmodelle mit Zugriff auf Mail, Datenbanken und Werkzeuge: Aus einem Textproblem wird ein Systemproblem. Die Angriffsfläche der Agenten, bevor sie überall laufen.

Akte 04vertraulich

Data Poisoning

Ein Modell ist nur so vertrauenswürdig wie seine Trainingsdaten. Wie vergiftete Datensätze Hintertüren einbauen und die Lieferkette des maschinellen Lernens zum Angriffsziel machen.

Akte 05vertraulich

Guardrails

Filter, Klassifikatoren, Regelwerke um das Modell herum. Was Guardrails wirklich leisten, wann sie fallen und warum sie eine Schicht sind, keine Verteidigung.

Akte 06vertraulich

Sichere KI-Architektur

Filter beruhigen, Architektur schützt: Rechte begrenzen, Ausgaben misstrauen, kritische Aktionen entkoppeln. Baupläne für KI-Anwendungen, die einen Angriff aushalten.

Akte 07vertraulich

Red Teaming

Das eigene System angreifen, bevor es jemand anderes tut: Methodik, Erfolgskriterien und Nachweise für das adversariale Testen von KI-Systemen.

Akte 08vertraulich

Regulierung & Governance

Der EU AI Act verlangt nachweisbare Sorgfalt. Zwischen Gesetzestext und Systemarchitektur liegt ein weites Feld. Ich übersetze in beide Richtungen.

Protokolle

Alle Beiträge
J-004 / 2026-08

MCP Security: wie ein einziger Server den Agenten kapert

KI-Agenten
J-003 / 2026-06

Indirect Prompt Injection: wenn fremde Inhalte die KI steuern

Prompt Injection
J-002 / 2026-05

KI-Agenten als Sicherheitsrisiko: die Angriffsfläche

KI-Agenten
J-001 / 2026-01

OWASP LLM Top 10: alle zehn Risiken erklärt, Stand 2026

Sichere KI-Architektur