Akte 06
Sichere KI-Architektur
Die ehrlichste Annahme beim Bauen mit KI: Das Modell wird sich irgendwann gegen seinen Betreiber entscheiden. Gute Architektur sorgt dafür, dass das folgenlos bleibt.
Das Modell als unsichere Komponente
Der tragende Gedanke: Das Sprachmodell wird behandelt wie jede Komponente, die fremden Einfluss verarbeitet, nämlich als nicht vertrauenswürdig. Seine Ausgaben sind Vorschläge, keine Befehle. Wer so entwirft, braucht keine perfekten Filter, weil ein übernommenes Modell schlicht wenig anrichten kann.
Die Baupläne
Daraus folgen konkrete Muster: Rechte pro Aufgabe statt pro Anwendung, Trennung von Anweisung und Inhalt wo immer möglich, Validierung jeder Ausgabe, die weiterverarbeitet wird, und eine Bestätigung außerhalb des Modells für alles, was Geld bewegt, Daten löscht oder nach außen geht.
Von der Checkliste zur Architektur
Kataloge wie die OWASP Top 10 für LLM-Anwendungen sind gute Landkarten, aber keine Konstruktion. Der Unterschied zwischen einer abgehakten Liste und einem sicheren System liegt im Entwurf: Wer die Schadensklasse eines übernommenen Modells von vornherein begrenzt, muss nicht jede neue Angriffstechnik gewinnen.
Beiträge in dieser Akte 01