Mensch in der Schleife (Human in the Loop)
Human in the Loop bedeutet, dass folgenschwere Aktionen erst nach ausdrücklicher menschlicher Freigabe ausgeführt werden. Die Freigabe wirkt nur, wenn dem Menschen die tatsächliche Aktion verständlich angezeigt wird — nicht bloß eine Zusammenfassung des Modells.
Der Begriff gehört zum Themenfeld Prompt Injection und LLM-Sicherheit. Das vollständige Nachschlagewerk mit 82 Einträgen steht im Glossar. Unmittelbar benachbart sind KI-Agent, Least Privilege, Verwirrter Stellvertreter (Confused Deputy).
Bezug zu Prompt Injection
Die Maßnahme ist nur so gut wie die Qualität der Anzeige: Sieht der Mensch lediglich die Zusammenfassung des Modells, bestätigt er im Zweifel eine Aktion, deren tatsächliche Parameter er nie gesehen hat. Zudem stumpft die Bestätigung ab, wenn sie zu häufig verlangt wird — dann wird sie zur Routinegeste. Sinnvoll ist sie deshalb selektiv für folgenschwere, nicht umkehrbare Aktionen und mit Anzeige der echten Parameter.
Beispiel
Vor dem Versand zeigt die Oberfläche Empfänger, Betreff und vollständigen Inhalt der E-Mail an — nicht den Satz „Ich sende jetzt die angeforderte Zusammenfassung“.
Verwandte Begriffe
- KI-Agent — Ein KI-Agent ist ein System, das ein Sprachmodell mit Werkzeugen und einer Handlungsschleife verbindet, um Aufgaben eigenständig…
- Least Privilege — Least Privilege bedeutet, jeder Komponente nur die minimal nötigen Rechte zu geben. Für KI-Agenten ist es die wirksamste…
- Verwirrter Stellvertreter (Confused Deputy) — Ein verwirrter Stellvertreter ist eine Komponente, die ihre legitimen Rechte im Auftrag eines Angreifers einsetzt. KI-Agenten…
Quellen
- Mensch in der Schleife (Human in the Loop) — Beleg: https://genai.owasp.org/llmrisk/llm062025-excessive-agency/