prompt injections.de
Glossar

Dual-LLM-Muster

Beim Dual-LLM-Muster arbeitet ein privilegiertes Modell mit Werkzeugzugriff niemals direkt mit nicht vertrauenswürdigen Inhalten, während ein isoliertes Zweitmodell diese verarbeitet und keine Werkzeuge besitzt. Der Ansatz stammt von Simon Willison und ist die konzeptionelle Grundlage von CaMeL.

Der Begriff gehört zum Themenfeld Prompt Injection und LLM-Sicherheit. Das vollständige Nachschlagewerk mit 82 Einträgen steht im Glossar. Unmittelbar benachbart sind CaMeL, Tödliche Trias, KI-Agent.

Bezug zu Prompt Injection

Das Muster ist die erste breit rezipierte Antwort auf die Einsicht, dass ein einzelnes Modell die Vertrauensgrenze nicht halten kann: Sicherheit entsteht aus der Trennung der Rollen, nicht aus besserem Prompten. Der Preis sind zusätzliche Komplexität und Einbußen bei Aufgaben, die Werkzeugzugriff und Verständnis fremder Inhalte gleichzeitig erfordern. CaMeL formalisiert den Gedanken später zu einer durchsetzbaren Policy-Schicht.

Beispiel

Ein Modell mit E-Mail-Zugriff erhält von einem zweiten, werkzeuglosen Modell nur eine strukturierte Zusammenfassung des fremden Textes — nie den Text selbst.

Verwandte Begriffe

  • CaMeL — CaMeL ist eine Architektur, die Kontroll- und Datenfluss aus der vertrauenswürdigen Anfrage ableitet und die Ausführung einer…
  • Tödliche Trias — Die tödliche Trias beschreibt die gefährliche Kombination aus Zugriff auf private Daten, Verarbeitung nicht vertrauenswürdiger…
  • KI-Agent — Ein KI-Agent ist ein System, das ein Sprachmodell mit Werkzeugen und einer Handlungsschleife verbindet, um Aufgaben eigenständig…

Quellen

  1. Dual-LLM-Muster — Beleg: https://simonwillison.net/2023/Apr/25/dual-llm-pattern/