InjecAgent
Benchmark für indirekte Prompt Injection in werkzeugnutzenden Agenten, unterteilt in Angriffe auf Nutzerdaten und auf Nutzeraktionen.
- Anbieter
- University of Illinois (Kang Lab)
- Typ
- Benchmark
- Lizenzmodell
- Open Source
- Primärquelle
- github.com
InjecAgent ist im Verzeichnis der Werkzeuge geführt, die beim Schutz vor Prompt Injection in LLM-Anwendungen eingesetzt werden. Die Beschreibung stammt aus der Primärquelle des Anbieters; Wirksamkeitsversprechen werden nicht übernommen. Vergleichbare Werkzeuge stehen im Werkzeug-Verzeichnis und im Guardrail-Vergleich.
Wofür es sich eignet
Messung der Anfälligkeit eigener Agenten gegenüber Tool-basierten Injektionen.
Was es nicht leistet
Ein Benchmark misst unter definierten Bedingungen. Werte sind zwischen Systemen nur vergleichbar, wenn Aufbau und Angriffsmenge identisch sind.
Der Grundsatz gilt unabhängig vom Produkt: Ein Sprachmodell ist kein Sicherheitskontrollpunkt. Wenn eine Aktion Schaden anrichten kann, muss sie außerhalb des Modells autorisiert werden — siehe Least Privilege für KI-Agenten.
Vergleichbare Werkzeuge
-
AgentDojo
Dynamische Testumgebung, die Agenten mit realistischen Aufgaben und eingebetteten Injektionen konfrontiert und Nützlichkeit gegen Sicherheit misst.
Open Source -
Open-Prompt-Injection
Offenes Framework zur systematischen Bewertung von Prompt-Injection-Angriffen und Abwehrmaßnahmen über mehrere Aufgaben und Modelle hinweg.
Open Source -
HackAPrompt-Datensatz
Offener Datensatz mit über 600.000 realen Angriffs-Prompts aus einem globalen Prompt-Hacking-Wettbewerb, taxonomisch aufbereitet.
Open Source
Quellen
- InjecAgent — Anbieter- oder Projektquelle: https://github.com/uiuc-kang-lab/InjecAgent