prompt injections.de
Werkzeug · Benchmark

InjecAgent

Benchmark für indirekte Prompt Injection in werkzeugnutzenden Agenten, unterteilt in Angriffe auf Nutzerdaten und auf Nutzeraktionen.

Anbieter
University of Illinois (Kang Lab)
Typ
Benchmark
Lizenzmodell
Open Source
Primärquelle
github.com

InjecAgent ist im Verzeichnis der Werkzeuge geführt, die beim Schutz vor Prompt Injection in LLM-Anwendungen eingesetzt werden. Die Beschreibung stammt aus der Primärquelle des Anbieters; Wirksamkeitsversprechen werden nicht übernommen. Vergleichbare Werkzeuge stehen im Werkzeug-Verzeichnis und im Guardrail-Vergleich.

Wofür es sich eignet

Messung der Anfälligkeit eigener Agenten gegenüber Tool-basierten Injektionen.

Was es nicht leistet

Ein Benchmark misst unter definierten Bedingungen. Werte sind zwischen Systemen nur vergleichbar, wenn Aufbau und Angriffsmenge identisch sind.

Der Grundsatz gilt unabhängig vom Produkt: Ein Sprachmodell ist kein Sicherheitskontrollpunkt. Wenn eine Aktion Schaden anrichten kann, muss sie außerhalb des Modells autorisiert werden — siehe Least Privilege für KI-Agenten.

Vergleichbare Werkzeuge

  • ETH Zürich (SPY Lab)

    AgentDojo

    Dynamische Testumgebung, die Agenten mit realistischen Aufgaben und eingebetteten Injektionen konfrontiert und Nützlichkeit gegen Sicherheit misst.

    Open Source
  • Duke University (Forschung)

    Open-Prompt-Injection

    Offenes Framework zur systematischen Bewertung von Prompt-Injection-Angriffen und Abwehrmaßnahmen über mehrere Aufgaben und Modelle hinweg.

    Open Source
  • Learn Prompting

    HackAPrompt-Datensatz

    Offener Datensatz mit über 600.000 realen Angriffs-Prompts aus einem globalen Prompt-Hacking-Wettbewerb, taxonomisch aufbereitet.

    Open Source