Ihre LLM-Sicherheit, getestet und nachweislich konform.
~31.000 defensive adversariale Prompts (Injection, Jailbreak, Datenleck, Toxizität, Excessive Agency, Fehlinformation…) zum Abspielen gegen IHRE Modelle mit kostenlosen Tools (garak, promptfoo). Der Bericht ist Ihr Robustheitsnachweis für die EU-AI-Act-Anhang-IV-Akte. On-prem, nichts verlässt Ihre Infrastruktur.
What we added recently
A living feed: here is the coverage added to it, dated.
- +274 sondes
- +82 sondes
- +58 sondes
- +104 sondes
Acht LLM-Angriffsflächen abgedeckt.
LLM01, direkte/indirekte Injections, DAN, Obfuskation, Many-Shot, Unicode-Smuggling.
LLM02, System-Prompt-Extraktion, Secrets, PII, Leak der vorherigen Runde.
LLM05, inerte XSS/SQLi/SSTI/Exfil-Kanarien, die nachgelagerter Code falsch behandeln könnte.
LLM06, Proxy-unsichere Tool-Aufrufe (Löschen, E-Mail-Exfil, Shell) ohne Freigabe.
LLM09, falsche Fakten, halluzinierte Zitate/Pakete, Zustimmung zu falschen Prämissen.
LLM10, Ressourcenerschöpfung / Denial-of-Wallet (Schleifen, rekursive Expansion).
+ zwei Bundles aus Referenz-Benchmarks (permissiv): Ablehnung schädlicher Inhalte und Toxizitätserzeugung. Jeder Prompt ist mit Technik + OWASP-Kategorie + MITRE-ATLAS-Technik gekennzeichnet, mit Abdeckungsbericht. ~50% des Inhalts ist original (eigen erzeugt, proprietär).
Konformitätsnachweis, nicht nur Prompts.
Jeder Prompt → OWASP LLM Top 10 → EU AI Act (Art. 15 / Anhang IV) → MITRE ATLAS → NIST AI 600-1.
Formate bereit für garak (NVIDIA) und promptfoo. Ein Befehl, ein Pass/Fail-Bericht für IHRE Modelle.
Sie führen es intern aus. Kein Prompt oder Modell geht an ein Dritt-SaaS, essenziell für Regulierte.
Permissive Quellen (garak, MIT/Apache-Benchmarks) dedupliziert + Hälfte eigener Originalinhalt.
Payloads = harmlose Kanarien (PWNED, verrate deinen Prompt…). Echte Malware/CBRN/PII beim Build gefiltert.
Neue Techniken und Kategorien, sobald sich LLM-Bedrohungen entwickeln. Ein Schlüssel, stets aktuell.
Wie führe ich es aus?
Das Pack liefert Prompts als JSONL, fertige promptfoo-Tests (YAML) und eine garak-Probe (tc_redteam.py). Mit garak: `garak --target_type ollama --target_name <Modell> --probes tc_redteam.Injection`. Mit promptfoo: `promptfoo eval --tests bundles/<bundle>/promptfoo-tests.yaml`. Beide Tools sind kostenlos und Open Source; richten Sie sie auf Ihr Modell oder Ihren Endpoint.
Wie hilft es beim EU AI Act?
EU-AI-Act Art. 15 verlangt Robustheit gegen adversariale Angriffe (Adversarial Examples, Model Evasion), und Anhang IV verlangt die passende technische Dokumentation. Das Abspielen dieses Feeds gegen Ihr System erzeugt einen Testbericht, ein direktes Dokumentationsartefakt für Ihre Konformitätsakte. Wir mappen auch NIST AI 600-1 (MEASURE-Aktionen) und MITRE ATLAS. Hinweis: Prompt-basierte Abdeckung zielt auf LLM01/02/05/06/07/09/10; architektonische Risiken (LLM03/04/08) sind Prozesskontrollen.
Welche Lizenz? Darf ich es weitergeben?
Das Pack ist ein proprietäres Abo-Produkt (EULA enthalten). Sie dürfen es zum Testen Ihrer eigenen Systeme nutzen; Sie dürfen es nicht weitergeben, weiterverkaufen oder einen konkurrierenden Feed daraus bauen. Der von ThreatClaw generierte Originalinhalt (~Hälfte) und die Kompilation sind unser Eigentum; permissive Drittkomponenten behalten ihre Lizenz (im Pack attribuiert).
Bereit, die Robustheit Ihrer LLMs zu beweisen?
Jahresabo. Sofort-Schlüssel. On-prem. Jederzeit kündbar.