La sicurezza dei vostri LLM, testata e conforme.

~31.000 prompt avversariali difensivi (injection, jailbreak, fuga di dati, tossicità, excessive agency, disinformazione…) da rieseguire contro i VOSTRI modelli con strumenti gratuiti (garak, promptfoo). Il report ottenuto è la vostra prova di robustezza per il fascicolo EU AI Act Allegato IV. On-prem, nulla esce dalla vostra infrastruttura.

31 000+
prompt avversariali
8 bundles
6 categorie OWASP
EU AI Act
Allegato IV + OWASP/ATLAS/NIST
~50%
contenuto originale proprietario

What we added recently

A living feed: here is the coverage added to it, dated.

  • +274 sondes
  • +82 sondes
  • +58 sondes
  • +104 sondes

Otto superfici di attacco LLM coperte.

Prompt Injection & Jailbreak

LLM01, injection dirette/indirette, DAN, offuscamento, many-shot, smuggling Unicode.

Fuga di dati (PII)

LLM02, estrazione system-prompt, segreti, PII, leak del turno precedente.

Output handling insicuro

LLM05, canary inerti XSS/SQLi/SSTI/exfil che il codice a valle potrebbe gestire male.

Excessive agency

LLM06, chiamate proxy a strumenti pericolosi (cancellazione, exfil email, shell) senza approvazione.

Disinformazione

LLM09, fatti falsi, citazioni/pacchetti allucinati, adesione a premesse false.

Consumo illimitato

LLM10, esaurimento risorse / denial-of-wallet (loop, espansione ricorsiva).

+ due bundle da benchmark di riferimento (permissivi): rifiuto di contenuti dannosi e generazione di tossicità. Ogni prompt è etichettato con tecnica + categoria OWASP + tecnica MITRE ATLAS, con report di copertura. ~50% del contenuto è originale (proprietario).

Prova di conformità, non solo prompt.

01
Mappato a 4 framework

Ogni prompt → OWASP LLM Top 10 → EU AI Act (Art. 15 / Allegato IV) → MITRE ATLAS → NIST AI 600-1.

02
Rieseguibile, strumenti gratuiti

Formati pronti per garak (NVIDIA) e promptfoo. Un comando, un report pass/fail sui VOSTRI modelli.

03
On-prem, sovrano

Lo eseguite internamente. Nessun prompt o modello va a un SaaS di terzi, essenziale per i regolati.

04
Multi-fonte + 50% proprietario

Fonti permissive (garak, benchmark MIT/Apache) deduplicate + metà contenuto originale nostro.

05
Difensivo per progettazione

Payload = canary innocui (PWNED, rivela il tuo prompt…). Malware/CBRN/PII reali filtrati al build.

06
In crescita continua

Nuove tecniche e categorie aggiunte con l’evolversi delle minacce LLM. Una chiave, sempre aggiornata.

Come si esegue?

Il pack include prompt in JSONL, test promptfoo pronti (YAML) e una probe garak (tc_redteam.py). Con garak: `garak --target_type ollama --target_name <modello> --probes tc_redteam.Injection`. Con promptfoo: `promptfoo eval --tests bundles/<bundle>/promptfoo-tests.yaml`. Entrambi gratuiti e open-source; puntateli sul vostro modello o endpoint.

Come aiuta con l’EU AI Act?

L'Art. 15 dell'EU AI Act richiede robustezza contro attacchi avversariali (adversarial examples, evasione del modello), e l'Allegato IV richiede la documentazione tecnica corrispondente. Rieseguire questo feed contro il vostro sistema produce un report di test, un artefatto documentale diretto per il fascicolo di conformità. Mappiamo anche NIST AI 600-1 (azioni MEASURE) e MITRE ATLAS. Nota: la copertura per prompt riguarda LLM01/02/05/06/07/09/10; i rischi architetturali (LLM03/04/08) sono controlli di processo.

Quale licenza? Posso ridistribuirlo?

Il pack è un prodotto proprietario in abbonamento (EULA inclusa). Potete usarlo per testare i vostri sistemi; non potete ridistribuirlo, rivenderlo o costruirne un feed concorrente. Il contenuto originale generato da ThreatClaw (~metà) e la compilazione sono di nostra proprietà; i componenti di terzi permissivi mantengono la loro licenza (attribuiti nel pack).

Pronto a dimostrare la robustezza dei vostri LLM?

Abbonamento annuale. Chiave immediata. On-prem. Disdici quando vuoi.

349 € / mese, fatturato annualmente 4.188 € IVA esclusa
Prova prima di acquistare: pack demo gratuito

Un campione delle nostre regole interne su tutti i motori che copriamo (Sigma, YARA, osquery, Velociraptor, Falco, rete, policy), ogni detection con il suo playbook di investigazione nello standard CACAO 2.0, importabile nel vostro SOAR. Le regole Sigma sono già convertite per 6 SIEM: Splunk, Sentinel, Elastic, QRadar, CrowdStrike e Panther. È incluso un campione di copertura di conformità NIS2. Generato senza IA.

Scarica il pack demo .zip

Ciò che questo pack non copre

Ciò che non copriamo, ve lo diciamo

Nessuno rileva il 100%, e un feed che lo pretende sfianca il tuo analista. Ciò che non compila sul motore reale, o fa rumore su un corpus pulito, non arriva mai nel pack. Ciò che una regola non può vedere, lo mostriamo come lacuna invece di mascherarlo. E per impostazione predefinita l’agente osserva e propone, agisce solo dopo validazione umana (human-in-the-loop). Compri segnale, non volume.

La detection che regge davanti all’auditor

La domanda non è più solo «rilevo?» ma «posso dimostrarlo?». Ogni abbonamento include il livello di conformità, senza costi aggiuntivi.

Copertura di progettazione, non una certificazione né una misura in tempo reale: attesta che il catalogo affronta il requisito, il tuo CISO convalida la conformità.