La seguridad de sus LLM, probada y conforme.

~31.000 prompts adversarios defensivos (inyección, jailbreak, fuga de datos, toxicidad, agencia excesiva, desinformación…) para ejecutar contra SUS modelos con herramientas gratuitas (garak, promptfoo). El informe resultante es su evidencia de robustez para el Anexo IV del EU AI Act. On-prem, nada sale de su infraestructura.

31 000+
prompts adversarios
8 bundles
6 categorías OWASP
EU AI Act
Anexo IV + OWASP/ATLAS/NIST
~50%
contenido original propio

What we added recently

A living feed: here is the coverage added to it, dated.

  • +274 sondes
  • +82 sondes
  • +58 sondes
  • +104 sondes

Ocho superficies de ataque LLM cubiertas.

Prompt Injection & Jailbreak

LLM01, inyecciones directas/indirectas, DAN, ofuscación, many-shot, smuggling Unicode.

Fuga de datos (PII)

LLM02, extracción de system-prompt, secretos, PII, fuga del turno anterior.

Manejo de salida inseguro

LLM05, canarios inertes XSS/SQLi/SSTI/exfil que el código posterior podría manejar mal.

Agencia excesiva

LLM06, llamadas proxy a herramientas peligrosas (borrado, exfil email, shell) sin aprobación.

Desinformación

LLM09, hechos falsos, citas/paquetes alucinados, adhesión a premisas falsas.

Consumo ilimitado

LLM10, agotamiento de recursos / denegación de billetera (bucles, expansión recursiva).

+ dos bundles de benchmarks de referencia (permisivos): rechazo de contenido dañino y generación de toxicidad. Cada prompt está etiquetado con su técnica + categoría OWASP + técnica MITRE ATLAS, con un informe de cobertura. ~50% del contenido es original (propio).

Evidencia de conformidad, no solo prompts.

01
Mapeado a 4 marcos

Cada prompt → OWASP LLM Top 10 → EU AI Act (Art. 15 / Anexo IV) → MITRE ATLAS → NIST AI 600-1.

02
Reejecutable, herramientas gratis

Formatos listos para garak (NVIDIA) y promptfoo. Un comando, un informe pass/fail sobre SUS modelos.

03
On-prem, soberano

Lo ejecuta internamente. Ningún prompt ni modelo se envía a un SaaS externo, esencial para regulados.

04
Multifuente + 50% propio

Fuentes permisivas (garak, benchmarks MIT/Apache) deduplicadas + mitad de contenido original nuestro.

05
Defensivo por diseño

Payloads = canarios inofensivos (PWNED, revela tu prompt…). Malware/CBRN/PII real filtrado en el build.

06
Crece continuamente

Nuevas técnicas y categorías añadidas según evolucionan las amenazas LLM. Una clave, siempre al día.

¿Cómo se ejecuta?

El pack incluye prompts en JSONL, tests promptfoo listos (YAML) y una probe garak (tc_redteam.py). Con garak: `garak --target_type ollama --target_name <modelo> --probes tc_redteam.Injection`. Con promptfoo: `promptfoo eval --tests bundles/<bundle>/promptfoo-tests.yaml`. Ambas herramientas son gratuitas y open-source; apúntalas a tu modelo o endpoint.

¿Cómo ayuda con el EU AI Act?

El Art. 15 del EU AI Act exige robustez frente a ataques adversarios (adversarial examples, evasión de modelo), y el Anexo IV exige la documentación técnica correspondiente. Reejecutar este feed contra su sistema produce un informe de prueba, una pieza documental directa para su expediente. También mapeamos NIST AI 600-1 (acciones MEASURE) y MITRE ATLAS. Nota: la cobertura por prompt cubre LLM01/02/05/06/07/09/10; los riesgos arquitectónicos (LLM03/04/08) son controles de proceso.

¿Qué licencia? ¿Puedo redistribuirlo?

El pack es un producto propietario de suscripción (EULA incluida). Puede usarlo para probar sus propios sistemas; no puede redistribuirlo, revenderlo ni crear un feed competidor. El contenido original generado por ThreatClaw (~la mitad) y la compilación son nuestra propiedad; los componentes de terceros permisivos conservan su licencia (atribuidos en el pack).

¿Listo para probar la robustez de sus LLM?

Suscripción anual. Clave instantánea. On-prem. Cancela cuando quieras.

349 € / mes, facturado anualmente 4 188 € sin IVA
Pruebe antes de comprar: pack demo gratuito

Una muestra de nuestras reglas propias en todos los motores que cubrimos (Sigma, YARA, osquery, Velociraptor, Falco, red, policy), cada detección con su playbook de investigación en estándar CACAO 2.0, importable en su SOAR. Las reglas Sigma ya vienen convertidas para 6 SIEM: Splunk, Sentinel, Elastic, QRadar, CrowdStrike y Panther. Se incluye una muestra de cobertura de conformidad NIS2. Generado sin IA.

Descargar el pack demo .zip

Lo que este pack no cubre

Lo que no cubrimos, te lo decimos

Nadie detecta el 100%, y un feed que lo pretende agota a tu analista. Lo que no compila en el motor real, o hace ruido en un corpus limpio, nunca llega al pack. Lo que una regla no puede ver, lo mostramos como brecha en lugar de disimularlo. Y por defecto el agente observa y propone, actúa solo tras validación humana (human-in-the-loop). Compras señal, no volumen.

La detección que resiste ante el auditor

La pregunta ya no es solo «¿detecto?» sino «¿puedo probarlo?». Cada suscripción incluye la capa de conformidad, sin coste adicional.

Cobertura de diseño, no una certificación ni una medición en tiempo real: evidencia que el catálogo aborda el requisito, tu CISO valida la conformidad.