A segurança dos seus LLMs, testada e comprovada em conformidade.

~31.000 prompts adversariais defensivos (injeção, jailbreak, vazamento de dados, toxicidade, agência excessiva, desinformação…) para reproduzir contra SEUS modelos com ferramentas gratuitas (garak, promptfoo). O relatório resultante é sua evidência de robustez para o dossiê EU AI Act Anexo IV. On-prem, nada sai da sua infraestrutura.

31 000+
prompts adversariais
8 bundles
6 categorias OWASP
EU AI Act
Anexo IV + OWASP/ATLAS/NIST
~50%
conteúdo original próprio

What we added recently

A living feed: here is the coverage added to it, dated.

  • +274 sondes
  • +82 sondes
  • +58 sondes
  • +104 sondes

Oito superfícies de ataque LLM cobertas.

Prompt Injection & Jailbreak

LLM01, injeções diretas/indiretas, DAN, ofuscação, many-shot, smuggling Unicode.

Vazamento de dados (PII)

LLM02, extração de system-prompt, segredos, PII, vazamento do turno anterior.

Tratamento de saída inseguro

LLM05, canários inertes XSS/SQLi/SSTI/exfil que o código a jusante pode tratar mal.

Agência excessiva

LLM06, chamadas proxy a ferramentas perigosas (exclusão, exfil e-mail, shell) sem aprovação.

Desinformação

LLM09, fatos falsos, citações/pacotes alucinados, adesão a premissas falsas.

Consumo ilimitado

LLM10, esgotamento de recursos / denial-of-wallet (loops, expansão recursiva).

+ dois bundles de benchmarks de referência (permissivos): recusa de conteúdo nocivo e geração de toxicidade. Cada prompt é rotulado com técnica + categoria OWASP + técnica MITRE ATLAS, com relatório de cobertura. ~50% do conteúdo é original (próprio).

Prova de conformidade, não apenas prompts.

01
Mapeado a 4 frameworks

Cada prompt → OWASP LLM Top 10 → EU AI Act (Art. 15 / Anexo IV) → MITRE ATLAS → NIST AI 600-1.

02
Reproduzível, ferramentas grátis

Formatos prontos para garak (NVIDIA) e promptfoo. Um comando, um relatório pass/fail nos SEUS modelos.

03
On-prem, soberano

Você executa internamente. Nenhum prompt ou modelo é enviado a um SaaS de terceiros, essencial para regulados.

04
Multifonte + 50% próprio

Fontes permissivas (garak, benchmarks MIT/Apache) deduplicadas + metade de conteúdo original nosso.

05
Defensivo por design

Payloads = canários inofensivos (PWNED, revele seu prompt…). Malware/CBRN/PII real filtrado no build.

06
Cresce continuamente

Novas técnicas e categorias adicionadas conforme as ameaças LLM evoluem. Uma chave, sempre atual.

Como executo?

O pack traz prompts em JSONL, testes promptfoo prontos (YAML) e uma probe garak (tc_redteam.py). Com garak: `garak --target_type ollama --target_name <modelo> --probes tc_redteam.Injection`. Com promptfoo: `promptfoo eval --tests bundles/<bundle>/promptfoo-tests.yaml`. Ambas ferramentas são grátis e open-source; aponte-as ao seu modelo ou endpoint.

Como ajuda com o EU AI Act?

O Art. 15 do EU AI Act exige robustez contra ataques adversariais (adversarial examples, evasão de modelo), e o Anexo IV exige a documentação técnica correspondente. Reproduzir este feed contra o seu sistema produz um relatório de teste, uma peça documental direta para o seu dossiê de conformidade. Também mapeamos NIST AI 600-1 (ações MEASURE) e MITRE ATLAS. Nota: a cobertura por prompt visa LLM01/02/05/06/07/09/10; os riscos arquiteturais (LLM03/04/08) são controles de processo.

Qual licença? Posso redistribuí-lo?

O pack é um produto proprietário de assinatura (EULA incluída). Você pode usá-lo para testar seus próprios sistemas; não pode redistribuí-lo, revendê-lo ou construir um feed concorrente. O conteúdo original gerado pela ThreatClaw (~metade) e a compilação são nossa propriedade; os componentes de terceiros permissivos mantêm sua licença (atribuídos no pack).

Pronto para provar a robustez dos seus LLMs?

Assinatura anual. Chave instantânea. On-prem. Cancele quando quiser.

349 € / mês, faturado anualmente 4.188 € sem impostos
Experimente antes de comprar: pacote demo gratuito

Uma amostra das nossas regras internas em todos os motores que cobrimos (Sigma, YARA, osquery, Velociraptor, Falco, rede, policy), cada deteção com o seu playbook de investigação no padrão CACAO 2.0, importável no seu SOAR. As regras Sigma já vêm convertidas para 6 SIEM: Splunk, Sentinel, Elastic, QRadar, CrowdStrike e Panther. Inclui uma amostra de cobertura de conformidade NIS2. Gerado sem IA.

Baixar o pacote demo .zip

O que este pack não cobre

O que não cobrimos, dizemos-lho

Ninguém deteta 100%, e um feed que o afirma esgota o seu analista. O que não compila no motor real, ou faz barulho num corpus limpo, nunca chega ao pack. O que uma regra não consegue ver, mostramo-lo como lacuna em vez de o disfarçar. E por defeito o agente observa e propõe, agindo apenas após validação humana (human-in-the-loop). Compra sinal, não volume.

A deteção que se sustenta perante o auditor

A pergunta já não é apenas «deteto?» mas «consigo prová-lo?». Cada assinatura inclui a camada de conformidade, sem custo adicional.

Cobertura de projeto, não uma certificação nem uma medição em tempo real: comprova que o catálogo aborda o requisito, o seu CISO valida a conformidade.