당신의 LLM 보안, 테스트하고 규정 준수를 증명.

방어용 적대적 프롬프트 약 31,000개(인젝션, 탈옥, 데이터 유출, 유해성, 과도한 에이전시, 허위정보 등)를 무료 도구(garak, promptfoo)로 당신의 모델에 재생하세요. 생성된 보고서는 EU AI Act 부속서 IV 자료의 견고성 증거가 됩니다. 온프레미스, 데이터는 밖으로 나가지 않습니다.

31 000+
적대적 프롬프트
8 bundles
6개 OWASP 범주
EU AI Act
부속서 IV + OWASP/ATLAS/NIST
~50%
자체 제작 콘텐츠

What we added recently

A living feed: here is the coverage added to it, dated.

  • +274 sondes
  • +82 sondes
  • +58 sondes
  • +104 sondes

8가지 LLM 공격면 커버.

Prompt Injection & Jailbreak

LLM01 · 직접/간접 인젝션, DAN, 난독화, many-shot, 유니코드 스머글링.

데이터 유출 (PII)

LLM02 · 시스템 프롬프트 추출, 비밀, PII, 이전 턴 유출.

안전하지 않은 출력 처리

LLM05 · 하위 코드가 잘못 처리할 수 있는 비활성 XSS/SQLi/SSTI/유출 카나리아.

과도한 에이전시

LLM06 · 승인 없는 위험한 도구 호출 프록시(삭제, 이메일 유출, 셸).

허위정보

LLM09 · 거짓 사실, 환각 인용/패키지, 거짓 전제 동조.

무제한 소비

LLM10 · 자원 고갈 / 지갑 거부(루프, 재귀 확장).

+ 참조 벤치마크(허용적 라이선스) 기반 2개 번들: 유해 콘텐츠 거부와 유해성 생성. 각 프롬프트는 기법 + OWASP 범주 + MITRE ATLAS 기법으로 라벨링되며 커버리지 리포트 포함. 콘텐츠의 약 50%는 자체 제작(독점)입니다.

단순한 프롬프트가 아니라 규정 준수 증거.

01
4개 프레임워크 매핑

각 프롬프트 → OWASP LLM Top 10 → EU AI Act(제15조/부속서 IV) → MITRE ATLAS → NIST AI 600-1.

02
재생 가능, 무료 도구

garak(NVIDIA)·promptfoo 지원 포맷. 명령 한 번으로 당신 모델의 합격/불합격 리포트.

03
온프레미스, 주권형

사내에서 실행합니다. 프롬프트나 모델이 제3자 SaaS로 전송되지 않습니다, 규제 대상 조직에 필수.

04
멀티소스 + 50% 자체

허용적 소스(garak, MIT/Apache 벤치마크) 중복 제거 + 절반은 우리가 생성한 원본.

05
설계상 방어적

페이로드 = 무해한 카나리아(PWNED, 프롬프트 공개…). 실제 멀웨어/CBRN/PII는 빌드 시 필터링.

06
지속적으로 성장

LLM 위협 진화에 맞춰 새 기법·범주 추가. 하나의 키로 항상 최신.

어떻게 실행하나요?

팩에는 JSONL 프롬프트, 준비된 promptfoo 테스트(YAML), garak 프로브(tc_redteam.py)가 포함됩니다. garak: `garak --target_type ollama --target_name <모델> --probes tc_redteam.Injection`. promptfoo: `promptfoo eval --tests bundles/<bundle>/promptfoo-tests.yaml`. 두 도구 모두 무료 오픈소스이며, 당신의 모델이나 엔드포인트를 지정하면 됩니다.

EU AI Act에 어떻게 도움이 되나요?

EU AI Act 제15조는 적대적 공격(적대적 예제, 모델 회피)에 대한 견고성을, 부속서 IV는 이에 상응하는 기술 문서를 요구합니다. 이 피드를 당신의 시스템에 재생하면 테스트 리포트가 생성되어 규정 준수 자료의 직접 증빙이 됩니다. NIST AI 600-1(MEASURE 활동)과 MITRE ATLAS도 매핑합니다. 참고: 프롬프트 기반 커버리지는 LLM01/02/05/06/07/09/10 대상이며, 아키텍처 리스크(LLM03/04/08)는 프로세스 통제입니다.

어떤 라이선스인가요? 재배포할 수 있나요?

이 팩은 독점 구독 제품입니다(EULA 포함). 자체 시스템 테스트에는 사용할 수 있으나, 재배포·재판매하거나 경쟁 피드를 만들 수 없습니다. ThreatClaw가 생성한 원본 콘텐츠(약 절반)와 편집물은 당사 소유이며, 허용적 제3자 구성요소는 각자의 라이선스를 유지합니다(팩 내 표기).

LLM의 견고성을 증명할 준비가 되셨나요?

연간 구독. 즉시 키 발급. 온프레미스. 언제든 해지 가능.

349€ / 월, 연간 청구 4,188€ (세금 별도)
구매 전 체험: 무료 데모 팩

저희가 운영하는 모든 엔진(Sigma, YARA, osquery, Velociraptor, Falco, 네트워크, policy)에 걸친 자체 규칙 샘플로, 각 탐지에 CACAO 2.0 표준 조사 플레이북이 포함되어 SOAR로 가져올 수 있습니다. Sigma 규칙은 6개 SIEM(Splunk, Sentinel, Elastic, QRadar, CrowdStrike, Panther)용으로 이미 변환되어 있습니다. NIS2 규정 준수 커버리지 샘플이 포함됩니다. AI 없이 생성.

데모 팩 다운로드 .zip

이 팩이 커버하지 않는 것

커버하지 못하는 것은 솔직히 말합니다

누구도 100% 탐지하지 못하며, 그렇다고 주장하는 피드는 분석가를 소진시킵니다. 실제 엔진에서 컴파일되지 않거나 정상 코퍼스에서 잡음을 내는 것은 팩에 들어가지 않습니다. 규칙이 볼 수 없는 것은 감추지 않고 격차로 표시합니다. 그리고 기본적으로 에이전트는 관찰하고 제안할 뿐, 사람의 승인 후에만 동작합니다(human-in-the-loop). 여러분은 양이 아니라 신호를 삽니다.

감사관 앞에서 통하는 탐지

이제 질문은 “탐지할 수 있는가”만이 아니라 “그것을 증명할 수 있는가”입니다. 모든 구독에 규정 준수 계층이 추가 비용 없이 포함됩니다.

설계 커버리지이며 인증이나 실시간 측정이 아닙니다: 카탈로그가 요구사항을 다룬다는 것을 입증하며, 규정 준수는 CISO가 검증합니다.