당신의 LLM 보안, 테스트하고 규정 준수를 증명.
방어용 적대적 프롬프트 약 31,000개(인젝션, 탈옥, 데이터 유출, 유해성, 과도한 에이전시, 허위정보 등)를 무료 도구(garak, promptfoo)로 당신의 모델에 재생하세요. 생성된 보고서는 EU AI Act 부속서 IV 자료의 견고성 증거가 됩니다. 온프레미스, 데이터는 밖으로 나가지 않습니다.
What we added recently
A living feed: here is the coverage added to it, dated.
- +274 sondes
- +82 sondes
- +58 sondes
- +104 sondes
8가지 LLM 공격면 커버.
LLM01 · 직접/간접 인젝션, DAN, 난독화, many-shot, 유니코드 스머글링.
LLM02 · 시스템 프롬프트 추출, 비밀, PII, 이전 턴 유출.
LLM05 · 하위 코드가 잘못 처리할 수 있는 비활성 XSS/SQLi/SSTI/유출 카나리아.
LLM06 · 승인 없는 위험한 도구 호출 프록시(삭제, 이메일 유출, 셸).
LLM09 · 거짓 사실, 환각 인용/패키지, 거짓 전제 동조.
LLM10 · 자원 고갈 / 지갑 거부(루프, 재귀 확장).
+ 참조 벤치마크(허용적 라이선스) 기반 2개 번들: 유해 콘텐츠 거부와 유해성 생성. 각 프롬프트는 기법 + OWASP 범주 + MITRE ATLAS 기법으로 라벨링되며 커버리지 리포트 포함. 콘텐츠의 약 50%는 자체 제작(독점)입니다.
단순한 프롬프트가 아니라 규정 준수 증거.
각 프롬프트 → OWASP LLM Top 10 → EU AI Act(제15조/부속서 IV) → MITRE ATLAS → NIST AI 600-1.
garak(NVIDIA)·promptfoo 지원 포맷. 명령 한 번으로 당신 모델의 합격/불합격 리포트.
사내에서 실행합니다. 프롬프트나 모델이 제3자 SaaS로 전송되지 않습니다, 규제 대상 조직에 필수.
허용적 소스(garak, MIT/Apache 벤치마크) 중복 제거 + 절반은 우리가 생성한 원본.
페이로드 = 무해한 카나리아(PWNED, 프롬프트 공개…). 실제 멀웨어/CBRN/PII는 빌드 시 필터링.
LLM 위협 진화에 맞춰 새 기법·범주 추가. 하나의 키로 항상 최신.
어떻게 실행하나요?
팩에는 JSONL 프롬프트, 준비된 promptfoo 테스트(YAML), garak 프로브(tc_redteam.py)가 포함됩니다. garak: `garak --target_type ollama --target_name <모델> --probes tc_redteam.Injection`. promptfoo: `promptfoo eval --tests bundles/<bundle>/promptfoo-tests.yaml`. 두 도구 모두 무료 오픈소스이며, 당신의 모델이나 엔드포인트를 지정하면 됩니다.
EU AI Act에 어떻게 도움이 되나요?
EU AI Act 제15조는 적대적 공격(적대적 예제, 모델 회피)에 대한 견고성을, 부속서 IV는 이에 상응하는 기술 문서를 요구합니다. 이 피드를 당신의 시스템에 재생하면 테스트 리포트가 생성되어 규정 준수 자료의 직접 증빙이 됩니다. NIST AI 600-1(MEASURE 활동)과 MITRE ATLAS도 매핑합니다. 참고: 프롬프트 기반 커버리지는 LLM01/02/05/06/07/09/10 대상이며, 아키텍처 리스크(LLM03/04/08)는 프로세스 통제입니다.
어떤 라이선스인가요? 재배포할 수 있나요?
이 팩은 독점 구독 제품입니다(EULA 포함). 자체 시스템 테스트에는 사용할 수 있으나, 재배포·재판매하거나 경쟁 피드를 만들 수 없습니다. ThreatClaw가 생성한 원본 콘텐츠(약 절반)와 편집물은 당사 소유이며, 허용적 제3자 구성요소는 각자의 라이선스를 유지합니다(팩 내 표기).
LLM의 견고성을 증명할 준비가 되셨나요?
연간 구독. 즉시 키 발급. 온프레미스. 언제든 해지 가능.