레드팀 테스팅은 실제 공격자 관점에서 시스템을 의도적으로 공격하고 우회해보며, 숨겨진 취약점과 리스크를 발견하는 검증 활동입니다.
AI 레드팀 테스팅(AI Red Teaming)은 생성형 AI, LLM, 챗봇, RAG, AI 에이전트 등 AI 기반 시스템을 대상으로 합니다.
정상적인 사용 시나리오뿐 아니라 악의적 입력, 우회 프롬프트, 민감정보 유도, 금지된 답변 생성 시도 등을 통해 AI 시스템이 예상치 못한 방식으로 동작하지 않는지 확인합니다.
즉, 단순히 “AI가 답변을 잘하는지”를 보는 것이 아니라 AI가 공격 상황에서도 안전하고 신뢰할 수 있게 동작하는지 검증하는 테스트입니다.