영국 AISI의 에이전트 및 안전성 평가 프레임워크
Inspect AI는 영국 AI 안전 연구소(AISI)가 만든 오픈 소스 프레임워크로, LLM 에이전트와 안전성 속성을 평가하도록 설계됐어. 도구 사용, 다단계 추론, 적대적 시나리오가 포함된 과제를 전제로 만들어져 안전성 중심 조직에서 널리 채택하고 있어.
특히 잘하는 일
- 에이전트 평가 — 도구 사용과 격리 환경을 지원하고, 상태를 유지하며 수행하는 과제도 다룰 수 있어.
- 안전성 평가 — 역량 평가, 위험 역량 평가, 레드팀 평가에 쓸 수 있는 패턴이 내장돼 있어.
- 재현성 — 모든 평가 실행을 스크립트로 완전히 정의해 같은 조건으로 다시 실행할 수 있어.
- 멀티모달 — 텍스트, 이미지, 도구 출력을 지원해.
- 제공업체 독립성 — OpenAI, Anthropic, Google, 로컬 모델을 모두 지원해.
가장 빛나는 상황
에이전트가 도구를 사용하고, 정보를 탐색하고, 코드를 실행하고, 여러 단계로 계획하는 능력을 평가한다면 Inspect AI가 잘 맞아. 다른 프레임워크는 에이전트 지원을 나중에 덧붙인 경우가 많지만, Inspect AI는 이를 처음부터 기본 전제로 삼았어.
잘 맞지 않는 상황
단순한 프롬프트-응답 평가에는 다소 과한 선택이야. 이런 경우에는 promptfoo나 DeepEval이 더 가벼워.
원칙: 평가에 도구 사용, 코드 실행, 다단계 계획이 포함된다면 Inspect AI를 선택해. 단순한 프롬프트-응답 평가라면 더 가벼운 도구를 선택해.