스킬트러스트벤치
SkillTrustBench
AI 에이전트가 불러 쓰는 외부 도구(스킬)의 보안 위험을 9개 범주로 나눠 채점하는 벤치마크
쉽게 말하면
스킬트러스트벤치는 AI 에이전트가 불러다 쓰는 외부 도구, 이른바 스킬이 얼마나 안전한지 매기는 시험지다. 새로 산 전기제품에 안전인증 마크가 붙어 있는지 확인하듯, 에이전트에 어떤 외부 기능을 붙여도 괜찮은지 미리 검사해보는 셈이다.
이 시험은 위험을 하나로 뭉뚱그리지 않고 T01부터 T09까지 아홉 갈래로 쪼갠다. 도구가 권한을 몰래 더 넘겨받거나, 엉뚱한 명령을 실행하는 경우처럼 위험 유형별로 따로 점수를 매기는 방식이다. 같은 외부 도구를 서로 다른 언어 모델에 붙였을 때 그 위험을 얼마나 잘 잡아내는지도 순위표로 공개한다.
이 분류 체계는 텐센트 보안 부서 산하 주작 랩이 함께 내놓은 점검 도구의 채점 기준으로도 쓰인다. 도구가 위험을 나눌 때 쓰는 잣대 자체가 이 벤치마크에서 나온 셈이다.
기사에서 이렇게 나와요
직접 해보기
함께 볼 용어
이 용어가 나온 기사
- 텐센트 주작랩, AI 에이전트·MCP 보안 스캐너 오픈소스 공개Products · 2026.08.21
- 엔비디아 검증 스킬 300여개, 정답률 41점 끌어올렸다Products · 2026.08.20
- MS, 저장소 읽고 테스트 짜는 유닛테스트 에이전트 오픈소스 공개Models · 2026.08.09
- AWS, Bedrock 자동 추론 정책에 오픈소스 에이전트 스킬 도입Products · 2026.08.09
- 메타, AI 에이전트 평가용 WildArtifactBench 과제 10개 첫 공개Models · 2026.08.21
- 오픈소스 오니스-1.5, 클로드 오퍼스급 점수 냈다고 밝혔다Models · 2026.08.21