에이전트 지수
Agentic Index
아티피셜 애널리시스가 AI 모델이 작업을 대신 수행하는 능력만 따로 떼어 매기는 순위 지표
쉽게 말하면
에이전트 지수는 AI 모델이 시키는 일을 얼마나 잘 대신 해내는지를 평가해 매긴 순위표다. 답변을 얼마나 똑똑하게 하는지를 재는 시험과 달리, 검색하고 파일을 만들고 여러 단계를 거쳐 실제 작업을 끝마치는 능력만 따로 골라 채점한다는 점이 다르다.
비유하자면 '지식 시험' 성적과 '일 처리 능력' 평가가 따로 있는 셈이다. 어떤 모델은 아는 게 많아도 막상 일을 맡기면 중간에 헤매고, 어떤 모델은 지식량은 덜해도 맡은 일을 끝까지 처리하는 데 강할 수 있다. 에이전트 지수는 후자, 즉 실무 처리 능력을 기준으로 순위를 정한다.
이 지수는 아티피셜 애널리시스라는 외부 평가 기관이 발표하며, 개발사가 자체적으로 매기는 점수가 아니라 제3자가 여러 모델을 같은 조건에서 비교해 내놓는 순위다.
기사에서 이렇게 나와요
기사에서는 "알리바바 큐원은 지난 8월 6일 Qwen3.8-Max가 Artificial Analysis의 Intelligence Index에서 5위(56점), 같은 기관의 Agentic Index에서는 1위를 기록했다"고 나온다. 여기서 헷갈리기 쉬운 점은 두 지수가 다른 걸 잰다는 것이다. 지식·추론 능력을 재는 순위에서는 5위였지만, 실제 작업 수행 능력을 재는 순위에서는 1위였다는 뜻으로, 하나의 지수만 보고 모델 전체 성능을 판단하면 안 된다.
직접 해보기
- 아티피셜 애널리시스의 웹사이트를 검색해 들어간다.
- 리더보드 항목에서 'Agentic Index' 또는 이와 유사한 이름의 순위표를 찾는다.
- 관심 있는 모델(예: 큐원, 제미나이, GPT 계열)의 순위와 점수를 비교해본다.
- 같은 모델의 일반 지능 지수(Intelligence Index) 순위와 함께 놓고 비교하면, '아는 것'과 '해내는 것'의 차이가 보인다.
함께 볼 용어
이 용어가 나온 기사
- 큐원, 허깅페이스 로컬 추론 순위서 1위 확인Models · 2026.08.16
- 앤트그룹 Ling 3.0 Tiny, 활성 파라미터 1.3B로 지능지수 25Models · 2026.08.12
- Artificial Analysis, 새 AI 벤치마킹 제품군 얼리 액세스 모집Products · 2026.08.11
- 그록 4.6, 지능지수 61점...GPT-5.6과 동급에 오르며 가격은 그대로Models · 2026.08.13
- Qwen3.8-Max, 에이전틱 지수 1위·종합 지능 지수 5위 기록Models · 2026.08.09
- 앤트그룹, 124B 오픈웨이트 모델 Ling 3.0 Flash 공개Models · 2026.08.09