AI GlossaryㅅWords you meet while using AI
SocialIQA
AI가 사람의 감정·의도·일상적 사회 상황을 얼마나 잘 이해하는지 객관식으로 시험하는 벤치마크
This entry has not been translated yet — it is shown in Korean. The translation attaches automatically once it lands.
In plain words
소셜아이큐에이(SocialIQA)는 인공지능이 사람 사이의 상황을 얼마나 잘 읽어내는지 시험하는 문제집이다. "친구가 약속에 늦어서 화가 났다면 왜 그럴까", "선물을 거절당한 사람은 어떤 기분일까" 같은 짧은 이야기를 주고 여러 답 가운데 가장 그럴듯한 것을 고르게 한다. 사람이라면 굳이 배우지 않아도 아는 것들이지만, AI에게는 감정과 의도, 상식적인 사회적 맥락을 한꺼번에 읽어야 풀리는 까다로운 문제다.
이 시험이 주목받는 이유는 점수 자체보다 "이 능력이 어디서 왔는가"를 캐는 도구로 쓰이기 때문이다. 최근 한 연구는 AI가 학습한 글 가운데 문학 작품을 골라 지워봤더니, 다른 글을 지웠을 때보다 소셜아이큐에이 점수가 유독 크게 떨어진다는 걸 보였다. 어릴 때 소설을 많이 읽은 사람이 남의 마음을 더 잘 헤아리게 되는 것처럼, AI도 대화와 이야기가 많은 글을 배워야 사회적 상황을 잘 읽어낸다는 뜻이다.
How it shows up in the news
기사에서는 "문학 문서를 지웠더니... 사회적 상황을 이해하는 능력을 재는 벤치마크 SocialIQA 점수가... 더 크게 떨어졌다"는 식으로, AI의 특정 능력이 어떤 학습 자료에서 비롯됐는지 확인하는 실험 도구로 등장한다. 흔한 오해는 이름에 'IQ'가 들어 있어 AI의 전반적인 지능지수를 재는 시험이라 여기는 것인데, 실제로는 사회적 상식과 대인관계 추론이라는 좁은 능력만 측정하는 벤치마크다.
See also
Stories using this term
- Georgia Tech Traces Roots of Social Reasoning Using Fully Open Olmo 3Models · 2026.08.22
- Databricks unveils enterprise document reasoning benchmark 'OfficeQA Pro V2'Products · 2026.08.12
- AI Safety Scores Can Be Gamed Just by Refusing MoreModels · 2026.08.22
- Kimi K3 Inference Benchmarks: Together AI Ranks Among Top ProvidersModels · 2026.08.09
- Artificial Analysis opens early access for new AI benchmarking suiteProducts · 2026.08.11
- Artificial Analysis launches Optima, a tool for benchmarking AI models on your own dataProducts · 2026.08.16