AI GlossaryㅇWords you meet while using AI
InferenceX
세미애널리시스가 공개한 AI 칩·시스템의 추론 성능(와트당 처리량) 측정 벤치마크
This entry has not been translated yet — it is shown in Korean. The translation attaches automatically once it lands.
In plain words
인퍼런스X는 AI 칩이나 서버가 이미 만들어진 인공지능 모델을 얼마나 빠르고 전력을 적게 쓰면서 돌리는지 재는 공개 시험이다. 자동차로 치면 최고 속도가 아니라 연비를 재는 시험에 가깝다. 얼마나 힘이 센가보다, 전기 1킬로와트를 넣었을 때 답변을 얼마나 많이 뽑아내는지를 본다.
이 시험을 만든 곳은 반도체 분석 회사인 세미애널리시스다. 오픈AI 같은 칩 개발사가 자기 칩 성능을 자랑할 때 이 시험 점수를 근거로 내밀면, 제3자가 정한 동일한 규칙으로 잰 수치라 다른 회사 칩과 비교하기가 쉬워진다. 실제로 여러 언어 모델을 같은 조건에서 돌려 초당 처리하는 토큰 수를 전력 소모량으로 나눈 값을 비교하는 식이다.
다만 시험 점수가 높다고 해서 그 칩이 모든 상황에서 앞선다는 뜻은 아니다. 어떤 경쟁 칩과 비교했는지, 최신 세대인지 이전 세대인지에 따라 결과 해석이 달라질 수 있어서 발표 수치를 볼 때는 비교 대상이 무엇인지 함께 확인하는 게 중요하다.
How it shows up in the news
See also
Stories using this term
- OpenAI's First Inference Chip Jalapeño Outpaced BlackwellBusiness · 2026.08.26
- Databricks unveils enterprise document reasoning benchmark 'OfficeQA Pro V2'Products · 2026.08.12
- DeepSeek V4 Pro GA Benchmarks Leak, Nears Top Open-Source TierModels · 2026.08.13
- Tencent's Zhuque Lab Open-Sources AI Agent/MCP Security ScannerProducts · 2026.08.21
- Epoch AI unveils undisclosed game puzzle benchmark — Opus 5 scores 59%Models · 2026.08.09
- DeepSeek-V4-Pro launches officially with three-tier reasoning intensity controlModels · 2026.08.14