METAL for iPhone

AI 뉴스, 이제 앱에서 읽으세요.

METAL 앱을 다운로드하고 매일 새로운 AI 기사를 만나보세요.

App Store에서 다운로드

iPhone용 앱 · 무료 다운로드

iPhone의 App Store에서도 ‘메탈 AI 매거진’을 검색할 수 있습니다.

METAL

AI 용어사전ㅍ쓰다 보면 만나는 말

프론티어코드 1.1 익스텐디드

FrontierCode 1.1 Extended

코딩 에이전트가 작업을 얼마나 잘 해내는지와 그 작업에 돈이 얼마나 드는지를 함께 재는 벤치마크표.

쉽게 말하면

프론티어코드 1.1 익스텐디드는 코딩 작업을 대신해 주는 AI 시스템의 성능과 비용을 한 표에 나란히 적어 비교하는 채점표다. 학교 시험이 정답률만 보여준다면 이 표는 정답률에 더해 그 시험을 치르는 데 든 수험료까지 같이 보여주는 셈이다.

표 안에는 두 가지 숫자가 짝지어 나온다. 하나는 중간 난이도 코딩 문제를 얼마나 잘 풀었는지 나타내는 점수고, 다른 하나는 그 문제 하나를 푸는 데 실제로 들어간 비용이다. 그래서 이 표를 보면 어떤 모델이나 실행 방식이 비슷한 실력을 더 싸게 내는지, 혹은 값은 비슷한데 실력 차이가 나는지를 한눈에 비교할 수 있다.

코딩 에이전트는 한 번 일을 맡기면 안에서 모델을 수십 번, 수백 번 불러 쓰기 때문에 문제 하나당 비용이 조금만 줄어도 전체 운영비에 미치는 영향이 크다. 그래서 이 벤치마크는 단순히 누가 더 똑똑한지보다 누가 더 경제적으로 똑똑한지를 드러내는 데 쓰인다.

기사에서 이렇게 나와요

기사에서는 "회사가 공개한 FrontierCode 1.1 Extended 벤치마크 표를 보면 Fable 5는 중간 난이도 태스크에서 점수 62.8에 태스크당 5.84달러가 들었는데, Fable 5.1은 점수 63.6에 2.68달러로 떨어졌어요"라고 쓰였다. 이름만 보면 특정 회사의 상용 제품처럼 들리지만, 실제로는 코그니션이 자사 모델과 하네스를 비교하려고 공개한 벤치마크 결과표를 가리킨다.

함께 볼 용어

이 용어가 나온 기사

ㄱㄴㄷ 전체 찾아보기