每天早上一封邮件,把昨天的 AI 梳理好订阅邮件

METAL LAB

AI 용어사전쓰다 보면 만나는 말

하버

Harbor

AI 비서에게 도구를 얹었을 때와 안 얹었을 때를 같은 조건에서 두 번 시험해 성능 차이를 재는 오픈소스 시험 장치

쉽게 말하면

Harbor는 AI 비서(에이전트)에게 같은 문제를 두 번 풀게 해서, 도구 하나를 얹었을 때와 안 얹었을 때의 실력 차이를 정확히 재는 오픈소스 시험장이다. 실험실에서 다른 변수는 다 고정하고 딱 하나만 바꿔 비교하는 대조 실험처럼, 문제와 채점 기준, AI 모델은 그대로 두고 오직 도구 사용설명서(능력 카드) 유무만 바꿔서 결과를 비교한다.

비교는 외부와 차단된 격리된 방 안에서 이뤄진다. 실험 도중 예상치 못한 변수가 끼어들지 않도록, AI 비서가 딴 길로 새거나 실제 시스템을 건드리지 못하게 막아둔 공간이다. 이 방에서 도구가 있을 때와 없을 때 두 번 돌린 결과의 차이가 그 도구의 실제 기여도가 된다.

엔비디아는 이 방식으로 자사가 인증한 여러 능력 카드가 정말 도움이 되는지 대규모로 검증했다. 개발자가 어떤 도구를 세상에 내놓기 전, Harbor 같은 시험장에서 미리 '이 도구가 진짜 효과가 있는지'를 숫자로 확인해볼 수 있다는 뜻이다.

기사에서 이렇게 나와요

기사는 "엔비디아오픈소스 프레임워크 Harbor를 이용해 격리된 샌드박스 안에서 에이전트를 실제로 두 번 돌린다"고 설명한다. Harbor는 스킬 자체가 아니라 스킬의 효과를 측정하는 시험 도구라는 점이 핵심이다. 성능을 올려주는 기능이 아니라, 다른 기능이 얼마나 도움이 되는지를 공정하게 재는 저울에 가깝다.

함께 볼 용어

이 용어가 나온 기사

ㄱㄴㄷ 전체 찾아보기