
이미지: 영상 갈무리
요약
- 프라임 인텔렉트가 10월 9일 Prime Agent를 러스트로 처음부터 다시 쓴 판을 공개했고, 이전 작업은 Prime Agent가 에이전트 2,000개 이상을 지휘해 2주 만에 끝냈다.
- 작업에는 샌드박스 1만 개 이상과 GLM-5.3 토큰 2,000억 개 이상이 들었고, 사람은 네 가지 동등성 검사를 세우는 일을 맡았다.
- 러스트판은 입력 대기 51.9밀리초로 타입스크립트판보다 14.18배 빠르고, 큰 세션 메모리는 4.76배 줄었다.
- 발표
- 2026년 10월 9일 · 프라임 인텔렉트 블로그 「Rewriting Prime Agent in Rust」 · @PrimeIntellect X
- 작업 규모
- 2주 · 에이전트 2,000개 이상 · Prime Sandboxes 1만 개 이상 · GLM-5.3 토큰 2,000억 개 이상 · 에이전트 간 메시지 1만 6,000건(X)
- Prime Agent 누적
- 8월 출시 이후 내려받기 30만 회 이상 · 처리 토큰 8조 개 이상
- 동등성 검사
- TUI · 하네스 · 프로토콜 · 기능 4종
- 에이전트 역할
- 최상위 오케스트레이터(코드 작성 없음) · 기획자 · 구현자 · 검토자(다른 모델) · 검증자
- 실행 환경
- 8코어 온디맨드 CPU 노드 2대 · 노드당 하위 에이전트 100개 이상 동시
- 성능 루프
- 사흘 · 실험·감사 기록 144건 이상 · 병합 변경 69건 이상 · 숫자 목표 없음
- 콜드 스타트
- 736.1ms → 51.9ms · 14.18배
- 웜 스타트
- 552.3ms → 41.4ms · 13.34배
- 큰 세션 메모리
- 1,130.0MB → 237.3MB · 4.76배 감소(10MiB 세션)
- 설치 용량
- 172.1MB → 59.6MB · 2.89배 감소
- 첫 화면
- 러스트판 23.6ms · Claude Code v2.1.289 264.6ms · Codex CLI v0.160.0 296.8ms · Pi v1.0.3 306.3ms · Hermes Agent v0.21.5 1,715.3ms
- 시작 후 메모리
- 러스트판 106.0MB · Claude Code 226.9MB · Codex CLI 344.4MB
- 측정 조건
- 4코어·8GB 샌드박스 · 스크립트 모델(추론 제외) · 외부 비교는 신중 해석(회사)
- 코드 구조
- 크레이트 9개 · 최대 파일 약 2,500줄(타입스크립트판 약 1만 5,000줄) · 5,000줄 초과 파일 0(타입스크립트판 4)
- 새 기능
- 윈도 기본 지원 베타 · 홈브루 설치 · 세션 충돌 격리 · 오픈소스 유지
- X 원문
- @PrimeIntellect · 2026년 10월 9일 21시 34분(UTC) · 조회 23만 회
오픈소스 AI 연구 기업 프라임 인텔렉트가 자사 코딩 에이전트 하네스 Prime Agent를 타입스크립트에서 러스트로 처음부터 다시 쓴 판을 10월 9일 내놓았다. 다시 쓰는 작업 자체를 Prime Agent가 맡았다. 회사에 따르면 Prime Agent는 2주 동안 에이전트 2,000개 이상을 지휘해 자기 코드를 끝까지 옮겼고, 이 과정에서 Prime Sandboxes 1만 개 이상과 자사 추론 서비스 Prime Inference의 GLM-5.3 엔드포인트 토큰 2,000억 개 이상을 썼다. 회사 X 계정은 에이전트끼리 주고받은 메시지가 1만 6,000건이라고 밝혔다.
결과는 속도로 나타났다. 회사가 공개한 벤치마크에서 러스트판은 새로 실행해 입력을 받을 수 있을 때까지 51.9밀리초가 걸려 타입스크립트판의 736.1밀리초보다 14.18배 빨랐다. 다시 실행할 때는 41.4밀리초로 13.34배 빨랐고, 10MiB 세션을 연 뒤 프로세스 전체 메모리는 1,130.0MB에서 237.3MB로 4.76배 줄었다. 설치 용량은 172.1MB에서 59.6MB로, 에이전트 화면 전환은 78.0밀리초에서 12.8밀리초로 줄었다.
프라임 인텔렉트는 8월에 Prime Agent를 내놓았고, 이후 내려받기 30만 회 이상, 처리 토큰 8조 개 이상을 기록했다고 밝혔다. 메탈은 프라임 인텔렉트가 자기개선형 에이전트 하네스 Prime Agent를 공개했다고 보도한 바 있다. 회사는 타입스크립트의 타입이 선택 사항이고 실행 중에 사라지며, 렌더링과 파싱 같은 무거운 작업이 단일 이벤트 루프에서 키보드 입력과 경쟁하고, 모든 프로세스가 자바스크립트 런타임과 가비지 컬렉터 비용을 낸다는 점을 러스트로 옮긴 이유로 들었다.
사람이 한 일은 검증 장치를 만드는 것이었다. 회사는 네 가지 동등성 검사를 세웠다. 같은 스크립트 모델을 상대로 두 버전이 그린 터미널 화면을 비교하는 TUI 검사, 같은 입력에서 세션 기록과 모델 제공사로 보내는 요청을 비교하는 하네스 검사, 데몬 프로토콜의 모든 메시지 유형을 맞춰 보는 프로토콜 검사, 에이전트가 기능을 하나씩 감사해 일치·부분·누락으로 분류하는 기능 검사다. 회사는 객관적인 검사가 있어 에이전트가 스스로 진척을 재고 병합 전에 퇴행을 잡을 수 있었고, 그만큼 사람의 검토를 줄였다고 설명했다.
지휘 구조는 단순했다. 최상위 에이전트 하나가 작업을 의존 관계 순서로 나눴고, 이 에이전트는 제품 코드를 쓰지 않고 감시와 병합만 맡았다. 작업마다 네 에이전트가 붙었다. 명세와 검증 기준을 쓰는 기획자, 별도 작업 트리에서 러스트 코드를 쓰는 구현자, 구현자와 다른 모델로 따로 떨어진 맥락에서 변경을 공격적으로 뜯어보는 검토자, 새 샌드박스에서 컴파일하고 검사를 돌리는 검증자다. 회사는 블로그에서 "코드를 쓰는 에이전트는 그 코드를 평가할 때 편향된다"며 생성과 검증을 다른 에이전트에 맡긴 이유를 밝혔다. 오케스트레이터와 하위 에이전트는 8코어 온디맨드 CPU 노드 두 대에서 돌았고, 노드마다 하위 에이전트 100개 이상을 동시에 받았다.
동등성을 맞춘 뒤에는 두 번째 오케스트레이터가 사흘 동안 벤치마크를 개선하는 루프를 돌렸다. 실험·감사 기록은 144건을 넘었고, 성능을 끌어올린 변경 69건 이상이 병합됐다. 숫자 목표는 일부러 주지 않았다. 회사는 "고정된 기준치는 멈춤 지점이 되기 쉽다"고 적었다. 각 변경은 서로 다른 프런티어 모델을 쓰는 검토 에이전트 두 개가 타입스크립트판과 동작이 같은지 확인한 뒤에야 들어갔다. 이득의 대부분은 시작·렌더링 경로에서 작업을 빼고, 폴링 루프를 이벤트 대기로 바꾸고, 큰 세션을 다 불러오면 메모리를 바로 놓아주는 세 가지 변경에서 나왔다.

다른 하네스와의 비교도 공개됐다. 회사가 4코어·8GB 샌드박스에서 잰 결과, 실행 후 첫 화면이 뜨기까지 러스트판은 23.6밀리초로 Claude Code v2.1.289의 264.6밀리초, Codex CLI v0.160.0의 296.8밀리초, Pi v1.0.3의 306.3밀리초, Hermes Agent v0.21.5의 1,715.3밀리초보다 짧았다. 시작 후 프로세스 전체 메모리는 106.0MB로 Claude Code 226.9MB, Codex CLI 344.4MB보다 적었다. 측정은 추론 시간을 뺀 스크립트 모델 기준이고, 회사는 공통 벤치마크 표준이 없어 외부 하네스 비교는 신중하게 해석해야 한다고 덧붙였다.
코드 구조도 바뀌었다. 코드는 한 방향 의존 그래프를 가진 크레이트 9개로 나뉘었고, 가장 큰 소스 파일은 약 2,500줄로 타입스크립트판의 약 1만 5,000줄에서 줄었다. 5,000줄이 넘는 파일은 타입스크립트판에 네 개 있었지만 러스트판에는 없다. 세션마다 별도 작업 프로세스가 돌아 한 세션이 죽어도 나머지는 살아 있다. 이번 판은 윈도 기본 지원 베타와 홈브루 설치를 함께 들여왔고 오픈소스로 남는다. 메탈이 확인한 블로그 원문은 자동 작업이 끝난 뒤 출시 품질까지 몇 주의 후속 작업이 들었고, 이 단계에서는 사람이 문제를 찾고 변경 방향을 정하고 모든 결과를 검토했다고 적고 있다.

이 발표의 무게는 속도 숫자보다 작업 방식에 있다. 2,000개 넘는 에이전트가 2주 만에 제품 하나를 다른 언어로 옮길 수 있었던 조건은 모델의 능력만이 아니라 사람이 미리 세운 네 가지 객관적 검사였다. 프라임 인텔렉트는 이번 이전에 쓴 다중 에이전트 작업 흐름을 사용자에게 열겠다고 밝혔다. 대규모 코드 이전을 에이전트 무리에 맡기려는 개발 조직이 먼저 갖춰야 할 것은 에이전트가 스스로 채점할 수 있는 검사라는 점을 이 사례가 보여 준다.





댓글