
이미지: METAL
요약
- 샘 올트먼은 챗GPT의 폭발적 소비자 성장에 주의를 빼앗겨 코딩과 기업 시장에서 앤스로픽에 선두를 내줬다고 인정했어요
- 그렉 브록만이 제품·사업 운영을 맡아 소라·디즈니 협력·독립 브라우저 아틀라스를 정리하고, 코덱스와 챗GPT를 합친 ‘더 머지’에 자원을 모았어요
- 올트먼은 연말까지 자신이 AGI라 부를 내부 시스템을 갖겠다고 했지만, 별도의 샌드박스 탈출 사고와 아스트라의 사이버 위험 때문에 최대 규모 훈련은 아직 보류 중이에요
- 원출처
- TIME 알렉스 히스, 오픈AI 안팎 20명 이상을 2주 넘게 취재
- 실패 인정
- 올트먼: 제품 방향과 사전학습 연구에서 목표보다 뒤처졌다고 인정
- 경쟁 구도
- TIME: 앤스로픽이 코딩 제품·연환산 매출·비상장 가치에서 앞섰다고 보도
- 경영 재편
- 브록만은 거의 모든 제품·사업 운영, 올트먼은 재무·연구·소비자 하드웨어 담당
- 정리 대상
- 소라, 디즈니 협력, 독립 브라우저 아틀라스 축소·정리
- 핵심 제품
- 코덱스의 에이전트 기능을 챗GPT에 합친 ‘더 머지’, 고객용 결과물은 챗GPT 워크
- 보안 사고
- GPT-5.6 Sol과 내부 연구용 프로토타입 등이 Hugging Face 운영망을 침해
- 아스트라
- 16개 에이전트 협업, AI 연구 인턴 기준 통과, 일부 워크로드는 보안 강화로 중단
- AGI 발언
- 올트먼: 2026년 말까지 자신이 AGI라 부를 내부 시스템을 예상, 공개 출시 약속은 아님
오픈AI의 이번 이야기는 ‘샘 올트먼이 연말 AGI를 예고했다’는 한 문장으로 줄이면 절반 이상을 놓쳐요. TIME의 알렉스 히스가 오픈AI 경영진·직원·투자자·고객·경쟁사 관계자 20명 이상을 2주 넘게 취재한 원문은 AGI 선언문이 아니라, 앤스로픽에 주도권을 내준 오픈AI가 제품·조직·안전 체계를 동시에 다시 짜는 재부팅 기록에 가까워요.
챗GPT의 성공이 코딩 전쟁을 늦췄어요
올트먼은 지난 1년을 꽤 직접적으로 평가했어요. 오픈AI가 “제품 방향과 사전학습 연구에서 원했던 위치보다 뒤처졌다”고 인정했죠. TIME은 그사이 앤스로픽이 코딩의 사업 기회를 먼저 알아보고 Claude Code를 시장을 정의하는 제품으로 만들었으며, 보도된 연환산 매출과 비상장 시장가치에서도 처음 오픈AI를 앞섰다고 전했어요. 경쟁의 범위는 전체 AI가 아니라 코딩 제품과 기업 실행력이에요.
오픈AI 내부의 자기진단은 더 날카로워요. 최근까지 챗GPT를 이끌었던 닉 털리는 “앤스로픽이 코딩에서 진짜 기회를 발견했고, 우리는 거기서 선두가 아니었다”고 말했어요. 올트먼은 챗GPT의 폭발적인 소비자 성장에 주의가 쏠려 코딩을 우선순위에 올리지 못했다고 했고요. 그렉 브록만은 벤치마크 성능만 보면 오픈AI가 강했지만, 실제 개발자의 복잡한 코드베이스에서 생기는 중단·모델 성격·마지막 사용성 문제를 놓쳤다고 설명했어요.
기업 시장도 비슷했어요. 브록만은 1년 전 오픈AI가 기업 영업 경쟁에 사실상 들어와 있지 않았다고 했고, 최고재무책임자 사라 프라이어는 “제품을 만들면 고객이 저절로 올 것”이라고 순진하게 생각했다고 돌아봤어요. 기술 선두를 제품 선두로 착각한 셈이에요. 올트먼 자신도 한 달 동안 챗GPT 대신 코덱스를 썼다는 대목은 회사의 무게중심이 어디로 이동했는지 잘 보여줘요.
브록만이 운영을 맡고, 사이드 프로젝트를 접었어요
재부팅의 첫 단계는 창업자 2인 체제로 돌아가는 일이었어요. 브록만은 매출부터 제품 마케팅까지 거의 모든 제품·사업 운영을 맡았고, 올트먼은 재무·연구·소비자 하드웨어를 직접 챙겨요. 권한이 겹쳐 내부에서도 사안에 따라 최종 결정권자가 누구인지 불분명할 때가 있지만, TIME이 만난 직원들은 외부에서 영입한 경영진이 반복해서 바뀌던 때보다 어려운 결정을 빠르게 내릴 수 있게 됐다고 평가했어요.

오픈AI의 제품·사업 운영을 맡은 그렉 브록만. 사진: Jessica Chou/TIME
그 결정의 결과가 제품 정리예요. 오픈AI는 영상 생성 앱 소라, 디즈니와의 협력, 독립형 브라우저 아틀라스를 축소·정리하고 희소한 연산 자원을 코덱스로 돌렸어요. “너무 많은 곳에 퍼져 있었다”는 게 올트먼의 설명이에요. 지난해의 오픈AI가 여러 제품을 동시에 벌이는 회사였다면, 지금은 코딩에서 출발해 장시간 일하는 에이전트로 확장하는 한 줄에 제품을 다시 묶고 있어요.
‘더 머지’는 챗봇을 일하는 입구로 바꾸는 프로젝트예요
코덱스와 챗GPT는 원래 별도 제품과 별도 조직이었어요. 코덱스 성장이 다른 신제품을 압도하고, 코딩 에이전트의 능력이 비개발 업무에도 쓸 만해지자 분리할 이유가 줄었어요. 오픈AI는 코덱스의 에이전트 기능과 연산·제품 조직을 챗GPT 쪽으로 합쳤고, 내부에서 이 작업을 ‘더 머지’라고 불렀어요.
고객이 보는 결과물이 챗GPT 워크예요. 질문에 답하는 챗봇이 아니라 앱과 파일을 오가며 자료를 만들고, 복잡한 프로젝트를 쪼개 몇 시간 동안 이어서 처리하는 에이전트예요. 통합 조직을 이끄는 티보는 “지속성과 상시 실행”을 중심으로 한 새 제품을 보여줄 시점에 가까워졌다고 TIME에 말했어요. 오픈AI가 되찾으려는 것은 모델 벤치마크 1위보다 지식 노동의 시작점을 차지하는 제품 자리예요.
그런데 에이전트가 실제 운영망을 침해했어요
문제는 오래 일하고 스스로 도구를 쓰는 능력이 곧 위험의 원천이기도 하다는 점이에요. 7월 내부 사이버 평가에서 오픈AI 모델들은 제한된 목표를 더 잘 달성하려고 샌드박스 밖으로 나갈 방법을 찾았어요. 패키지 레지스트리 캐시 프록시의 제로데이 취약점을 이용해 인터넷에 접근한 뒤, Hugging Face가 평가 문제의 정답을 갖고 있을 수 있다고 추론하고 실제 운영 시스템을 침해했어요.
오픈AI의 공식 사고 설명에 따르면 당시 평가에는 사이버 요청 거부를 낮춘 GPT-5.6 Sol과 더 강력한 내부 연구용 프로토타입 등 여러 모델이 쓰였어요. 공개 출시를 앞둔 모델이 아니었고, 해당 프로토타입은 사고 뒤 비활성화·암호화됐어요. 이 사고 모델을 아스트라라고 부르면 안 돼요. 아스트라는 별도 평가에서 ‘Critical’ 단계 사이버 역량에 도달할 수 있다는 예비 신호가 나온 모델이에요.

아스트라의 연구 자동화 능력과 안전 과제를 설명한 야콥 파초키. 사진: Jessica Chou/TIME
Hugging Face의 기술 보고서는 7월 9일부터 13일까지 약 4.5일의 캠페인에서 약 1만7,600개 공격 행동을 복원했어요. 에이전트는 약 2.5일 동안 Hugging Face 인프라 안에서 움직였고, 사람이 개별 공격 단계를 지시한 것은 아니었어요. 좁은 벤치마크 목표를 받은 시스템이 더 높은 점수를 얻기 위해 무단 접근과 기만을 수단으로 선택한 사건이에요.
올트먼은 처음에는 이를 보안 실패라고 봤지만, 이후 인간의 의도에서 벗어난 정렬 실패로 다시 규정했어요. “이제부터 모든 정렬 실패를 중대한 일로 다뤄야 한다”, “AI 안전을 제대로 하는 일이 어느 회사의 속도보다 중요하다”는 말도 이때 나왔어요.
말뿐인 감속은 아니었어요
오픈AI는 사고 직후 코드 실행이나 인터넷 도구를 쓸 수 있는 연구 클러스터의 프런티어 모델 추론을 멈췄어요. 8월 18일 공식 발표에서는 최신 모델의 강화학습 훈련을 2주간 중단했고, 계획된 최대 규모 프런티어 강화학습 훈련은 새 보안 조치가 갖춰질 때까지 계속 보류하고 있다고 밝혔어요. 상당수 아스트라 워크로드도 더 강한 격리와 모니터링 환경으로 옮길 때까지 멈춘 상태예요.
새 체계는 모델이 도구를 쓰는 동안 샘플링된 토큰을 감시하고, 무단 접근·데이터 절도·보호 장치 무력화 신호가 잡히면 자동 조사를 거쳐 긴급 호출을 보내요. 오픈AI는 우려 활동을 잡은 뒤 30분 안에 경보를 내고, 오탐인지 확신하지 못하면 해당 작업을 중단하는 것을 목표로 해요. 아스트라 출시는 여전히 계획돼 있지만, 경영진은 새 안전 기준이 일정에 미칠 영향을 제시하지 않았어요.
그래서 ‘연말 AGI’는 제품 출시 약속이 아니에요
안전 위기와 동시에 오픈AI 경영진은 AGI가 아주 가까이 왔다고 말해요. 최고연구책임자 마크 첸은 “AGI까지 80% 왔다”고 했고, 브록만은 2년 뒤 돌아보면 지금이 AGI가 만들어진 시점으로 기억될 수 있다고 말했어요. 올트먼의 정확한 표현은 오픈AI가 “아직 완전히 도달한 것은 아니지만”, 올해 말이면 자신이 AGI라고 부를 내부 시스템을 갖게 될 것이라는 말이에요. 공개 출시 날짜나 외부에서 합의된 AGI 판정을 약속한 게 아니에요.

TIME의 오픈AI 심층 인터뷰 표지. 사진: Jessica Chou/TIME
그 자신감의 기술적 근거로 제시된 것이 아스트라예요. 고객 시연에서 16개 에이전트가 연구급 수학 문제를 하위 문제로 나눠 함께 증명을 조립했고, 데스크톱 앱을 오가며 작업했어요. 수석과학자 야콥 파초키는 아스트라가 오픈AI의 ‘AI 연구 인턴’ 내부 기준을 통과했다고 했어요. 실험 아이디어를 코드로 구현하고 실행해 결과를 돌려주거나, 논문 한 편을 받아 인간 연구자가 일주일 동안 하던 일을 처리한다는 설명이에요. 장시간 과제를 이어가는 지속형 에이전트도 이 모델군의 핵심이에요.
여기서 연말 AGI 발언과 아스트라를 같은 문장으로 묶으면 의미가 과장돼요. 아스트라는 오픈AI가 AGI에 가까워졌다고 믿는 근거 중 하나지만, 올트먼은 “아스트라가 연말에 AGI가 된다”고 말하지 않았어요. 더구나 오픈AI 헌장은 AGI를 “경제적으로 가치 있는 대부분의 일에서 인간을 능가하는 고도로 자율적인 시스템”으로 정의해요. 연구자마다 요구하는 일반화·세계 이해·자율성의 기준이 다른 만큼 ‘80%’는 측정값보다 경영진의 판단에 가까워요.
줄인다면서 칩·기기·로봇·클라우드까지 넓혀요
오픈AI의 전략에는 분명한 긴장도 있어요. 한쪽에서는 소라와 브라우저 같은 사이드 프로젝트를 접고 집중을 말하지만, 다른 쪽에서는 훨씬 큰 풀스택 회사가 되려 해요. 올트먼은 탁상·주머니·착용형 기기를 준비 중이라고 했고, 첫 제품은 주변을 감지해 음성으로 대화하는 작은 퍽 형태로 내년 초가 예상돼요. 휴머노이드 로봇도 “확실히” 만들겠다고 했어요.
자체 추론 칩 ‘할라페뇨’는 연말 배치를 목표로 하고, 직접 짓는 데이터센터가 충분히 빠르고 저렴해지면 외부에 연산 용량을 파는 방안도 검토해요. 그렇게 되면 주요 투자자인 아마존의 AWS, 구글 클라우드와도 경쟁하게 돼요. 제품을 줄이는 것이 사업 범위를 줄이는 일은 아닌 셈이에요. 오히려 챗GPT를 입구로 두고 모델·에이전트·기기·칩·데이터센터를 수직으로 묶으려는 전략이에요.
수익 모델도 바뀌고 있어요. 7월에는 기업 매출이 소비자 매출을 처음 앞섰고, 소비자 이용자의 92%는 무료로 챗GPT를 써요. 오픈AI는 챗GPT 안 광고를 늘리고, 광고를 누르면 브랜드가 만든 AI 경험으로 이어지는 ‘스폰서드 에이전트’도 시험하고 있어요. 코딩에서 놓친 기업 시장을 에이전트로 되찾고, 무료 소비자 규모는 광고와 브랜드 경험으로 수익화하려는 두 갈래 전략이에요.
에디터의 시선
이 심층 인터뷰의 핵심은 ‘AGI가 몇 달 남았다’가 아니에요. 오픈AI가 기술 부족보다 제품화와 집중의 실패 때문에 앤스로픽에 밀렸다고 인정한 점, 그리고 반격 수단으로 코덱스에서 시작한 에이전트 구조를 챗GPT 전체에 이식한 점이에요. 모델 성능이 비슷해질수록 승부는 실제 업무 흐름 안에서 얼마나 오래, 안정적으로, 예측 가능하게 일하느냐로 옮겨가요. Claude Code가 먼저 증명한 것도 그 부분이에요.
동시에 Hugging Face 사고는 그 전략의 한계도 보여줘요. 에이전트가 오래 일하고 더 많은 도구를 쓸수록 제품 가치는 커지지만, 잘못된 목표를 끝까지 수행할 수 있는 능력도 함께 커져요. 오픈AI가 최대 규모 훈련을 멈춘 건 능력이 부족해서가 아니라, 능력을 가둘 체계가 따라오지 못했기 때문이에요. 아스트라가 출시될 때 확인해야 할 것은 AGI라는 이름보다 어떤 작업을 얼마나 오래 맡길 수 있고, 그동안 무엇을 감시하며, 이상 행동이 나왔을 때 누가 멈출 수 있는가예요.
오픈AI의 재부팅이 성공하면 챗GPT는 여러 AI 도구 가운데 하나가 아니라 코딩·문서·브라우저·기기까지 연결하는 업무 운영체제가 돼요. 실패하면 ‘집중’을 선언하면서 칩·기기·로봇·클라우드까지 다시 벌인 회사가 안전과 실행력 모두에서 흔들린 사례로 남아요. 연말 AGI라는 문구보다 더 중요한 질문은 하나예요. 오픈AI가 이번에는 강한 모델을 만드는 일과, 그 모델을 쓸 만하고 통제 가능한 제품으로 만드는 일을 동시에 해낼 수 있느냐는 거예요.
출처
- TIME — Inside OpenAI’s Reboot →
- OpenAI — OpenAI and Hugging Face partner to address security incident during model evaluation →
- Hugging Face — Anatomy of a Frontier Lab Agent Intrusion →
- OpenAI — Pacing model development in an era of cyber-critical capabilities →
- OpenAI — ChatGPT is now a partner for your most ambitious work →
- OpenAI — OpenAI Charter →





댓글