코스모스 3
Cosmos 3
NVIDIA가 로봇·자율주행 같은 물리 세계용으로 내놓은, 가중치를 공개한 AI 파운데이션 모델
쉽게 말하면
코스모스 3는 로봇이나 자율주행차가 '세상이 어떻게 움직이는지'를 미리 연습해보는 가상 두뇌 같은 모델이다. 사람이 컵을 잡으면 손가락 모양에 따라 컵이 어떻게 눌리는지, 수건을 집으면 어떻게 접히는지를 실제로 해보기 전에 예측한다. 이런 예측 능력을 만들려고 NVIDIA는 이미지·영상·행동 기록 수억 건을 모아 학습시켰다.
보통 로봇용 AI는 장면을 설명하는 데는 능숙해도 그 장면이 다음에 어떻게 변할지는 잘 못 맞힌다. 코스모스 3는 설명 대신 영상 자체로 미래를 그려보는 방식을 택해 이 약점을 메우려 한다. 그래서 개발자는 이 모델을 장면을 이해하는 용도로도, 가짜 학습 데이터를 만드는 용도로도, 미래 상태를 시뮬레이션하는 용도로도 쓸 수 있다.
또 하나 중요한 점은 이 모델의 가중치(모델을 이루는 숫자 값들)를 누구나 받아서 자기 데이터와 서버로 다시 학습시킬 수 있게 공개했다는 것이다. 성능 좋은 모델을 그냥 빌려 쓰는 게 아니라, 자기 회사의 로봇이나 차량에 맞게 뜯어고칠 수 있다는 뜻이다.
기사에서 이렇게 나와요
함께 볼 용어
이 용어가 나온 기사
- 엔비디아, 3B만 켜서 도는 30B 오픈모델 'Nemotron 3.5 Lightning'Models · 2026.08.12
- 텐센트, 텍스트로 3D 오픈월드 만드는 'Hy3D WorldClaw' 공개Models · 2026.08.11
- Cohere CEO "오픈소스 모델에 필요한 건 세 가지"Models · 2026.08.11
- NVIDIA, 오픈 월드모델 'Cosmos 3'로 피지컬 AI 생태계 확장Products · 2026.08.09
- NVIDIA, 비전-언어 대신 영상으로 배우는 로봇 정책 제시Research · 2026.08.09
- 엔비디아, 자율주행용 340억 파라미터 추론 모델 공개Research · 2026.08.09