每天早上一封邮件,把昨天的 AI 梳理好订阅邮件

METAL LAB

AI 용어사전쓰다 보면 만나는 말

몰모액트

MolmoAct

앨런AI연구소(Ai2)가 만든 로봇용 AI 모델로, 카메라로 본 장면을 이해해 로봇 팔이나 몸체를 움직이는 행동으로 바꿔준다.

쉽게 말하면

몰모액트는 로봇이 눈으로 본 것을 곧바로 몸의 움직임으로 옮기도록 도와주는 AI 모델이다. 사람이 물건을 보고 손을 뻗어 집는 과정을 하나의 감각-판단-행동 흐름으로 처리하듯, 이 모델은 카메라 영상과 사람의 말(지시문)을 함께 입력받아 로봇이 다음에 어떤 동작을 해야 하는지 계산해낸다.

일반적인 언어 모델이 텍스트만 주고받는다면, 몰모액트는 눈(영상)과 귀(언어)로 들어온 정보를 몸(동작)으로 연결하는 역할을 한다. 이런 방식의 모델을 시각-언어-행동 모델이라 부르는데, 자세한 개념은 관련 항목에서 다룬다.

몰모액트는 앨런AI연구소(Ai2)가 공개한 여러 모델 중 하나로, 언어모델 올모(Olmo)나 지구관측 모델 올모어스(OlmoEarth)와 함께 허깅페이스(Hugging Face) 허브에 공개돼 있다. 가중치뿐 아니라 학습 과정 전반을 공개하는 방식이 특징이다.

기사에서 이렇게 나와요

기사에서는 "로봇용 시각-언어-행동 모델 MolmoAct"라는 표현으로 등장한다. 챗봇처럼 대화를 하는 모델이 아니라, 실제 로봇을 움직이게 하는 데 쓰이는 물리적 AI 모델이라는 점이 핵심이다.

함께 볼 용어

이 용어가 나온 기사

ㄱㄴㄷ 전체 찾아보기