스테이트 스페이스 모델
State Space Model
문장이 길어져도 계산량이 크게 늘지 않도록, 지금까지 읽은 내용을 압축한 상태 하나만 계속 갱신하며 처리하는 AI 모델 구조.
쉽게 말하면
스테이트 스페이스 모델은 문장이나 소리를 처음부터 끝까지 하나씩 읽어나가면서, 지금까지 들은 내용을 압축한 '상태' 하나만 계속 갱신해가는 AI 모델 구조다. 마치 책을 읽으며 매 페이지마다 줄거리를 한 문장으로 요약해 다음 페이지로 넘어가는 것과 비슷하다. 지금까지 읽은 모든 문장을 다시 펼쳐볼 필요 없이, 방금 갱신한 요약본 하나만 들고 있으면 되기 때문에 입력이 아무리 길어져도 처리 부담이 크게 늘지 않는다.
반면 지금 널리 쓰이는 방식은 매 단어를 처리할 때마다 이전에 나온 모든 단어를 다시 훑어보는 구조라, 문장이 길어질수록 계산량이 눈덩이처럼 불어난다. 스테이트 스페이스 모델은 이 부담을 덜어내는 대신 순서대로 하나씩 처리해야 해서, 실시간으로 말이 흘러나오는 음성 합성이나 스트리밍 서비스처럼 데이터가 끊임없이 이어지는 상황에 특히 잘 맞는다.
기사에서 이렇게 나와요
카르테시아의 음성합성 모델 Sonic-3.6은 널리 쓰이는 구조 대신 스테이트 스페이스 모델(SSM) 구조로 작동한다고 소개됐다. 기사는 이 구조 덕분에 첫 오디오가 나오기까지 걸리는 시간이 90ms 미만이라고 설명하는데, 이는 회사가 자체 측정한 수치이며 실제 서비스에서 체감하는 왕복 지연과는 다를 수 있다는 점을 함께 짚었다.
함께 볼 용어
이 용어가 나온 기사
- Inworld AI, 리얼타임 TTS-2 출시…음성합성 1위 경쟁 재점화AI · 2026.09.03
- 카르테시아 소닉-3.6, 음성합성 두 리더보드 동시 1위AI · 2026.08.19
- 오픈소스 오니스-1.5, 클로드 오퍼스급 점수 냈다고 밝혔다AI · 2026.08.21
- 레딧 개발자, 로컬 LLM 여러 개 자동 전환하는 '언스웜' 공개AI · 2026.08.23
- 업스테이지 'Solar Pro 4', 누스 포털서 일주일 무료 개방AI · 2026.08.12
- 미스트랄, 유럽 AI 주권 위해 컴퓨트 연합 구성...외부 모델도 개방비즈니스 · 2026.08.12
