
요약
- Together AI가 IBM, NVIDIA와 손잡고 IBM Cloud에 엔터프라이즈급 AI 추론 인프라를 구축한다고 밝혔다.
- 전용 NVIDIA B300 클러스터와 Spectrum-X 네트워킹을 결합한 구성으로, IBM Cloud에서는 처음 시도되는 형태로 알려졌다.
- Together AI는 지난달 8억 달러 규모 시리즈 C를 유치한 데 이어 잇따라 파트너십을 발표하며 추론 인프라 시장 확장에 속도를 내고 있다.
- 파트너사
- Together AI, IBM, NVIDIA
- GPU 클러스터
- NVIDIA B300 전용 클러스터
- 네트워킹
- NVIDIA Spectrum-X
- 구축 대상
- IBM Cloud
- 특징
- IBM Cloud 내 이런 구성으로는 처음이라고 발표
- 발표일
- 2026년 8월 11일
- 직전 투자
- 2026년 7월 1일 시리즈 C 8억 달러 유치
B300 클러스터, IBM 클라우드에 처음 들어선다
Together AI가 IBM, NVIDIA와 함께 IBM Cloud에 새로운 AI 추론 인프라를 구축한다고 밝혔다. 핵심은 NVIDIA의 최신 GPU인 B300으로 구성된 전용 클러스터다. 여기에 NVIDIA의 고속 네트워킹 기술 Spectrum-X를 결합했는데, Together AI는 이 조합이 IBM Cloud에서는 처음 시도되는 구성이라고 설명했다. Together AI는 이를 두고 "엔터프라이즈급 AI 추론"이라고 소개했다.
세 회사가 나눠 맡은 역할
구조는 명확하다. NVIDIA가 하드웨어(B300 GPU와 Spectrum-X 네트워킹)를 대고, IBM이 이를 자사 클라우드에 얹어 기업 고객에게 판매하며, Together AI는 그 위에서 실제로 모델을 돌리는 추론 소프트웨어 계층을 맡는다. Together AI는 스스로 '프로덕션 준비가 된 추론 플랫폼'이라고 부르는 서비스를 이번 클러스터 위에서 운영할 예정으로 알려졌다.
이런 3사 구조는 클라우드 업체가 GPU만 임대해주는 것을 넘어, 모델을 실제로 서빙하는 소프트웨어까지 패키지로 묶어 파는 방식이다. 기업 고객 입장에서는 GPU 확보와 추론 최적화를 각각 따로 계약할 필요 없이 한 번에 해결할 수 있다는 뜻이다.
Together AI, 왜 지금 파트너십을 쏟아내나
Together AI는 지난 7월 1일 8억 달러 규모 시리즈 C 투자 유치를 발표하며 오픈소스 AI로의 전환 가속을 명분으로 내세웠다. 같은 시점에 Y Combinator 전용 GPU 클러스터 파트너십과 B200 온디맨드 제공, MiniMax-M3 서빙 지원을 함께 공지했다. 제공하는 GPU 라인업도 GB300, GB200, B200, H200, H100까지 폭이 넓다.
이후 흐름도 빠르다. 8월 6일에는 코딩 에이전트 도구 Roomote가 Together AI를 추론 제공자로 채택했다고 밝혔고, 이번 IBM·NVIDIA 파트너십과 같은 날인 8월 11일에는 자사 TTS 모델의 음성 600개 이상을 검색·매칭해주는 'voice finder'를 공개했다. 다음날인 8월 12일에는 DeepSeek V4 Flash 0731 모델의 파인튜닝 지원도 시작했다. 투자 유치, 대형 클라우드 파트너십, 개발자 도구, 신규 모델 지원이 한 달 사이 이어지는 셈이다.
| 날짜 | 발표 내용 |
|---|---|
| 2026-07-01 | 시리즈 C 8억 달러 유치, YC 전용 클러스터, B200 온디맨드 |
| 2026-08-06 | Roomote가 추론 제공자로 채택 |
| 2026-08-11 | voice finder 공개 (음성 600개 이상 검색) |
| 2026-08-11 | IBM·NVIDIA와 IBM Cloud 파트너십, B300 클러스터 |
| 2026-08-12 | DeepSeek V4 Flash 0731 파인튜닝 지원 시작 |

B300과 Spectrum-X는 무엇인가
B300은 NVIDIA의 최신 세대 데이터센터용 GPU로, 대규모 언어모델을 돌리는 추론 작업에 쓰인다. Spectrum-X는 NVIDIA가 만든 이더넷 기반 네트워킹 플랫폼으로, 여러 대의 GPU를 하나의 클러스터처럼 묶어 데이터를 주고받을 때 발생하는 병목을 줄이는 역할을 한다. 추론 속도가 GPU 개수만큼 늘어나지 않고 병목에 막히는 경우가 많은데, 이 둘을 함께 쓰면 그 손실을 줄일 수 있다는 게 업계의 설명이다.
그래서 무엇이 달라지나
기업 고객 입장에서 보면, IBM Cloud를 이미 쓰고 있는 조직이라면 별도의 GPU 클라우드 계약 없이도 Together AI의 추론 스택을 곧바로 붙일 수 있는 경로가 생긴 셈이다. 오픈소스 모델을 누가 더 빠르고 안정적으로 서빙해주느냐가 경쟁의 핵심으로 옮겨가는 추론 인프라 시장에서, Together AI는 투자 유치 직후 대형 클라우드 업체와의 제휴로 세력을 넓히는 모양새다. IBM처럼 오랜 기업 고객층을 보유한 클라우드가 이런 파트너십에 나선다는 것은, 오픈 웨이트 모델 도입이 스타트업 단계를 넘어 보수적인 대기업 시장까지 번지고 있다는 신호로 읽힌다.





댓글