노바
Nova
아마존이 만든 대형언어모델로, 텍스트와 이미지를 다루도록 훈련된 자체 AI 모델이다.
쉽게 말하면
노바는 아마존이 자체적으로 만들어 쓰는 AI 모델이다. 사람이 책을 많이 읽을수록 글을 잘 쓰게 되는 것처럼, 이런 모델도 글과 그림 데이터를 잔뜩 읽고 보면서 실력을 키운다. 노바는 그 학습 재료로 글자와 이미지를 함께 쓰는, 여러 감각을 동시에 배우는 학생에 가깝다.
다만 이 학생에게 밥을 먹이는 방식이 논란이 됐다. 인터넷에 떠도는 글만으로는 재료가 부족해지자, 실제 인쇄된 책을 사서 스캔한 뒤 그 내용을 노바에게 먹인 것이다. 문제는 스캔 속도를 높이려고 책을 낱장으로 분해했다는 점인데, 원본을 훼손하면서까지 '깨끗한 글'을 확보하려 한 셈이다.
노바가 특별히 나쁜 모델이라서가 아니라, 이 사례는 요즘 AI 모델들이 학습 재료를 어디서 구하는지를 보여주는 창문 같은 역할을 한다. 인터넷 글이 AI가 쓴 글로 오염되기 전인 옛 책들이 유독 값진 재료로 취급받고 있다는 뜻이다.