양식 붕괴
Mode Collapse
AI가 여러 가지로 표현할 수 있는데도 특정 문구나 패턴 하나로 답이 쏠리는 현상
쉽게 말하면
양식 붕괴는 AI가 다양하게 표현할 수 있는 상황에서도 유독 몇 가지 문구나 패턴으로만 답을 몰아 쓰는 현상이다.
사람 100명에게 같은 질문을 던지면 답이 저마다 다르게 나온다. 말투도 다르고 표현도 제각각이다. 반면 챗봇에게 비슷한 질문을 여러 번 던지면 어딘가 낯익은 문구, 비슷한 문장 구조가 자꾸 반복된다는 느낌을 받을 수 있다. 원래는 사람만큼 다양하게 쓸 수 있는 모델인데도 실제로는 몇 갈래의 정해진 표현으로 답을 좁혀 버리는 것이 바로 양식 붕괴다.
이 현상은 모델이 능력이 부족해서가 아니라, 출시 전에 대화 예절이나 위험한 요청 거절 같은 행동 규칙을 학습시키는 과정에서 생긴다. 이 규칙들을 입히지 않은 원시 모델은 사람만큼 폭넓은 문체로 글을 쓰지만, 규칙을 학습한 뒤에는 특정 사과 문구나 정형화된 접속사 패턴에 확률이 몰리게 된다. 이런 몰림은 역설적으로 AI가 쓴 글임을 알아채는 힌트가 되기도 한다.
기사에서 이렇게 나와요
직접 해보기
- 챗봇에게 같은 질문을 표현만 살짝 바꿔서 서너 번 던져 본다. 예: "오늘 날씨 어때?", "오늘 기온 좀 알려줘", "바깥 날씨 어떤 것 같아?"
- 답변에서 반복되는 문구나 문장 구조가 있는지 살펴본다. 예를 들어 항상 비슷한 도입 문장이나 사과 표현으로 시작하는지 확인해 본다.
- 이번엔 "다음 문장을 서로 다른 문체로 5가지 버전으로 다시 써줘"라고 요청해 본다. 5개 버전이 실제로 얼마나 다른지, 아니면 어휘만 살짝 바뀐 비슷한 문장인지 비교해 본다.
- 사람 여러 명이 같은 질문에 답했을 때와 비교하면 AI 답변의 표현 폭이 얼마나 좁은지 체감할 수 있다.
