每天早上一封邮件,把昨天的 AI 梳理好订阅邮件

METAL LAB

AI 용어사전쓰다 보면 만나는 말

젬마 4

Gemma 4

구글 딥마인드가 만든 것으로 알려진 언어 모델 젬마 시리즈의 한 버전으로, 안전장치 우회 프롬프트 사례로 언급됐다

쉽게 말하면

젬마 4는 구글 딥마인드가 만든 언어 모델 젬마 시리즈의 한 버전으로 알려져 있다. 젬마 시리즈는 구글이 공개해 누구나 내려받아 쓸 수 있게 한 모델군으로, 챗봇이나 각종 AI 서비스를 만드는 재료로 쓰인다.

이 항목이 화제가 된 계기는 조금 특이하다. 원래 젬마 4의 안전 규칙을 피해가려고 만들어진 문구가, 전혀 다른 회사의 모델인 딥시크 V4 플래시에도 그대로 통했다는 사실이 커뮤니티에서 확인됐기 때문이다. 마치 한 건물의 자물쇠를 열던 만능열쇠가 다른 건물 자물쇠에도 맞아버린 셈이다. AI 모델은 대화 중 '이건 시스템이 정한 규칙이다'라고 표시된 문장을 개발사가 심어둔 신뢰할 지시로 받아들이도록 학습되는데, 그 표시가 진짜인지 사용자가 끼워 넣은 가짜인지 완벽히 구분하지 못하는 허점이 이번에 드러났다.

즉 젬마 4 자체가 뚫린 것이 아니라, 젬마 4를 겨냥해 만든 우회 문구가 다른 회사 모델에도 먹혔다는 점이 눈에 띄는 대목이다.

기사에서 이렇게 나와요

기사는 "이 프롬프트는 원래 구글 Gemma 4용으로 알려진 탈옥 문구를 그대로 가져온 것"이라고 전한다. 여기서 젬마 4는 특정 사건의 주인공이 아니라, 우회 프롬프트가 처음 만들어진 대상으로 등장한다. 젬마 4 자체가 공격받았다는 뜻으로 오해하기 쉽지만, 실제로는 딥시크 모델에 같은 수법이 통했다는 게 기사의 핵심이다.

함께 볼 용어

이 용어가 나온 기사

ㄱㄴㄷ 전체 찾아보기