자동 안전 검토
Automated Safety Review
사람이 대화 내용을 직접 보지 않고 자동 시스템이 API 요청의 악용 위험만 골라내는 점검 단계.
쉽게 말하면
자동 안전 검토는 사람이 대화 내용을 직접 읽지 않고도 기계가 알아서 위험한 사용을 걸러내는 점검 단계다. 공항 보안 검색대를 떠올리면 쉽다. 가방 속 물건을 사람이 일일이 열어 확인하는 대신, 엑스레이 기계가 위험물 여부만 판단해서 알려주는 것과 비슷하다. 오픈AI가 이런 방식을 쓴 이유는 기업 고객의 API 요청 내용을 서버에 아예 저장하지 않겠다고 약속했기 때문이다. 데이터를 안 남기면서도 악용을 잡아내려면, 그 판별을 사람이 아니라 자동 시스템에 맡길 수밖에 없다.
이 단계를 거치고 나면 위험이 감지됐을 때 알림이 두 곳으로 간다. 하나는 그 API를 쓰는 기업 고객에게, 다른 하나는 오픈AI에게 간다. 그런데 오픈AI가 받는 알림에는 실제 대화 내용이 담기지 않는다. 위험의 종류와 심각도 정도만 표시될 뿐, 콘텐츠를 실제로 공개할지 말지는 고객이 정한다. 즉 자동 안전 검토는 위험을 찾아내는 역할까지만 하고, 그 뒤 판단은 사람에게 넘기는 구조다.
기사에서 이렇게 나와요
기사는 자동 안전 검토가 사람의 검토나 오픈AI 서버상의 콘텐츠 보관 없이 악용 여부를 판별한다고 설명한다. 오해하기 쉬운 점은 이게 콘텐츠를 아예 안 본다는 뜻이 아니라는 것이다. 자동 시스템이 콘텐츠를 스캔하기는 하되, 그 결과가 사람 눈에 보이는 형태로 저장되거나 오픈AI 직원에게 그대로 전달되지 않는다는 뜻이다.
