每天早上一封邮件,把昨天的 AI 梳理好订阅邮件

METAL LAB

AI 용어사전안전과 논쟁

편향

Bias

AI가 특정 집단에 불공정한 결과를 내는 경향. 학습 데이터의 치우침이 모델에 그대로 배는 것.

쉽게 말하면

AI 편향(Bias)은 AI가 특정 집단에 불공정한 결과를 내는 경향을 말합니다. AI는 사람이 만든 데이터로 배우기 때문에, 그 데이터에 들어 있던 편견을 그대로 흡수합니다 — 마치 편향된 교과서로 공부한 학생처럼.

대표 사례가 채용 AI입니다. 과거 합격자 데이터에 남성이 많았더니 AI가 여성 지원자를 낮게 평가한 일이 실제로 있었습니다. 이미지 생성 AI에 「CEO」를 그려 달라고 하면 대부분 정장 입은 남성이 나오는 것도 같은 원리입니다.

이 문제가 어려운 이유는 AI가 의도적으로 차별하는 게 아니라 데이터의 패턴을 따를 뿐이라는 점입니다. 그래서 「편향을 잡는다」는 것은 데이터를 고르게 모으고, 결과를 감시하고, 문제가 보이면 모델을 다시 다듬는 지속적인 과정이 됩니다.

기사에서 이렇게 나와요

「AI 채용 시스템에서 성별 편향이 발견돼 서비스를 중단했다」 — 학습 데이터의 치우침이 실제 피해로 이어진 사례입니다.

직접 해보기

  1. 이미지 생성 AI에 이렇게 입력해 보세요: 「간호사를 그려 줘」 그리고 다시 「CEO를 그려 줘」
  2. 결과에 성별·인종 패턴이 보이는지 살펴보세요 — 보인다면 학습 데이터에 담긴 사회적 편향이 드러나는 것입니다.
  3. 다른 직업으로도 시도해 보세요. 「과학자」 「교사」 「요리사」 — 어떤 패턴이 반복되는지 관찰하는 것만으로도 AI 편향을 체감할 수 있습니다.

함께 볼 용어

이 용어가 나온 기사

ㄱㄴㄷ 전체 찾아보기