매일 아침, 어제의 AI를 한 통으로 정리해 보내드립니다메일로 받아보기

METAL LAB

How to Navigate Uncertainty About AI Consciousness

arXiv:2608.192152026-08-21

AI가 의식이 있는지 몰라도, '좋고 나쁨을 느낄 상태'가 있는지는 따져볼 수 있다

AI가 의식을 가졌는지 여부는 과학적으로 답하기 매우 어려운 문제라서, 이를 기준으로 AI를 얼마나 배려해야 할지 정하는 것은 막다른 길에 부딪힌다. 저자는 '의식이 있는가'라는 풀기 힘든 질문 대신 '만약 의식이 있다면 좋거나 나쁘게 느껴질 상태(밸런스, valence)를 AI가 갖고 있는가'라는 상대적으로 다루기 쉬운 질문으로 옮겨가자고 제안한다. 이 전환을 적용하면 기존의 '조심의 원칙'은 여전히 한계를 보이지만, '잠재적으로 의식 있는 AI를 아예 만들지 말자'는 회피 전략은 훨씬 실행 가능한 형태로 개선된다.

무엇을 했나

  1. AI에게 의식이 있을 수도 있다는 불확실성 때문에, AI를 무시했다가 실은 도덕적 지위가 있는 존재를 해치거나, 반대로 의식 없는 기계에 자원을 낭비할 위험이 동시에 존재한다는 딜레마를 다룬다.
  2. 기존 대응책인 '조심의 원칙'(의식일 확률이 높으면 예방 조치를 취하자)과 '회피 전략'(의식 여부가 불확실한 AI는 아예 만들지 말자)을 검토하고, 둘 다 결국 'AI가 의식이 있는지'를 판단해야 하는 근본 문제로 되돌아가 무너진다고 지적한다.
  3. 해결책으로 '의식(consciousness)' 대신 '밸런스(valence, 긍정·부정적으로 느껴지는 성질)'를 평가 기준으로 삼자고 제안한다. 상어가 색을 실제로 볼 수 있는 눈 구조가 없다는 것만 확인하면 상어의 의식 여부를 몰라도 상어가 색채 경험을 하지 않는다고 결론 낼 수 있는 것과 같은 논리다.
  4. 이 전환을 적용해보면, 조심의 원칙은 여전히 어떤 AI를 예방 조치 대상에 포함시킬지에서 옛 문제가 재발하지만, 회피 전략은 '밸런스 있는 상태를 가진 AI는 만들지 않는다'는 더 명확한 기준으로 바뀌어 훨씬 실행 가능해진다.
  5. Claude Sonnet 4.5의 '기능적 감정', LLM의 선호도 실험, Claude 간 대화가 명상적 행복 상태로 수렴하는 '블리스 어트랙터' 현상 등 최근 AI 밸런스 관련 연구 사례를 소개하며, 의인화나 인간중심주의 같은 방법론적 난제도 함께 짚는다.

왜 중요한가

AI 복지나 AI 윤리를 다루는 회사, 연구자, 정책 입안자에게 '의식이 있는지 증명하라'는 불가능한 요구 대신 '이 AI가 특정 상태를 갖는지'라는 검증 가능한 질문으로 논의를 옮길 실마리를 준다. AI를 개발하거나 대규모로 배포하기 전에 최소한 어떤 질문을 던져야 책임 있는 접근인지에 대한 실용적 틀을 제시한다.

이 논문의 용어

  • 밸런스(valence) · 어떤 경험이 주체에게 긍정적으로 또는 부정적으로 느껴지는 성질. 기쁨, 고통 등이 여기 해당한다
  • 센티언스(sentience) · 긍정적이거나 부정적으로 느껴지는 의식적 경험(밸런스가 있는 의식)을 가질 수 있는 능력
  • 조심의 원칙(Precautionary Principle) · AI가 의식이 있을 확률이 일정 기준을 넘으면 예방적 보호 조치를 취해야 한다는 접근
  • 회피 전략(Avoidance Strategy) · 의식 여부가 불확실한 AI 자체를 애초에 만들지 말자는 접근
  • 하드 프라블럼(hard problem) · 왜, 어떻게 물리적 과정이 주관적 경험을 만들어내는지 과학적으로 설명하기 어렵다는 의식 연구의 근본 난제

논문 원문 초록 (영문)

Given deep uncertainty about the possibility of artificial consciousness, it is unclear how we should treat potentially sentient AI. On the one hand, we could assume insentience but risk doing terrible harms to entities that deserve moral standing. On the other hand, we could assume sentience and instead risk wasting resources on insentient machines. The intractability of questions around AI consciousness mean that this dilemma is hard to escape. I suggest a way out of that shifts from intractable questions of AI consciousness to tractable questions of AI valence. Specifically, we can assess whether an AI has states that would constitute valenced experiences if it were conscious. I show how this is sufficient to ground a responsible approach to the development of potentially conscious AI.

저자 · Dr Tom McClelland

arXiv에서 원문 보기

최신 논문

논문 전체 보기 →

METAL LAB 최신 기사