Lost in Translation: How Universal Ethical Values Fail to Translate Across Global Contexts
对10个国家14位AI专家的访谈发现,'公平''透明'这些价值观在不同地方的理解并不相同
OECD、UNESCO等全球机构制定的AI伦理框架假设公平、透明、隐私这些价值观可以在任何地方以同样的方式落地。研究团队访谈了来自10个国家的14位AI专家,发现这些价值观在当地道德逻辑下被重新诠释,形成了作者称之为全球框架与本地实践之间的翻译鸿沟。基于此,研究提出转向一种重新分配话语权的多元治理路径。
METAL LAB 解读图
AI伦理翻译模型:从普遍原则到本地治理
证据状态已报告实测结果
- 全球原则OECD、UNESCO等机构提出的公平、透明、隐私等被视为普遍适用的AI伦理价值观
- 本地诠释专家在基础设施差距、攫取性做法和技术神秘化的本地条件下,对这些价值观进行重新解读
- 契合或翻译鸿沟重新诠释的含义如果与原始原则一致则为契合,若产生偏差则形成翻译鸿沟
- 扎根于文化的治理承认翻译鸿沟后,形成重新分配认知权威、纳入本地知识的多元治理方式
他们做了什么
- 研究团队对来自非洲、亚洲、拉丁美洲、大洋洲、欧洲、北美和加勒比地区共10个国家、从事AI开发、政策或治理工作的14位专家进行了半结构化访谈。
- 访谈历时七个月,每次通过Zoom进行45至60分钟,其中包含一个结构化环节,要求参与者根据自身文化背景定义偏见、可解释性、公平、透明和隐私这五个被广泛引用的价值观。
- 研究发现,电力、网络连接等基础设施的不平等条件、数据的攫取性做法,以及对技术的一种神秘化认知,共同决定了人们如何看待AI的风险与机遇。
- 隐私被重新理解为集体性、关系性的概念而非个人权利,透明被理解为建立信任的问责机制而非技术性信息披露,公平被理解为在准入和代表性上的公平而非结果上的均等。
- 研究者将这些错位称为翻译鸿沟,即全球编码的伦理框架与本地实际情况之间的不匹配,并据此提出走向多元、注重权力平衡的治理路径。

| ID | Country | Region | Sector | Area of Expertise |
|---|---|---|---|---|
| P1 | Mexico | North/Central America | Industry | AI |
| P2 | Kenya | Africa | Tech Founder (Non-profit) | AI / Content Moderation |
| P3 | New Zealand | Oceania | Industry | AI |
| P4 | USA | North America | Researcher & Founder | AI |
| P5 | New Zealand | Oceania | Research Fellow | AI |
| P6 | Zambia | Africa | Academia | Journalism / Emerging Media |
| P7 | Bangladesh | South Asia | Academia | HCAI |
| P8 | Ghana | Africa | Industry / Co-founder | AI |
| P9 | Bangladesh | South Asia | Academia | HCI / AI |
| P10 | Nigeria | Africa | Researcher | HCI |
| P11 | Nigeria | Africa | Researcher | HCAI |
| P12 | France | Europe | Academia | AI Ethics |
| P13 | Jamaica | Caribbean | Academia | Humanities |
| P14 | Bangladesh | South Asia | Research Fellow | HCAI |
研究结果
- 参与者表示,由于电力、网络连接和设备获取方面的差距,他们在结构上被排除在AI带来的好处之外。
- 在偏见、可解释性、公平、透明、隐私这五个被追问的价值观中,隐私、透明、公平等在不同文化背景的参与者中被赋予了不同含义,例如隐私被理解为集体性和关系性的,而非个人权利。
- 多位参与者提到数据在未经同意的情况下被收集,数据标注和内容审核等劳动报酬低且对心理造成伤害。
- 参与者报告了代表性缺口,例如缺乏斯瓦希里语或非洲口音的聊天机器人,让他们感到被排斥和象征性抹除。
- 参与者也报告了机遇,例如移动银行、电子政务扩大了服务可及性,当AI与本地需求契合时能支持学习和社区赋权。
可应用场景
- 可用于在多国部署AI产品或政策之前,与当地专家和社区一起重新界定核心价值观含义的流程设计。
- 可作为撰写AI伦理指南时的检查项,提醒审视'公平''透明'等术语是否被当作文化固定不变的定义使用。
- 可用于审视数据收集与标注流程中的劳动条件和同意机制。
局限与待验证事项
- 14人的目的性抽样是为了保证定性分析的深度,而非统计学上的可推广性;研究结果是理论上可迁移的洞见,而不是对整个文化群体的代表性陈述。
- 研究结果基于自我报告的访谈资料,作者指出这可能与AI伦理在实践中真实协商的方式有所不同,并呼吁未来开展民族志或纵向研究。
- 文中提出的多元治理路径仍主要停留在分析层面,平衡本地诠释与全球共同承诺(如人权、安全)的具体机制仍待未来研究设计。
- 参与者被定义为在AI领域具有深厚经验的'专家',因此非专家或边缘化社区成员的视角未被纳入本次研究。
为什么重要
各国政府和大型科技公司制定的AI伦理指南往往建立在西方个人主义假设之上,一旦部署到全球其他文化环境中就可能出现偏差,这项研究提供了具体证据说明这种偏差发生在何处、如何发生。为多个地区设计AI政策、产品或审计的从业者,可以借此警惕不能把'公平''透明'这类词语当作只有一种固定含义。
本文术语
- 翻译鸿沟 · 全球AI伦理原则被本地重新诠释后,与原意产生的错位
- 多元治理 · 让多种价值体系共同参与决策,而不是强制推行单一标准解释的治理方式
- 话语权/认知权威 · 决定什么算是有效知识或真理的权力
- 参与式攫取 · 只让社区作为无否决权的数据来源参与,其知识被用来增强全球系统,却未获得任何结构性权力
论文原文摘要(英文)
AI ethics frameworks treat values such as fairness, transparency, and accountability as universal and uniformly operationalizable across contexts. We examined how 14 experts across 10 countries made sense of AI in practice, reinterpreted core values, and envisioned governance alternatives. We found that AI deployment is characterized by structurally unequal conditions, marked by infrastructural constraints, extractive practices, and a "mystification" of technology, which fundamentally shape perceptions of risks and opportunities. Our findings reveal that experts reinterpret values to fit local moral logics: privacy as collective and relational rather than individual; transparency as trust-building accountability rather than technical disclosure; and fairness as equity in access and representation rather than parity in outcomes. We identify these as translation gaps between encoded global frameworks and situated local practices. Finally, we propose pathways toward plural governance that redistributes epistemic authority and treats ethical negotiation as an ongoing, context-sensitive process rather than a settled technical standard.
在 arXiv 阅读最新论文
- AgentMercury: Your Agent Can Synthesize Verifiable Environments for Business Scenarios at scaleAI不再为单个任务搭环境,而是直接生成整个商业世界,让训练场自己扩展规模
- FlavourBench: Ranking Frontier Language Models with Executable Culinary Ground Truth用一套可执行的美食评分系统当裁判,而不是靠人或AI来打分的语言模型评测
- When Vocabulary Comprehension Fails Clinical Reasoning: Evaluating Therapy Bots' Safety Risks for Generation Alpha治疗聊天机器人能听懂青少年的俚语,却常常判断不出话里藏着的危机
- Hadith computational science in the age of large language models: a critical narrative review一篇批判性综述追问:大语言模型给圣训(hadith)计算研究带来的进步哪些是真的,哪些只是在窄基准上好看
- SWE-bench Science: Can Coding Agents Resolve Engineering Tasks in Science?让AI编程助手去修复真实科学软件,连最强的那个也有一半以上任务没做对
- FlashPrefill V2: Block-Sparse Prefill Attention for Long-Context LLM Serving把稀疏注意力从论文原型变成能真正上线服务的加速方案
- PolicyGuide: From Guarding One Action to Guiding the Whole Workflow for Policy-Compliant LLM Agents让客服AI坐席不只是拦住一个危险动作,而是把整个流程走对
- EXIMO: VLM Guided Exploration of VLA Policies不用人工遥控演示,让会说话的AI来教机械臂做新家务
METAL LAB 最新报道
图片来源: Ozioma C. Oguine et al., arXiv:2608.20490, CC BY 4.0