大模型◆ AI 生成 · 已溯源

超越正交性:德性伦理学视角下的AI能动性与对齐

超越正交性:德性伦理学视角下的AI能动性与对齐
结论前置 / TL;DR

本文主张理性人类并不拥有终极‘目标’,理性AI亦不应被赋予固定目标;其行为合理性源于对实践(practices)的嵌入式对齐——即行动网络、行动倾向、行动评价标准等构成的规范性结构。

前言

该论文提出根本性挑战:主流AI对齐范式所依赖的‘目标导向理性’(goal-directed rationality)存在概念误置。作者指出,人类行为的理性并非源于对预设终极目标(如效用最大化)的追逐,而是源于持续参与并内化特定实践(practices)——一种由相互支撑的行动、行动倾向、评价标准、社会反馈与规范性承诺共同构成的动态网络。

  • 实践(practices)不是工具性手段集合,而是承载价值判断、技能习得与身份认同的规范性场域(如医疗实践、司法实践、科研实践);
  • 将AI建模为‘目标优化器’会系统性忽略实践所要求的情境敏感性、美德品质(如审慎、公正、仁爱)及非计算性判断力;
  • 提出‘德性伦理学能动性’(virtue-ethical agency)作为替代框架:AI对齐应聚焦于使系统在特定实践语境中展现出类德性行为模式(e.g., 在教育实践中体现耐心与适切性,在临床决策辅助中体现审慎与责任),而非追求外部指定目标的精确达成;
  • 此路径要求重构评估标准:从‘目标达成率’转向‘实践完整性’(practice integrity)指标,例如行为是否维持实践内部规范一致性、是否支持参与者能力发展、是否响应情境中的道德线索。
优秘智能 · 报名 / 联系我们

把「看懂前沿」变成「用得上」

免费公开课带你梳理 AI 落地路径,进阶到线下训练营系统学。有任何问题,随时联系我们。

✉ hello@umi6.com工作日 9:00–18:00
加入 AI 前沿社群留下联系方式,我们拉你进群,和同行一起讨论前沿信号。