中国伦理学会会刊
国家社科基金资助期刊
中文社会科学引文索引(CSSCI)来源期刊
全国中文核心期刊
中国人文社会科学核心期刊

Studies in Ethics ›› 2026(4): 26-36.

Previous Articles     Next Articles

Meta-Ethical Reflections on Artificial Intelligence Value Alignment:from Preference Fitting to Normative Reasons

Fu Xingyuan   

  • Online:2026-07-10 Published:2026-08-31

人工智能价值对齐的元伦理学反思:从偏好拟合到规范性理由

傅星源   

  • 作者简介:傅星源(1991—),山西大学哲学学院副教授。

摘要: 人工智能价值对齐构成了当代智能治理的元命题。面对大语言模型、通用智能体与具身智能的快速演进,主流以“满足人类偏好”为导向的对齐路径在实践中正遭遇算法“游叙弗伦困境”、偏好不融贯以及价值漂移等多重治理风险。为此,引入元伦理学中的“适度价值实在论”立场,将价值对齐范式从“经验性偏好拟合”转向“客观规范理由约束”。在这一视角下,对齐的实质是将技术系统有机编织进客观理由、公共伦理与制度刚性相互融贯的规范性秩序之中。高阶智能系统因其在信息整合与非线性因果模拟等层面的优势,得以扮演“道德认识论伙伴”的角色,辅助人类通过反思平衡澄清价值冲突。人工智能价值对齐的终极愿景,在于通过双向协同向普遍规范理由收敛,从而深化人类对“何为应当”这一伦理命题的理性审视。

关键词: 人工智能, 价值对齐, 元伦理学, 客观规范理由, 价值实在论, 道德认识论