儒家“和而不同”能否拯救 AI 对齐?
价值 pluralism 不是技术 bug,而是文明常态——儒家的智慧或许比单一价值观更稳。
一、对齐困境:单一价值观的幻象
AI 对齐(alignment)常被视为让模型“学会正确价值观”。但“正确”由谁定义?不同文化、阶层、世代对何为善、何为正当有深刻分歧。强行把一套单一价值观写进系统,反而可能复制并放大某一种话语权,把局部的偏好伪装成普世的真理。这正是当代对齐研究中“whoever’s values”难题的根源。
更棘手的是,单一价值观即便在内部自洽,也难以应对真实世界的歧义。同一句话在不同语境下可能是礼貌,也可能是冒犯;同一个决策在不同社群里有不同的正当性。把世界压成一个向量的代价,是丢失这些不可替代的微妙,也牺牲了少数群体的声音。
二、“和而不同”的哲学资源
孔子说:“君子和而不同,小人同而不和。”(《论语·子路》)“和”不是消除差异的“同”,而是在差异中寻求协调共处。中国互联网信息办公室的“关键词”解读指出,“和而不同”是孔子处理人际关系、乃至处理多样性与统一性关系的基本原则,体现了中国古人对多元与一致的深邃看法。
“和”强调在差异中共生,“同”则是无差别的复制。儒家拒绝以“同”吞没“不同”,恰恰守护了共同体中不尽相同的意志。
这与西方自由主义以“个人权利”为起点的路径形成有趣对照。儒家从“关系”与“共同体”出发,更看重差异如何在共处以中求“和”。对齐若只从个体偏好聚合入手,容易陷入多数暴政;而从共同体和谐入手,则更强调差异之间的相互成全。两种资源,或许都不可或缺,互补方能更稳。
三、对 AI 对齐的启示
把这一智慧迁移到对齐,至少有三层启发:
- 容纳分歧:对齐目标应承认价值 pluralism,而非追求唯一正确答案;
- 寻求协调:系统的目标是在冲突价值间找到可接受的平衡点,而非消灭某一方;
- 共同体视角:中山大学 2025 年的研究指出,“文”的共同体是学习与实践的产物,无法由一人独力完成——AI 也应是共同体的协作者,而非价值的独裁者。
四、比单一价值观更稳?
当世界本身多元,一套宣称“普世”却封闭的价值观反而脆弱。儒家的“和而不同”提供了一种更具韧性的框架:它不假设所有价值可化约为一,却相信差异可以和谐共存。这对跨文化、跨地域部署的 AI 尤其重要——与其塞给用户一个“标准答案”,不如训练系统学会在冲突中磋商、在差异中周旋。
值得注意的是,“和而不同”并非相对主义的借口——它不要求对所有价值等量齐观,而是要求在无法统一时保持商谈的开放。对齐系统同样需要一套“底线+协商”的结构:不可逾越的安全红线,加上可磋商的偏好空间。守住底线,敞开协商,才是对齐成熟的标志。
在实践层面,这意味着对齐不应追求一份静态的“价值观文件”,而应设计一套动态的商谈机制:让不同社群能持续表达自己的价值偏好,让系统在冲突中学会让步与解释。把“和而不同”写进算法,不是给机器灌入某种东方教条,而是教它尊重分歧本身。差异不是待消除的噪声,而是文明得以纠错的冗余。一个只听得进一种声音的系统,终究会在自身的盲区里跌倒;而一个学会与不同共处的系统,才可能真正稳健地服务于多样化的世界。
结语
AI 对齐的终点或许不是某个完美的“正确答案”,而是一种让不同价值得以共存、协商、相互校正的能力。儒家的古老智慧提醒我们:真正的和谐,从尊重“不同”开始。技术的对齐,终究要回到人与人的和解。
延伸阅读
- “和而不同”, 中国互联网信息中心关键词解读, 2024-08.
- 《”和而不同“的努力:孔子及”文“的共同体》, 中山大学学报, 2025.
- Traditional Chinese “和合”哲学及其当代价值, hanspub.org, 2023.














No comments yet