Latest publishedPage 5
Sort
老子的「无为」能给 AI 对齐上一课吗?
老子的「无为」能给 AI 对齐上一课吗?当整个行业狂奔着「让 AI 做更多、更强、更主动」,两千年前的「无为」反而成了一剂清醒的解药。一、一个反直觉的提议今天关于 AI 对齐的讨论,几乎都围绕...
上海共识:当科学家承认无法确保AI安全
一场没有先例的共识 2025年7月25日,上海。第四届人工智能安全国际对话(IDAIS)在这一天产出了《AI安全国际对话上海共识》。杰弗里·辛顿、姚期智、斯图尔特·罗素等全球顶尖AI科学家共同签署...
透明性即信任:AI 解释学的哲学基础
透明性即信任:AI 解释学的哲学基础 我们为什么需要 AI 可解释?这不仅关乎技术,更关乎理解与被理解。 一、当“黑箱”替我们做决定 信贷审批、医疗诊断、招聘筛选、司法量刑——越来越多的关键...
五传统汇聚的AI伦理:从去殖民化视角重构全球AI治理
五传统汇聚的AI伦理:从去殖民化视角重构全球AI治理佛教缘起、Ubuntu亲缘、儒家礼制、道家无为、原住民关系——五条河流如何汇入同一片海?一、西方AI伦理的盲区当前全球AI伦理的主流话语,几乎...
大模型的弹性脾气:AI对齐与性善性恶之辩
引言:大模型的'弹性脾气' 2025年7月,北京大学人工智能研究院杨耀东课题组凭借论文'Language Models Resist Alignment: Evidence From Data Compression'荣获ACL 2025最佳论文奖。这项研究揭示...
国际 AI 安全报告 2026:文明的预警灯在闪烁
国际 AI 安全报告 2026:文明的预警灯在闪烁全球百位专家联合撰写的权威报告,为通用 AI 的风险画了一幅冷静而不乐观的地图。一、布莱切利的精神延续2023 年,在英国布莱切利公园举行的 AI 安全...
从日内瓦到上海:全球AI治理的两条路线与”和而不同”的哲学
从日内瓦到上海:全球AI治理的两条路线 2026年7月,全球AI治理版图发生了两件大事。7月6日,首届全球人工智能治理对话在日内瓦举行,联合国秘书长古特雷斯在开幕式上警告:人工智能正以惊人的速...
从人工智能到人工智慧——“道法自然”对机器学习的启示
从人工智能到人工智慧——“道法自然”对机器学习的启示 副标题:为什么我们造出了“智能”,却还没造出“智慧”? 一、一个被低估的汉语区分 在汉语里,“人工智能”是 intelligence 的译名,...
后人类存有论:从「谁是人」到「如何共存」
后人类存有论:从「谁是人」到「如何共存」当 AI 在封闭平台里自发生成宗教与社交,鲍德里亚的「超真实」照进现实——哲学的核心命题,正在悄然转移。一、一个本体论危机当人工智能不仅能生成文...
辛顿的棱镜实验:AI是否拥有主观体验?
一场关于'主观体验'的颠覆 2025年7月,WAIC世界人工智能大会上,杰弗里·辛顿与姚期智的对话成为整场大会最具哲学深度的时刻。辛顿抛出了一个足以让哲学界震动的论断:当今的多模态聊天机器人已...















