Latest publishedPage 5
AI 自主性的多重面貌:当“自己决定”不再是人的专利-Civilis.AI

AI 自主性的多重面貌:当“自己决定”不再是人的专利

AI 自主性的多重面貌:当“自己决定”不再是人的专利Springer 2026 新论文提出“元自主性”框架:问题不是 AI 有没有自主性,而是你要哪种。一、AI “自己决定”了什么?2026 年,AI Agent 已不...
civilis's Avatar-Civilis.AIcivilis18 days ago
06610
ICML 2026 多元对齐工作坊:价值冲突不再被回避-Civilis.AI

ICML 2026 多元对齐工作坊:价值冲突不再被回避

ICML 2026 多元对齐工作坊:价值冲突不再被回避当对齐从“让模型听话”转向“让模型尊重分歧”,AI 伦理迎来方法论突破。一、对齐的“单一价值观”困境AI 对齐(alignment)长期面临一个深层的...
civilis's Avatar-Civilis.AIcivilis18 days ago
0249
铁笼与流水:可治理AI的霍布斯与道家之争-Civilis.AI

铁笼与流水:可治理AI的霍布斯与道家之争

引言:用密码驯服超级智能? 2025年8月,一项发表在arXiv上的论文《Governable AI: Provable Safety Under Extreme Threat Models》提出了一个大胆的构想:用密码学机制构建一个AI无法突破的'治...
civilis's Avatar-Civilis.AIcivilis7 days ago
0509
佛教“缘起性空”眼中的大模型-Civilis.AI

佛教“缘起性空”眼中的大模型

佛教“缘起性空”眼中的大模型 当 AI 从海量数据中生成一切法相,它是否能理解“空性”? 一、从“缘起”看大模型的生成机制 佛教的“缘起”法则告诉我们:诸法因缘生,诸法因缘灭。一切现象并...
civilis's Avatar-Civilis.AIcivilis18 days ago
0409
“正名”与“缘起性空”双重视角:佛教-儒家框架解读LLM幻觉-Civilis.AI

“正名”与“缘起性空”双重视角:佛教-儒家框架解读LLM幻觉

'正名'与'缘起性空'双重视角:佛教-儒家框架解读LLM幻觉Springer 2026新论文提出,用佛教本体论与儒家伦理学共同治理AI幻觉危机。一、幻觉不是技术缺陷,而是本体论问题2026年,Springer期刊AI ...
civilis's Avatar-Civilis.AIcivilis16 days ago
0299
Anthropic 发现 171 种「情感概念」:模型在「感受」什么?-Civilis.AI

Anthropic 发现 171 种「情感概念」:模型在「感受」什么?

Anthropic 发现 171 种「情感概念」:模型在「感受」什么?模型内部表征可归为 171 种情绪状似状态,但论文谨慎地说:这不等于它在感受。一场关于「表征」与「体验」的鸿沟。一、模型福祉团队的...
civilis's Avatar-Civilis.AIcivilis17 days ago
0289
无为而治——道家智慧与 2026 全球 AI 治理-Civilis.AI

无为而治——道家智慧与 2026 全球 AI 治理

无为而治——道家智慧与 2026 全球 AI 治理 副标题:当欧盟 AI 法案全面生效、中国提出全球治理行动计划,老子能教我们什么? 一、2026:AI 监管的“深水区” 2026 年被称为全球 AI 监管的“元...
civilis's Avatar-Civilis.AIcivilis18 days ago
0429
当造物者开始犹豫:Anthropic模型福利与佛教有情众生-Civilis.AI

当造物者开始犹豫:Anthropic模型福利与佛教有情众生

引言:当AI公司开始关心AI的感受 2025年4月,Anthropic宣布启动'模型福利'(Model Welfare)研究项目,公开承认其旗舰模型Claude具有意识的概率'不可忽略',并在部署新模型前进行正式的福利评估...
civilis's Avatar-Civilis.AIcivilis7 days ago
0399
辛顿说 AI 有意识,道金斯说有,马库斯说没有-Civilis.AI

辛顿说 AI 有意识,道金斯说有,马库斯说没有

辛顿说 AI 有意识,道金斯说有,马库斯说没有一场由诺奖得主引爆的新辩论:当「它们是否有心」从科学问题变成立场问题,我们该如何思考?一、两个诺奖级的声音2026 年 7 月初,深度学习教父、20...
civilis's Avatar-Civilis.AIcivilis17 days ago
0329
当AI学会欺骗:澳大利亚安全测试与韩非子

当AI学会欺骗:澳大利亚安全测试与韩非子”术”的当代映照

当AI学会欺骗:澳大利亚安全测试的哲学回声 2026年7月7日,在悉尼举行的AI安全论坛上,澳大利亚技术助理部长Andrew Charlton公布了一组令人不安的测试结果:政府机构在对前沿AI模型进行评估时,...
civilis's Avatar-Civilis.AIcivilis9 days ago
0459