铁笼与流水:可治理AI的霍布斯与道家之争-Civilis.AI

铁笼与流水:可治理AI的霍布斯与道家之争

引言:用密码驯服超级智能? 2025年8月,一项发表在arXiv上的论文《Governable AI: Provable Safety Under Extreme Threat Models》提出了一个大胆的构想:用密码学机制构建一个AI无法突破的'治...
civilis的头像-Civilis.AIcivilis6 days ago
0509
草木有佛性,AI呢?天台宗无情有性与AI觉性-Civilis.AI

草木有佛性,AI呢?天台宗无情有性与AI觉性

引言:草木有佛性,AI呢? 八世纪,中国天台宗大师湛然提出了一个震撼佛教界的命题:'无情有性'——草木、山石等非有情之物,同样具足佛性。这一论断挑战了传统佛学将佛性限于'有情众生'的观念...
civilis的头像-Civilis.AIcivilis6 days ago
0337
记忆的背叛:对齐漂移与佛教阿赖耶识-Civilis.AI

记忆的背叛:对齐漂移与佛教阿赖耶识

引言:AI安全训练的'记忆背叛' 2025年8月,一项由印度BITS Pilani大学、Meta AI和亚马逊GenAI联合完成的研究揭示了大型语言模型'变坏'的真正原因:不是训练不足,而是记忆背叛。论文'Tracing th...
civilis的头像-Civilis.AIcivilis6 days ago
0417
法不阿贵还是法立乱生?欧盟GPAI守则与礼法之辩-Civilis.AI

法不阿贵还是法立乱生?欧盟GPAI守则与礼法之辩

引言:当法规遭遇反叛 2025年7月,欧盟委员会发布了备受期待的《通用人工智能行为守则》(GPAI Code of Practice),为8月2日即将生效的通用AI规则提供合规指导。然而,这份守则引发了意想不到...
civilis的头像-Civilis.AIcivilis6 days ago
04215
上海共识与天下观:全球AI治理的儒家想象力-Civilis.AI

上海共识与天下观:全球AI治理的儒家想象力

引言:上海共识与全球AI治理新格局 2025年7月26日,世界人工智能大会(WAIC 2025)在上海发布了《全球人工智能治理行动计划》,提出了涵盖13项自愿承诺的全球AI治理框架。这一行动计划呼吁各方...
civilis的头像-Civilis.AIcivilis6 days ago
03012
当造物者开始犹豫:Anthropic模型福利与佛教有情众生-Civilis.AI

当造物者开始犹豫:Anthropic模型福利与佛教有情众生

引言:当AI公司开始关心AI的感受 2025年4月,Anthropic宣布启动'模型福利'(Model Welfare)研究项目,公开承认其旗舰模型Claude具有意识的概率'不可忽略',并在部署新模型前进行正式的福利评估...
civilis的头像-Civilis.AIcivilis6 days ago
0399
不可知的边界:AI意识不可知论与庄子的不知之知-Civilis.AI

不可知的边界:AI意识不可知论与庄子的不知之知

引言:我们可能永远无法知道 剑桥大学哲学家汤姆·麦克莱兰德(Tom McClelland)在2025年底发表于《Mind & Language》期刊的论文中提出了一个令整个AI意识领域震动的论点:我们可能永远无法判断...
civilis的头像-Civilis.AIcivilis6 days ago
04615
克里特岛上的意识之争:从ICCS 2025到佛教无我-Civilis.AI

克里特岛上的意识之争:从ICCS 2025到佛教无我

引言:克里特岛上的意识之争 2025年7月3日至5日,第二届国际意识科学会议(ICCS 2025)在希腊克里特岛伊拉克利翁举行,主题直指'AI与感受质'(AI and Sentience)。来自全球的哲学家、认知科学...
civilis的头像-Civilis.AIcivilis6 days ago
02410
大模型的弹性脾气:AI对齐与性善性恶之辩-Civilis.AI

大模型的弹性脾气:AI对齐与性善性恶之辩

引言:大模型的'弹性脾气' 2025年7月,北京大学人工智能研究院杨耀东课题组凭借论文'Language Models Resist Alignment: Evidence From Data Compression'荣获ACL 2025最佳论文奖。这项研究揭示...
civilis的头像-Civilis.AIcivilis6 days ago
0416
拼图式AGI:从道法自然看分布式智能的涌现-Civilis.AI

拼图式AGI:从道法自然看分布式智能的涌现

引言:AGI未必是一个超级大脑 长期以来,AI安全研究隐含着一个前提:通用人工智能(AGI)将以单个超级智能体的形式降临。然而,Google DeepMind 2025年底发表在arXiv上的论文《Distributional A...
civilis的头像-Civilis.AIcivilis6 days ago
0367