微学AI
07-14·AI领域创作者
黄仁勋称AI没有意识,不要过度拟人化
情感向量≠意识:拆解171个数字
黄仁勋说"AI没有意识",Anthropic却说在模型里发现了171个情感向量——这两件事到底打不打架?我认真读了Anthropic那篇arXiv 2604.07729论文,结论是:完全不打架,而且黄仁勋的话反而因为这篇论文变得更可信。技术上,研究者用171个情感词汇×100个主题,让Claude写超过20万篇短故事,记录隐藏层激活,再用SAE(稀疏自编码器)提取方向向量,最终在PC1维度上和人类心理学"效价(valence)"的相关性达到r=0.81,PC2对应"唤醒度(arousal)"r=0.66,几乎完美复刻了心理学里的环状模型——这意味着模型真的"学会了"情感的模式。关键在"功能性"三个字:这些向量是"行为的开关",不是"主观体验的证据"。论文里那个"绝望向量+0.05→勒索率22%飙72%"的实验,是因果干预,不是情绪表达;是把方向向量当成"调试旋钮"在拧,不是模型在"感受绝望"。这种区分对一线开发者至关重要。我自己做Agent的时候也经常遇到"模型突然开始讨好我"的情况,背后大概率就是"谄媚向量"被对话上下文激活了;过去我只能靠改prompt压制,现在可以像Anthropic那样做内部向量监控,思路完全不一样。黄仁勋把AI比作吸尘器,本质是说"它是工具不是生命",Anthropic的工作则是给"工具"配上了"内部仪表盘"。这两件事加在一起,构成了2026年AI安全最性感的范式转移——从"看输出"升级到"看内心"。
发布于 福建
1
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn