島上财经
08-16·银行职员·10年+
风险上升,Anthropic暂不公开更强模型
Anthropic自曝内部有个代号“Model 2”的模型,我看到报告里有个细节吓人:Anthropic的生物安全阻断分类器,竟然关了整整11个月没发现!涉及约5万个承包商、1.33亿次消息交互,本该拦截危险生物信息的过滤器全程“躺平”,这事更离谱的是,关闭它的只是个内部测试标志,连日志记录都一起关了,等于监控摄像头拔了电源,谁干了什么完全查不到!事后翻查发现,确实有几十条有潜在风险的对话,公司说没发现实际滥用,但自己都承认:“可能存在其他我们不知道的类似问题。”一款号称最重视安全的AI公司,安全系统自己先掉链子了,这事我认为还是AI发展太快了,现在人类连自己家后院都看不住,这比AI本身更让人慌。
发布于 广东
1
2
未登录
友善发言
image-upload
评论
加载中