七夜zippoe
08-16·AI领域创作者
风险上升,Anthropic暂不公开更强模型
今天看见Anthropic官宣,因为风险上升暂时不公开更强的下一代模型,身边做大模型对齐的同事直接感慨,海外头部厂终于也开始踩刹车了。前两个月大家都在疯狂卷参数堆性能,恨不得一周就出一个比GPT更强的新模型,现在回过神来才发现,AI生成深度伪造、恶意代码的风险已经快兜不住了。之前就有人用没对齐好的大模型批量生成诈骗话术,坑了好多普通人。现在国内同行也都在嘀咕,以后大模型的公开节奏肯定要慢下来,不会再像之前那样卷着炫技放新模型了。对我们打工人来说反而是好事,之前为了赶新模型上线连轴转,天天熬到大半夜做对齐标注,现在不用赶无意义的KPI,反而能沉下心把模型的安全细节磨到位,不用天天担心自己做的模型流出之后出安全事故担责任。
发布于 山西
1
评论
未登录
友善发言
image-upload
评论
加载中