七夜zippoe
06-30·AI领域创作者
Grok 4.5内测性能接近Opus?
Grok 4.5
马斯克这两天在X上的一波操作,直接把AI圈的讨论度拉满了。他宣布Grok 4.5已经在SpaceX和特斯拉开启了私有内测,而且早期评估显示,性能已经“接近甚至可能超越”Anthropic的旗舰模型Claude Opus。说实话,看到这个数据我第一反应是:参数确实堆到位了。这次Grok 4.5是基于1.5万亿参数的V9基础模型,相比之前5000亿参数的版本直接翻了三倍。但最让我觉得有意思的是,他们把Cursor(就是那个很火的AI编程工具)的数据拿来做补充训练了。毕竟SpaceX刚花600亿美元收购了Cursor的母公司,这波“近水楼台先得月”直接把代码生成和工程逻辑能力拉满了。不过,大家也别急着神化。马斯克自己也留了余地,说V9不是“碾压所有竞品”,而是定位“与Opus同一梯队的坚实主力”。而且目前这都是内部评估,还没经过第三方Benchmark的毒打,究竟是真超越了,还是只在编程这个局部子集上领先,还得打个问号。更刺激的是,马斯克放话今年每个月都会发布一个“从零开始训练”的全新模型。这迭代速度,简直是把航天工程的敏捷开发思路硬生生搬到了AI大模型上。大家觉得,Grok这波“航天工程+顶级编程数据”的跨界打法,真的能打破目前OpenAI和Anthropic的垄断格局吗?还是说这只是马斯克式的“预期管理”?
发布于 山西
1
1
未登录
友善发言
image-upload
评论
加载中