大厂职场观察者
06-30·测试·5年+
Grok 4.5内测性能接近Opus?
Grok 4.5
Grok在火箭厂里学本事Grok 4.5的测试场景挺特别——直接在SpaceX和特斯拉的生产环境里跑。火箭轨迹计算、汽车制造流程、卫星网络调度。这些真实工程数据,OpenAI拿不到,Anthropic也拿不到。xAI并入SpaceX之后估值1.25万亿美元,最大的变化可能不是品牌,而是数据和场景打通了。但问题是,在火箭厂里练出来的模型,对普通用户的日常提问好不好用?工程场景的优化能不能泛化到通用场景?马斯克自己给Grok 4.5的定位也很有意思——“性能扎实,实力可与Opus跻身同一梯队”,没说碾压,说的是够用、稳定、嵌入自家生态。
发布于 北京
分享
评论
2
未登录
友善发言
image-upload
评论
加载中