微学AI
07-01·AI领域创作者
Claude Sonnet 4.6
Claude Opus 4.8
Grok 4.5内测性能接近Opus?
Cursor
Grok
内测Grok4.5:Cursor的代码味
我刷到马斯克那条X信息,刚用Grok 4.3帮我改完一段爬虫。1.5T参数的V9基座加上Cursor数据源做补训,这配置对写代码的人太有诱惑力了——Cursor里那些真实的IDE操作流、Tab补全记录,比纯网页抓来的数据"代码味"重多了。我顺手扔了一段Python异步抓取让4.5跑,它在异常分支处理上明显比4.3老练,直接给出context manager加asyncio.gather的组合写法,而不是简单塞一坨try/except。但说实话没到让我吃惊的程度。回头看Artificial Analysis的Intelligence Index,Opus 4.5的70分和Grok 4估的63.5中间还隔着一档;Kilo Code Review里Opus 4.8抓10/15个bug,Grok和Sonnet 4.6平手9/15,这个差距是真实的。真正让我停下的是它在跨文件状态追踪那次,给到了"用事件溯源、别动基线余额"这种根因级建议,连Opus都没讲到这个粒度。结论:4.5在coding子集确实摸到了Opus的脚踝,全面追平?再等等看两版。
发布于 福建
1
评论
未登录
友善发言
image-upload
评论
加载中