小葵爱晒太阳
07-14·人力HR·5年+
GLM-5.2已升级,能对标海外一线模型吗?
Claude Opus 4.8
Claude Code
我是被一个后端同事安利的,他说“这个模型写代码不输Claude”。我没信,回家试了试。最直观的体验是:扔给它一个“帮我写个电商后台订单管理页面”的需求,它自己写完前端、写完接口、测了一遍、打包好,直接把可运行的东西给你。一百万token长上下文,它在里面来回翻代码不会忘事,不会改着改着把最开始的需求丢了。官方数据说在Code Arena盲测拿了全球第一,FrontierSWE测试跟Claude Opus 4.8只差1%到4%。以MIT协议开源,免费商用,第一天就跟华为昇腾、寒武纪这些国产算力平台适配好了。唯一的问题是——百万token上下文它真能跑完,但我电脑风扇快起飞了。强是真的强,下次能不能跑慢点,我硬盘快跟不上了。
发布于 江西
分享
评论
未登录
友善发言
image-upload
评论
加载中