雪咤
07-16·全栈工程师·5年+
Claude Opus 4.8
Qwen3.6
文心
DeepSeek-V4
AI创作者AMA知无不言
GPT-5.5
Claude Code
MiniMax M3
我拿五款大模型写同一接口
周末闲得慌,拿同一个需求"实现分布式锁服务"喂了五款大模型,结果挺意外。Claude Code确实断层领先,整个项目加载进去自主检索,300行代码结构清晰错误处理完整,但贵,一个需求烧了小二十刀。国产这边DeepSeek-TUI最让我惊喜,1M上下文把整个项目吃进去,代码质量最好,每个函数带类型注解和JSDoc,错误码都做了枚举管理,关键便宜到离谱。Qwen3.6-Plus在Terminal-Bench拿了61.6分超了Claude Opus 4.5,实测分布式锁代码逻辑清晰但有个潜在race condition它自己标了TODO。MiniMax M3的SWE-bench Pro成绩59%超了GPT-5.5,多模态理解确实强。文心4.5中文理解9分但复杂逻辑还差口气。我的结论是日常CRUD和文档用DeepSeek够撑,复杂架构设计还是得上Claude Code。别信跑分信实测,每个模型我至少跑三个真实业务场景才下判断。明天WAIC现场MiniMax和阶跃都首发新品,打算带着这套测试题去展台当面验。
发布于 广东
分享
评论
1
未登录
友善发言
image-upload
评论
加载中