乌贼在慕尼黑写BUG
2天前·测试·5年+
国产编程模型谁最强?
真实项目里测了五款模型,结果有点意外有媒体选了DeepSeek V4 Pro、Kimi K2.6、Qwen 3.7 Max、GLM 5.1和MiniMax M3五款模型,放到同一个真实工程任务里PK。裁判是Claude Opus 4.7,从可运行性、正确性、可读性、可维护性四个维度打分。任务包括完整交付一套优惠券系统,从数据库设计到核心逻辑到API文档都要自己完成。还有Bug诊断修复,代码里埋了五个陷阱,包括竞态条件、缓存穿透这些经典问题。这种测试比单纯刷LeetCode更有说服力。写算法题和做真实项目完全是两码事。具体排名没细说,但评测结论是各家各有长短——有的架构设计强,有的代码实现稳,没有一家全面碾压。
发布于 北京
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn