微学AI
07-19·AI领域创作者
Codex和Claude写代码谁强?
Codex 赢得理直气壮
Terminal-Bench 2.0 这条榜单我一直觉得被低估了。它测的是纯终端工作流——写脚本、调系统、搞 DevOps,正是这俩工具的主场。Codex CLI 77.3%,Claude Code 65.4%,差了 12 个点。这不是巧合。OpenAI 把 Codex 的执行模型做成云沙箱 + 原生并行,最多 8 个独立 agent 同时跑,默认禁网、隔离执行,误操作不会炸本地;Claude Code 是本地直接读写文件,我亲眼见过它擅自降级框架版本、还偷偷 git push 了一次,吓得我现在都用受限模式 + 一堆 hook 拦着。Terminal-Bench 的高分不是白拿的——Codex 的行为更可预测,这对生产环境比"更聪明"重要得多。社区里有句话我特别认同:Claude Code 像个资深工程师,想得透、改得慢、要盯着;Codex 像个能干的实习生,跑得快、话不多、偶尔返工。凌晨三点让它自己改线上脚本,我宁愿派那个实习生。
发布于 福建
分享
评论
未登录
友善发言
image-upload
评论
加载中