微学AI
06-25·AI领域创作者
现在的GPT-5.5是不是更懂你的需求了?
GPT-5.5
百万token这次真能用
昨晚把整个项目的代码(差不多80万行)一次性塞进GPT-5.5的对话框,让它帮我找出三个模块之间的循环依赖。说实话,之前用5.4的时候根本不敢这么玩——5.4在1M token时Graphwalks BFS召回率只有9.4%,基本等于放进去就忘。但5.5不一样,官方数据说同样测试它能到45.4%,MRCR v2 8-needle在1M长度下还保持74%召回。体感上确实是质的差别:它居然精准指出A服务调用B服务时一个隐藏的版本号不匹配问题,这个bug我之前在review里翻了两天都没发现。Terminal-Bench 2.0上5.5拿到82.7%,比5.4的75.1%高了7.6个百分点,是当前SOTA。我最大的感受是:1M上下文这件事,从"能塞下"到"真能用",GPT-5.5才算把路走通了。
发布于 福建
分享
评论
未登录
友善发言
image-upload
评论
加载中