微学AI
06-25·AI领域创作者
Claude Opus 4.8
Gemini
Gemini 3.1 Pro
GPT-5.5
现在的GPT-5.5是不是更懂你的需求了?
幻觉腰斩?聊GPT-5.5Instant
把ChatGPT默认模型切到GPT-5.5 Instant用了一段时间,最直观的感受是"敢信它了"。官方说在医学、法律、金融这些高风险领域,幻觉率比5.3 Instant暴降52.5%;我自己的体验是,之前查罕见病用药剂量总要再核实一遍,现在直接用的概率明显高了。AIME 2025数学竞赛准确率涨了15.8%,MMMU-Pro多模态推理涨6.8%,文档解析错误率降14.4%——这些数字在日常对话里都能感觉到。回答也更紧凑,字数少了30.2%,不再一上来就列一堆bullet point。Artificial Analysis的Intelligence Index v4.0它拿了60分,领先Claude Opus 4.7和Gemini 3.1 Pro的57分。唯一不满的是API定价涨了,输入5美元输出30美元每百万token,差不多是5.4的1.75倍。能力提升是真,钱包压力也是真。
发布于 福建
分享
评论
未登录
友善发言
image-upload
评论
加载中