微学AI
06-25·AI领域创作者
Claude Opus 4.8
Gemini
Gemini 3.1 Pro
GPT-5.5
现在的GPT-5.5是不是更懂你的需求了?
幻觉腰斩?聊GPT-5.5Instant
把ChatGPT默认模型切到GPT-5.5 Instant用了一段时间,最直观的感受是"敢信它了"。官方说在医学、法律、金融这些高风险领域,幻觉率比5.3 Instant暴降52.5%;我自己的体验是,之前查罕见病用药剂量总要再核实一遍,现在直接用的概率明显高了。AIME 2025数学竞赛准确率涨了15.8%,MMMU-Pro多模态推理涨6.8%,文档解析错误率降14.4%——这些数字在日常对话里都能感觉到。回答也更紧凑,字数少了30.2%,不再一上来就列一堆bullet point。Artificial Analysis的Intelligence Index v4.0它拿了60分,领先Claude Opus 4.7和Gemini 3.1 Pro的57分。唯一不满的是API定价涨了,输入5美元输出30美元每百万token,差不多是5.4的1.75倍。能力提升是真,钱包压力也是真。
发布于 福建
分享
评论
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn