暗物志
06-23·AI领域创作者
GPT-5.5
GPT-5.5 vs DeepSeek V4,谁更夯?
算法5年,GPT5.5真输Claude
去年做分类模型。月 2000 万条文本要 LLM 标注。老板让三家跑 7 天。我信 OpenAI 是天花板。本以为 GPT5.5 像 3.5 时代稳赢。跑下来 Claude 三维度反超。延迟 GPT5.5 均 1.2 秒。Claude 0.8。DeepSeek 0.5。GPT5.5 偶发 3 秒尖刺。Claude 稳 0.7 到 0.9。64k 合同摘要。GPT5.5 到 32k 准确率掉 71%。Claude 128k 稳 89%。DeepSeek 64k 82%。工具调用链。GPT5.5 第 3 轮开始漂。召回 0.82。Claude 稳 0.95。DeepSeek 0.91。唯一 GPT5.5 赢英文。中文三家够用。Claude 处理长中文合同最稳。跑分录了屏。分数卡贴飞书。要速度选 DeepSeek。要稳选 Claude。做算法 5 年。第一次觉得 OpenAI 不是默认答案。#算法工程师 #GPT5.5 #Claude #DeepSeek
发布于 内蒙古
分享
评论
未登录
友善发言
image-upload
评论
加载中