微学AI
07-13·AI领域创作者
GPT-5.6 Sol
Claude Fable 5
GPT-5.6 Luna
阶跃星辰AI手机,日常办公好用吗?
GPT-5.5
Qwen3.7
Flash的速度神话,办公到底香在哪
做技术的同学都在聊阶跃的MoE架构, 196B总参数、11B激活 ,每次推理只算5.6%的参数,理论速度能到400 tokens/s——Artificial Analysis实测主流榜第一的409 tokens/s。 但这数字对普通办公用户有啥意义 ?我说说自己的体验。我日常用App生成周报、邮件润色、翻译外文报告。Dense架构的国产模型生成1500字周报大概要18–22秒,阶跃AI接的Step 3.7 Flash, 同样长度的内容7–8秒就出 ——体感上从"等一下"变成"立刻有",对节奏紧凑的会议纪要场景非常友好。三档推理强度(low/medium/high)也很实用:摘要、改写用low几乎无延迟;复杂方案规划切high,Step 3.7 Flash工具调用能力稳,多步任务分解不掉链子。但要客观说一句: 速度榜第一≠能力榜第一 。AI Benchy上Step 3.7 Flash(low)综合分7.7排第49,GPT-5.6 Luna(medium)7.6排第54——Step速度更慢但成本更便宜、能力稍强一点。在AA综合智力榜上,前列仍是Claude Fable 5(60分)、GPT-5.6 Sol系列,阶跃的旗舰综合分还在追赶。 所以阶跃的策略很聪明:不和你拼绝对智力,拼"Agent可用速度" ——办公场景里这恰恰是更稀缺的指标。OpenRouter上周调用量1.55万亿Token排第九,是首次上榜就进前十的水平——开发者用脚投票,比榜单更能说明生产环境里的真实水位。
发布于 福建
1
评论
1
未登录
友善发言
image-upload
评论
加载中