靠谱阿无
08-14·AI领域创作者
GPT-5.6 Terra
AI第一线
Gemini新Flash半价实测
谷歌急了:3周发一版,价格直接腰斩
3周前才发3.6 Flash,谷歌又端上了3.7 Flash。不是小修小补,是软件工程跑分从49%干到65.3%,网页开发Elo从1538拉到1588,企业自动化直接翻倍——17%变30.4%。部分Coding测试里,已经能把Claude Sonnet 5和GPT-5.6 Terra按在地上摩擦。更狠的是价格。输入0.75刀/百万Token,输出3.75刀。上一代原价的一半。三周一更,能力往上拱,价格往下砍。这节奏不像发模型,像搞双十一。背后原因不难猜。谷歌联合创始人Sergey Brin最近几个月一直在给团队施压。今年4月内部会上直接要求加速,把资源砸向Gemini。旗舰模型延期了,算力紧、内部分歧大、流程慢——Coding这种后来被证明最关键的能力,之前居然没拿到足够资源。于是Demis Hassabis转去当主席,Koray Kavukcuoglu拿到最终决定权。3.7 Flash成了新官上任第一把火。DeepMind的权力终被收编……但真正有意思的不是内斗,是打法变了。以前谷歌跟OpenAI、Anthropic拼旗舰,比谁更聪明。现在旗舰没按时出来,就换条路:不跟你比谁单次更猛,比谁天天在线、便宜、能干长活。Agent时代,调用量是聊天场景的几百倍。一个每天跑几百万次工作流的模型,每百万Token省几块钱,一年就是天文数字。Flash本来就是"便宜大碗",现在碗没变小,菜还变好了。配合Nano Banana做3D游戏、调度多个sub-agent写网页、连机器人训练都塞进来了。写代码、跑流程、做设计——Flash的工种在快速变多。Gemini Spark个人Agent今天起也换上3.7 Flash,Workspace里的文件整理、邮件起草全接上了。旗舰暂时追不上,就用高频迭代+低价+谷歌全家桶(Workspace、Cloud、Android)抢真实生产环境。这招算盘打得响:你憋三个月出个Pro,我三周出个Flash,性能涨一截、价格砍一半,直接塞进几亿人的工作流里。用户用着用着就离不开了,到时候旗舰再补位也不迟。无奈也好,务实也罢,谷歌这波操作至少说明一件事——模型竞赛的胜负手,正在从"谁更聪明"转向"谁更能干活、更便宜地干活"。Flash这把火,烧的不是参数,是成本线。
发布于 安徽
分享
评论
未登录
友善发言
image-upload
评论
加载中