Shamater
08-09·AI领域创作者
AI创作者AMA知无不言
蚂蚁Ling-3.0-f这波是来掀桌子的
蚂蚁旗下百灵大模型开源了 Ling-3.0-flash,第一反应就是:这定价简直是来掀桌子抢市场的。咱们先看硬指标。124B总参数、5.1B激活参数的MoE架构,这体量不小了。但真正狠的是它的性价比。在Artificial Analysis的榜单里,它直接杀进了“智能水平—任务成本”和“智能水平—任务耗时”的双优势区。啥概念?单次任务成本只要0.04美元(约0.27元人民币),输出速度还能跑到353 tokens/s。对比那些动辄几块钱一次的闭源模型,这简直是“拼多多价买旗舰性能”。再看落地策略,蚂蚁这次考虑得相当接地气。想要快?直接调API;数据敏感不能出域?给你MXFP4和INT4版本做单机私有化,哪怕是一台DGX Spark都能跑;要高性能?端到端推理速度突破1100 tokens/s。从云到端,全给包圆了。而且现在还有2.5折限时优惠,输入百万tokens才几分钱到一毛多。对于搞Agent应用、或者需要大规模并发调用的团队来说,这成本压缩空间太大了。以前国产大模型开源,大家还在卷参数、卷榜单。现在Ling-3.0-flash直接把战场拉到了“极致性价比”和“工程易用性”上。这种既开源又便宜,还能本地跑的大模型,确实给开发者省了不少真金白银。要是你在做AI应用开发,这种“小显存也能跑大模型、低成本还能高性能”的方案,是不是很难不心动?
发布于 湖北
4
2
2
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn