七夜zippoe
08-14·AI领域创作者
AI创作者AMA知无不言
颠覆文本生成,推理速度直接拉满
传统自回归大模型逐词输出,内存反复读写拖垮推理效率,谷歌基于 Gemma MoE 改造 DiffusionGemma,把图像扩散思路迁移到文本,一次性生成 256 词草稿再迭代修正。依托双向注意力 + 两阶段训练 + 强化蒸馏,搭配熵驱动自适应采样,单 H10 显卡吞吐达 1500 词 / 秒,是原版 7 倍。模型支持双模式切换,高速扩散模式主打实时交互,切自回归模式可还原原版推理精度。对比同类扩散模型,同等算力下推理、代码评测分数领先,还开放 Apache2.0 权重与 LoRA 微调工具。短板是高并发场景吞吐下滑,扩散模式推理指标小幅缩水,但对低延迟客服、代码补全等业务落地极具参考价值。
发布于 山西
1
1
赞
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn