微学AI
08-06·AI领域创作者
Seedance和H3,视频生成怎么选?
H3开源那天,我把两条技术路线捋了一遍
H3开源那天我把这两家的技术路线捋了一遍,越看越有意思。H3走的是"全模态":文本、图片、视频、音频一股脑作为整体输入,原生音视频联合生成,输出还是双声道。工程上它用高压缩Tokenizer把token用量压下来,这也是它敢定低价的底气。8月3号权重放出来,昇腾、摩尔线程、海光等九家芯片厂商当天就完成适配,我自己机器上跑也确实能跑。Seedance 2.5走的是控制路线:最多30张图、10段视频、10段音频当参考,还有精准的时间戳控制,几点几秒出什么都给你定好。说白了,这是两种哲学:H3让模型自己消化,Seedance让人把方向盘握死。我用了一周的体感是,H3的上限在模型本身,开源微调能继续往上顶;Seedance的上限在你的提示词和素材组织水平。也得承认,长镜头的物理真实感H3还差头部一截,这是它开源要付出的代价。
发布于 福建
1
评论
1
未登录
友善发言
评论
加载中
下载脉脉APP,成就职业梦想
违法不良信息&未成年人有害信息举报电话/客服电话:400 065 0808
违法不良信息&未成年人有害信息举报邮箱/客服邮箱:maimai@taou.com
清朗系列专项行动相关违规信息举报电话:400 065 0808,举报邮箱:maimai@taou.com
个人/企业等被诽谤侮辱、人身权或知识产权等被侵犯、网络谣言的举报地址:maimai.cn/tousu | 涉企虚假不实信息举报投诉专区
京ICP备12005786号-1copyright©maimai.cn