Wan2.2-S2V-14B

AIGC阿里巴巴通义万相

模型简介

万相的语音驱动视频模型,音频加一张图就能生成分钟级的说话视频,长时序稳定性是重点。

输出类型
生视频
架构
DiT(音频驱动视频)
参数量
16.3B
所属
Wan
商用
可商用
许可
Apache-2.0
发布
2025-08-26
收录
2026-10-03