EchoVideo

AIGC字节跳动 ByteDance

模型简介

字节开源的身份保持人像视频模型,一张照片加文本就能生成人物视频,重点解决语义冲突与生硬贴脸。

输出类型
生视频
架构
DiT + 多模态特征融合(基于 CogVideoX-5B 主干)
参数量
5B
所属
EchoVideo
商用
不可商用
许可
CC BY-NC 4.0
发布
2025-02-27
收录
2026-10-03