EchoVideoAIGC字节跳动 ByteDance2025-02-27模型简介字节开源的身份保持人像视频模型,一张照片加文本就能生成人物视频,重点解决语义冲突与生硬贴脸。HuggingFace ↗GitHub ↗论文 ↗输出类型生视频架构DiT + 多模态特征融合(基于 CogVideoX-5B 主干)参数量5B所属EchoVideo商用不可商用许可CC BY-NC 4.0发布2025-02-27收录2026-10-03