时间全部时间
2026 年30
2025 年48
所属全部所属

2026 年 9 月 2

2026 年 8 月 7

2026 年 7 月 5

2026 年 6 月 3

Bernini-R字节跳动 · Bernini

字节的视频生成渲染器,先用语义规划把「要发生什么」排好再交给扩散渲染,复杂多主体场景更稳。

HuggingFace ↗

2026 年 5 月 5

NAVA百度 ERNIE 团队 · NAVA

百度 6.3B 的音视频生成模型,把口型、音效与画面同步做进同一套权重,音画对齐是它的核心卖点。

HuggingFace ↗GitHub ↗

2026 年 4 月 1

2026 年 3 月 4

VOIDNetflix · VOID

Netflix 开源的视频物体擦除模型,连物体删掉后引发的物理连锁变化一起重绘,是目前最会「擦」的开源视频模型。

HuggingFace ↗GitHub ↗

2026 年 1 月 3

2025 年 12 月 5

2025 年 11 月 4

BindWeave字节跳动 ByteDance · BindWeave

让多个主体在复杂空间关系与时间逻辑下保持一致,明显缓解多主体视频里的语义漂移。

HuggingFace ↗

2025 年 10 月 5

Video-As-Prompt字节跳动 ByteDance · VAP

把一段参考视频当成「提示词」来做统一语义控制,不用按任务重训就能迁移运动、风格与主体语义。

HuggingFace ↗

2025 年 9 月 6

Lynx字节跳动 ByteDance · Lynx

字节从单张人像生成个性化视频的方案,用轻量身份适配器守住人脸一致性,另配 24fps 的 Lite 版本。

HuggingFace ↗GitHub ↗
HuMo字节跳动 ByteDance · HuMo

字节的人本视频模型,同时吃文本、参考图和音频,音画同步与主体身份保持是它的重点。

HuggingFace ↗

2025 年 8 月 4

2025 年 7 月 4

2025 年 5 月 5

2025 年 4 月 5

2025 年 3 月 4

2025 年 2 月 5

2025 年 1 月 1