OviAIGCCharacter AI2025-09-30模型简介把画面与声音放进同一次生成过程的双塔模型,音效、音乐与口型天然同步,不用再事后对齐。HuggingFace ↗GitHub ↗论文 ↗输出类型生视频架构双塔 DiT(视频 5B + 音频 5B + 1B 融合)参数量11.7B所属Ovi商用可商用许可Apache-2.0发布2025-09-30收录2026-10-03