AI视频音频视频创作

豆包视频生成

豆包发布视频生成大模型

标签：AI视频生成视频生成

链接直达手机查看

豆包发布视频生成大模型。其特性包括高效的DiT融合计算单元、全新设计的扩散模型训练方法和深度优化的Transformer结构，可以实现更充分地压缩编码视频与文本，支持一致性多镜头生成，能够大幅提升视频生成的泛化能力。

豆包视频生成大模型支持多风格多比例的一致性多镜头生成，可应用在电商营销、动画教育、城市文旅、微剧本等领域。

无论是语义理解能力，多个主体运动的复杂交互画面，还是多镜头切换的内容一致性，豆包视频生成大模型均达到业界先进水平。豆包视频生成模型基于 DiT 架构，通过高效的 DiT 融合计算单元，让视频在大动态与运镜中自由切换，拥有变焦、环绕、平摇、缩放、目标跟随等多镜头语言能力。豆包视频生成模型具备专业级光影布局和色彩调和，画面视觉极具美感和真实感。