当前页面
目录
Vidu 现有ViduQ3、ViduQ2、ViduQ1、Vidu2.0等模型,适用于视频生成、音频生成、音视频直出等多个领域:
模型 | viduq3-pro | viduq3-mix | viduq3-drama | viduq3-ad | viduq3-turbo |
|---|---|---|---|---|---|
介绍 | - 支持音画同出 - 支持智能切镜 - 视频内容更生动、更形象、更立体 | - 均衡性更好,适合普遍场景,一致性和美学持续升级 - 支持音画同出 - 支持智能切镜 | - 漫剧行业模型 - 支持音画同出 - q3系列效果最佳,对话、人物站位、动效和镜头叙事能力强,更擅长影视镜头语言 | - 广告行业模型 - 智能切镜,节奏合理,细节一致性较好,适合5-8s短片广告 | - 支持音画同出 - 支持智能切镜 - 生成速度快 |
清晰度 | 540p、720p, 1080p | 540p、720p, 1080p | 720p、1080p | 720p、1080p | 540p、720p, 1080p |
帧率 | 24fps | 24fps | 24fps | 24fps | 24fps |
时长 | 可选1~16S | 可选1~16S | 可选3~15S | 可选3~15S | 可选1~16S |
图生视频 | ✔️ | - | - | - | ✔️ |
参考生视频 | - | ✔️ | ✔️ | ✔️ | ✔️ |
首尾帧 | ✔️ | - | - | - | ✔️ |
文生视频 | ✔️ | - | - | - | ✔️ |
特效/模版 | - | - | - | - | - |
模型 | viduq2-pro | viduq2 | viduq2-turbo |
|---|---|---|---|
介绍 | - 画面美学效果较好 - 参考生场景下支持视频编辑能力 | - 动态效果好,情绪表达强,细节更丰富 | 新模型,速度快 |
清晰度 | 540p, 720p, 1080p | 540p, 720p, 1080p | 540p, 720p, 1080p |
帧率 | 24fps | 24fps | 24fps |
时长 | 可选1~10S | 可选1~10S | 可选1~10S |
图生视频 | ✔️ | - | ✔️ |
参考生视频 | ✔️ | ✔️ | - |
首尾帧 | ✔️ | - | ✔️ |
文生视频 | - | ✔️ | - |
特效/模版 | - | - | - |
模型 | viduq1 | viduq1-classic |
|---|---|---|
介绍 | 画面清晰 | 运镜丰富稳定 |
清晰度 | 1080p | 1080p |
帧率 | 24fps | 24fps |
时长 | 5S | 5S |
图生视频 | ✔️ | ✔️ |
参考生视频 | ✔️ | - |
首尾帧 | ✔️ | ✔️ |
文生视频 | ✔️ | - |
特效/模版 | - | - |
模型 | vidu2.0 |
|---|---|
介绍 | 生成速度快 |
清晰度 | 360p, 720p, 1080p |
帧率 | 32fps |
时长 | 4S, 8S |
图生视频 | ✔️ |
参考生视频 | ✔️ |
首尾帧 | ✔️ |
文生视频 | - |
特效/模版 | ✔️ |
能力/模型 | 产品介绍 | 产品体验 | API接入 |
|---|---|---|---|
Vidu S1 | 首个能互动、会表演,可双向感知的商业级交互式数字人 |
能力/模型 | viduq2 | viduq1 |
|---|---|---|
文生图 | ✔️ | - |
参考生图 | ✔️ | ✔️ |
图片编辑 | ✔️ | - |
文生图 | ✔️ | - |
特效/模版 | ✔️ | ✔️ |
清晰度 | 1080p、2K、4K | 1080p |
支持图片数量 | 0-7张 | 1-7张 |
比例 | auto、16:9、9:16、1:1、3:4、4:3、21:9、2:3、3:2 | 16:9,9:16,1:1,4:3,3:4 |
能力 | 是否支持 |
|---|---|
文生音频 | ✔️ |
可控文生音效 | ✔️ |
语音合成 | ✔️ |
声音复刻 | ✔️ |
时长 | 2-10S |
能力 | 介绍 |
|---|---|
音乐MV | - 仅需上传1个音乐音频 + 1-7张参考图,搭配歌词/提示词,一键产出完整叙事MV - 自动拆解歌词情节,串联成连贯故事线,镜头与歌词意境高度契合,MV 兼具 “视听感” 与 “故事性” - 告别变速&重复分镜,连贯流畅情节 - 支持风格传参(style举例真人写实、3D 建模、2D 动画等)、人物一致性提升 - 精准还原参考图中的角色外貌、穿搭、气质,以及风格色调、滤镜、场景元素,支持多图风格统一 - 自动实现歌词字幕精准卡点,镜头切换/动作转场贴合音乐鼓点与旋律起伏,同时支持字幕 |
Motion Control | - 背景稳定性显著增强,人物运动表现更清晰流畅 - 针对动物类场景单独调优,支持动物跳舞。 - 加强了特殊角度动作模仿优化,如俯视、仰视。 |
对口型 | 输入文字/音频驱动,生成对口型的视频 |
视频延长 | 延长Vidu视频,可选1~7S |
智能多帧 | 设置多个关键帧生成高质量、长时长视频 |
智能超清-尊享 | 提高视频的分辨率,分别支持1080p、2K、4K |
模版成片 | 拼接多个特效为标准的成片模版 |
推荐提示词 | 根据输入的1-7张图片,推荐出合适的提示词 |
能力 | 介绍 |
|---|---|
一键解说漫 | - AI解说剧快速、批量化生产工具 - 一站式解决解说剧视频制作成本高、ROI低、无法规模化、场景连贯性差四大核心痛点 |
短剧成片 | - ✅角色与场景一致性显著增强 - ✅主体空间位置关系更加稳定,不易错位 - ✅ 动态逻辑自然流畅,镜头切换后连贯性强,剧情演绎更顺滑 - ✅画质与美学效果全面优化 - ✅声画协同让精品剧“视听一体” ,从生成一刻即成片,无需后期配音 - ✅单次最多可规划2-30s、长达 1 分多钟时长内容 |
能力 | 介绍 |
|---|---|
一键广告成片 | - 上传一张/多张图片即可生成一段15-60S任一时长营销投流成片,直接投放,有效获客 - 💡视频贯穿“开头创意吸睛、中间详细展示、结尾引导转化”的逻辑主线,让每一件商品都展示出独一无二的特性 - 💡自动匹配最合适的模特形象,免去没有模特实拍的困扰 - 💡支持多种语言TTS输出,让配音解说适配海内外不同区域 - 💡支持输入商品链接🔗(new) |
一键复刻 | - 【一段】爆款视频+【一张】图片,即可获得一个相似、完整的营销视频 - 多元素模仿,包括运镜、光影、动作等,同时,避免同质化素材产生 - 视频、音频皆可模仿,真正做到爆款复刻 |
剧集广告 | - 适配短视频平台:原生竖屏比例,画面节奏对齐抖音、快手、小红书等平台的观看习惯,导出即用。 - 角色IP建立信任:固定角色反复出现,用户对角色产生情感认同,角色推荐的商品天然带有故事感、信任感,而非广告感。 - 内容留存率高:漫剧有完整叙事,用户追剧习惯带来持续回访,账号粉丝粘性远高于单条带货视频。 - 一键输出长秒数:突破主流视频模型单次最多生成 15 秒的上限,最多支持直出 30 秒完整视频 |
热点广告 | - 【一段】目标卖点+目标商品的描述【一张多张】图片,即可获得一个热点营销视频 - 从营销策略自主规划到30秒长视频直出,agent帮你完成一切 - 抽象热点特效化表达,精准表达热点与卖点 |