以前用AI数字人,要克隆真人视频,克隆声音,生成的数字人视频动作单一不真实,过程操作比较繁琐。
NOW!独家首发,一张照片加文案,就能生成口播视频,全身能动,场景能动,镜头能动,这才叫真数字人!用AI全驱多维数字人,轻松帮你做出优质口播视频!

1️⃣全身能动:不再是只有嘴巴在动手势、身体姿态、微表情全部自然呈现。
2️⃣场景能动:背景可以切换、移动、缩放,不再是死板的一张图片。
3️⃣镜头能动:推、拉、摇、移,专业级的运镜,让视频拥有电影感的节奏。
这才是真数字人!知识口播、产品讲解全能拿捏💡
一张照片 + 一段文案 + 声音统一(你提供的参考音频),AI 自动生成高质量口播视频效率直接翻 10 倍,成本直降 90%✅
先来看效果:
多维数字人-高阶版-标准15秒
多维数字人-超燃版-长视频
多维数字人-畅享版-标准10秒
操作步骤视频教程
操作过程视频演示:

体验方式和步骤
目前只有H5版本(手机版本),请自行用手机号注册:
https://myszr.myhkq.cn/h5/3.html#
下面给出傻瓜式体验步骤,无脑照做就能做出一个高质量的照片口播视频。
一张人物图片 + 一段参考音色mp3文件 + 口播文案,准备好这三个素材就行了。
人物图片
这是做口播文案的起点,也是做出来的口播视频的第一个画面。
自己有图片就用自己准备的图片,也可以用下面我们提供的人物图片:


参考声音文件
为了保证一个人物所有口播视频的音色统一性,系统做口播视频时需要上传一个参考声音文件,就是一段10秒左右的人物说话的音频文件,一个mp3文件。
测试时也可以使用下面我们提供的一些参考声音文件:
口播文案
口播文案就自行准备了,准备一段90字左右的文案,口播时长大约15秒。
多维数字人(高阶版)
使用多维数字人(高级版),可以做15秒的口播视频

进入多维数字人(高级版)页面,如下图,把人物图片、文案和参考声音文件上传后提交,然后在“作品”里等待生成的口播视频:

上面的例子,我们得到的口播视频如下:
价格体系
终端客户(自用)
| 套餐名称 | 积分额度 | 价格 |
|---|---|---|
| 体验版 | 200积分 | 9.9元 |
| 黄金版 | 1万 | 298元 |
| 钻石版 | 3万 | 798元 |
| 星耀版 | 5万 | 1080元 |
多维数字人对于终端客户算力价格见下表:
| 序号 | 模型 | 单位 | 积分消耗 | 模型特点 |
| 1 | 多维数字人-高阶版(标清画质:480×848) | 15秒 | 150 | 只能做固定10秒或15秒的口播视频 |
| 2 | 多维数字人-高阶版(高清画质:720×1280) | 15秒 | 150 | |
| 3 | 多维数字人-畅享版(画质:720×1280) | 10秒 | 60 | |
| 4 | 多维数字人-超然版(画质:720×1280) | 10秒 | 100 | 可以做任意时长的口播视频,以10秒为单位计费 |
| 5 | 一键追爆 | 10秒 | 100 | 复制爆款,一键生成分镜图,生成长视频 |
| 6 | 其他模型 | 每秒 | 自行查看价格 |