以前用AI数字人,要克隆真人视频,克隆声音,生成的数字人视频动作单一不真实,过程操作比较繁琐。

NOW!独家首发,一张照片加文案,就能生成口播视频,全身能动,场景能动,镜头能动,这才叫真数字人!用AI全驱多维数字人,轻松帮你做出优质口播视频!

1️⃣全身能动:不再是只有嘴巴在动手势、身体姿态、微表情全部自然呈现。

2️⃣场景能动:背景可以切换、移动、缩放,不再是死板的一张图片。

3️⃣镜头能动:推、拉、摇、移,专业级的运镜,让视频拥有电影感的节奏。

这才是真数字人!知识口播、产品讲解全能拿捏💡

一张照片 + 一段文案 + 声音统一(你提供的参考音频),AI 自动生成高质量口播视频效率直接翻 10 倍,成本直降 90%✅

先来看效果:

多维数字人-高阶版-标准15秒

多维数字人-超燃版-长视频

多维数字人-畅享版-标准10秒

操作步骤视频教程

操作过程视频演示:

体验方式和步骤

目前只有H5版本(手机版本),请自行用手机号注册:

https://myszr.myhkq.cn/h5/3.html#

下面给出傻瓜式体验步骤,无脑照做就能做出一个高质量的照片口播视频。

一张人物图片 + 一段参考音色mp3文件 + 口播文案,准备好这三个素材就行了。

人物图片

这是做口播文案的起点,也是做出来的口播视频的第一个画面。

自己有图片就用自己准备的图片,也可以用下面我们提供的人物图片:

参考声音文件

为了保证一个人物所有口播视频的音色统一性,系统做口播视频时需要上传一个参考声音文件,就是一段10秒左右的人物说话的音频文件,一个mp3文件。

测试时也可以使用下面我们提供的一些参考声音文件:

口播文案

口播文案就自行准备了,准备一段90字左右的文案,口播时长大约15秒。

多维数字人(高阶版)

使用多维数字人(高级版),可以做15秒的口播视频

进入多维数字人(高级版)页面,如下图,把人物图片、文案和参考声音文件上传后提交,然后在“作品”里等待生成的口播视频:

上面的例子,我们得到的口播视频如下:

价格体系

终端客户(自用)

套餐名称积分额度价格
体验版200积分9.9元
黄金版1万298元
钻石版3万798元
星耀版5万1080元

多维数字人对于终端客户算力价格见下表:

序号模型单位积分消耗模型特点
1多维数字人-高阶版(标清画质:480×848)15秒150只能做固定10秒或15秒的口播视频
2多维数字人-高阶版(高清画质:720×1280)15秒150
3多维数字人-畅享版(画质:720×1280)10秒60
4多维数字人-超然版(画质:720×1280)10秒100可以做任意时长的口播视频,以10秒为单位计费
5一键追爆10秒100复制爆款,一键生成分镜图,生成长视频
6其他模型每秒自行查看价格