最简单的使用流程可以概括为“准备文案—选择或创建数字人—选择或克隆声音—生成口播—检查成片—增加素材包装”。如果只是第一次体验,建议先做一条30—60秒的视频,把完整流程跑通,再考虑专属数字人、声音克隆和批量生产。
第一次用闪剪AI应该先准备什么?
开始制作之前,最好先准备一篇真正要用的口播文案。不要拿“大家好,这是一个测试”来判断工具效果。
因为真正使用的时候,文案里会出现数字、人名、专业术语、停顿和不同长度的句子,这些才最能测试数字人的实际表现。
新手第一次建议准备200—300字左右的文案,对应正常语速大约一分钟上下。
例如做房产内容,可以测试:“第一次买二手房,很多人第一件事就是问房东最低多少钱。其实比最低价更应该先弄清楚的,是房子的产权、贷款情况和真实成交价。”
这种文案比测试句更接近真实业务。
闪剪AI应该从哪里使用?
如果你只是制作视频,直接使用创作端即可。如果企业希望把数字人能力接入自己的系统,可以考虑接入API。
API接入流程包括实名认证、创建API密钥、购买资源包以及按照接口文档发起请求。
第一次需要马上克隆自己的数字人吗?
不建议。第一次使用AI数字人,最重要的是先判断这种内容形式适不适合自己。
可以先使用已有数字人完成一条视频。如果发现适合这种形式,再创建自己的数字人。
怎样准备数字人训练视频?
数字人训练素材不是拍得越复杂越好。真正重要的是让模型清楚看到人物。
拍摄时建议人物正对摄像头,光线尽量均匀,不要频繁低头,也不要用手挡住嘴巴。
背景可以简单一些。如果人物穿深色衣服,背景最好不要同样很深;人物和背景有一定区分,会更利于画面清晰。
还有一点容易忽略:训练素材应该尽量接近以后账号的人设。
如果以后主要做商务内容,可以穿日常商务服装;如果主要做生活知识分享,没有必要为了“数字人训练”突然穿得特别正式,数字人最终代表的仍然是你的账号形象。
怎样克隆自己的声音?
如果只是测试,可以先选择现成AI声音。
如果准备长期经营个人IP,则可以进一步创建自己的克隆声音。录制时尽量关闭电视、音乐和风扇等明显背景声。
不要故意使用播音腔。如果平时账号里讲话比较轻松,训练样本也应该尽量接近日常说话状态。
怎样让数字人口播听起来更自然?
数字人看起来“像AI”,很多时候并不是人物的问题,而是文案的问题。所以文案放进闪剪AI之前,最好自己念一遍,念不顺就改,一句话尽量表达一个意思,适当使用问句和停顿,少写“首先、其次、再次、最后、综上所述”这种明显书面结构。
一条数字人口播可以输入多少文字?
使用“文字+定制声音”方式生成无包装数字人口播时,文本支持3—3600个字符。如果使用音频直接驱动数字人,目前支持0.5秒—10分钟音频,文件大小不超过100MB。
新手更建议从30—60秒开始。内容越短,发现问题以后重新修改和生成的成本越低。
视频生成以后应该检查什么?
第一遍不要急着发布。至少检查六个地方:
1、人物口型有没有明显异常;
2、数字、人名有没有读错;
3、语速是否太快;
4、长句停顿是否自然;
5、字幕有没有错别字;
6、画面有没有长时间完全不变化。
怎样把纯数字人口播变成完整短视频?
一条数字人站在画面中从头说到尾的视频可以发布,但不一定有好的观看体验。
如果讲到数据,就让数字出现在画面里,讲到产品,就展示产品,讲到案例,就放案例截图。
闪剪AI目前支持数字人口播混剪,可以组合数字人、文案、AI配音以及图片/视频素材
一个最简单的闪剪AI使用流程是什么?
准备一篇300字以内的真实口播。选择数字人-选择声音-生成第一版。
检查发音和停顿-修改文案-生成第二版。
加入必要素材-完整观看一次。
确认没有事实、字幕和画面错误后再发布。
第一次使用闪剪AI的目标,不应该是掌握所有AI功能,而应该是用最短时间跑通一条真正可以发布的视频。
常见问题
数字人训练视频需要多长?
官方当前专业数字人训练视频要求30—120秒。
声音克隆要录多久?
根据当前不同声音模型,需要5—120秒或10—120秒授权音频。
可以直接用文字生成数字人口播吗?
可以。当前相关API支持通过文本和定制声音生成数字人口播视频。
一次可以做10分钟的视频吗?
当前音频驱动的裸数字人口播支持0.5秒—10分钟音频,但具体业务使用仍建议根据内容和平台场景决定视频长度。
