AI数字人音视频制作操作说明书 - 九宸智能

完整介绍平台登录、数字人与音色克隆、AI 文案创作、素材匹配、七步成片、视频导出发布、算力计费及合规规范。

文档说明 本文档依据《数字员工短视频创作平台培训会议》内容编制,面向平台使用人员,完整覆盖系统登录、数字人/音色克隆、AI 文案创作、多模态素材匹配、视频全流程编辑、合规发布、算力计费全套操作步骤,适用于企业运营、内容创作人员日常 AI 数字人短视频生产。 一、系统登录与平台整体架构 1.1 双入口登录方式(免重复登录) 平台提供两种访问渠道,账号互通,无需二次验证: 域名直登: 浏览器访问 https://agent.9czn.cn/video/ ,输入企业分配的账号、密码直接进入。 图 1-1:通过专属域名登录短视频创作平台 平台跳转: 登录数字员工总平台,依次进入左侧菜单【应用管理】→【短视频创作平台】,即可无缝跳转。 图 1-2:从数字员工总平台进入短视频创作平台 1.2 平台两大核心功能分区 登录后首页分为两大独立模块,所有音视频制作操作均在以下板块完成: 数字人管理模块: 数字人形象克隆、音色克隆、人物素材资产管理。 视频编辑工作台模块: 完整 7 步成片流程:文案 → 声音 → 数字人 → 分镜头 → 字幕 → 背景音乐 → 参数设置。 二、数字人形象与音色克隆操作 2.1 数字人形象克隆建模 进入【数字人管理】→【新建数字人】,填写数字人相关信息。 图 2-1:等待内容回显后点击【创建数字人】 图 2-2:创建数字人信息填写页面 点击上传区域,从电脑中选择约 30 秒的正脸自拍视频。 图 2-3:上传数字人建模视频 素材拍摄硬性标准: 不符合要求可能导致建模失真或人脸漂移。 镜头稳定,无大幅度远近推拉。 室内自然光,无逆光或强光直射面部。 全程正面看向镜头,头部可小幅自然活动。 上传后点击【提交生成】,等待 1~3 分钟完成数字人建模。 图 2-4:确认素材后提交数字人建模 建模完成后预览形象,确认无误后保存至个人数字人素材库,视频制作时可直接选用。 也可直接选择系统提供的数字人形象使用。 图 2-5:选择已克隆或系统提供的数字人 2.2 专属声音管理 进入【数字人管理】中的【声音管理】,点击【添加】。 图 2-6:进入声音管理并添加专属声音 选择以下任一种素材录入方式: 线上实时录制: 点击录制按钮,连续朗读 15 秒标准口播文稿。 本地上传: 上传 15 秒清晰、无杂音的人声音频。 图 2-7:录制或上传音色训练素材 系统提取声纹并完成音色训练。 点击【保存】,设置音色名称;可将其标记为默认音色,后续数字人视频可一键调用。 图 2-8:音色训练完成后试听与配置 图 2-9:填写音色名称并保存 三、AI 智能文案创作 3.1 全网热点定向追踪 在工作台首页进入【热点追踪】→【实时追踪】。平台自动聚合抖音、知乎、微博等实时榜单,并按小时更新。 图 3-1:查看全网实时热点 点击【添加】,输入自定义关键词(如 AI、行业产品、品牌词),系统将自动筛选匹配行业相关热点。 图 3-2:添加自定义热点关键词 图 3-3:查看关键词匹配的热点内容 3.2 AI 结构化口播文案生成 图 3-4:进入视频工作台并点击【AI 帮写】 选中目标热点,点击【生成口播文案】,调用“口播文案大师”智能体。 系统自动输出标准化短视频脚本,采用三段式结构: 钩子开头: 抓住用户注意力并提高停留。 正文: 呈现产品或资讯核心内容。 CTA 行动引导: 引导互动、咨询或转化。 支持人工二次修改、增减字数。修改后保存至文案库,可直接同步至视频工作台。 四、多模态素材匹配 4.1 企业素材库管理 在素材库上传企业自有图片、产品实拍和案例视频。 图 4-1:管理企业自有图片与视频素材 点击素材上的【编辑】,可手动添加标签并结合 AI 自动语义打标,便于后续精准匹配。 图 4-2:为素材补充标签与描述 4.2 四层素材自动降级匹配逻辑 图 4-3:工作台中的素材自动匹配区域 图 4-4:查看已匹配的分镜素材 编辑分镜头时,系统按以下优先级自动填充画面,无需逐条手动查找: 一级: 企业自有素材库(无版权风险,优先使用)。 二级: 平台商用版权图库 AI 检索。 三级: AI 文生图,根据文案关键词生成配图。 四级: AI 文生短视频,生成动态画面素材。 五、视频编辑工作台 7 步完整成片流程 步骤 1:文案导入 从素材库选择 AI 生成的口播文案,点击【编辑】后进入视频工作台,并可根据已选热点新闻生成文案。 图 5-1:在热点列表中进入文案编辑 图 5-2:调用智能体生成口播文案 文案生成后,点击文章内容末尾的【应用】,即可一键将内容写入工作台文案。 图 5-3:查看生成的口播文案 图 5-4:点击【应用】写入视频工作台 图 5-5:确认并编辑口播文案 步骤 2:声音配置 选择已克隆的个人音色,调节语速与情绪,并预览人声朗读效果。 图 5-6:选择口播声音 图 5-7:配置声音并试听 步骤 3:数字人绑定 从素材库选择已克隆的数字人形象,并设置人物大小与画面位置。 图 5-8:绑定数字人形象 步骤 4:分镜头编排 系统根据文案自动拆分镜头,可手动切换素材并调整镜头切换时长。 图 5-9:检查和调整分镜头 步骤 5:字幕自动生成 系统根据人声同步识别生成字幕,支持修改字体、大小、颜色和位置。 图 5-10:配置字幕样式 步骤 6:背景音乐匹配 选择匹配短视频风格的 BGM,并调节背景音乐与人声音量比例。 图 5-11:选择背景音乐并调节音量 步骤 7:参数设置 设置视频分辨率、画面比例(9:16 竖屏或 16:9 横屏)和输出画质,确认后点击【一键生成视频】。 图 5-12:确认参数并生成视频 六、视频导出、二次编辑与跨平台发布 6.1 两种视频导出方式 图 6-1:进入【发布管理/作品管理】查看作品导出信息 本地标准视频文件: 直接导出 MP4 文件并保存到本地。 剪映草稿文件导出(合规优化推荐): 生成剪映专用草稿文件,导入剪映后可继续微调音量、画面和配乐,降低平台 AI 内容审核拦截风险。 6.2 一键跨平台自动发布 图 6-2:查看发布状态并执行【立即发布】 在电脑上安装平台配套的本地发布客户端。 在工作台选中成品视频,勾选需要发布的渠道:抖音、B 站、小红书。 批量填写标题、话题标签和简介。 点击【一键发布】,系统自动完成多平台上传并提交审核。 七、算力计费与后台账户操作 计费模式: 企业统一储值账户,按实际功能用量扣除算力点。 兑换比例: 储值金额与算力积分汇率为 1:1000。 后台入口: 企业管理员进入【账户中心】,可完成充值及算力消耗明细查询。 后续版本规划: 平台将打通 AI 热点宝接口,实现播放、点赞、浏览等发布数据实时回查。 八、合规发布核心规范 以下规范必须遵守,以降低视频下架和合规风险: 数字人、音色仅限本人或已获明确授权的对象使用,禁止深度伪造他人肖像、人声。 素材优先使用企业自有资源,减少 AI 生图或生视频占比,规避版权纠纷。 AI 生成视频建议导出剪映草稿进行二次微调,弱化纯 AI 生成特征。 热点文案不得搬运他人原创内容,应使用平台智能重构脚本。 发布内容不得包含虚假宣传或违规资讯,所有视频均支持后台溯源存档。 九、常见问题简易排查 数字人建模人脸扭曲: 重拍约 30 秒稳定正脸视频,确保光线均匀。 音色朗读口齿不清: 重新录制约 15 秒清晰、无杂音的人声。 视频生成算力扣费异常: 联系管理员查看账户消耗明细。 发布平台审核驳回: 导出剪映草稿二次编辑后重新发布。