① 上传素材
数字分身(人脸 + 人声)只需录制一次,已移到「⚙ 配置」。本步只需上传产品 / 门店 / 场合图。
给每张图选「角色」并写一句备注,AI 会更懂怎么讲(如:门店门头、招牌产品、活动海报)。上传过的图会存入「⚙ 配置 · 素材库」可复用。
⚠ 上传图片请避免包含真人/人脸/模特(火山合规:输入图含真实人物会被隐私审核拒绝)。真人出镜请使用「数字分身」档案。
未选择——生成时仅靠人脸图+克隆音锚定人物。真人样片将作为参考视频增强口型/动作/神态真实度(视频上限 10MB,超限请压缩)。
📋 授权说明(火山合规):已通过真人认证的分身,样片将作为授权素材(asset://)入库后使用——含人脸参考视频官方要求走授权素材,避免被隐私审核拦截;未认证则回落普通视频引用。
② 创作设置
📦 商品讲解模板 (可选,填写后脚本按商品讲解结构生成)
出片画幅;后端按平台规范裁剪并烧录 AIGC 标识。
五维运镜硬约束(留空=不强制,由 AI 导演自由发挥)。
叙事=起承转合、第一人称、结尾留悬念、每段意象画面;搞笑=反差三原则、有梗不低俗。留空=旧行为零变化。
数字人专属:造型按档描述保持跨帧一致,五官脸型仍严格为本人;古风/科技档自动跳过现代全身照参考。留空=旧行为零变化。
等级越高细节越足(受套餐 max_detail_level 上限拦截);数字人自动防护:皮肤词不超 P2 白名单(防老化)。留空=自动档。
数字人专属:作为情绪时间轴基线(示例:思念=眼神柔化、语气放缓、手势减少)。留空=零注入。
显式选择 TOP15 组合模板(脚本5段+运镜节奏+合规一键套用),优先于行业×形态自动匹配。留空=自动匹配。
选择虚拟角色后:脚本/画面/封面全程注入角色外貌与性格设定(形象锁定不漂移);与数字人/造型档互斥(角色自带外貌,真人分身自动不参与);配音建议开启 TTS 并选卡通/萌系音色(真人样音不驱动角色口型,mini 档口型不可达建议 pro/2.5)。留空=旧行为零变化。
固定人设(称呼/关系/性格/口头禅/禁忌/风格),口播语气用词都体现该人设,人设与需求冲突时人设优先。留空=旧行为零变化。
选择本次出片使用的数字分身;默认用当前默认分身。仅列出本厂商(seedance)分身。也可选「🚫 不用数字分身」生成纯产品/门店口播视频。
选 2 位以上已授权数字分身(真人活体素材),画面中多人同框互动、各角色形象严格锁定。需 2.5 引擎(最长 30s);开启后上方「出镜数字分身」单人档不参与。
默认 mini;pro 高清档。tier 收敛在 model_registry.yaml(2.5 引擎无分档)。
按租户权益过滤(/api/tenant/capabilities resolutions);480p 走 2.5 省钱档,720p/1080p 按套餐引擎。
未选 = 常规默认 Seedance 2.0 mini;选 2.5/可灵则本次任务优先于此选择。仅本次任务生效。
first_frame 用参考图作人脸首帧最像本人;reference_image 仅参考风格。
素材底图按封面提示词检索免费图库,封面 0 元且降低画面同质化;数字人场景封面恒为本人首帧,不受此项影响。
模型 BGM 模式成片自带音乐,不再叠加自定义 BGM。
曲库可在「⚙ 配置」上传自有 / CC0 音乐;选曲后会混入出片。
🎨 字幕样式(可选)
影响脚本结尾话术、画面钩子与发布文案 CTA;「无营销引导」适合情感/ASMR/叙事内容。
勾选后跳过后处理(字幕/多平台规格/AIGC 显式标识),母片直出,出片更快;数字人任务不受影响。适合纯画面 / 需急取预览。
③ 预览脚本
📑 与上一版对比(新脚本在上,旧版在下)
④ 生成与下载
出片前审核(请确认真实媒体)
📝 审核内容(脚本 / 分镜 / 封面 / 字幕 / 发布文案)
🖼 封面预览
🎨 封面驱动提示词(cover_prompt)
📚 历史成片
📊 AI PPT
输入主题自动生成结构化大纲,再用本地 Edge 渲染为高清页面 PNG,一键打包下载。
⚙ 配置
密钥仅保存在本机凭据库,绝不上传。
厂商密钥
⚠ 真人素材库要求 volc_ak 与 volc_sk 来自同一个 IAM 访问密钥对。若测试提示 401 不匹配,请到火山控制台「访问控制 IAM → 访问密钥」新建一对,同时复制 AK 与 Secret 原值(Secret 应为控制台弹出的随机串,不要从文档/.env 复制被 base64/hex 包装过的衍生值)。
免费素材库(封面底图零成本分支) 未配置素材库 Key
配置 Pexels / Pixabay API Key 后,新建任务可选「素材底图」作为封面来源(替代 Kling 文生图,封面 0 元且降低画面同质化)。密钥仅存本机/租户密文,不占上方厂商密钥槽位。
数字分身(人脸 + 原声样音)
同一厂商可录制多个分身,列表任选「设为默认」切换;下面的样音可直接试听。
录制数字分身
人脸照 + 人声样音,录制一次即可,此后每次创作自动调用(无需再次上传)。当前为 seedance 模式:人脸作数字人首帧、样音作原声参考(非克隆),均在此存档与预览。
🧍 全身照(可选):双图参考更贴近官方最佳实践——人脸照锁定身份、全身照提供身形/衣著版式参考;不上传则按单图出片。
📋 真人素材要求(火山合规):必须为认证本人的单人正面照,面部清晰、无帽子/口罩/重度美颜;含多张人脸或与认证基准非同一人的素材将无法入库(官方同人比对)。
✨ 磨皮建议:上传前请对出镜人脸照做轻度磨皮(抹平细碎干纹即可,勿动五官/脸型——过度磨皮会导致生成变脸失真)。平台侧默认不处理;管理员可在 model_registry.yaml 开启 feature.face_prep: on 并用 face_prep_strength(0.2~0.5 推荐)微调强度。
BGM 曲库(自有 / CC0,零版权风险)
仅接受你自有或 CC0 的音乐;选曲后会混入出片,显著提升完播率。绝不预置任何版权音乐。
🎙 我的声音(三种音色,各司其职)
① 数字分身·原声样音:Seedance 数字人出片的音色(默认走本人样音,无需克隆声,见上方数字分身卡片);② 视频内克隆声:可灵 Kling 引擎的视频内角色声音(需配置 Kling Key);③ TTS 旁白克隆声:产品图/纯文生视频的旁白音色(火山声音复刻,需配置 huoshan_tts Key)。
克隆新声音(视频内克隆声 · 可灵 Kling 专用)
仅显示已配置 Key 的厂商;样音将作为该厂商的视频内克隆声(kling)。与数字分身音色无关——数字人出片默认用原声样音。
🎞 视频引擎
默认 Seedance 2.0(人脸首帧 + 参考音频)。仅在你已配置对应厂商 Key 时可切换;选择后该引擎用于后续新建任务。
📂 图片素材库(G-4)
上传过的产品图 / 人脸图 / 参考图在此留存,下次创作可直接复用,避免重复上传与重传流量。