开始创作你的数字人口播视频
AI 驱动 · 全流程自动化 · 商业级品质
按场景开始
最近创作
热门模板
视频口播
流水线式引导创作,6 步完成商业级数字人口播视频
一键生成视频
输入文案,自动完成文案仿写、语音合成、数字人口播、字幕、视频合成全流程
详细信息
文案工作台
AI 驱动的口播文案创作:润色、仿写、扩写、缩写、风格转换、主题生成
润色:优化表达,保留原意
仿写:语义级改写,避免查重
扩写:增加细节和案例
缩写:精简压缩,保留核心
风格转换:调整语气风格
主题生成:根据主题创作
需先在「设置 → 模型配置」配置 LLM API Key,否则使用 Mock 模板
分步创作
单独执行任一模块,便于调试和定制。前置模块会自动执行以准备上下文。
等待执行...
批量处理
批量提交多个文案,串行生成视频。适合内容矩阵运营。
时间轴剪辑
画中画插播视频 + 快捷剪辑,对标剪映/HeyGen 的 B-roll 编辑能力
整段切换模式(CUT):在指定时间段用 B-roll 替换主画面,数字人暂离(适合展示实景素材)
三种插入方式:① 点击字幕间的 + 在两段字幕之间插入;② 点击 B-roll 轨道空白处在任意位置插入;③ 点击"在播放头插入"按当前播放位置插入
快捷剪辑:裁剪头尾、调整音量、片头片尾淡入淡出,一键应用
形象管理
上传真人照片或视频(嘴巴不动),生成唇形同步数字人
2. 生成音频:系统将文案转为语音(TTS)
3. 唇形同步:LatentSync 模型根据音频驱动参考素材中的嘴唇动作
4. 输出视频:生成嘴唇会动的数字人口播视频
音色管理
上传 5-10 秒干净人声样本,克隆音色
模板中心
场景化一键创作:选场景 → 填内容 → 生成视频。对标腾讯智影/万兴播爆的"点点点"创作模式
任务管理
查看历史任务、断点续跑、删除任务
| 任务 ID | 状态 | 创建时间 | 更新时间 | 操作 |
|---|
模型配置
配置 LLM、TTS、ASR、数字人等核心模型。修改后自动保存并热更新。
视频设置
字幕样式、BGM、画面比例、水印等视频输出参数
场景与效果
数字人场景、音频效果、视频转场/滤镜/水印/片头片尾等高级效果配置
发布设置
多平台账号管理、发布模式、频率控制
方式:点击"登录"按钮,浏览器扫码或账密登录
存储:config/cookies/{platform}.json
技术:Playwright 自动化发布
方式:上传 Netscape 格式 .txt 文件
存储:config/asr_cookies.txt
技术:yt-dlp 下载后 ASR 转文字
⚙ 更多选项(描述、标签)
🔧 高级选项(发布模式 / 平台启用 / 手动 Cookie / 发布测试台)
• Cookie检查:仅检查文件存在性和字段完整性,不访问网络(最安全)
• 登录态校验:实际加载 Cookie 访问平台,检测是否被重定向到登录页
• 选择器探测:打开浏览器访问发布页,检测上传/标题/发布按钮选择器是否有效
• 上传测试:实际上传视频文件,dry-run 模式不点发布按钮;关闭 dry-run 将真实发布视频
系统状态
查看各模块运行状态
Ollama / CosyVoice / LatentSync:三大本地依赖服务,由服务监管器自动拉起与健康监测;「启动中」为模型加载(CosyVoice 约 50 秒),稍候自动就绪
FFmpeg:视频处理引擎,必须可用
LLM 模式:「已就绪」=本地 Ollama 或云端 API 正常;「Mock 模式」=未配置,文案走模板
提示:全本地链路(Ollama + CosyVoice + LatentSync)开箱即用,素材不出本机。服务未就绪时点「生成」会给出明确指引。前往「设置中心」可切换 provider 与参数。