从脚本开始 · AI 口播创作
先整理脚本,再生成视频,最后导入下方编辑字幕与导出。AI 请求会将脚本发送到所选服务;本地编辑的视频不会自动上传。
登录客户账号用自己的电脑生成 · MiniMax H3
先检测本地连接助手。没有安装时,下载安装包并运行;安装后回到这里检测。浏览器可能询问本地网络访问权限。
先按台词拆成短片段,再逐段生成。可编辑每段画面要求;台词不会自动改写。H3原生语音可能漏词或改词,需听审;跨片段人物一致性、真实产品外观及逐字口型暂不保证。这里不是“独立配音+口型同步”的精准对稿模式。
优先保留手动换行和完整句子,超长段落再按短句拆分;在每段5–12秒范围内分配总时长。时间节点是计划时间,不是语音识别对齐。更改分段后需要重新生成片段,旧视频不会自动改变。
需要1.0.8助手及字幕组件。识别失败或关闭此选项时,只导入视频,不用脚本自动填字幕;品牌名和数字需校对。识别不会更改视频里说错或漏说的内容。
适用于同一人物的连续镜头。仅对新生成片段生效,需要助手1.0.7;不能保证逐帧、声音或人物完全一致,请逐段核验。切换场景时可关闭。
整片队列由本地助手执行,一次只生成一段,全部成功后自动拼接。失败时停止后续片段,继续时保留已完成片段;本地助手须保持运行,网页可刷新。助手重启后需手动继续。当前页面参数未改变时,完成会自动导入预览;重新打开页面后可手动导入整片。
下载后解压,双击 install.cmd。安装完成后双击 start.cmd 启动;已有 ComfyUI 环境可按包内说明连接。
尚未检测。手机 / Mac / 无独立显卡设备建议使用云服务,无需安装模型。
我的电脑能运行吗?
本安装档位建议:Windows 10/11 64 位,NVIDIA RTX 50 系列至少 16GB 显存、32GB 内存、100GB 可用 SSD。64GB 内存及 24GB 以上显存更有余量。已有单机测试参考为 RTX 5060 Ti 16GB / 32GB 内存的短片,并非通用最低配置保证;其他显卡请用官方手动方案或云服务。
五个模型约 44.43GB,另需下载约 2.15GB 程序包。安装器按官方固定版本下载并校验,支持断点续传。安装包未数字签名。商业使用请核对 官方授权说明。
直接拖动字幕 / 卡片调整位置 · 手机请在画布外滑动页面
尚未导入视频
截取会保留所选时间范围的视频、字幕和原声,不修改原文件。帧位置按所选编辑帧率计算,不是对源视频原始帧率的识别。此处截取视频;右侧入点/出点只调整字幕。
直接导出你的成品
原视频 + 字幕动效 + 原声 · 本地合成 · 水印默认关闭
先选择本机视频,即可合成成品。
录制时请保持此页面可见;耗时约等于片段时长。实时录制的时长和帧率可能小幅浮动,允许最多 5% 的正常采样差异(短片至少容许两帧末端差);明显不足会停止下载。下载后请检查画面与声音。仅保存到本机,不会上传或改写原视频。
72 帧 · 最多 240 帧 / 256 MiB
与 AI 协作:准备口播视觉方案
复制提示词后,自行交给你选择的 AI 服务。这里不会调用模型;提示词包含当前卡片文字,请自行决定是否分享。
从原片到成品,方法也一起带走。
没有原片?先学习本地 MiniMax H3 工作流。已有素材,就从字幕和动效开始。教程在新页面打开,不打断当前编辑。