视频素材工作台
点击选择或拖拽视频文件到此处
无音频视频
已剥离音轨,仅保留画面(无损),用于动作模仿。
剥离音频
从原视频提取的完整音轨(MP3),用于口播修正/配音参考。
视频生成工作区
预留区域:后续在此输入提示词并调用 API 生成视频
拼接点检测
检测视频是否为多段不同来源内容拼接(不同场景/人物/音色)。
分镜场景分组
把下面「待确认切片」拖到分组框(或点击放入)=归入同一分镜场景;每组可「合并导出」为一个场景视频。点击组内切片可移出。
待确认切片(拖入上方分组)
首帧图
自动截取首帧;若首帧无产品、无需改图,可直接点「 推送到脚本区」作为首帧锚点。识别不准可点击「手动替换」,或把本地图片直接拖到首帧区域。
产品图(最多 5 张)
+产品1
+产品2
+产品3
+产品4
+产品5
产品图可选:首帧画面里若没有产品(只需处理字幕、文字等信息),可不传产品图直接改图;若要替换产品,上传对应产品图即可精确替换。
改图工作区
画面比例
清晰度
质量
生成结果(点击图片可放大)
推送后,新首帧图与产品图将自动填入「视频拆解 → 脚本生成工作区」。
产品图提取
从视频中自动筛选画面最清晰、产品居中的关键帧(本地抽帧 + 清晰度评分,零 API 成本)
已选 0 张
人物形象提取
自动识别画面中的主要人物(背景路人自动过滤),每人提取一张清晰形象照
已选 0 张
识别结果(点击标签可切换说话人)
确认版逐字稿(可修改,拆解以此为准)
同一时间段多人说话:行内用 [说话人] 分段,如
[女性A] 20袋 [男性A] 20袋这么多。;也可在上方识别结果里点文字中间+回车拆行。视频拆解提示词
模型
配置 Gemini API 后,点击「开始拆解」调用 Gemini 3.7 Flash。
拆解结果
视频脚本生成工作区(基于拆解结果二次创作 → 投喂 MiniMax H3)
首帧图(1 张)
+新首帧图
产品图(最多 5 张)
+产品1
+产品2
+产品3
+产品4
+产品5
备注图(可选,最多 3 张)
+备注1
人物/场景
人物/场景
+备注2
人物/场景
人物/场景
+备注3
人物/场景
人物/场景
用于补充首帧里没有出现的人物或场景形象;不需要时可以留空。
新口播文案
脚本生成提示词
模型
素材顺序固定为:首帧 1 张 + 产品图最多 5 张 + 备注图最多 3 张(可选)。使用 Gemini 3.7 Flash 生成。
生成的脚本
生成视频
渠道
模型
时长
分辨率
比例
生成将使用:新首帧图 + 产品图(≤5)+ 上方脚本,直投 MiniMax H3。
本次流程总成本:—
图像生成 API 配置(改图用,OpenAI 兼容接口)
配置保存到本地 config.json,仅本机可见。改图调用 images/edits 接口(图生图)。输出尺寸在图片生成页面选择(比例+清晰度)。
豆包大模型 API 配置(视频拆解用,OpenAI 兼容)
保存配置后可测试 Key 可用性。温度=输出随机度,0 保守 / 1 发散,温度=输出随机度(官方默认 1.0,与火山方舟 API 测试台未设置温度时的效果一致;0 更保守,2 更发散)。
视频拆解调用豆包 chat/completions 接口。Key 仅存本机 config.json。可在火山方舟控制台创建 API Key 与推理接入点。
视频生成 API 配置(MiniMax H3,生成视频用)
模型固定 MiniMax-H3。默认 Base URL 为秘塔自部署
https://metaso.cn/api/minimax/v2(Key 为 mk- 前缀);若用 MiniMax 官方:国际站 https://api.minimaxi.com/v1 / 国内 https://api.minimax.io/v1。生成参数(时长/分辨率/比例)在「视频拆解 → 生成的脚本」处选择。即梦 / LibTV 账号授权(Seedance 模型渠道)
视频生成处可切换 MiniMax H3 / 即梦 Seedance / LibTV Seedance 三种渠道。即梦走网页授权、LibTV 走手机验证码,均可在此自助登录 / 切换账号 / 登出,授权失效时也能自行重新授权,无需联系管理员。
正在读取授权状态…
即梦(Dreamina)— 网页授权
LibTV — 手机验证码登录
模型与权限说明:
· 即梦 Seedance:2.0 / 2.0 Mini / 2.0 Fast 为普通档(但即梦 CLI 整体要求「高级会员」才能调用),2.5 为 VIP 专属。
· LibTV Seedance:2.0 / 2.0 Mini / 2.0 Fast / 2.5 全部为 VIP 专属(需 LibTV 会员)。
· 分辨率:即梦 2.x 系列固定 720p(2.5 支持 480p/720p);LibTV 支持 480p/720p/1080p。
· 即梦 Seedance:2.0 / 2.0 Mini / 2.0 Fast 为普通档(但即梦 CLI 整体要求「高级会员」才能调用),2.5 为 VIP 专属。
· LibTV Seedance:2.0 / 2.0 Mini / 2.0 Fast / 2.5 全部为 VIP 专属(需 LibTV 会员)。
· 分辨率:即梦 2.x 系列固定 720p(2.5 支持 480p/720p);LibTV 支持 480p/720p/1080p。
Gemini API 配置(拆解/脚本备选模型,走 Packy 中转)
视频拆解与脚本生成均固定提交
gemini-3.7-flash;这里只配置 Base URL 与 API Key。语音识别(火山豆包 ASR,转写用)
云端转写约 0.8~2.3 元/小时(15 秒视频约 1 分钱),新开通送 20 小时免费额度。开启后转写快、准确度高、自带说话人分离;火山不可用时自动降级本地模型。
视频渠道积分换算(估算花费用)
即梦 / LibTV 生成视频消耗「积分 / 算力」,此处配置 1 积分 ≈ 多少元,用于在生成结果里估算实际花费。即梦官方充值约 50 元=500 积分(1 积分 0.1 元),高级会员折后更低;LibTV 约 1 积分 0.038 元。可按你的会员等级 / 充值折扣调整。
默认提示词管理(拆解 / 脚本生成,可手动维护)
文本框默认只读展示当前实际生效的提示词。点「 编辑」后可修改,保存后立即生效(无需刷新),「视频拆解」页的提示词框随之更新。「恢复内置默认」回到代码内置的模式B v1.1。
账号管理
| 账号 | 角色 | 状态 | 创建时间 | 操作 |
|---|
用量统计
| 用户 | 角色 | 任务数 | 总耗时 | 总花费 | 总Token |
|---|
✅ 完成
新增账号
员工
管理员