不只是"能生成",而是能改、能批量

AI 视频工坊把短视频生产拆成五个互相对得上的界面:项目工作台、策划脚本、切分镜、生成视频、设置。 下面按顺序说明每个界面实际能做什么。

01 / 项目工作台

所有片子都有一个项目文件

每个项目独立保存简报、脚本、分镜与生成状态,切换项目不影响其它片子;工作台顶部还会汇总镜头总数与完成率, 批量生产时一眼看出哪条卡住了。

一张简报新建项目

选题、内容类型、平台、时长、受众、调性、卖点一次性填好,之后每个环节都复用这份简报,AI 不会跑偏。

进度一眼可见

项目数、分镜总数、已生成片段数与完成率实时统计,侧栏还会显示有多少个任务正在跑。

项目即文件

项目以 JSON 形式保存在本机数据目录,复制文件就等于备份项目,删项目也不会留下散落的临时文件。

02 / 策划脚本

先定简报,再让 AI 写

脚本质量取决于简报质量。所以第一步不是"让 AI 随便写一段",而是把选题、平台、调性、卖点这些约束填清楚, 再让模型按固定的字段结构输出。

创作简报包含什么

  • 选题 / 主题:一句话说清要讲什么
  • 内容类型:口播知识、产品种草、剧情故事、悬疑反转、Vlog 纪实、教程干货等 10 种
  • 发布平台:抖音、视频号、小红书、快手、B站、YouTube,各自套用不同的节奏与话术规则
  • 目标时长:15 / 30 / 60 / 90 / 120 / 180 秒
  • 表达调性:亲切有信息量、专业克制、热血强煽动、幽默网感、温柔治愈、悬念紧张
  • 受众与卖点:目标人群、必须讲到的信息点、参考账号、其它硬性要求

平台差异不是文案装饰:抖音要求前 3 秒强钩子、句子短、口语化;视频号偏理性可信;小红书第一人称种草; B站要有信息量、有观点。

// 脚本输出结构(AI 按此 JSON 结构返回,直接落库) { "title": "你写的周报,领导根本没看", "hook": "前 3 秒钩子:你以为周报是汇报,其实是……", "angle": "核心切入角度", "sections": [ { "heading": "小标题", "narration": "口播全文", "caption": "屏幕字幕" } ], "cta": "结尾行动指令", "visualKeys": "画面关键词(供生成画面参考)", "notes": "给拍摄 / 后期的提醒" }

分段可编辑

小标题、旁白、字幕逐段可改,还能上移、下移、删除或新增段落,改完的结构会同步给切分镜环节。

按意见修改

不用重写简报:直接写"开头钩子不够强,改成反问句""第三段太长拆两段",AI 会在保留其它内容的前提下重写。

历史版本

每次生成与修改都会留版本,改坏了随时回滚到上一版,不用怕"越改越差"。

03 / 切分镜

把文案变成"能投喂给视频模型"的镜头表

一段口播文案直接丢给视频模型效果很差。切分镜会把它拆成一个个镜头,每个镜头都补上景别、运镜、时长与英文提示词, 这样模型才知道画面该怎么动。

镜头字段 可选值 / 说明 用途
景别 大远景、远景、全景、中景、中近景、近景、特写、大特写 控制画面信息量与情绪强度
运镜 固定机位、缓慢推近、缓缓拉远、左右横移、跟随拍摄、环绕运镜、手持晃动、俯拍下降、仰拍上升、快速甩镜 让画面动起来,避免"PPT 感"
时长 按镜头单独设置,与视频模型的 5 秒 / 10 秒档对齐 方便统计总时长、卡配乐节奏
画面描述 中文描述这一镜要拍什么 给实拍或找素材时看的
视频生成提示词 英文提示词,可一键润色 直接投喂给视频模型的那一段
旁白 / 台词 · 屏幕字幕 这一镜要念什么、屏幕上打什么字 剪辑对轴、配音、上字幕
音效 / BGM · 后期备注 声音设计提示与剪辑注意事项 交给剪辑同学不用再口头解释

单镜重写

哪一镜不满意就重写哪一镜,其余镜头保持不动,不用整条片子重来。

提示词润色

把中文画面描述润色成更符合视频模型口味的英文提示词——这一步直接决定出片率。

三种格式导出

JSON 给程序、CSV 给 Excel、Markdown 给人看。交给剪辑、发给客户、存档都方便。

镜头统计:切分镜界面顶部会显示镜头数、总时长、已出片数量与单镜平均时长, 并按目标时长给出建议镜头数——避免出现"写了 60 秒却有 30 个镜头"这种没法执行的表。
04 / 生成视频

批量跑镜头,失败的单独重试

视频模型一次只能出一个短片段,所以真正的效率来自队列:勾选镜头 → 排队 → 看进度 → 挑失败的补跑。

生成参数

  • 画幅:9:16 / 16:9 / 1:1 / 4:3 / 3:4 / 21:9 / adaptive
  • 分辨率:480p / 720p / 1080p
  • 单镜时长:5 秒 / 10 秒
  • 并发数:1–4 路
  • 可选带水印、是否生成音频

队列与状态

  • 筛选:全部 / 待处理 / 已完成 / 失败
  • 批量全选、只选未完成、一键清空选择
  • 实时百分比进度,可随时停止
  • 失败镜头「重试失败项」一键补跑
  • 查询异常连续失败会自动停止等待并给出任务 ID

片段落到本机,顺手就能用

任务完成后软件会把视频下载到你指定的媒体目录,并记录远端地址、任务 ID、使用模型与完成时间。 在列表里就能播放预览、在文件夹中定位、或用系统播放器打开。

  • 每个镜头独立记录生成状态,换电脑前可先导出分镜表
  • 图生视频可选本机图片作为首帧,锁定画面起点
  • 「本地模拟」模式不消耗额度,先把流程和分镜验证一遍
05 / 模型与设置

文案模型和视频模型,都填你自己的

软件不代售额度、不中转请求。文案侧走任意 OpenAI 兼容接口,视频侧走火山方舟 Seedance 或你自己的 HTTP 接口。

文案大模型预设 Base URL 默认模型
DeepSeekhttps://api.deepseek.comdeepseek-chat
通义千问https://dashscope.aliyuncs.com/compatible-mode/v1qwen-plus
Kimihttps://api.moonshot.cn/v1moonshot-v1-8k
智谱 GLMhttps://open.bigmodel.cn/api/paas/v4glm-4-plus
OpenAIhttps://api.openai.com/v1gpt-4o-mini
本地 Ollamahttp://localhost:11434/v1qwen2.5:14b

视频提供方

火山方舟 Seedance / 自定义 HTTP / 本地模拟三选一,随时切换。

自定义系统提示词

可以替换风格层提示词,把"你是一位专做职场干货的编导"这类人设写死。

界面偏好

深色 / 浅色主题、4 种强调色、侧边栏收起状态,配置即时生效。

媒体目录

默认在用户数据目录,可改成任意磁盘、移动硬盘或 NAS 路径。

推荐的用法

先花 5 块钱试一镜,再批量跑

视频模型的出片率高度依赖提示词写法。最省钱的做法是先把一个镜头调顺,再复制这套写法到整条片子。

  1. 写好简报,生成脚本。平台和调性选对,脚本的节奏基本就定了;不满意就用大白话提意见重写。
  2. 切分镜,先把第一镜的提示词润色到满意。重点改画面描述的具体程度:主体、动作、光线、镜头运动。
  3. 用第一镜试生成一次。确认画风、画幅和运动方向符合预期,再决定要不要调整整表的提示词风格。
  4. 勾选剩余镜头,4 路并发批量跑。中途可以继续改后面的镜头提示词,不影响正在跑的任务。
  5. 导出分镜表进剪辑软件。按镜头号拼接、配上旁白与字幕,一条片子就成了。
关于费用:软件不参与计费,模型调用费用由你直接支付给服务商。批量生成前建议确认账户余额与并发限制, 避免跑到一半因为限流整批失败。

装好就能用,不需要环境配置

安装包已内置运行环境。装完后在设置里填一次 API Key,之后打开就能直接开工。