AI VIDEO PIPELINE · 实战教程
MJ 提示词反推 → AI 视频生成全流程
7 步从"刷到爆款视频"到"做出自己的 AI 视频":截图反推提示词、出图、运镜脚本、API 自动生成、FFmpeg 拼接、剪映配音。每步附可直接复制的提示词模板。
📺 方法源自常州 AI 社区群友「天天」一线实战(2026-08-29 分享),已整理成可复用流程
STEP 01
截取爆款视频关键帧
找同赛道火爆视频(如抖音头部博主),把画面最有冲击力的几个场景截图。要点:选"单场景、无复杂转场"的镜头,反推更容易。
💡 操作技巧播放器暂停在画面最清晰的一帧 → 截图保存;一个视频取 3-5 个关键帧,覆盖不同景别。
STEP 02
Agent 反推 MJ 8.2 提示词
把截图丢给 AI Agent(Claude/ChatGPT/Coze 均可),让它按 Midjourney 8.2 的语法反推完整提示词——比自己写快且风格还原度高。
📋 提示词模板(可复制)你是 Midjourney 提示词专家。请根据这张图片反推一条完整的 MJ 8.2 提示词,要求:①主体、环境、光线、镜头、风格、参数(--ar --v)全部还原 ②按 MJ 语法组织,中文描述 ③另给 2 个"同风格不同主体"的变体。
STEP 03
生成图片(决定视频上限)
用反推出的提示词在 MJ 或国产绘图(即梦/可灵)生图。图片决定视频上限——图不好,视频一定不好,多抽几张挑最满意的。
💡 关键认知(群友原话)"视频生成的质量和图片息息相关,图片决定了视频的上限"——把 80% 时间花在出图上。
STEP 04
Agent 生成运镜脚本
把选定的图片再喂给 Agent,让它根据画面自动生成运镜脚本(推拉摇移/景别变化/运动节奏),交给视频模型执行。
📋 提示词模板(可复制)根据这张图片生成 5 个运镜方案,每个方案包含:景别(远景/中景/特写)、运动方式(推/拉/摇/移/升降)、运动方向、速度节奏、建议时长(秒)。按"最稳 → 最有冲击力"排序。
STEP 05
API Key + 自动生成视频
把图片+运镜脚本发给智能体,配上视频模型的 API Key(官方渠道最稳;团队量大可考虑智云 tokenhub / toby 类额度平台),它全自动上传图片和脚本、轮询下载生成结果。
💰 成本参考(2026)Seedance(即梦)720P 约 0.4 元/秒,2.5 版本单次最长 30 秒;先算预算再批量。Key 用官方平台(即梦/可灵官网)最安全。
STEP 06
FFmpeg 无损拼接片段
多个生成片段用 FFmpeg 自动拼接:统一分辨率参数后 concat 合并,一条命令完成。
📋 FFmpeg 拼接命令(可复制)# 1. 生成清单文件(每行 file '片段名.mp4',顺序即拼接顺序)
echo -e "file 'clip1.mp4'\nfile 'clip2.mp4'\nfile 'clip3.mp4'" > list.txt
# 2. 同参数片段可直接无损合并
ffmpeg -f concat -safe 0 -i list.txt -c copy output.mp4
# 3. 若分辨率/帧率不一致,先统一再拼接
ffmpeg -i clip.mp4 -vf "scale=1280:720,fps=30" -c:a aac norm.mp4
STEP 07
剪映合成:配音 + 字幕
最后进剪映:AI 配音(自带音色/克隆音色)、字幕识别、配乐。配音涉及版权问题的素材直接在剪映本地合成,规避平台限制。
💡 群友经验后期配音在剪映处理:AI 配音 + 字幕识别一键完成;版权音乐用剪映曲库,商用前确认授权。
🚧 避坑清单
⚠️图片不过关不要开始——视频 80% 的质量由图片决定,先出好图再谈运镜。
⚠️API Key 当密码保管——群友实测 key 会过期、会限流(429),用量统计页打不开先查网络与供应商配置;泄露会被盗刷。
⚠️先算成本再批量——视频按秒计费(Seedance 约 0.4 元/秒),批量生成前先跑 2 条试效果。
⚠️版权红线——搬运爆款素材仅用于"学习反推",商用内容请用原创画面;配音音乐用剪映曲库。
⚠️别让 Agent 做决策——选题、风格判断、内容把关留给自己,Agent 只负责采集、生成、拼接这些"输入输出明确"的环节。