开始搭建 +
AI VIDEO PIPELINE · 实战教程

MJ 提示词反推 → AI 视频生成全流程

7 步从"刷到爆款视频"到"做出自己的 AI 视频":截图反推提示词、出图、运镜脚本、API 自动生成、FFmpeg 拼接、剪映配音。每步附可直接复制的提示词模板。

📺 方法源自常州 AI 社区群友「天天」一线实战(2026-08-29 分享),已整理成可复用流程
STEP 01

截取爆款视频关键帧

找同赛道火爆视频(如抖音头部博主),把画面最有冲击力的几个场景截图。要点:选"单场景、无复杂转场"的镜头,反推更容易。

💡 操作技巧播放器暂停在画面最清晰的一帧 → 截图保存;一个视频取 3-5 个关键帧,覆盖不同景别。
STEP 02

Agent 反推 MJ 8.2 提示词

把截图丢给 AI Agent(Claude/ChatGPT/Coze 均可),让它按 Midjourney 8.2 的语法反推完整提示词——比自己写快且风格还原度高。

📋 提示词模板(可复制)你是 Midjourney 提示词专家。请根据这张图片反推一条完整的 MJ 8.2 提示词,要求:①主体、环境、光线、镜头、风格、参数(--ar --v)全部还原 ②按 MJ 语法组织,中文描述 ③另给 2 个"同风格不同主体"的变体。
STEP 03

生成图片(决定视频上限)

用反推出的提示词在 MJ 或国产绘图(即梦/可灵)生图。图片决定视频上限——图不好,视频一定不好,多抽几张挑最满意的。

💡 关键认知(群友原话)"视频生成的质量和图片息息相关,图片决定了视频的上限"——把 80% 时间花在出图上。
STEP 04

Agent 生成运镜脚本

把选定的图片再喂给 Agent,让它根据画面自动生成运镜脚本(推拉摇移/景别变化/运动节奏),交给视频模型执行。

📋 提示词模板(可复制)根据这张图片生成 5 个运镜方案,每个方案包含:景别(远景/中景/特写)、运动方式(推/拉/摇/移/升降)、运动方向、速度节奏、建议时长(秒)。按"最稳 → 最有冲击力"排序。
STEP 05

API Key + 自动生成视频

把图片+运镜脚本发给智能体,配上视频模型的 API Key(官方渠道最稳;团队量大可考虑智云 tokenhub / toby 类额度平台),它全自动上传图片和脚本、轮询下载生成结果。

💰 成本参考(2026)Seedance(即梦)720P 约 0.4 元/秒,2.5 版本单次最长 30 秒;先算预算再批量。Key 用官方平台(即梦/可灵官网)最安全。
STEP 06

FFmpeg 无损拼接片段

多个生成片段用 FFmpeg 自动拼接:统一分辨率参数后 concat 合并,一条命令完成。

📋 FFmpeg 拼接命令(可复制)# 1. 生成清单文件(每行 file '片段名.mp4',顺序即拼接顺序) echo -e "file 'clip1.mp4'\nfile 'clip2.mp4'\nfile 'clip3.mp4'" > list.txt # 2. 同参数片段可直接无损合并 ffmpeg -f concat -safe 0 -i list.txt -c copy output.mp4 # 3. 若分辨率/帧率不一致,先统一再拼接 ffmpeg -i clip.mp4 -vf "scale=1280:720,fps=30" -c:a aac norm.mp4
STEP 07

剪映合成:配音 + 字幕

最后进剪映:AI 配音(自带音色/克隆音色)、字幕识别、配乐。配音涉及版权问题的素材直接在剪映本地合成,规避平台限制。

💡 群友经验后期配音在剪映处理:AI 配音 + 字幕识别一键完成;版权音乐用剪映曲库,商用前确认授权。

🚧 避坑清单

⚠️图片不过关不要开始——视频 80% 的质量由图片决定,先出好图再谈运镜。
⚠️API Key 当密码保管——群友实测 key 会过期、会限流(429),用量统计页打不开先查网络与供应商配置;泄露会被盗刷。
⚠️先算成本再批量——视频按秒计费(Seedance 约 0.4 元/秒),批量生成前先跑 2 条试效果。
⚠️版权红线——搬运爆款素材仅用于"学习反推",商用内容请用原创画面;配音音乐用剪映曲库。
⚠️别让 Agent 做决策——选题、风格判断、内容把关留给自己,Agent 只负责采集、生成、拼接这些"输入输出明确"的环节。
← 返回 AI 工具箱