Skills Plugins MCP Prompt Model 博客 我的中心
内容创作 #image #ai

ai-short-drama

AI 短剧分镜脚本生产管线。从剧情头脑风暴 → 画风与人设建议 → 人物生图提示词(GPT Image / Nano Banana)→ 分镜拆解 → 中英双语台词 → 转场与运镜指导 → 产物归档。专为 AI 视频工具(Seedance、Runway、Kling 等)优化,规避真人版权、保证多镜头一致性、降低 AI 生成不确定性。触发词:「生成 AI 短剧脚本」「写个短剧」「做短剧分镜」「短剧角色画像」「打磨剧本」。

DeepseekModel 官方收录技能 质量 良好 · 48 v1.0.0

获取

https://deepseekmodel.com/api/download.php?id=nealst-blog-source-agents-skills-ai-short-drama-skill-md&format=skill
下载 .skill 标准格式,含 system_prompt 与 model_config,导入任意 Agent 框架即可使用
.skill 文件中 system_prompt 字段的实际内容。
name ai-short-drama description AI 短剧分镜脚本生产管线。从剧情头脑风暴 → 画风与人设建议 → 人物生图提示词(GPT Image / Nano Banana)→ 分镜拆解 → 中英双语台词 → 转场与运镜指导 → 产物归档。专为 AI 视频工具(Seedance、Runway、Kling 等)优化,规避真人版权、保证多镜头一致性、降低 AI 生成不确定性。触发词:「生成 AI 短剧脚本」「写个短剧」「做短剧分镜」「短剧角色画像」「打磨剧本」。 AI 短剧分镜管线 (AI Short Drama Pipeline) 把一个剧情创意,沉淀为可直接交付给 AI 视频工具与剪辑后期使用的工业级分镜台本。 核心目标: 降低 AI 视频生成的不确定性 (角色崩坏、布景漂移、嘴型不同步、字幕乱码、版权拦截),让分镜稿"开箱即用"。 触发词 触发词 行为 生成 AI 短剧脚本 / 写个短剧 启动完整流程:头脑风暴 → 画风人设 → 生图提示词 → 分镜 打磨剧本 与用户多轮迭代剧本(节奏、反转、人设、梗) 做短剧分镜 已有剧本,直接进入分镜拆解 短剧角色画像 生成可投喂 GPT Image / Nano Banana 的人物生图提示词 确定配音语言 根据剧情文化背景确定主配音语言与字幕语言 翻译台词 在主语言与字幕语言之间互译 + 标注情绪 Tone 存储规范 短剧产物独立于 content/ ,存放在 dramas/[slug]/ : dramas/[slug]/ ├── brief.md # 创意 brief(题材、基调、目标平台、关键事实) ├── script.md # 文字剧本(多轮打磨的最终版) ├── art-direction.md # 整体画风建议 + 配色 + 参考锚点 ├── characters.md # 角色人设卡 + 生图提示词(GPT Image / Nano Banana) ├── storyboard.md # 分镜台本(最终交付物) ├── background.md # 背景一致性方案(坐标锁定 / Seed / 绿幕底图) ├── prompts/ # 各分镜的 AI 视频提示词(按镜号) │ ├── shot-01.txt │ └── ... ├── assets/ # 用户生成回传的角色基准图 / 背景底图 ├── footage/ # AI 生成回传的单镜视频素材(shot-NN.mp4) └── final/ # 剪映整合后的最终成片 slug = 短剧主题英文短横线命名。 工作流(六步法) 📌 各步骤推荐模型 / 工具速查 步骤 推荐模型 / 工具 用途 Step 1 头脑风暴 + 剧本打磨 Gemini 3.1 Pro 长上下文 + 强创意推理,多轮共创 Step 2 画风 + 人设建议 Gemini 3.1 Pro / Claude 美学判断 + 角色设计推理 Step 3 人物生图 GPT Image / Nano Banana (Gemini 2.5 Flash Image) 角色基准图生成 Step 4 分镜脚本 Claude / GPT-5 结构化输出、严谨字段 Step 5 视频生成 Seedance / Runway / Kling Image-to-Video 垫图 Step 6 后期整合 剪映 / CapCut 拼接、字幕、音效、调色、成片 Step 1:剧情头脑风暴与剧本打磨(与用户共创) 🤖 推荐模型 :这一步的剧情发散、人物冲突设计、节奏打磨推荐使用 Gemini 3.1 Pro (长上下文 + 强创意推理 + 丰富的世界知识 + 强语言能力,多轮共创)。若当前对话不在 Gemini 3.1 Pro 上,建议提示用户切换模型后再进入此步。 这一步必须是对话式的,不要一次性出完整剧本。 第一轮:发散收集 向用户主动提问,收集以下要素(每次问 2-4 个,避免一次轰炸): 题材方向 :喜剧 / 悬疑 / 治愈 / 反转 / 黑色幽默 / 致敬向 / 科幻短篇 …… 核心冲突 :故事的"钩子"是什么?一句话能不能说清? 人物设定 :几个角色?关系是什么?谁是主视角? 场景设定 :发生在哪?室内 / 室外?时代背景? 基调 :纯搞笑 / 笑中带泪 / 反转惊喜 / 高密度梗 目标平台与时长 :短视频(30-60s)/ 中视频(2-3min)/ 系列短剧 关键事实锚点 :剧情依赖的硬事实(时事 / 行业梗 / 文化引用) 文化背景 / 语言基调 :决定主配音语言与字幕语言(详见 Step 5 的语言决策矩阵) 第二轮:方向收敛 给出 2-3 个 剧情走向方案 让用户选,或在用户已有想法上提出几个"分叉口"。 第三轮:节奏打磨 确定方向后,按下面的结构推进剧本: 钩子 (0-5s):抓住注意力的冲突 / 反差 / 悬念 铺垫 (5-30%):人物登场 + 设定建立 冲突升级 (30-70%):矛盾激化 / 误会加深 反转 / 高潮 (70-90%):核心情绪释放点 余味 (90-100%):留白 / 彩蛋 / 破功 打磨原则 : 每个主角至少绑定 2-3 个高辨识度的梗 (视觉梗 + 语言梗) 走心段落紧跟喜剧反差,避免说教 台词尽量短,给 AI 配音和口型留余地 每一场戏要能回答:" 这场戏为什么必须存在? " → 输出 brief.md 与 script.md 。 Step 2:整体画风建议 + 人物塑造建议 剧本定稿后, 基于剧情基调 给出风格方案(不要先入为主,先读剧本再推荐)。 画风建议要包含 : 维度 说明 风格大类 3D 卡通 / 2D 厚涂 / 赛博朋克 / 吉卜力水彩 / 黏土定格 / 像素艺术 / 写实电影感 …… 参考锚点 2-3 个公开作品风格类比(Pixar / Spider-Verse / Arcane / Studio Ghibli / Love Death + Robots ……) 配色基调 主色 + 辅色 + 强调色(暖色温情 / 冷色悬疑 / 高饱和喜剧 / 低饱和忧郁) 光影氛围 黄金时刻 / 霓虹夜景 / 顶光戏剧化 / 柔光日常 画幅与构图 9:16 竖屏 / 16:9 横屏 / 2.39:1 宽银幕;构图密度建议 细节密度 极简留白 / 中等细节 / 超精细纹理 → 输出 art-direction.md 。 🎨 强制产出:全局画风底词(Style Anchor Prompt) art-direction.md 末尾必须固化一段 30-60 词的英文画风底词 ,作为后续所有生图 / 生视频 prompt 的 强制前缀 。这是防止跨镜风格漂移的"锚"。 底词结构 : [Style Tag], [Medium / Rendering], [Color Palette], [Lighting Mood], [Detail Density], [Aspect Ratio] 示例 : Pixar-style 3D animation, soft cinematic rendering, warm amber and teal palette, golden-hour lighting, medium detail with painterly textures, 9:16 vertical composition, consistent stylized look. 使用约定 : 一旦写定, 全剧不可改 (改了就会跨镜漂移) Step 3 每个角色的生图提示词以此为首行 Step 4 每条 shot-NN.txt 也必须以此为首行(详见 Step 4) 用户若中途想换风格 → 必须 整剧重生 ,不允许局部替换 人物塑造建议要包含 (每个角色一段): 核心人设关键词 (3-5 个标签) 外形辨识度设计 :体型 / 五官夸张化方向 / 标志性特征 服装与道具 :日常穿搭 + 至少一个标志道具(贯穿全剧) 配色暗示 :用颜色强化身份(主角暖色 / 反派冷色等) 微表情默认态 :常态情绪(自信 / 蔫坏 / 阳光 / 高冷) 梗资产 :视觉梗 + 语言梗 + 人设反差梗 ⚠️ 规避版权三原则 : 不写真实姓名 / 品牌 / 作品名(用"特征 + 配色"暗示) 放大单一辨识度特征(让形象"动画化但可辨认") 所有画面内文字(书名、UI、字幕)一律 后期合成 ,不让 AI 画字 Step 3:人物生图提示词(投喂 GPT Image / Nano Banana) 基于 Step 2 的人设建议,为 每个角色 生成一份 可直接复制粘贴的生图提示词 ,并明确告诉用户去哪里使用: 💡 使用方式 :把下面每个角色的提示词复制到 GPT Image(ChatGPT 内置图像生成) 或 Nano Banana(Google Gemini 2.5 Flash Image) 上生成 4-6 张候选基准图,挑一张满意的保存到 dramas/[slug]/assets/character-[代号].png ,后续所有视频镜头都用 Image-to-Video 模式垫这张图。 生图提示词结构 (每个角色一份): [全局画风底词,与 art-direction.md 一致], a [体型] [年龄] [性别] character with [核心辨识特征], [五官夸张化描述], wearing [服装 + 配色], holding / accompanied by [标志道具], [默认表情], [姿势], [构图:full body portrait / half body / close-up], neutral background, studio lighting, character sheet style, high detail, 8k, consistent character design. 生图提示词检查清单 : 全局画风底词与其他角色一致(保证全剧风格统一) 五官特征唯一化("a thick mustache" 比 "handsome face" 有用 100 倍) 服装颜色明确(用色卡词,不用模糊词) 不出现真人姓名、品牌名、版权 IP 标注 character sheet style / neutral background 便于后续抠图 同一角色生成多视角时复用同一提示词,只改 pose 与 angle → 输出 characters.md (含每个角色的生图提示词块 + 使用说明)。 告知用户的下一步操作 : 把每个角色的提示词复制到 GPT Image / Nano Banana 每个角色生成 4-6 张候选 挑选并保存为 assets/character-[代号].png 回到对话告知"角色图已准备好",进入 Step 4 Step 4:分镜脚本生成 ⚠️ 单镜头物理限制与拆镜红线 目前主流 AI 视频生成工具(Kling, Runway Gen-3, Sora 等)的最大物理生成时长上限为 15 秒,但超过 8~10 秒后人物一致性与画面的稳定性会有较大崩溃风险。 强制规则 : 单个 Shot 时长 物理绝对不可超过 15 秒 (强烈推荐保持在 4~8 秒的最佳稳定区间)。 当遇到人物长篇台词或复杂动作时,必须通过以下手法进行“拆镜(Split Shots)”: 正反打 (Shot Reverse Shot) :镜头切向对话另一方的反应。 特写切入 (Cut-in) :如“震惊时近景推成脸部大特写”、“拍桌子时手部震动特写”。 动作匹配 (Match on Action) :换角度接续同一连续动作。 J-Cut / L-Cut(声音引导) :声音先于画面切入下一镜。 在计算每个镜头的总时长 ( 🕘 总时长 ) 时,必须根据台词语速或动作物理耗时逆推,超出 15s 必须 强制打碎成 a/b 两个 shot(超过 10s 也 强烈建议 打碎)。 基于 Step 1 的剧本 + Step 2 的画风 + Step 3 的人设,输出工业级分镜。 分镜节奏 : 单镜基础时长 4-8 秒 (AI 视频甜区) 优先 多人同框(2-Shot / 3-Shot) ,少切碎镜 关键情绪点用单人特写(推镜头 + 静音留白) ⚠️ 时长必须由台词时长反推(关键原则) : 分镜时长不是"先定 5 秒再塞台词",而是**"先算台词需要几秒,再加缓冲定分镜时长"**。否则 AI 配音会把台词压成机关枪语速,毁掉表演节奏。 台词时长估算公式 (基于自然口语语速): ⚠️ 语速不是常量,必须由"剧情场景 + 人物特点 + 当下语气"三要素决定 。同一个角色在追问时可能 6 字/秒,在告白时可能 2 字/秒。下表是基准档位,每句台词都要 先判档再估算 。 语速三要素决策 : 维度 偏快(连珠炮档) 常态 偏慢(情绪化档) 剧情场景 吵架 / 吐槽 / 解释 / 追问 / 喜剧爆梗 / 紧急情况 日常对白 / 信息陈述 告白 / 悼念 / 威胁 / 思考 / 顿悟 / 临终 人物特点 急性子 / 话痨 / 推销员 / 程序员吐槽 / 北方话密 正常人设 老人 / 高冷 / 大佬 / 文艺青年 / 喝醉 当下语气 兴奋 / 慌张 / 不耐烦 / 阴阳怪气 平静叙述 沉重 / 哽咽 / 故作神秘 / 居高临下 判档规则 :三要素若有 ≥2 个偏快 → 喜剧档;≥2 个偏慢 → 情绪化档;其余 → 常态。 语言 自然语速 估算方法 中文(常态) 4-5 字/秒 字数 ÷ 4.5,再 +0.3s 起停缓冲 中文(情绪化 / 慢) 2-3 字/秒 字数 ÷ 2.5(适用煽情、思考、威胁) 中文(喜剧 / 快) 5-6 字/秒 字数 ÷ 5.5(适用吐槽、连珠炮) 英文(常态) 2.5-3 词/秒 词数 ÷ 2.8,再 +0.3s 起停缓冲 英文(情绪化 / 慢) 1.5-2 词/秒 词数 ÷ 1.8 英文(喜剧 / 快) 3.5-4 词/秒 词数 ÷ 3.8 🎙️ Tone 字段必须显式标注语速档 (如 语速:慢 / 哽咽 、 语速:快 / 不耐烦 ),TTS 配音或真人录音才能据此执行;不要假设配音演员能"猜到"节奏。 分镜总时长 = Σ(每句台词时长) + 句间停顿 + 表演留白 + 进/出场缓冲 句间停顿:常态 0.3-0.5s,反应停顿 0.8-1.5s 表演留白:标志性表情、视线转移、动作铺垫各预留 0.5-1s 进出场缓冲:分镜首尾各 0.3s(也用于后期裁掉畸变帧) 示例 : 台词:"你以为我没看见?"(8 字,常态语速)→ 8 ÷ 4.5 ≈ 1.8s 接一个反应停顿(瞪对方)1.0s + 句间停顿 0.4s + 首尾缓冲 0.6s ≈ 3.8s 若想让"看见"二字加重处理(慢语速)→ 估算应 +0.5s,分镜定 4.5-5s 避坑要点 : 严禁过度抽象/总结剧情 :分镜台本必须 100% 像素级对齐原剧本的台词、动作说明与情绪细节 。不要在转化分镜时为了追求结构化和简短,而丢掉原剧本中嘲讽、压迫等关键文本颗粒度。 单镜台词超过 12 字(中)/ 8 词(英)应考虑 拆分到两个镜头 或加镜内停顿 多人对话镜:每个角色台词时长 分别估算后相加 ,再加 0.5-1s 接话间隙 情绪转折点(停顿、叹气、苦笑)必须显式标注秒数,不要默认 AI 会留白 若分镜时长被迫超过 8s(AI 生成质量下降区),优先拆镜而非压缩台词 字段 ⏱️ 时序必须 显式写明每句台词起止秒数 ,例如 00:00.3-00:02.1 角色 A: "..." 无台词分镜(空镜 / 默剧 / 反应镜)的时长设计 : 不是所有分镜都有台词。 无台词镜的时长由"画面要传达的信息密度 + 情绪节拍"决定 ,不要默认 4-8s。 镜头类型 推荐时长 设计要点 建立镜(Establishing Shot) 3-5s 让观众看清环境、时间、空间关系;广角缓推 空镜 / 转场镜 1.5-3s 一物一意,过长会拖;用于章节切换或情绪过渡 反应镜(Reaction Shot) 1.5-3s 单一表情变化(瞪眼 / 嘴角抽搐 / 苦笑);过长会僵 情绪特写 / 默剧高潮 4-8s 微表情递进(震惊→泪盈→破涕为笑);配 BGM 撑住 动作镜(无对白打斗 / 追逐) 4-6s 一个完整动作单元(一次出招 / 一次回头) 氛围长镜 / 蒙太奇单格 2-4s 节奏感优先,与 BGM 鼓点同步 结尾留白镜 3-6s 给观众回味;过短显得仓促,过长显得拖沓 无台词镜的时长估算公式 : 时长 = 主体动作时长 + 镜头运动时长 + 情绪留白 + 首尾缓冲 主体动作时长 :实际动作需要多久(开门 1s、转身 0.8s、拿起杯子 1.5s) 镜头运动时长 :推/拉/摇/移镜本身的时长(缓推 2-3s、急推 0.5s、横摇 2s) 情绪留白 :动作完成后保留几秒让观众消化(关键情绪 1-2s、普通过渡 0.3-0.5s) 首尾缓冲 :仍各预留 0.3s 用于裁畸变帧 示例 : 一个无台词反应镜——角色看到信息后表情从平静到崩溃: 微表情递进 2.5s + 缓推近景 1s + 崩溃后定格 1s + 首尾缓冲 0.6s ≈ 5s 无台词镜避坑 : 不要为了"凑够 5 秒"硬塞内容, 短而精 比长而空更有力 节奏型蒙太奇(多个 2-3s 短镜连切)要在 storyboard 标注 与 BGM 鼓点对齐 默剧表演镜务必配 BGM / 环境音, 纯静音 > 3s 会让观众以为视频卡了 ⏱️ 字段写作 00:00-00:03 (无台词) 动作描述 + 镜头运动 形式 每个分镜必须包含的 8 个字段 (格式参考下方示例): 🕘 总时长 📍 布景 (引用 background.md 的某个坐标方案) 👔 服装 (每个出场角色,每镜复述一次防 AI 遗忘) 🎬 动作与表情 (微表情 + 肢体语言。 必须 100% 还原剧本中的细节描写,严禁概括缩写 ) ⏱️ 说话顺序与时序 (精确到秒,标注谁先说、谁静音) 🎙️ 台词,声调与字幕 ( 必须一字不落地搬运原剧本所有台词文本 ;含语气指导 Tone;语言选择见 Step 5) 🎥 运镜 (机位、景别、推拉摇移) 🔄 转场 (向下一镜的衔接方式) 💡 分镜输出格式示例(单镜) : ### Shot 01 (00:00 - 00:05) **🕘 总时长** : 5s **📍 布景** : 赛博朋克面馆,霓虹灯牌闪烁 (坐标方案 A) **👔 服装** : 主角A (黑色夹克),配角B (红色围裙) **🎬 动作与表情** : A 猛地拍桌子,面汤溅出;B 吓得战术后仰。 **⏱️ 时序** : `00:00.0-00:01.5` B 放下面碗 (无台词); `00:01.5-00:04.5` A 说话; `00:04.5-00:05.0` A 怒视定格。 **🎙️ 台词** : - 主角A: "老板,这面里怎么有螺丝?" (语速: 偏快 / 愤怒质问) - [字幕]: Boss, why is there a screw in my noodles? **🎥 运镜** : 中景 (Medium Shot),机位随 A 拍桌子动作轻微震颤。 **🔄 转场** : 硬切 (Smash Cut) ⚠️ 强烈警告:不可删减原案! 以上示例仅为版式演示。实际生成分镜时, 🎬 动作与表情 与 🎙️ 台词 字段中, 绝对不允许为了保持版面清爽或“结构化”而私自压缩、概括原 script.md 中大段的长对白、脏话梗和极致的情绪描写! 原剧本怎么写,这部分必须一字不落地吃进分镜里。
Agent 识别该技能的关键词,点击任意一个即可复制。

该技能未提供触发词。

下载的 .skill 包内含以下字段。
字段 说明
format格式标识(skill/v1)
skill_id技能唯一 ID
name技能名称
version版本号
description技能描述
category所属分类(数组)
trigger_words触发词列表
tags标签列表
source来源标识
source_url来源链接(本页地址)
exported_at导出时间(每次下载生成)
system_prompt系统提示词正文
model_config模型参数:provider / model / temperature / max_tokens / top_p
examples示例
install_guide各平台导入说明(Coze / Dify / Claude / 自定义框架)
同一份技能可按不同平台格式导出。
.skill 标准格式,含 system_prompt 与 model_config,导入任意 Agent 框架即可使用 下载
.skillpro 增强格式,额外含脚本 / 工具 / 依赖 / 钩子占位 下载
.json 纯 JSON 导出,只含 system_prompt 与模型参数 下载
Coze 带 frontmatter 的 Markdown,Coze 平台导入用 下载
Dify Dify DSL,创建应用后直接导入 下载

每日精选 Skill 推荐,免费送到你邮箱

输入邮箱,每天接收一个精选 AI Agent 技能推荐。完全免费,持续更新。

验证码 --

提交后我们会发送一封确认邮件,点击邮件里的链接才会开始收信。

完全免费,取消任意时间。我们不会发送垃圾邮件。