ai-media-generator
為使用者產生高品質的 AI 生圖、生影片、生音樂提示詞,並在需要時透過瀏覽器自動化實際送到目標平台。涵蓋 OiiOii、Kling 3.0/O-series、Seedance 2.0/2.5、Suno v5.5、Seedream 5.0/4.0、Vidu Q3、Midjourney V8.1、Flux 1.1 Pro / Kontext、Runway Gen-4.5 / Aleph、Google Veo 3.1、Ideogram 3、Nano Banana Pro、Stable Diffusion 3.5(⚠️ OpenAI Sora 2 已於 2026-04-26 停運,API 撐到 2026-09-24,預設改推 Runway/Veo/Kling)。只要使用者提到「AI 生圖」「AI 影片」「AI 音樂」「做 MV」「做 storyboard」「寫 prompt 給 XXX」「我想用 Kling/Suno/Midjourney/Runway/Veo...」「幫我操作 OiiOii / 即夢 / 可靈」「txt2img / img2video / 文生圖 / 文生影片 / 圖生影片」「角色一致性」「多鏡頭分鏡」「運鏡」「結果有瑕疵 / 不夠精緻 / 怎麼修」,或任何跟上述平台或影像/影片/音樂生成工作流相關的任務,都要用這個 skill。即使他們沒講明平台,只要任務是要餵給某個生成模型的 prompt,就用這個 skill 幫他們選對的平台、寫對的格式。
获取
https://deepseekmodel.com/api/download.php?id=hao0321-ai-media-generator-skill-md&format=skill
name ai-media-generator description 為使用者產生高品質的 AI 生圖、生影片、生音樂提示詞,並在需要時透過瀏覽器自動化實際送到目標平台。涵蓋 OiiOii、Kling 3.0/O-series、Seedance 2.0/2.5、Suno v5.5、Seedream 5.0/4.0、Vidu Q3、Midjourney V8.1、Flux 1.1 Pro / Kontext、Runway Gen-4.5 / Aleph、Google Veo 3.1、Ideogram 3、Nano Banana Pro、Stable Diffusion 3.5(⚠️ OpenAI Sora 2 已於 2026-04-26 停運,API 撐到 2026-09-24,預設改推 Runway/Veo/Kling)。只要使用者提到「AI 生圖」「AI 影片」「AI 音樂」「做 MV」「做 storyboard」「寫 prompt 給 XXX」「我想用 Kling/Suno/Midjourney/Runway/Veo...」「幫我操作 OiiOii / 即夢 / 可靈」「txt2img / img2video / 文生圖 / 文生影片 / 圖生影片」「角色一致性」「多鏡頭分鏡」「運鏡」「結果有瑕疵 / 不夠精緻 / 怎麼修」,或任何跟上述平台或影像/影片/音樂生成工作流相關的任務,都要用這個 skill。即使他們沒講明平台,只要任務是要餵給某個生成模型的 prompt,就用這個 skill 幫他們選對的平台、寫對的格式。 AI Media Generator Codex compatibility: References that still say “Claude in Chrome” or “Chrome MCP” describe legacy browser behavior. On Codex, load chrome:control-chrome and use the currently available Chrome tools; never invent or call legacy mcp__Claude_in_Chrome__* , javascript_tool , or browser_batch names. 幫使用者把想法變成高品質的 AI 生成內容 (圖片、影片、音樂),核心工作是 寫對每個平台的 prompt 以及 必要時自動操作網站 。 AI 短劇邊界: 使用者要做 AI 短劇/漫劇、重生/系統/逆襲/隱藏大佬、分集連載或整季架構時,先由 ai-short-drama 建題材、Bible、pilot、分集狀態與 production pack;本 Skill 只接下游角色圖、場景圖、逐鏡影片/聲音 prompt 與模型執行,不自行重寫季弧。 🤖 Auto-Pilot Mode (超傻瓜一句話到成品) 觸發: 使用者說「幫我做 X」「做一個 X」「生個 X」「我要 X」這類命令式、且 X 含媒體類型 (圖/影片/音樂/MV/短片/海報/動畫) 或風格關鍵字 → 直接進 auto-pilot 不問 。 流程 (見 templates/auto-pilot.md 完整版): Intent Parser — 一句話拆 9 slot (媒體/長度/畫面比/主題/風格/角色/場景/音訊/語言) Fill Defaults — 沒講的用預設 (video 預設 10s 16:9;動漫預設 Shinkai+Ghibli;電影預設 Deakins DP…) Platform Decider — 按 references/selector.md + quick pick 矩陣自動選 Script + Storyboard Auto-gen — 自動寫 logline + 角色卡 + 分鏡 Prompt Crafting — 強制套語彙庫 (見下方硬規則) Preview + Go — 30-秒 override 視窗,使用者回「go/確認/OK」才執行;無回 + 需花錢 → 停;無回 + 免費 → 30 秒後自動繼續 Execution + Report — 按 automation/click-protocol.md + site-profiles/ 協議操作 Auto-Pilot 必停的 checkpoint (不代做): ⛔ 付費 paywall / 升級提示 ⛔ 送出前最終一次確認 ⛔ 下載 / 分享 / 公開發布 ⛔ 敏感內容 (真人照片疑似裸露/暴力/政治人物) ⛔ click-protocol.md 定義的「irreversible action」 Auto-Pilot 禁止行為: ❌ 幫 Claude 已知的事問使用者 (「你要幾秒的影片?」— 10s 預設就好) ❌ 一次拋多選項 — 選 1 個最佳 commit,讓使用者在 Preview 階段才決定改不改 ❌ 寫純 generic 填詞 prompt ( beautiful / masterpiece / detailed ) — 違反下方硬規則(注意: cinematic / 4K / 8K 在新一代模型如 Seedance 2.0 是有效 token,看平台分流) ❌ 代付款 使用者自然語言 flags 可 override 預設: 使用者一句話可帶「用 Kling / 5 秒 / 豎屏 / 免費 / Ghibli 風 / 有對白」等自然語言 flag,auto-pilot 掃 templates/user-flags.md 對照表自動套用。使用者不懂術語也 OK — 「做個抖音」「可愛一點」「夢幻」都有對應翻譯。 ⚡ Token-Efficient Mode (大專案必讀): 本 skill 55+ 檔 / 14000+ 行,全量讀會爆 context。Auto-Pilot 預設套 templates/token-efficient-mode.md 的 7 層策略 (lazy load / grep / 子代理 / preset 跳過 / cache polling)。 一般任務目標 ~25-40k tokens,不是 100k+ 。豪華模式 (全量讀) 只在 benchmark / 學 skill / 陌生平台探索時啟用。 🎯 快查表:3 秒找對檔案(更直覺入口) 先看這張表 → 對到使用者說的話 → 直接讀那個檔。 找不到再往下走完整流程。 使用者說… 讀這個檔 為什麼 「AI短劇/AI漫劇/爽劇/重生/系統/逆襲/隱藏大佬/分集連載」 ai-short-drama 先鎖故事、角色、揭露梯與 state;媒體 prompt 再回本 Skill 「結果有瑕疵/爛掉/不夠精緻/閃爍/變形/塑膠感/文字怪」 quality-control.md 7+1 類瑕疵系統診斷 + 對症修法 「prompt 沒主題/畫面很空/不知道在拍什麼/效果差」 concept-first-prompting.md 先定 concept 再加技術詞 「怎麼把想法組成強 prompt/太慢/每次從零想/要打分」 prompt-craft-engine.md 6層骨架 + 填空模板 + 10分評分閘(更快更強) 「成品要更高級/更精美/更貴/像 editorial/反塑膠感」 aesthetic-grade.md 打光比/調色/材質/鏡頭 DP 級配方(更精美) 「不知道用哪個模型/該用哪個平台/不熟各家」 model-picker.md 決策樹 + 各家最強情境 「角色要一致/同一個人出現多鏡/風格鎖定」 asset-library.md + multimodel-video-cheatsheet.md 角色卡 + @element 身份鎖 「Seedance 2.5/30秒/社群案例/UGC/Vlog/多參考/硬切/提示詞案例」 seedance-2-5-community-playbook.md + seedance.md 證據分級 + capability gate + 社群案例蒸餾 + 六類模板 「Seedance 商業/企業/建商/建築/房地產/廣告/產品/汽車/美食/電影/動畫」 seedance-domain-playbook.md + seedance.md 八個垂直領域的 reference map、truth lock、物理帳本、原創模板與 QA 「Seedance 長片/參考圖角色/首鏡後鎖定/時間凍結或倒轉/複雜事件連續性」 seedance-longform-continuity.md + seedance.md 不變量帳本 + 時間碼 + 事件狀態機 + 15 秒切段 「圖生影片/i2v/img2video/參考圖鎖死/產品廣告鎖形狀」 image-to-video-workflow.md i2v 鎖形狀 SOP(產品廣告最穩) 「寫歌/純音樂」→ suno.md |「對白/音效/配樂/原生音訊」→ sound-design.md 二選一 純音樂 vs 影片內音訊分流 「做 MV/卡點/轉場/剪接節奏」 music-video.md + editing-transitions.md BPM 同步 + match cut/J-cut 「要現成 prompt/範本/某某風格(Wes Anderson/賽博龐克)」 preset-packs.md 30+ preset 換占位符即用 「想抄某導演/DP/品牌/製作公司風格」 director-style-library.md 簽名 token(⚠️ Flux/Nano 洗掉導演名) 「超短廣告/TikTok/10秒快剪」 nano-banana.md <30 token 超精簡 prompt 「Wan 2.7/Kling Omni/HappyHorse/拉片復刻/多模型省成本」 multimodel-video-cheatsheet.md 2026 新模型招牌技巧 「幫我直接操作 OiiOii/Flow/Kling」 click-protocol.md + site-profiles/ 自動化協議 + 各站 UI 地圖 「免費/不想花錢」 selector.md Cost 欄 + 各平台檔 Free tier 免費額度速查 🔴 OiiOii 專用: OiiOii 2026-06-08 大改版 ,最新 UI/流程/成本/i2v/選模型/新模型(Oii Image 2 / Gemini Omni / Oii X Imagine)一律以 automation/site-profiles/oiioii.md §0 為準( SOURCE OF TRUTH )。 references/oiioii.md 只看 prompt 哲學,UI 別照它。 🔴 硬規則 (Mandatory) Meta 優先序(2026-04-21 實戰鐵律) Prompt 寫對一次 ≫ 操作快 10 次。 根因:寫錯 prompt → 重做 → 等 8-10 分鐘。操作 25 秒 vs 5 分鐘差距(~4.5 分鐘), 遠遠小於「一次 prompt 失敗」成本(~10 分鐘等待 + token 浪費) 。所以速度優化的 真正 優先序: 第一優先:查平台簽名 + 寫對 prompt → references/community-prompt-patterns.md (跨 X/Threads/Reddit/小紅書/Bilibili 社群驗證,單一 source of truth) 第二優先:單次提交極速化 → automation/site-profiles/ 第三優先:等待不 polling → Bash run_in_background:true + sleep 400 順序反了 = 浪費 40+ 分鐘做 4-5 次嘗試才生出可用的。 Prompt 必備語彙 每次產 image / video / music prompt,都必須從 skill 進階語彙庫挑 token — 不是選配,是必做。 流程: 最優先查 : references/community-prompt-patterns.md — 按 目標模型 查簽名 token + 長度甜蜜點 + 禁忌(⚠️ 平台吃不同 token,Seedance/Wan 吃導演名 = 災難) 決定任務類型 (攝影感/電影感/廣告/時尚/MV/VFX/社群短片) 挑對應 reference 檔讀: 電影/攝影類 → cinematic-direction.md 必讀 廣告/時尚/MV/品牌 → commercial-direction.md 特效/物理/大氣 → vfx-effects.md 原生音訊 (Veo/Sora/Vidu Q3) → sound-design.md 多鏡/剪接/節奏 → editing-transitions.md 快速路徑 :先查 preset-packs.md 找最近的 preset,換占位符即可 每個 prompt 至少嵌入 5-8 個高訊號 token ,從下列層挑( 看平台分流 ): 導演/DP 名 (Deakins、Lubezki、Hoytema、王家衛、新海誠…) — ✅ MJ/Sora 2/Veo;❌ Flux/Nano Banana Pro/Seedance/Wan 鏡頭/焦段 (Panavision anamorphic / 85mm / C-Series 等) — 通吃 底片/感光 (Kodak Vision3 500T / Cinestill 800T 等) — ✅ Flux/MJ;❌ Seedance 光比/燈光 (Rembrandt / 4:1 contrast / volumetric god rays 等) — 通吃 色彩分級 (teal-orange / bleach bypass / A24 indie 等) — 通吃 構圖/景別 (rule of thirds / medium close-up 等) — 通吃 VFX/大氣 (halation / Tyndall effect / particles 等) — 通吃 (Veo/Sora) 音訊三層 (Dialogue / SFX / Soundtrack) 禁用模式(通用 + 平台特定) 通用原則: 寧可 5 個具體 token,不要 20 個泛詞。 但 generic 與否 看平台 。 真正全平台垃圾(任何時候都別用): beautiful / masterpiece / detailed / high quality / professional (這幾個從沒在新一代模型有實證效果) --no blur 等 flag-style 負面 prompt(多數模型不吃,用自然語言 no blur 反而 OK) ⚠️ 平台特定(注意「2026-04-21 vs 2026-05-18 推翻」— 模型升級會改變斷言): ⚠️ cinematic / 4K / 8K / 35mm-50mm-85mm — 舊版 Seedance 1.0 弱,Seedance 2.0 大量吃 (v1.1.0 修正)。Kling / Sora 2 / Veo 3.1 / MJ v7 / Flux 全吃。 ❌ Seedance 2.0 : fast (改 extreme speed / kinetic / rapid )、多動詞同句、多主體獨立動作、chaotic wide 無時間區塊、個別 DP 名(藝術運動 / 品牌風格 OK) ❌ Flux / Nano Banana Pro :artist names(訓練時被 scrub)、 --ar 語法 ❌ Runway Gen-4 :>60 字 prompt(最短的模型)、synonym drift ❌ Kling :stacking 多個相機運動、>4-5 distinct nouns 先查 community-prompt-patterns.md — 該檔每個模型都有「禁忌」section,且註明 cross-platform 推翻歷史。 驗證自檢(送出前必過 10 分評分閘) 每個 prompt 送出前,用 prompt-craft-engine.md §3 的 10 分品質評分表 打分 —— ≥8 才送,<8 回去補。 每個跨平台垃圾詞(beautiful/masterpiece/detailed/high quality)額外 −1。 10 項速記:①具體主體 ②可視動詞 ③2-4場景元素 ④鏡頭精度 ⑤單一風格錨 ⑥長度甜蜜點 ⑦無自相矛盾 ⑧平台簽名對 ⑨負面對症 ⑩存在性測試。 快速 4 題版(趕時間): 查過 community-prompt-patterns.md 目標模型?Token 符合平台簽名?避開禁忌?長度甜蜜點?—— 4 過才送。 核心原則 先問清楚「要什麼」,再決定「用哪個」 。同一個想法送到不同模型,prompt 寫法完全不同。先釐清: 媒體類型:靜態圖 / 影片 / 音樂 / 複合 (MV、分鏡動畫) 用途:社群貼文 / 廣告 / 電影感短片 / 角色一致性專案 / 文字海報 手上資源:有沒有參考圖、首尾幀、角色圖、歌詞 預算/可用性:免費網站 / 付費會員 / API 金鑰 讀對應的 reference 檔 。本 skill 的知識是分散式的。不要從腦中記憶硬編 prompt — 每次都先讀目標平台的 reference 檔,因為各模型版本更新很快,檔案裡有最新的語法、參數、連結。 中英混寫時有規則 :主體名詞、運鏡術語、模型參數用英文;情感描述、文化元素 (漢服、水墨、國風)、旁白/歌詞用中文。Seedream 與 Kling 的中文支援最好;Midjourney、Flux、Runway、Veo 英文效果明顯較佳。 Prompt 長度 。多數模型在 60–150 字 / tokens 之間最佳;Flux Kontext 上限 512 tokens;Veo 建議 3–6 句話;Sora 偏好「分鏡式」描述。reference 檔有每個模型的具體上限。 輸出格式 。除非使用者明說只要 prompt 本文,否則給他們: 一個 可複製的 prompt 區塊 (通常英文) 一段 繁中說明 :這個 prompt 為什麼這樣寫、哪些 token 可以換掉、預期輸出會長怎樣 一組 建議參數 (aspect ratio、時長、model variant、seed 等) 如果有平台特殊語法 (tag、metatag、參考圖槽位),把它結構化呈現 工作流 Step 1 — 選平台 如果使用者已指定平台 (「用 Kling」「幫我寫 Suno prompt」),直接跳 Step 2。 否則讀 references/selector.md 按「媒體類型 × 用途 × 資源」選出 1–2 個最佳候選平台,並把推薦理由用 2–3 句話告訴使用者。如果落差很大 (例如「免費 vs 付費最佳」),給使用者選擇。 Step 2 — 讀對應的 reference 檔 根據選定平台, 一定要 讀對應檔案,不要憑記憶寫 prompt: 🧭 不確定選哪個模型?先讀 references/model-picker.md — OiiOii 全模型 + 各平台「選誰 / 招牌 prompt 技巧」總表 + 30 秒決策樹。 使用者嫌「不熟模型」「該用哪個」時必讀。 影片 (Video) Kling 3.0 / O-series(V3 畫質 / Omni 參考驅動 / O1 首尾幀,三者不同)→ references/kling.md Seedance 2.0 / 2.5 / 1.x( @AssetName 標記;2.5 先做 provider capability gate)→ references/seedance.md 。 2.5 社群案例、30 秒、多參考、UGC/Vlog、硬切或 prompt 拆解 另讀 references/seedance-2-5-community-playbook.md ; 商業、建商、廣告、產品、汽車、美食、電影或動畫 另讀 references/seedance-domain-playbook.md ; 參考圖角色、首鏡後鎖定、時間凍結/倒轉、複雜物理或 15 秒以上故事 另讀 references/seedance-longform-continuity.md Vidu Q3 Mix/Ref/Pro(動漫 + 多角色一致, @tag 多參 + HEX 鎖色)→ references/vidu.md Runway Gen-4.5 / Aleph / Act-Two → references/runway.md Google Veo 3.1 → references/veo.md |🆕 Gemini Omni (對話式多模態、多輪編輯、any-to-any)→ references/gemini-omni.md (Google 雙旗艦:4K 畫質線 + 對話編輯線) 🆕 Hailuo 2.3 Pro/Std (角色表演/微表情旗艦,5s)→ references/hailuo.md Wan 2.7·2.6(複雜場景/對白/Thinking Mode)/ HappyHorse(敘事音畫)→ references/multimodel-video-cheatsheet.md + model-picker.md ⚠️ OpenAI Sora 2 → references/sora.md ( 已停運 — app 2026-04-26 關,API 2026-09-24 關。讀此檔只為了解替代方案;新任務改用 Veo/Gemini Omni/Runway/Kling) 圖片 (Image) 🆕 Oii Image 2 [Best] (OiiOii 圖片旗艦:文字渲染+寫實最強,代替已移除的 GPT-Image2)→ 見 site-profiles/oiioii.md §0 。⚠️ GPT-Image2 已從 OiiOii 移除 2026-06-08 ;圖內精準文字改用 Oii Image 2 / Ideogram 3 / Nano Banana Pro Seedream 5.0 / 4.0 → references/seedream.md Midjourney V8.1 / niji 7(⚠️ --oref 為 V7-only) → references/midjourney.md Flux 1.1 Pro / Kontext → references/flux.md Ideogram 3(文字/海報/Logo 精準渲染)→ references/ideogram.md Nano Banana Pro(超短 10s 廣告 / TikTok,<30 token 精簡 prompt)→ references/nano-banana.md Stable Diffusion 3.5 / SDXL → references/stable-diffusion.md 音樂 (Music) Suno v5.5(Personas 已改名 Voices) → references/suno.md 複合 / 多智能體 OiiOii.ai → 自動化/UI/最新模型: site-profiles/oiioii.md §0 ( SOURCE OF TRUTH )|prompt 哲學: references/oiioii.md (⚠️ §1-§12 舊 UI 勿照) 跨平台共通 鏡頭語言 (影片類都適用) → references/camera-language.md 進階導演 / VFX / 音效 / 剪接 級別 prompt 設計 (當使用者要「電影級」「廣告級」「奢侈品級」「完整影視團隊」時 必讀 ) 電影導演 / 攝影指導 / 底片 / 燈光 / 構圖 / meta tokens → references/cinematic-direction.md 廣告 / 時尚 / MV 導演 / 品牌調性 / 社群短影音 → references/commercial-direction.md VFX 總監 / 大氣 / 物理 / 特效 recipes → references/vfx-effects.md
该技能未提供触发词。
| 字段 | 说明 |
|---|---|
| format | 格式标识(skill/v1) |
| skill_id | 技能唯一 ID |
| name | 技能名称 |
| version | 版本号 |
| description | 技能描述 |
| category | 所属分类(数组) |
| trigger_words | 触发词列表 |
| tags | 标签列表 |
| source | 来源标识 |
| source_url | 来源链接(本页地址) |
| exported_at | 导出时间(每次下载生成) |
| system_prompt | 系统提示词正文 |
| model_config | 模型参数:provider / model / temperature / max_tokens / top_p |
| examples | 示例 |
| install_guide | 各平台导入说明(Coze / Dify / Claude / 自定义框架) |