aigc-video-cover-gpt · v1 · 2026-06-24 · sha256 c93d5dba243dd347

aigc-video-cover-gpt v1A

Immutable. This exact content is served forever at /api/v1/blob/c93d5dba243dd347.

---
name: aigc-video-cover-gpt
version: 1.0
description: 用 GPT Image 2 一步生成「商单/科普视频」高质量横版封面的工作流。输入一张人物参考图 + 一份视频脚本,自动发散标题钩子、套用商单封面公式、写出含锁脸与中文大字策略的 GPT Image 2 提示词(中间产物),并一次出若干张可发布的 16:9 封面。当用户说"给这个视频做封面""根据脚本出封面""用 GPT Image 2 做视频封面""把人物参考图做成封面"时触发。
---

# AIGC Video Cover (GPT Image 2)

## 适用场景

把「一张人物参考图 + 一份视频脚本」直接变成若干张可发布的 **16:9 横版视频封面**,由 **GPT Image 2 一步出含中文大标题的整张图**。面向商单视频、知识科普、揭秘解说这类需要「缩略图秒懂 + 有点击欲」的封面。

典型触发语:

- "给这个视频做封面 / 出 3 张封面"
- "根据脚本出封面,人物用这张参考图"
- "用 GPT Image 2 把人物参考图做成封面"
- "这条片子要发 B 站,封面帮我搞一下"

**与相邻 skill 的区别**:

- `aigc-poster-layout` 是**保护已定稿原图**做手工排版海报,不重绘主体;本 skill 是**从零生成**封面、接受 GPT Image 2 重画人物。
- `aigc-prompt-optimizer` 是通用 prompt 优化;本 skill 专做「脚本 → 封面」这一条龙,内置商单封面公式与锁脸打法。

## 核心约定(本 skill 的硬设定)

1. **一步出整图**:GPT Image 2 直接生成含中文大标题的完整封面,不做「底图 + 后期排版」两段式。
2. **接受 ~92% AI 近似**:人物用参考图重画,靠「禁美化 + 点名锚点」把身份拽回到工具上限,不做抠图换脸。详见 [[GPTImage2锁脸的脸占比上限_v1]]。
3. **只出 16:9 横版**:用自然语言 `Wide 16:9 horizontal video thumbnail`,GPT Image 2 不吃 `--ar`。
4. **若干张 = 多个标题钩子**:默认从脚本发散 **3 个**不同钩子,各出 1 张,而非同一张改比例。
5. **prompt 是中间产物**:先把 prompt 写清楚给用户过目(尤其文字内容与锚点),再调用出图。

---

## 第一步:拆参考图 + 拆脚本

### 1A. 从参考图抽「身份锚点」

找出参考图**最强的单一特征**(眼睛颜色/形状、脸型、发型、肤色、标志性配饰其一),作为锁脸成败的判据。

> 锁脸先看锚点有没有还原,不必逐项比对五官。**锚点丢 = 锁脸失败**([[GPTImage2锁脸的脸占比上限_v1]])。

记录:性别、年龄段、锚点特征、是否戴眼镜、气质(温婉/硬朗/书卷/喜剧)。

### 1B. 从脚本抽「封面要素」

读完脚本,提炼:

- **核心冲突 / 卖点**:这条片子最戏剧的一句话是什么。
- **题材情绪**:科技商单 / 揭秘暗黑 / 活泼梗 / 教学正经 —— 决定配色模板(见第三步)。
- **可上封面的钩子词**:能做成 2–4 字大标题的核心动词或名词(如「折解」「揭秘」「魔改」「过于先进」)。
- **品牌/栏目信息**:记下来但**不上封面**——IP 名、栏目名、英文 slogan 一律写进视频标题 / 简介,不进画面(见第三步要点 3)。

---

## 第二步:发散标题钩子矩阵(默认 3 个)

不要只想一个标题。从脚本发散 3 个不同角度的钩子,每个包含:

| 字段 | 说明 |
|---|---|
| 主标题 | 2–4 字核心词,缩略图主角 |
| 高亮字 | 标题里最戏剧的 1–2 字,用对比色单独跳出 |
| 副钩子 | 一句吊人的短句,常带「!」或「?」(如「建议低调使用!」「今天你哈了吗?」) |
| 英文幽灵层 | 全大写英文,做低透明度背景字(如 `DISASSEMBLE` `WAR` `MUSK`) |
| 角度 | 这个钩子打的是悬念 / 利益 / 冲突 / 反差 哪一种 |

三个钩子尽量打不同情绪(如:① 悬念式 ② 利益式 ③ 冲突式),让用户有得挑。

---

## 第三步:商单封面公式(从高质量模板提炼,核心资产)

这是这套「高质量封面」的统一骨架,每张图都按它搭:

### 版式骨架(16:9 横版)

```
┌─────────────────────────────────────────────┐
│   (顶角留空,不挂品牌条 / 栏目名 / 英文 slogan)    │
│  超大主标题(左/中)         主体(人物/产品/IP)   │
│  ▓▓▓▓ 高亮字 ▓▓▓▓          右侧 3/4 侧身/指向    │
│  英文幽灵层(半透明压在标题后)   或纯黑剪影        │
│  ── 副钩子短句 ! ──                            │
└─────────────────────────────────────────────┘
        ↑ 深色科技底 + 暗角 + 危险/电光氛围
```

要点:

1. **主标题占画面 40–55% 宽**,放左侧或中部;主体(人物/产品)放右侧,3/4 侧身、看镜头或指向标题。人物没素材时可用**纯黑剪影 + 高饱和底**(如马斯克选志愿)。
2. **主体要够大**:人物至少占到半身。脸越小越跑(工具硬上限),封面天然适合给脸足够像素。
3. **顶角默认留空——不上品牌条 / 栏目名 / 英文 slogan**(如「GenJi冷知识」「DAILY FACT CHECK」这类顶部标签一律不要)。封面只承载「主标题 + 高亮字 + 一句副钩子」,文字越少越秒懂。运营信息(IP 名、栏目名、期号)写进视频简介 / 标题,不上封面。用户明确反馈(2026-06-24)。
4. **暗角 + 危险氛围**:背景深色科技感(蓝黑/红黑),四角压暗托出主体与文字;揭秘类加骷髅/警示三角/电光火花制造点击欲。

### 字体与文字系统(封面成败关键)

- **主标题**:粗黑体或书法体,**必加厚描边/外发光**保证缩略图可读。常见三种配色:
  - 黄字 + 黑描边(揭秘/暗黑:投毒术、魔改)
  - 白字 + 局部红字(冲突/严肃:折解、缅北诈骗)
  - 白→蓝/紫渐变 + 白描边(科技:影视级视频模型)
- **关键词高亮**:标题里最戏剧的 1–2 字换对比色单独跳出(「战争」红、「诈骗」血红书法),其余字保持主色。
- **英文幽灵层**:全大写英文,低透明度、大字号,压在主标题后面当背景肌理。
- **副钩子**:小一号,带感叹号/问号,可加小色块底。
- **中英文对照**:主标题旁配同义英文小字(中文「马斯克」+ 英文 `MUSK`),增加设计感。

### 配色情绪模板(按题材选)

| 题材 | 主色 | 强调色 | 氛围 |
|---|---|---|---|
| 科技商单 | 蓝黑 | 电光紫 / 青 | 数据流、电路、光效 |
| 揭秘 / 暗黑 | 红黑 | 警示黄 | 骷髅、警示三角、火花 |
| 活泼 / 梗 | 高饱和撞色 | 紫 / 青 / 黄 | 漫画感、贴纸、问号 |
| 教学 / 正经 | 深蓝 | 白 / 暖金 | 干净、专业、信任感 |

---

## 第四步:写 GPT Image 2 提示词(中间产物)

把第二、三步的决定翻译成一条结构化 prompt。**先给用户看 prompt 再出图**,重点核对「文字内容」和「身份锚点」两块。

提示词分块(英文为主、中文字符串照抄):

```
[1·画幅] Wide 16:9 horizontal video thumbnail, bold YouTube/Bilibili cover style.

[2·锁脸] A [年龄/性别] with the EXACT facial identity from the attached
reference photo — keep the same [点名锚点:如 round face, large blue-grey eyes],
same face shape, eyes, nose, lips, skin tone. Do NOT beautify or alter features.
[主体景别与姿态:half-body, 3/4 turned to the right, pointing up / looking at camera].

[3·版式] Place a HUGE bold Chinese title on the [left/center], occupying ~50%
width. Main subject on the right.

[4·文字内容·逐条列清] Render ONLY this exact text — no other text anywhere:
  - Main title: "折解" in [color], thick [outline color] outline.
  - Highlight: the character "V4" in bright yellow.
  - Subtitle: "DeepSeek" white bold below.
  - Ghost English behind title: "DISASSEMBLE" large, low-opacity.
  - NO top brand bar, NO channel name, NO English slogan in the top corners.
  - Keep the top-left and top-right corners clean / empty.

[5·配色氛围] [配色模板]: deep blue-black tech background, electric purple glow,
vignette darkening the four corners, [危险元素:sparks / warning triangle / circuit lines].

[6·质感] Cinematic lighting, high contrast, crisp poster typography, ultra-detailed, 4k.

[7·负面] No garbled text, no misspelled Chinese characters, no extra random text,
no top brand bar / channel name / English slogan in the corners,
no watermark, no blurry low-quality.
```

写 prompt 的硬规则:

1. **锁脸块永远在最前面且显式禁美化**——GPT Image 2 默认会顺手美化导致跑脸。
2. **中文文字必须逐条列出确切字符串 + 颜色 + 位置**,别让模型自己编字。
3. **主标题字数压到 2–4 字**:中文越短越长的句子越容易糊/错字。复杂生僻字尽量避开或换近义短词。
4. **负面词必带** `no garbled text, no misspelled Chinese characters`。
5. 一个钩子一条 prompt;3 个钩子 = 3 条 prompt。

---

## 第五步:调用 GPT Image 2 出图

- 把参考图作为附件 + 对应 prompt 一起喂给 GPT Image 2,每个钩子出 1 张。
- 中文渲染有概率出错字 —— **预期 1–2 次重试**属正常,不是 prompt 写错。重试时只复述「确切文字 + 禁错字」,别整条重写。

---

## 第六步:自检 + 锁脸补救阶梯

出图后逐张自检:

- 缩到缩略图大小,**一眼能读到主标题**吗?描边够不够厚?
- **身份锚点**(第一步那个最强特征)还在吗?锚点丢就是锁脸失败,进补救。
- 中文有没有错字 / 多余乱码字?
- **顶角是否干净**——有没有混进品牌条 / 栏目名 / 英文 slogan 这类不该上封面的小标签?有就重出或裁掉。
- 主体够不够大、够不够抢眼?文字有没有糊住脸最好看的部分?
- 题材情绪对不对(暗黑题别出成小清新)?

**锁脸三级补救阶梯**(按性价比,来自 [[GPTImage2锁脸的脸占比上限_v1]]):

1. **对话式微调(首选)**:`The face is not matching the reference. Regenerate with her EXACT face from the photo: [点名锚点]. Keep pose, scene, text the same.` —— 只动脸不动景。
2. **拉近景别**:全身→半身/七分身,脸占比一上去锁脸立刻稳。封面本就该给脸足够像素。
3. **两步合成**(终极):先出脸部特写确认锁脸,再融合氛围图。要求最高时用。

> 收尾铁律:锚点对 + 气质对 + 文字无错 = 可定稿。**别为修小瑕疵重抽**——重抽有脸再次跑偏的风险,见好就收。

---

## 交付格式

交付时给:

- 3 张封面图路径(按钩子命名,如 `封面_悬念式_折解.png`)。
- 每张一句话:用了哪个钩子、哪套配色、保留了什么锚点。
- 用过的 prompt(中间产物,便于用户微调复用)。

不长篇讲设计理论。用户要的是能直接发的封面。

---

## 禁止行为

- ❌ 锁脸块不写在最前、不写禁美化(必跑脸)。
- ❌ 中文文字让模型自由发挥,不逐条列字符串(必出错字/乱码)。
- ❌ 主标题塞一长句、堆生僻字(缩略图糊成一团)。
- ❌ 只出一张就交付(要求是"若干张",默认发散 3 个钩子)。
- ❌ 主体做得太小、脸占比太低(违背工具锁脸规律,越缩越跑)。
- ❌ 出图错字直接整条 prompt 重写(应只复述确切文字 + 禁错字重试)。
- ❌ 把暗黑/揭秘题做成小清新配色(题材情绪错位)。
- ❌ 在顶角加品牌条 / 栏目名 / 英文 slogan 等小标签(用户明确不要;运营信息走标题简介)。

---

## 关联文档

- [[GPTImage2锁脸的脸占比上限_v1]] —— 本 skill 锁脸打法的实测来源(~92% 上限、禁美化、三级补救)。
- [[严格人脸一致性二创的范式阶梯_假说_v1]] —— 若用户要"复制级"真人一致,升级到后期换脸 / InstantID / Nano / LoRA。
- [[aigc-poster-layout]] —— 保护已定稿原图做手工排版海报(不重绘)的姊妹流程。
- [[aigc-prompt-optimizer]] —— 通用 AIGC prompt 优化,本 skill 的 prompt 写法与其同源。
- [[角色一致性金字塔]] —— 角色跨图一致性的总框架。