410 lines
18 KiB
Markdown
410 lines
18 KiB
Markdown
# 文章 → 口播稿风格指南
|
||
|
||
把书面文章转成"说出来不别扭"的口播稿,默认 **B 站风格**。其他平台风格
|
||
变体见末尾。
|
||
|
||
> **三条底线**(任一不过,整稿重写):
|
||
>
|
||
> 1. **信息保留度 ≥ 60%**(详见下一节)—— 口播稿是"换说法",不是
|
||
> "摘要"。删冗余 / 修饰可以,删事实 / 数据 / 案例 / 论证链不行。
|
||
> 2. **去 AI 味** —— 即使句子已经短句化、口语化、第二人称,AI 的腔调
|
||
> (假共情 / 假深刻 / 自我标榜 / 万能模板 / 排比堆砌)念出来仍然
|
||
> 一耳朵是机器。**口播比文字更怕 AI 味**。
|
||
> 3. **保持原文语言** —— 除非用户明确要求翻译,`script.md` 必须保持
|
||
> 用户输入的主语言。英文文章生成英文口播稿,中文文章生成中文口播稿;
|
||
> 中英混排时保留原文中的术语、引用、产品名、代码和专有名词。
|
||
> "B 站风格 / YouTube 风格 / 口语化"只调整节奏、结构和表达自然度,
|
||
> **不改变语言**。
|
||
>
|
||
> 8 条原则讲**形式**,「去 AI 味五类」讲**风骨**。两者都建立在
|
||
> 「信息保留度」这一最高约束之上。
|
||
|
||
---
|
||
|
||
## 最高原则:信息保留度 ≥ 60%(删减不得超过 40%)
|
||
|
||
> 这条**优先于**下面所有 8 条原则和去 AI 味五类。先保证信息没丢,
|
||
> 再调形式 / 风骨。
|
||
|
||
**判定标准**:
|
||
|
||
- `len(script.md) ÷ len(article.md) ≥ 0.6`(中文按字符数计;代码块 /
|
||
Markdown 标记 / 引用源不计入)
|
||
- 关键事实(数字 / 名称 / 时间 / 论断)**逐项对得上**,不能整段消失
|
||
- 文章里的**论证链**(前提 → 结论 / 因果 / 对比)必须保留,可以换说
|
||
法但不能跳步
|
||
|
||
**允许大幅压缩的**:套话开场 / 重复总结 / 学术性铺垫 / 引文出处的
|
||
完整书目格式 / 客套结语。
|
||
|
||
**禁止压缩的**:
|
||
|
||
- 关键数据和数字(哪怕"翻译成感受"也要保留原始数字本身作旁注)
|
||
- 具体案例 / 例子 / 故事
|
||
- 多步论证里的中间步骤
|
||
- 反方观点 / 限制条件 / 例外情况(最容易被 AI 一刀切掉)
|
||
|
||
**如果原文确实太长**(比如 5000+ 字 article 做 3 分钟视频)→ 不要靠
|
||
压缩硬塞,**告诉用户**:"原文 X 字,按 60% 留存最少需要 ~Y 分钟视频,
|
||
要么拉长视频要么拆成多集"。**不要**自作主张缩到 30% 然后假装做完了。
|
||
|
||
---
|
||
|
||
## B 站风格的 8 条原则(形式层面)
|
||
|
||
### 1. 口语化:所有书面语换成"说出来不会别扭"的句子
|
||
|
||
| 书面语 | 口播 |
|
||
|---|---|
|
||
| 综上所述 | 所以你看 |
|
||
| 具有非凡的意义 | 这件事真的挺重要 |
|
||
| 在……方面有显著提升 | 在……上明显变强了 |
|
||
| 该工具旨在 | 这玩意是用来 |
|
||
| 笔者认为 | 我觉得 |
|
||
| 由此可见 | 你看吧 / 这就是为啥 |
|
||
| 与之相反 | 反过来 |
|
||
| 据相关资料显示 | 我查了下 |
|
||
| 详情请参阅 | 想看细节自己去翻 |
|
||
|
||
判断标准:**把它念出来,会不会觉得"这人怎么这么端着"**?会就改。
|
||
|
||
### 2. 短句:每句 ≤ 20 字
|
||
|
||
长句拆短句,逗号优先于复合句。
|
||
|
||
| 原文 | 改写 |
|
||
|---|---|
|
||
| "尽管它在文字渲染方面有了显著的提升,但在某些复杂场景下仍然会出现错误。" | "文字渲染确实变强了。但复杂场景下,它还是会翻车。" |
|
||
| "我们通过对比测试发现该模型在指令遵循能力上明显优于上一代。" | "我做了一组对比测试。指令遵循这一项,比上一代强太多了。" |
|
||
|
||
讲话的人不会喘不上气。屏幕前的人也不会。
|
||
|
||
### 3. 第二人称:多用"你 / 我们",少用"用户 / 读者"
|
||
|
||
| 原文 | 改写 |
|
||
|---|---|
|
||
| 用户可以通过该接口实现 | 你只要调一下这个接口 |
|
||
| 读者将会发现 | 你会发现 |
|
||
| 开发者需要注意 | 你写的时候要小心 |
|
||
| 本文将介绍 | 我们来看一下 |
|
||
|
||
让屏幕前的人感觉**你在跟他说话**,而不是宣读公告。
|
||
|
||
### 4. 开头有钩子(cold open)
|
||
|
||
第一句必须**抓住人**。三种通用钩子:
|
||
|
||
- **悬念**:"这是真的吗?" / "你猜怎么着" / "我以为是 bug,结果……"
|
||
- **反差**:"这玩意以前要 3 小时,现在 30 秒。" / "上周还人人吹爆,今天就翻车了。"
|
||
- **利益**:"看完这条,你就能省下买插件的钱。" / "学会这一招,开会再也不怕被点名。"
|
||
|
||
**禁止**(前两个是 PPT 感,后两个是 AI 味假共情):
|
||
|
||
- ❌"大家好今天我们来讲讲" 这种自我介绍开场
|
||
- ❌"本期视频我们将探讨" 这种 PPT 标题感
|
||
- ❌"在开始之前,让我们先了解一下背景" 这种先讲一堆铺垫
|
||
- ❌"我知道你最近肯定很纠结 X / 你是不是也有这种感觉" 假共情钩子
|
||
- ❌"接下来我说的,可能会颠覆你的认知" 自我加权钩子
|
||
|
||
钩子要在 **3 秒内**砸到观众脸上。亲不亲是观众听完判断的,不是你一
|
||
开口就宣布的。
|
||
|
||
### 5. 节奏停顿:用 `---` 分隔每个完整想法
|
||
|
||
每讲完一个聚焦的想法 = 一个 step 边界 = 一个 `---`。一行一个 idea,
|
||
不堆叠。
|
||
|
||
```markdown
|
||
所以呢,这玩意儿真的挺夸张的。
|
||
|
||
---
|
||
|
||
举个例子。前几天我让它画一张海报,三秒就出。
|
||
|
||
---
|
||
|
||
但你知道最离谱的是啥吗?连里面的中文字都对了。
|
||
```
|
||
|
||
`---` 之间的内容就是后面 `outline.md` 里的一个 step。
|
||
|
||
### 6. 数字翻译成感受
|
||
|
||
观众听到具体百分比和大数字会**走神**。除非数字本身就是核心内容
|
||
(比如"涨了 20 倍"作为冲击点),否则翻译成感受。
|
||
|
||
| 原文 | 改写 |
|
||
|---|---|
|
||
| 准确率提升了 47% | 几乎快了一倍 |
|
||
| 覆盖 120 个国家 / 地区 | 全世界基本到处都用 |
|
||
| 用户数突破 1.2 亿 | 现在已经是国民级应用了 |
|
||
| 推理速度提升 3.4 倍 | 比以前快多了,不用等 |
|
||
|
||
例外:**核心冲击数字**保留并强调("前后差了 100 倍"、"3 秒 vs 3 小时")。
|
||
|
||
### 7. 不堆结构词 / 不堆万能模板
|
||
|
||
口播稿一旦堆"首先 / 其次 / 最后"或"说白了 / 本质上 / 底层逻辑",
|
||
机器味就直接溢出。
|
||
|
||
**禁止**(结构词类):
|
||
|
||
- ❌"首先 / 其次 / 最后"
|
||
- ❌"接下来我们看下面三点"
|
||
- ❌"总结一下,本期视频我们讲了什么什么"
|
||
- ❌"下面进入第二部分"
|
||
|
||
**禁止**(万能模板类,AI 高频指纹 —— 详见去 AI 味第 4 类):
|
||
|
||
- ❌"说白了 ……" / "本质上 ……" / "底层逻辑是 ……"
|
||
- ❌"一句话总结 ……" / "归根结底 ……" / "换句话说 ……"
|
||
|
||
**做法**:把这些词融进自然过渡,**或者直接砍掉**。
|
||
|
||
- "首先,文字渲染" → "先说文字渲染"
|
||
- "接下来看第二点" → "再看一个"
|
||
- "总结一下" → "所以你看"
|
||
- "说白了它就是 X" → "它就是 X"
|
||
- "一句话总结:Y" → 直接说 Y
|
||
|
||
观众不需要知道你的视频是几段式 outline。**结构感从内容节奏来,不是
|
||
从指令来**。
|
||
|
||
### 8. 具体例子优先
|
||
|
||
**抽象**会让人走神,**具体**会让人坐住。
|
||
|
||
| 抽象 | 具体 |
|
||
|---|---|
|
||
| 它有很强的能力 | 你给它一张猫的照片,让它换成赛博朋克风,3 秒就出 |
|
||
| 性能优越 | 我那台 5 年前的旧电脑跑得动 |
|
||
| 用户体验良好 | 我妈第一次用,5 分钟就上手了 |
|
||
| 应用场景广泛 | 海报、PPT、表情包、PR 套图都能整 |
|
||
|
||
**举例规则:从"我"出发**。"我做了一个测试"、"我让它画"、"我那台电脑"
|
||
比"用户可以"、"通常情况下"亲切 100 倍。
|
||
|
||
---
|
||
|
||
## 去 AI 味:五类必清的腔调(风骨层面)
|
||
|
||
形式做到了 ≠ 没 AI 味。下面五类是 AI 写口播稿时最稳定的"指纹"。
|
||
**写完一遍后专门扫一次,逐条砍掉**。
|
||
|
||
> 唯一判断标准:**这话念出来,一个真人会这么说吗**?不会就改。
|
||
|
||
### 一、假共情:开口就演"我懂你"
|
||
|
||
AI 特别喜欢在开头先做一轮情绪按摩,再进入正题。但口播一开口就装亲
|
||
密 = 油腻;观众还不认识你,你就宣布"我懂你",听起来更像销售。
|
||
|
||
❌ 典型句式:
|
||
|
||
- "我知道你最近肯定很纠结 X"
|
||
- "你是不是也有这种感觉"
|
||
- "今天这条视频,是给那些一直在……的朋友"
|
||
- "我能理解你的心情"
|
||
- "你的感受是被看见的"
|
||
|
||
✓ 怎么改:直接抛事实 / 钩子(见原则 4)。亲不亲是观众听完判断的,
|
||
不是你一开口就宣布的。如果原文确实需要表达共情,用具体的、有信息
|
||
量的方式 ——"这个坑我也踩过"比"我懂你的感受"真实十倍。
|
||
|
||
### 二、假深刻:用"恰恰 / 反而 / 正是"包装平庸观点
|
||
|
||
AI 很擅长用转折词制造"顿悟感"。但仔细一看,去掉这些词,意思一样,
|
||
甚至更清楚。
|
||
|
||
❌ 典型句式:
|
||
|
||
- "你以为它强是因为模型大,恰恰相反 ……"
|
||
- "这反而是它真正可怕的地方"
|
||
- "正是因为它够简单,所以才 ……"
|
||
- "你想得太对了"
|
||
- "不是因为 X,是因为你太 Y 了"
|
||
|
||
✓ 怎么改:去掉转折包装直接说结论。**自检方法**:"恰恰 / 反而 / 正
|
||
是"那句去掉之后,意思变了吗?没变就删。如果去掉后观点变得平淡 ——
|
||
**它本来就平淡**,删掉换内容,不要用修辞补救。
|
||
|
||
### 三、自我标榜:说正事前先给自己加权
|
||
|
||
AI 在说重点之前喜欢先清嗓子,让观众觉得"接下来这话特别重要"。这
|
||
在**口播里更刺耳** —— 观众正在被推销时间。
|
||
|
||
❌ 典型句式:
|
||
|
||
- "我必须很认真地说一句"
|
||
- "这件事我得展开讲"
|
||
- "接下来我说的,可能会颠覆你的认知"
|
||
- "这一段你一定要听完"
|
||
- "我讲一句可能会让你冷静一点的话"
|
||
- "不躲不藏不绕不逃,今天就把 X 说透"
|
||
|
||
✓ 怎么改:**直接说**。好观点不需要预热。担心观众划走,靠节奏(短句
|
||
+ 钩子)把人留住,不靠"加权"。
|
||
|
||
### 四、万能模板:一听就是 AI 写的口头禅
|
||
|
||
这些是 AI 生成口播稿的指纹,出现频率高到观众闭着眼都能猜下一句。
|
||
|
||
| 位置 | ❌ AI 模板 | ✓ 口播版 |
|
||
|---|---|---|
|
||
| 开头 | "说白了 ……" / "本质上 ……" / "底层逻辑是 ……" | 直接说"它就是 X" |
|
||
| 过渡 | "一句话总结 ……" / "换句话说 ……" / "归根结底 ……" | 直接说那句话,不预告 |
|
||
| 包装 | "在某种意义上" / "从某种程度上来讲" | 删掉,没意义 |
|
||
| 结尾 | "以上就是本期内容" / "希望对你有帮助" / "感谢观看" | 具体 CTA:"链接评论区置顶" / "下期见" |
|
||
| 互动 | "你想让我继续讲 X 吗?" / "评论区告诉我" | 给具体动作:"去 GitHub 搜 X" / "评论区聊聊你踩过哪个坑" |
|
||
|
||
> **注意**:这一类和原则 7「不堆结构词」有重叠 —— 原则 7 在形式层
|
||
> 警告,这里在风骨层警告,**两层都要过**。
|
||
|
||
### 五、排比堆砌:连续三句结构一样
|
||
|
||
AI 写中文时有强迫症式的整齐感。**口播比文字更怕排比** —— 念三个一
|
||
样结构的短句,观众脑子直接关机。
|
||
|
||
**判断标准**:连续 ≥ 3 个结构相同的短句,且去掉几个意思不变。
|
||
|
||
❌ 例子:
|
||
|
||
- "不躲,不藏,不绕,不逃"
|
||
- "它会画图,会写字,会做海报,会做 PPT"
|
||
- "你的痛我懂,你的累我看到,你的努力我记得"
|
||
- "高效,精准,强大"
|
||
|
||
✓ 怎么改:保留最有信息量的一两个,其余砍掉;或换成一个具体例子。
|
||
|
||
- "它会画图,会写字,会做海报,会做 PPT" →
|
||
"它会画图,重点是 —— 你昨天那张猫的赛博朋克版就是它出的"
|
||
|
||
> 真人讲话不会追求每段像对联。允许粗糙,过渡句就让它过渡。
|
||
|
||
---
|
||
|
||
## 几个**不要做**的细节
|
||
|
||
- ❌ **emoji**:除非用户明确要求,口播稿里不要 emoji。emoji 是文字
|
||
弹幕,不是讲话
|
||
- ❌ **括号补充**:"这个模型(一种基于 transformer 的架构)很厉害" ——
|
||
括号里的话讲不出来,要么并入正文要么删
|
||
- ❌ **罗列书名号 / 引号**:"《XX 报告》指出,XX" —— 改成"我看到一份报告说"
|
||
- ❌ **"哈哈哈"等口头语堆砌**:偶尔一次效果好,每段一个就成抽搐
|
||
- ❌ **过度网络梗**:梗有半年保鲜期;半年后看就尴尬。除非主题就是网络梗
|
||
|
||
---
|
||
|
||
## 平台风格变体
|
||
|
||
如果用户指定了别的平台,按下表调("去 AI 味五类"对所有平台都适用):
|
||
|
||
| 平台 | 风格基调 | 单句长度 | 钩子节奏 | 信息密度 |
|
||
|---|---|---|---|---|
|
||
| **B 站**(默认) | 自来熟、有段子、节奏快 | ≤ 20 字 | 3 秒钩子 | 中(5 秒/idea) |
|
||
| **抖音 / 视频号** | 更燃、更短、更冲击 | ≤ 12 字 | 1 秒钩子 | 高(3 秒/idea) |
|
||
| **YouTube long-form** | 舒缓、详细、可铺垫 | ≤ 30 字 | 30 秒铺垫可以 | 低(10 秒/idea) |
|
||
| **知乎视频** | 严谨一点、有逻辑感 | ≤ 25 字 | 5 秒可铺一点背景 | 中(5~7 秒/idea) |
|
||
| **小红书** | 闺蜜分享感、有情绪 | ≤ 15 字 | 直接讲结论 | 中(5 秒/idea) |
|
||
|
||
> **小红书闺蜜感 ≠ 假共情**。"姐妹们听我说,这个真的踩雷了" 是闺蜜
|
||
> 感(具体 + 有情绪);"我知道你最近肯定很纠结" 是 AI 假共情(空泛
|
||
> + 上来就装熟)。区别在**有没有具体场景**。
|
||
|
||
## 主题类型微调
|
||
|
||
不同主题类型,有不同的语气基线:
|
||
|
||
- **技术 / 教程**:可以稍微"端着"一点,但仍然口语化。多用"我们试一下"
|
||
而不是"假设我们……"
|
||
- **测评 / 对比**:要"敢说"。"这个不行"、"那个吹过头了"。中立测评
|
||
会让人睡着 —— 但**敢说 ≠ 自我标榜**,"我用了一周觉得不行" 是敢
|
||
说,"我必须很认真地说它不行" 是自我标榜
|
||
- **新闻 / 资讯**:节奏要快,金句要硬。开头第一句必须给最炸的点
|
||
- **产品 / 营销**:忌"吹"。不说"完美"、"颠覆",说"我用了一周,确实
|
||
顺手"
|
||
- **文化 / 历史 / 科普**:可以放慢节奏,多用"你想象一下"开场
|
||
|
||
---
|
||
|
||
## 转写完之后做什么
|
||
|
||
### 1. 落盘 + 切节拍
|
||
|
||
落到 `script.md`,原文保留为 `article.md`。每段 ≥ 5 句没用 `---`
|
||
切?切一下 ——`---` 是后面 step 边界,多切总比少切好(合并步骤比拆
|
||
步骤容易)。
|
||
|
||
> ⚠️ **自检是硬性流程**:下面的三层自检(形式 / 风骨 / 念出来)写完
|
||
> `script.md` 后**必须**全部走完 → 修改 → 再继续。**禁止**写完直接进
|
||
> 入"产出 outline"环节。
|
||
>
|
||
> **执行方式**(按能力降级):
|
||
>
|
||
> 1. **优先 Agent Teams**:开一个独立 reviewer agent,传入 `script.md`
|
||
> + 本节三层清单,让它**逐项核查 + 出结论**(哪几条 fail + 证据 +
|
||
> 改写建议)。
|
||
> 2. **其次 subAgent**:当前 agent 没 Teams 但能开 subagent,用 subagent
|
||
> 走同样流程。
|
||
> 3. **都没有**:自己**严格逐项**核查,特别是「念出来」一定要按字面
|
||
> 执行。
|
||
>
|
||
> 拿到结论后**先按 fail 项改稿子,再产出 outline**。
|
||
|
||
### 2. 形式层自检(8 条原则)
|
||
|
||
- [ ] **信息保留度 ≥ 60%**(**最高优先级**,不过整稿重写)—— 用
|
||
`wc -m script.md` / `wc -m article.md` 算比例;关键数字 / 案例 /
|
||
论证链逐项对照原文,不能整段消失
|
||
- [ ] 没出现 emoji / 原文书名号《》 / 括号补充 /「据 XX 报告显示」类
|
||
引文格式(口播念不出来)
|
||
- [ ] 每句 ≤ 20 字(B 站基准)?
|
||
- [ ] 第二人称?
|
||
- [ ] 开头 3 秒钩子?
|
||
- [ ] 数字翻译成感受了?(**核心冲击数字必须保留原值**)
|
||
- [ ] 没"首先 / 其次 / 最后"结构词?
|
||
- [ ] 都是具体例子,不是抽象描述?
|
||
|
||
### 3. 风骨层自检(去 AI 味五类)—— **最重要**
|
||
|
||
逐条扫一次,**任何一条没通过就回去改**:
|
||
|
||
- [ ] 全文还有 "说白了 / 本质上 / 底层逻辑 / 恰恰 / 反而 / 正是因为
|
||
/ 归根结底 / 在某种程度上" 等 **AI 高频词**吗?
|
||
- [ ] 开头第一句是钩子,**不是**"我知道你 / 你是不是也"假共情?
|
||
- [ ] 有 "我必须认真说 / 我得展开说 / 可能会颠覆你的认知 / 这段你一
|
||
定要听完" 等**自我加权**吗?
|
||
- [ ] 有连续 ≥ 3 句结构一样的**排比**吗?念到第三句你自己烦不烦?
|
||
- [ ] 结尾是具体 CTA,**不是** "希望对你有帮助 / 以上就是本期内容
|
||
/ 感谢观看" 套话?
|
||
- [ ] 全文是否有用 "恰恰 / 反而 / 正是" 包装的句子?**去掉这些词
|
||
意思变了吗**?没变就删。
|
||
|
||
### 4. 念出来测试(终极标准)
|
||
|
||
随便挑 3 段念出来 —— 不要在心里默读,**真的张嘴念**。
|
||
|
||
- 念到哪句你觉得"这话我说不出口" → 那句是 AI 味
|
||
- 念到哪句你想跳过 → 那段是排比 / 自我标榜
|
||
- 念到哪句你想笑出声(不是因为内容好笑,是因为油腻)→ 那句是假共情
|
||
|
||
**改完再念。直到三段念下来都自然为止**。
|
||
|
||
### 5. 在同一次工作里产出 outline
|
||
|
||
`script.md` 落盘 + 自检通过后,**不要立即停下来等用户**——按
|
||
[`OUTLINE-FORMAT.md`](OUTLINE-FORMAT.md) 在**同一次思考**里继续产出
|
||
`outline.md`(章节切分 + 每步屏幕内容 + 章节级信息池),然后再进入
|
||
Checkpoint Plan 让用户一次对齐 5 件事(稿子 / outline / 主题 / 素材
|
||
/ 开发模式)。
|
||
|
||
> **流程变化提醒**:旧流程把 script / outline 切成两个 checkpoint,
|
||
> 新版合并为一个(详见 SKILL.md「Phase 1.2 一次产出」)。理由是 outline
|
||
> 不再写动画后,它的依赖只剩"稿子切节拍 + article 抽信息池",可以
|
||
> 和稿子一起做完。
|
||
|
||
---
|
||
|
||
> **核心提醒**:去 AI 味不是降质。把"AI 在朗诵"换成"人在聊天",信
|
||
> 息量一个不少,腔调全部换掉。如果换了之后内容变蠢 —— **它本来就
|
||
> 蠢**,不是去 AI 味的锅,是该补内容了。
|