🧠 图解记忆:贪心走一条,Beam 留多路,采样按概率探索;点击图片可查看原图。
三种解码策略
| 策略 | 原理 | 优点 | 缺点 | 适用场景 |
|---|---|---|---|---|
| 贪心解码 | 每次选概率最大的 Token | 快、稳定 | 易重复、缺多样性 | 代码/问答(配合Temperature=0) |
| Beam Search | 每步保留 Top-N 条候选路径 | 全局较优、连贯 | 慢、易重复、缺惊喜 | 翻译、摘要、机器翻译 |
| 采样(Sampling) | 按概率分布随机选 | 多样、自然 | 不稳定、可能跑偏 | 对话、创意写作 |
面试高频追问
- Beam Size 越大越好? 不是!越大越慢,且容易陷入重复(常见 4-8)
- 采样怎么控随机性? Temperature(整体)、Top-K(候选数)、Top-P(累积概率)三者组合
- 为什么机器翻译用 Beam Search? 因为要全局最优、不容许跑偏,可接受重复风险
- 为什么对话用采样? 多样性更重要,Beam 会显得呆板
面试话术
"解码策略主要分贪心、Beam Search 和采样三类。贪心最快但易重复;Beam 保留多条路径全局较优,适合翻译摘要;采样引入随机性更自然,适合对话创作。实际工程里问答和代码生成我用贪心+T=0,对话用采样+T=0.7。"
