新版学习地图与样章
这本书希望帮助你解释大模型怎样回答,判断回答是否可靠,并把它放进一个可以检查的工作流。你可以从没有编程和数学背景开始阅读。
重构试读
这页和两章样章用于验证新版的学习顺序、图解和动画。全书的章节划分还会随着试读调整。图示在附近注明来源、数据身份与简化范围。
一张贯穿全书的地图
先区分图中的三种信息:模型在训练中学到的、你当次提供的、外部工具返回的。回答是否可信,需要另行检查。
阅读路线
| 从哪个问题开始 | 将理解什么 | 读后可以尝试什么 |
|---|---|---|
| 我在和什么系统对话? | 模型、产品界面、上下文与工具的关系 | 说出一次回答可能使用了哪些信息 |
| 回答怎样产生,能力怎样学来? | Token、数值表示、上下文处理、生成、训练与后训练 | 解释下一段文字怎样加入后续输入 |
| 为什么流畅的回答也会出错? | 知识、推理、证据、上下文和评估条件 | 检查一个结论的出处与适用范围 |
| 怎样把任务组织成工作流? | 规格、资料、检索、工具、核验和失败处理 | 画出每个检查点与停止条件 |
| 怎样知道自己的方案有效? | 基线、比较、评估、成本和复盘 | 在换模型或换领域后重新验证方案 |
先读两章样章
- 一次回答是怎样生成的:看输入怎样变成数值表示和候选分布,选择一个片段后,后续生成怎样变化。配分步 SVG 动画与可操作的候选示意。
- 带引用的回答,怎样才算有依据:用三份虚构资料观察错位引用,比较修正和资料不足的情形,设计一条会在证据不够时停下的流程。
两章暂时跳过了中间的技术细节。第一章负责建立机制地图,第二章把它连接到核查和实践;它们的最终章节位置会在全书展开时调整。
图与动画怎样读
先看图旁的问题,猜一次结果,再播放或分步观察。读完说明后换一个条件,检验自己是否能解释变化。
“概念示意”中的数字由作者设定;“真实模型输出”需要注明模型与版本;“论文结果”需要保留实验条件。动画展示的是解释顺序,实际计算可能并行执行或复用之前的结果。
网络资料与复用说明见视觉资源记录。其中列出已引入的 Distill 图示、外部交互入口与本书自绘动画。