链路观察与错误归因
你能沿一次请求的执行记录定位故障,区分观察到的事实和仍待验证的原因。
Lessons in Chinese · Notes v0.1
The lesson text and question bank are currently in Chinese. Navigation and explanatory illustrations are available in English.
核心概念
链路观察是把请求经过的关键步骤记录下来,例如身份检查、检索、生成、确认、工具调用和结果查询。它帮助回答“在哪里偏离预期”,不是把所有内容无差别保存。
记录应包含关联 ID、步骤输入输出摘要、资料与配置版本、耗时、错误码和可靠状态。日志要脱敏,不能记录密钥或无关个人信息。归因时先找最早的已确认偏差,再提出可验证假设,避免只怪模型。
情境拆解
虚构企业的助手回答了错误的门店制度。模拟记录显示:身份和门店识别正确,检索只返回过期文档,答案忠实引用该文档。已确认偏差在资料或检索阶段,优先检查有效期过滤;仅改回答语气没有解决原因。
另一次工单提交没有返回结果。若只有超时记录,不能断言创建失败;应继续查询模拟工单状态,并将结论标为待确认。
常见误区
单个错误码不一定是根因,模型解释也不是诊断证据。调试日志越详细不一定越好,还要控制保存范围和访问权限。评测与错误记录应从项目开始建立,本模块是在已有基线上深化诊断。
沿着一次错误找到最早分歧
模拟回答引用了旧制度。日志表明身份正确,检索却返回失效版本,模型忠实复述了片段。已经确认的错误是版本过滤问题,不是“模型不聪明”。
排查记录应区分观察、推断和下一项检查。仅看到最终错误,不能证明哪一层是根因。
动手:分析一条六步追踪
- 构造身份、检索、模型回答、字段校验、工具调用与状态核对六步模拟记录。
- 给每步写输入、输出、版本和是否符合预期,不填真实密钥或完整客户数据。
- 找最早有证据的分歧,并列出仍无法确认的假设。
- 为每个假设写一项能够证伪或支持它的检查。修复后用原样本重测,确认没有把问题转移到下一层。
追踪 ID / 固定样本:
步骤与版本:
预期 / 实际:
直接观察到的证据:
最早已确认分歧:
仍属假设的原因:
下一次定向检查:
改动后结果 / 未执行:检查产物
结论能够追到某一步的证据,而不是模型、提示词或数据库的笼统标签。日志只保留排查所需的最小内容,避免为调试再复制敏感信息。
Lesson self-test
You can retry. Answers are visible in the browser. This is a learning exercise, not a secure exam or certification.
Stored only in this browser, not uploaded or synced. Reading and self-tests are recorded separately.