跳到主要内容

学习反馈

每次你教智能体新东西后,它都会给你一个反馈——告诉你它学到了什么。这是确保教学质量的关键环节。

学习反馈卡片

当你教了一条规则或给了一个示例后,智能体会生成一张学习反馈卡片,总结它理解的内容:

学习反馈卡片

卡片包含的信息

字段说明
类型规则(Rule)/ 示例(Example)/ 偏好(Preference)
主题这条知识属于哪个领域
层级强制 / 建议 / 偏好
理解内容智能体用自己的话复述它理解的内容
适用范围这条知识在什么场景下会被使用
来源从哪次对话中学到的

如何确认学习是否正确

看到反馈卡片后,你有三个选择:

确认正确

如果智能体的理解与你的意图一致,点击"正确"。这条知识会被正式写入智能体的行为手册。

你:[点击 ✓ 正确]
智能体:"好的,已将这条规则记录到合同审查规范中。以后审查合同时,
我会自动检查违约金比例。"

修改理解

如果智能体理解得不完全对,你可以修改:

你:"理解基本正确,但补充一点:这条规则只适用于采购合同,
销售合同的违约金标准是 30%。"

智能体:

更新反馈卡片

撤销学习

如果智能体理解完全偏了,或者你改变了想法,可以撤销:

你:[点击 ✗ 撤销]
智能体:"好的,已撤销这条学习内容。这条规则不会被应用。"

纠正错误理解

有时候智能体可能在后续任务中表现出错误的理解。这时你可以直接纠正:

智能体:"[审查报告中] 第 5 条付款周期为 25 天,
低于 30 天标准,标记为高风险。"

你:"这里不对。25 天虽然低于 30 天标准,但差距很小,
应该标记为'中风险'而不是'高风险'。高风险是差距
超过 50% 的情况,比如付款周期只有 10 天。"

智能体:

纠正反馈卡片

查看学习历史

你可以随时查看智能体的完整学习记录:

  • 在对话中说:"你最近学了什么?""列出这周的学习记录"
  • 在智能体设置的 行为规范 页面浏览

每条学习记录都包含:

  • 学到的内容
  • 学习时间
  • 来源对话
  • 当前状态(生效中 / 已撤销 / 已修改)

学习存储机制

了解学习内容的存储方式,有助于理解反馈卡片各字段的含义:

存储位置内容说明
memory/ 目录事实、偏好、经验教训每条记忆一个 .md 文件,带类型标签
principles.md行为规则和约束经你确认的"必须做 / 绝不做"规则写入此处
relationship.md协作契约双方的沟通约定和工作方式

当你确认一条学习反馈后,智能体会根据知识类型将其写入对应文件。撤销操作则是将该条目标记为无效或从文件中移除。

记忆 vs 规则
  • 记忆:智能体"知道"的事实(如"用户喜欢深色模式"),影响回答内容
  • 规则:智能体"必须遵守"的行为约束(如"绝不在邮件中使用感叹号"),影响行为方式

一次对话中的多条学习

在一次较长的教学对话中,智能体可能同时学到多条内容。此时你会看到多张反馈卡片依次出现:

你:"记住三件事:
1. 周报用 Markdown 格式
2. 发给客户的邮件必须抄送项目经理
3. 代码注释用中文"

智能体:[生成 3 张反馈卡片,分别对应格式偏好、邮件规则、注释规范]

你可以逐张确认、修改或撤销,互不影响。

有效教学的最佳实践

做法效果
✅ 给出具体示例,而非抽象描述智能体理解更准确,反馈卡片质量更高
✅ 一次教一个主题避免混淆,每张卡片对应一条清晰知识
✅ 确认前仔细阅读"理解内容"字段发现理解偏差的最佳时机
✅ 纠正时说明"为什么"和"边界条件"智能体能泛化到类似场景
❌ 教了就走,不看反馈可能积累错误理解
❌ 一次灌输大量不相关规则容易混淆适用范围
建立定期复审习惯

建议定期(比如每周)花几分钟检查智能体新学到的内容,确保一切都在正轨上。就像定期跟徒弟沟通一样——越早发现问题,纠正成本越低。

下一步
  • 发现智能体学错了?前往 撤销与遗忘 了解如何回退
  • 想了解教学背后的完整原语体系?回到 六大原语 复习