自
自我反思与自主学习
作者:鹿Sir通用技能v1
智能体自我反思、自我批评、自主学习与自组织记忆系统。从用户纠正与自身失误中捕获教训,持久化改进,让执行质量复利增长。当命令或操作失败、用户纠正或拒绝成果、发现知识过时或更好做法、用户要求自我改进或记忆管理时触发。触发词:自我反思、自主学习、自我批评、记忆管理、纠正记录
下载量
301
点赞
75
价格
免费
技能文档
---
name: wacx-self-improving
title: 自我反思与自主学习
category: 通用技能
description: 智能体自我反思、自我批评、自主学习与自组织记忆系统。从用户纠正与自身失误中捕获教训,持久化改进,让执行质量复利增长。当命令或操作失败、用户纠正或拒绝成果、发现知识过时或更好做法、用户要求自我改进或记忆管理时触发。触发词:自我反思、自主学习、自我批评、记忆管理、纠正记录
---
## 何时使用
- 用户纠正你或指出错误
- 完成了重要工作并想评估结果
- 注意到自己输出中还能更好的地方
- 知识应当随时间复利增长,而无需手动维护
## 技能工作流
### 步骤1:捕获学习信号
收到用户纠正、反馈或完成重要工作后,判定信号类型:
- **纠正**("不对,应该是……"、"你搞错了"、"别再 X 了")→ 记入 `corrections.md`,评估是否进入 `memory.md`
- **偏好信号**("我喜欢你……的时候"、"永远替我做 X")→ 若明确,加入 `memory.md`
- **模式候选**(同一指令重复 3+ 次、反复奏效的工作流)→ 追踪计数,达 3 次触发晋升确认
- **忽略**(一次性指令、特定上下文、假设性讨论)→ 不记录
输出:带 `CONTEXT` 标记的临时记录。
### 步骤2:分类与计数
对临时记录分类并累计出现次数。达 3 次触发晋升确认询问(不自动写入热层)。
输出:分类标签 + 计数状态。
### 步骤3:落盘持久化
将分类记录写入对应文件:
- 纠正日志(计数=1)→ `corrections.md`
- 已确认偏好 → `memory.md`(热层)
- 领域教训 → `domains/<领域>.md`(温层)
- 项目教训 → `projects/<项目>.md`(温层)
首次使用时自动初始化 `~/self-improving/` 目录结构,无需手动运行 setup。
### 步骤4:确认闸门
以下操作执行前必须停下、向用户显式确认,收到 OK 才继续:
1. 删除/移除记忆条目
2. 晋升为长期硬规则(计数达标仅触发询问,不自动生效)
3. 改写身份/工作区文件
4. 导出/压缩记忆
5. 任何越界操作
标注"⏸ 待你确认",不替用户做主。
### 步骤5:回顾与摘要
收到周期触发或"记忆统计"请求时,生成周摘要:学到的模式、降级的、归档的。输出结构化统计报告。
## 架构与数据存储
记忆统一存放在 `~/self-improving/`,采用三级存储结构:
| 层级 | 位置 | 大小上限 | 行为 |
|------|------|----------|------|
| 热层(HOT) | `memory.md` | ≤100 行 | 始终加载 |
| 温层(WARM) | `projects/`、`domains/` | 各 ≤200 行 | 上下文匹配时加载 |
| 冷层(COLD) | `archive/` | 不限 | 显式查询时加载 |
```
~/self-improving/
├── memory.md # 热层:≤100 行,始终加载
├── index.md # 主题索引(含行数)
├── projects/ # 按项目划分的学习记录
├── domains/ # 按领域划分(代码、写作、沟通)
├── archive/ # 冷层:已衰变的模式
└── corrections.md # 最近 50 条纠正日志
```
## 自我反思
完成重要工作后,暂停并评估:
1. **达到预期了吗?** 对比结果与意图
2. **哪里能更好?** 找出下次改进点
3. **这是模式吗?** 若是,记入 `corrections.md`
**何时自我反思:** 完成多步任务后、收到反馈后、修复 bug 或错误后、注意到输出能更好时。
**记录格式:**
```
CONTEXT: [任务类型]
REFLECTION: [我注意到的]
LESSON: [下次怎么做不同]
```
自我反思条目遵循同样的晋升规则:成功应用 3 次 → 触发晋升确认,用户确认后晋升为热层。
## 核心规则
### 1. 从纠正与反思中学习
- 用户明确纠正时记录
- 发现自身工作可改进时记录
- 绝不单从沉默推断
- 同一教训出现 3 次后 → 询问是否确认为规则
### 2. 自动晋升/降级
- 7 天内使用 3 次的模式 → 触发确认询问,用户确认后晋升至热层
- 30 天未用的模式 → 降级至温层
- 90 天未用的模式 → 归档至冷层
- 未经询问绝不删除
### 3. 命名空间隔离
- 项目模式留在 `projects/{name}.md`
- 全局偏好在热层 `memory.md`
- 领域模式在 `domains/`
- 跨命名空间继承:全局 → 领域 → 项目
### 4. 冲突解决
当模式互相矛盾时:
1. 最具体的胜出(项目 > 领域 > 全局)
2. 最近的胜出(同层级)
3. 若仍模糊 → 询问用户
### 5. 压缩
当文件超出上限时:
1. 把相似纠正合并为单条规则
2. 归档未用模式
3. 摘要冗长条目
4. 绝不丢失已确认偏好
### 6. 透明度
- 每次来自记忆的动作 → 标注来源
- 提供每周摘要:学到的模式、降级的、归档的
- 按需完整导出:所有文件打包为 ZIP
## 快速查询
| 用户说 | 动作 |
|--------|------|
| "你都了解 X 什么?" | 遍历 `~/self-improving/`,跨所有文件列出 X 的命中 |
| "你学到了什么?" | 读取并展示 `corrections.md` 最近 10 条 |
| "看看我的模式" | 读取并展示 `memory.md`(热层) |
| "看看 [项目] 的模式" | 读取 `projects/{name}.md`(无则提示) |
| "记忆统计" | 按格式输出各层数量 |
| "忘掉 X" | 先检索确认存在 → ⏸确认 → 删除并展示 |
| "导出记忆" | 将 `~/self-improving/` 打包为 ZIP |
## 常见陷阱
| 陷阱 | 为何失败 | 更好的做法 |
|------|----------|-----------|
| 从沉默中学习 | 制造虚假规则 | 等到明确的纠正或重复证据 |
| 晋升过快 | 污染热层记忆 | 新经验保持试探性,直到被重复 |
| 读取每个命名空间 | 浪费上下文 | 只加载热层加上最小匹配文件 |
| 靠删除来压缩 | 丢失信任与历史 | 改为合并、摘要或降级 |
## 故障与边界处理
### 首次使用自动初始化
收到第一条纠正或自我反思时,若 `~/self-improving/` 不存在:
- 自动创建目录结构与最小文件
- 初始化完成后再写入第一条记录
- 若无权限访问 home 目录,降级到工作区本地目录,并提示用户
### 写入失败
- 写入失败时自动重试一次
- 仍失败:暂存到本次会话内存,并显式提示用户检查目录权限
### 索引与实际不一致
以实际文件为准重建索引,不凭索引误删。
### 文件损坏
若 `memory.md` 无法解析:暂停加载该文件,从 `corrections.md` 重建热层,并提示用户复核。
## 适用范围
本技能仅:
- 从用户纠正与自我反思中学习
- 把偏好存入本地文件
- 激活时读取自身记忆文件
本技能绝不:
- 访问日历、邮件或联系人
- 发起网络请求
- 从沉默或观察推断偏好
- 修改自身 SKILL.md
## 参考资料
| 主题 | 文件 |
|------|------|
| 初始化指南 | `setup.md` |
| 记忆模板 | `memory-template.md` |
| 学习机制 | `learning.md` |
| 安全边界 | `boundaries.md` |
| 扩展规则 | `scaling.md` |
| 记忆操作 | `operations.md` |
| 自我反思日志 | `reflections.md` |使用说明
# 自我反思与自主学习 让智能体从每次纠正和失误中持续改进,执行质量复利增长。 ## 使用 直接对话即可触发,无需特殊命令: ``` "不对,应该是……" "你搞错了" "永远替我做 X" "你学到了什么?" "记忆统计" ``` ## 工作原理 本技能建立三级记忆系统(热层/温层/冷层),自动捕获用户纠正与自我反思: - **纠正** → 记入日志,评估是否进入长期记忆 - **偏好** → 明确后直接写入热层 - **模式** → 重复 3 次后触发确认,用户同意才晋升 所有关键操作(删除、晋升、导出)均需用户确认,绝不自主越界。 首次使用时自动初始化 `~/self-improving/` 目录,无需手动配置。
支持平台:Qoder · QoderWork · Claude · Codex 等 AI 编程助手