你明明教过,它还是忘了——这不是你的问题
上周二,你告诉 AI 团队使用带 OKLCH 色彩的 Tailwind。周五,你让它写一个新组件,它却返回 `bg-blue-500`。你叹了口气、纠正它,然后继续工作。这就是 2026 年 AI 编程助手的日常:它们都有记忆功能,但当你真正需要时,那段记忆似乎从未出现。
多数工具都能保存你告诉它的内容,真正经常失效的是下一步:面对当前这条消息,究竟应该从数百条已保存事实中取出哪些。如果正确事实没有附在问题前,哪怕数据库装得再满,AI 看起来仍像失忆。
Onevium 1.1.6 从头重做了这套机制。新的记忆系统会在你发送每条消息时运行,自动选出相关记忆,并在这条消息本身上清楚展示选择结果。
你会在应用里真正看到什么
日常使用会出现三项变化:
- 消息上出现一个小型记忆标签。 把鼠标移到任意一条自己的消息上,底部会显示类似“3 条记忆”的标签。点击后,弹出层会列出回答这条消息时提供给 AI 的具体记忆。无需再猜 AI 是否知道项目约定,你可以针对这一条回复直接核实。
- 设置中新增“用户规则”输入框。 打开设置 → Autonomy,页面顶部会看到一个自由格式的 Markdown 编辑器。写在其中的内容——例如“桌面应用优先使用 SQLite”“除非另有要求,否则用中文回复”“该项目使用 pnpm 而不是 npm”——会附加到所有项目的每次聊天中。它与 Cursor 的 User Rules 或全局 CLAUDE.md 思路相同,但直接放在其他 AI 设置旁边,并能跨项目使用。
- 置顶记忆每次都会注入。 在记忆页面点击任意记忆的图钉,它就会保证出现在 AI 的每一轮上下文中,适合那些绝对不能忘记的少数事实。其他记忆则根据当前问题按需检索。
它大致如何工作
发送消息时,系统会按顺序为 AI 组装三块上下文:用户规则、置顶记忆,以及以当前消息为查询条件,对其余全部记忆执行的一次新搜索。第三层正是解决“AI 忘了”问题的关键——无需等 AI 主动询问,相关上下文在它开始思考前就已经到位。
这个顺序也关系到成本。静态内容(第一层和第二层)会在首次调用后缓存在 Claude 一侧,只要没有变化就持续复用。只有第三层——动态搜索结果——会随每条消息重新计算并重新计费。因此,即使记忆上下文让提示增加约 800 个 Token,每轮实际新增计费的也只有约 450 个 Token,而不是完整的 800 个。
实际运行成本是多少
对于“这会不会烧掉很多 Token”,坦率的答案是不会,而且原因值得说清。记忆系统会做三件事,其中只有一件会调用付费模型:
- 检索(每条消息) — 在你的设备本地运行。我们使用小型本地嵌入模型与经典全文索引,在几毫秒内合并结果并选出最相关的五条。搜索本身不发起 API 调用,也不消耗 Token。
- 提取(会话结束时) — 一次低成本的 Haiku 调用会读取对话、提取值得保留的事实,并与已有记忆核对。每个会话约 0.0003 美元。
- 维护(每日一次,后台运行) — 降低旧记忆权重、合并重复项、归档过期内容。全部在本地完成,不调用模型。
审计记录:准确查看注入了哪些内容
除提取步骤外,所有保存工作也都在本地运行。任何内容都不会被永久删除;当一条记忆被更新内容取代时,它会归档而不是移除,因此一旦出现异常,你仍能审计历史。
你发送的每条用户消息,底部都会有一个小标签,记录 AI 回答时获得了哪些记忆。将鼠标移到消息上、点击标签,就能看到完整列表。如果 AI 做出了意外选择,你可以准确核实它当时拥有的上下文,并一键置顶或作废相关记忆。这枚标签正是让自动记忆可以放心保持开启的信任机制。
在哪里开启或关闭
新安装默认启用全部功能,但每一项都可以在设置 → Autonomy 中单独控制:
- 用户规则 — 位于 Autonomy 页面顶部。写入内容前默认关闭;其中的文字会全局应用于所有聊天。
- 记忆提取 — Memory 区块的主开关。如果不希望 AI 从对话中保存任何内容,可以完全关闭。现有记忆会保留,只是不再新增。
- 注入置顶记忆 — Memory 区块内的子开关,默认开启。如果想把置顶记忆留作参考,却不想每轮为它消耗 Token,可以关闭。
- 自动提取模型 — 选择执行事实保存工作的模型。默认使用 Haiku,每个会话成本约为十分之一美分;技术项目若需要更高召回率,可以切换到 Sonnet,或任何已经配置的第三方 Anthropic 兼容模型。
- 按项目覆盖 — 打开任意项目的项目设置,可以只为该代码库覆盖全局配置。例如个人项目保持完整记忆,工作项目则完全关闭。
这些情况下值得开启
如果你同时维护多个代码库、用 AI 完成真正的功能工作而不只是补全代码,或曾发现自己第二次解释同一条项目约定,新记忆系统通常第一周就能产生回报。保存成本每天只有几分之一美分,检索免费,每条消息上的审计标签也意味着控制权仍在你手中。
如果你主要用 AI 做一次性的代码补全,或不希望任何内容跨会话保存,可以关闭记忆。仅使用用户规则,也足以全局注入少量人工整理的事实,而不会发生自动保存。
无论如何,Memory v2 都会随 Onevium 1.1.6 一起提供。现有记忆会原地迁移,无需重新提取;升级后,每条消息上的记忆审计标签会立即开始工作。