RAG 记忆管理

产品里叫 RAG 记忆管理,有的界面写作「语义搜索库」。它负责把你的日记切块向量化,让伙伴能按语义搜到具体片段。

第一次配的话,先走 十分钟聊起来,确认开关打开、嵌入模型在、日记已经进库。本页讲参数、迁移和排障。

它和「回忆」不是一回事

回忆年轮RAG
形态总结文档,周记月报那些向量块加检索索引
目的压缩人生时间线精确找到某个具体片段
谁在用生成和复制共同回忆伙伴调用语义搜索工具

两者并行不冲突:总结管全貌,RAG 管细节。

日记怎么进 RAG

  1. 先在全局默认模型里配好嵌入模型。
  2. 之后保存日记会自动尝试嵌入。
  3. 有遗漏或失败的,打开 RAG 页点 全量扫描未索引日记 补齐。

你也可以手动添加记忆片段,然后用语义或全文检索翻看。

界面上还会显示向量块数量、维度、缓存占用、当前工作区的日记向量数这些信息。

可以调的参数

  • 召回数量 Top-K:一次取回多少个片段
  • 相似度阈值:低于这个分数就不算命中
  • 召回截断 Tokens:注入上下文的长度上限
  • 批量嵌入并发数

搜不到东西的时候,通常是阈值调太高了。

换嵌入模型要迁移

不同嵌入模型的向量维度一般不兼容。换了模型之后,务必按客户端提示执行 嵌入模型迁移,流程里会有备份、继续、恢复、取消这几个选择。

伙伴「不记得」怎么查

按这个顺序排:

  1. 这个伙伴是亲密伙伴吗?语义搜索和记忆类工具开了吗?工作伙伴默认用不了这些。
  2. 嵌入模型配好了吗?测连通过吗?
  3. RAG 页有没有提示未索引或失败?
  4. 刚从旧版迁移完?日记可能在了,但向量库还得重新全量扫描一次。
  5. 相似度阈值是不是太高?调低一点或者加大 Top-K 再试。

伙伴类型的区别见 AI 伙伴与对话