RAG 記憶管理

產品裡叫 RAG 記憶管理,有的介面寫作「語意搜尋庫」。它負責把你的日記切塊向量化,讓夥伴能按語意搜到具體片段。

第一次設定的話,先走 十分鐘聊起來,確認開關打開、嵌入模型在、日記已經進庫。本頁講參數、遷移和排查。

它和「回憶」不是一回事

回憶年輪RAG
形態總結文件,週記月報那些向量塊加檢索索引
目的壓縮人生時間線精確找到某個具體片段
誰在用生成和複製共同回憶夥伴呼叫語意搜尋工具

兩者並行不衝突:總結管全貌,RAG 管細節。

日記怎麼進 RAG

  1. 先在全域預設模型裡設定好嵌入模型。
  2. 之後儲存日記會自動嘗試嵌入。
  3. 有遺漏或失敗的,打開 RAG 頁點 全量掃描未索引日記 補齊。

你也可以手動新增記憶片段,然後用語意或全文檢索翻看。

介面上還會顯示向量塊數量、維度、快取占用、目前工作區的日記向量數這些資訊。

可以調的參數

  • 召回數量 Top-K:一次取回多少個片段
  • 相似度閾值:低於這個分數就不算命中
  • 召回截斷 Tokens:注入上下文的長度上限
  • 批次嵌入並發數

搜不到東西的時候,通常是閾值調太高了。

換嵌入模型要遷移

不同嵌入模型的向量維度一般不相容。換了模型之後,務必按用戶端提示執行 嵌入模型遷移,流程裡會有備份、繼續、還原、取消這幾個選擇。

夥伴「不記得」怎麼查

按這個順序排:

  1. 這個夥伴是親密夥伴嗎?語意搜尋和記憶類工具開了嗎?工作夥伴預設用不了這些。
  2. 嵌入模型設定好了嗎?測連通過嗎?
  3. RAG 頁有沒有提示未索引或失敗?
  4. 剛從舊版遷移完?日記可能在了,但向量庫還得重新全量掃描一次。
  5. 相似度閾值是不是太高?調低一點或者加大 Top-K 再試。

夥伴類型的區別見 AI 夥伴與對話