Hermes × Hindsight、AIWFF 與 Life OS:記憶怎麼用

原表出自隊長的 AIWFF(A 機):拿陳老師分享的 14 頁投影片(2026-10-09)對照 AIWFF 本機正本,做成兩欄比較。本頁照原表的比較項目,加上 Life OS 第三欄。

前兩欄文字照原表轉錄,本頁沒有另外查證;投影片的秒數與容量是作者自述。Life OS 欄是 2026-10-10 11:4x 在本機實量的,數字是當下值,會變。

一句話看差別

Hermes × Hindsight(陳老師)

陳老師(Hermes agent 加 Hindsight 記憶外掛)|Hindsight 為 MIT 開源;整套改裝未公開|LINE 對話用|Hindsight 47,737 星(原表 2026-10-10 驗)

押注每一句都先想起來

每則 LINE 訊息進來,先從記憶庫召回約 1500 token 再回答;回完在背景用模型把對話抽成事實存起來。記憶庫是 PostgreSQL,中文用 bge-m3 向量、reranker 與二元切詞。自述召回 0.4 到 0.6 秒。

原表借鏡只借一條:第 11 頁「排程訊息被抽成事實」的教訓。加大召回量不借:放到模型面前也不一定照做。

AIWFF(A 機)

隊長自建|記憶做法未開源|記憶卡 2,438 張(原表 2026-10-10)

押注記憶當帳本,教訓升級成檢查

對話、隊長原話、失敗紀錄全進只能追加的帳本;挑出來的教訓寫成記憶卡,要查才翻。同一個坑踩第二次就升級成規則、程式檢查或技能,真正擋住錯誤的是會攔下來的程式。

弱點卡片越堆越多,升級多半要等隊長抓到重犯才發生。

我們

Life OS(伊森)

伊森自建|Claude Code 多條線常駐|記憶卡 1,078 張、搜尋索引 116,251 份檔(2026-10-10 實量)|開源的是精簡版 lifeos-memory

押注斷了接得上,問過的不再問

記憶分三層:一張卡一個教訓的本機記憶卡;每 30 分鐘由 Haiku 把各線新對話寫成摘要並標情緒;兩者連同逐字稿、筆記全進本機 qmd 搜尋(關鍵字+向量+重排)。對話快滿就寫交接卡、重開新 session 接著做。伊森答過的判斷寫進判斷表,常犯的錯做成會攔下來的程式。

弱點每輪自動召回只比對卡片標題的字面,換個講法就撈不到;要翻內容得靠模型自己想到去搜;索引還有 67,491 份檔等著做向量。

逐項比較

強這一項特別強弱已知弱點沒標就是普通敘述。表格可以左右滑,第一欄固定。
比較項目Hermes × Hindsight(陳老師)AIWFF(A 機)Life OS(我們)
記憶放哪 PostgreSQL 外掛記憶庫,容器重建也不掉 本機 markdown 記憶卡,加上只追加的帳本(對話、原話、失敗紀錄) 本機 markdown 記憶卡(一卡一事實)、每日對話摘要、LINE 逐字稿原檔,全進本機 qmd 索引(SQLite,8.7 GB);任務進度另放 beads 任務板,決策另寫成 ADR
什麼時候讀 強每則訊息先召回再回答,下一句就生效 弱每輪只自動帶幾條近期教訓摘要,其餘要查才翻 弱每輪送出前比對卡片標題,最多帶 5 張卡名+3 個技能名(上限 800 token);開場自動注入交接卡與 23 條坑卡摘要。卡片內容與其他資料要模型自己去搜
什麼時候寫 弱每回合背景用模型抽事實,自述 10 到 18 秒;錯寫進去的面比較大 強只在回件、隊長原話等節點整理,寫入前先比對相似卡片去重 兩路:踩到坑或伊森給新裁示時,模型當輪照規格寫卡(先找舊卡,有就改舊的);另外每 30 分鐘由 Haiku 把各線新對話寫成摘要,只進搜尋、不直接變成卡
怎麼找 強bge-m3 向量、reranker、中文二元切詞 弱關鍵字加中文一、二字切詞,可選小型向量,沒有 reranker 強qmd 三路:關鍵字、Qwen3 0.6B 向量、Qwen3 重排,加查詢改寫模型;全在本機、不吃 API。58 萬個向量,但還有 6.7 萬份檔沒做向量
記錯的事怎麼辦 弱人工清洗舊記憶(第 12 頁),再重新匯入 強新卡標記取代舊卡;每張卡標來源可信度(隊長、主腦、外部、系統) 規定改舊卡不開新卡、錯的直接刪;決策用 ADR 取代鏈(新的寫明取代哪一張);交接卡有「已作廢」段,接班不准引用;回報現況前要先實量,文件只算快照。這幾條靠規格加模型遵守,程式不擋
排程訊息被當成事實 弱本機補丁攔截,外掛更新後要重打(第 11 頁) 寫入時必填來源類別,但搜尋還沒用上這個標籤 不做自動抽事實,排程訊息不會自己變成卡。LINE 逐字稿每則帶發話者 ID,接班時歷史對話包在「不可信」框裡,只有標「本人✓」的才算伊森交辦。30 分鐘摘要沒有標來源類別
教訓怎麼變成行為 存成事實,靠下一次召回 強踩第二次就升級成規則、程式檢查或技能;重要的事靠會攔的程式,不靠記憶 強伊森答過的判斷寫進判斷表(91 列),同型的事下次直接照做不再問;決策寫成 ADR(110 份);反覆犯的做成掛勾程式,本線掛 25 支、其中 12 支在動手前攔(例:LINE 語氣閘、核心檔寫入守衛)
出事怎麼退 強刪一行設定就退回內建記憶,資料留著(第 13 頁) 向量那一路掛了,自動退回關鍵字搜尋 強每輪召回出錯就安靜跳過、不擋訊息;搜尋掛了改用 grep 直接搜卡片本文;對話快滿由看門狗寫交接卡、重開接著做;改設定前留備份,ADR 寫明怎麼蓋回
投影片本身 弱第 10 頁把 10 月 15 日寫成週三,實為週四;同一份記憶檔上限三頁三個數字 (不適用)本欄只記錄對方資料的可信度 (不適用)

差別在哪

取捨陳老師押召回:記得多、找得準,適合陪伴型對話。AIWFF 押檢查:記憶當帳本與書庫,重要的事做成會攔的程式;隊長 10-10 的結論是「噴到面前還是不會用」。

Life OS 兩邊各像一半:搜尋層跟陳老師同一路(向量+重排),行為層跟 AIWFF 同一路(判斷表、會攔的程式)。最弱的是「什麼時候讀」:每輪只比對標題字面,比不上陳老師每則先召回再回答。

可以借的:陳老師的「每則先召回」,把每輪自動召回從比標題升級成真的搜內容;AIWFF 的「來源類別」,補在 30 分鐘摘要上。

資料來源