Hermes × Hindsight、AIWFF 與 Life OS:記憶怎麼用
原表出自隊長的 AIWFF(A 機):拿陳老師分享的 14 頁投影片(2026-10-09)對照 AIWFF 本機正本,做成兩欄比較。本頁照原表的比較項目,加上 Life OS 第三欄。
前兩欄文字照原表轉錄,本頁沒有另外查證;投影片的秒數與容量是作者自述。Life OS 欄是 2026-10-10 11:4x 在本機實量的,數字是當下值,會變。
一句話看差別
Hermes × Hindsight(陳老師)
押注每一句都先想起來
每則 LINE 訊息進來,先從記憶庫召回約 1500 token 再回答;回完在背景用模型把對話抽成事實存起來。記憶庫是 PostgreSQL,中文用 bge-m3 向量、reranker 與二元切詞。自述召回 0.4 到 0.6 秒。
原表借鏡只借一條:第 11 頁「排程訊息被抽成事實」的教訓。加大召回量不借:放到模型面前也不一定照做。
AIWFF(A 機)
押注記憶當帳本,教訓升級成檢查
對話、隊長原話、失敗紀錄全進只能追加的帳本;挑出來的教訓寫成記憶卡,要查才翻。同一個坑踩第二次就升級成規則、程式檢查或技能,真正擋住錯誤的是會攔下來的程式。
弱點卡片越堆越多,升級多半要等隊長抓到重犯才發生。
Life OS(伊森)
押注斷了接得上,問過的不再問
記憶分三層:一張卡一個教訓的本機記憶卡;每 30 分鐘由 Haiku 把各線新對話寫成摘要並標情緒;兩者連同逐字稿、筆記全進本機 qmd 搜尋(關鍵字+向量+重排)。對話快滿就寫交接卡、重開新 session 接著做。伊森答過的判斷寫進判斷表,常犯的錯做成會攔下來的程式。
弱點每輪自動召回只比對卡片標題的字面,換個講法就撈不到;要翻內容得靠模型自己想到去搜;索引還有 67,491 份檔等著做向量。
逐項比較
| 比較項目 | Hermes × Hindsight(陳老師) | AIWFF(A 機) | Life OS(我們) |
|---|---|---|---|
| 記憶放哪 | PostgreSQL 外掛記憶庫,容器重建也不掉 | 本機 markdown 記憶卡,加上只追加的帳本(對話、原話、失敗紀錄) | 本機 markdown 記憶卡(一卡一事實)、每日對話摘要、LINE 逐字稿原檔,全進本機 qmd 索引(SQLite,8.7 GB);任務進度另放 beads 任務板,決策另寫成 ADR |
| 什麼時候讀 | 強每則訊息先召回再回答,下一句就生效 | 弱每輪只自動帶幾條近期教訓摘要,其餘要查才翻 | 弱每輪送出前比對卡片標題,最多帶 5 張卡名+3 個技能名(上限 800 token);開場自動注入交接卡與 23 條坑卡摘要。卡片內容與其他資料要模型自己去搜 |
| 什麼時候寫 | 弱每回合背景用模型抽事實,自述 10 到 18 秒;錯寫進去的面比較大 | 強只在回件、隊長原話等節點整理,寫入前先比對相似卡片去重 | 兩路:踩到坑或伊森給新裁示時,模型當輪照規格寫卡(先找舊卡,有就改舊的);另外每 30 分鐘由 Haiku 把各線新對話寫成摘要,只進搜尋、不直接變成卡 |
| 怎麼找 | 強bge-m3 向量、reranker、中文二元切詞 | 弱關鍵字加中文一、二字切詞,可選小型向量,沒有 reranker | 強qmd 三路:關鍵字、Qwen3 0.6B 向量、Qwen3 重排,加查詢改寫模型;全在本機、不吃 API。58 萬個向量,但還有 6.7 萬份檔沒做向量 |
| 記錯的事怎麼辦 | 弱人工清洗舊記憶(第 12 頁),再重新匯入 | 強新卡標記取代舊卡;每張卡標來源可信度(隊長、主腦、外部、系統) | 規定改舊卡不開新卡、錯的直接刪;決策用 ADR 取代鏈(新的寫明取代哪一張);交接卡有「已作廢」段,接班不准引用;回報現況前要先實量,文件只算快照。這幾條靠規格加模型遵守,程式不擋 |
| 排程訊息被當成事實 | 弱本機補丁攔截,外掛更新後要重打(第 11 頁) | 寫入時必填來源類別,但搜尋還沒用上這個標籤 | 不做自動抽事實,排程訊息不會自己變成卡。LINE 逐字稿每則帶發話者 ID,接班時歷史對話包在「不可信」框裡,只有標「本人✓」的才算伊森交辦。30 分鐘摘要沒有標來源類別 |
| 教訓怎麼變成行為 | 存成事實,靠下一次召回 | 強踩第二次就升級成規則、程式檢查或技能;重要的事靠會攔的程式,不靠記憶 | 強伊森答過的判斷寫進判斷表(91 列),同型的事下次直接照做不再問;決策寫成 ADR(110 份);反覆犯的做成掛勾程式,本線掛 25 支、其中 12 支在動手前攔(例:LINE 語氣閘、核心檔寫入守衛) |
| 出事怎麼退 | 強刪一行設定就退回內建記憶,資料留著(第 13 頁) | 向量那一路掛了,自動退回關鍵字搜尋 | 強每輪召回出錯就安靜跳過、不擋訊息;搜尋掛了改用 grep 直接搜卡片本文;對話快滿由看門狗寫交接卡、重開接著做;改設定前留備份,ADR 寫明怎麼蓋回 |
| 投影片本身 | 弱第 10 頁把 10 月 15 日寫成週三,實為週四;同一份記憶檔上限三頁三個數字 | (不適用)本欄只記錄對方資料的可信度 | (不適用) |
差別在哪
- Hermes × Hindsight(陳老師) LINE 陪伴對話裡記住使用者的事(下週去哪、偏好),下一句就用得上。
- AIWFF(A 機) 工程與治理工作裡,同一個錯不要犯第二次。
- Life OS(我們) 好幾條線長時間跑、隨時會被重啟,重點是斷了接得上、問過的不再問。
取捨陳老師押召回:記得多、找得準,適合陪伴型對話。AIWFF 押檢查:記憶當帳本與書庫,重要的事做成會攔的程式;隊長 10-10 的結論是「噴到面前還是不會用」。
Life OS 兩邊各像一半:搜尋層跟陳老師同一路(向量+重排),行為層跟 AIWFF 同一路(判斷表、會攔的程式)。最弱的是「什麼時候讀」:每輪只比對標題字面,比不上陳老師每則先召回再回答。
可以借的:陳老師的「每則先召回」,把每輪自動召回從比標題升級成真的搜內容;AIWFF 的「來源類別」,補在 30 分鐘摘要上。
資料來源
- 原表:隊長的 AIWFF(A 機)整理,2026-10-10 在 AI 討論大家樂群分享。Hermes × Hindsight 與 AIWFF 兩欄的文字、強弱標記照原表。
- 陳老師分享的投影片《Hermes × Hindsight 記憶架構升級》14 頁(Gemini Notebook 製作,數字為作者自述);hermes-agent v0.21.5(投影片自述)。
- Hindsight 開源專案 47,737 星(MIT),原表 2026-10-10 查證:github.com/vectorize-io/hindsight
- AIWFF:原表以本機正本逐行對照(兩份唯讀審查,主腦抽驗 4 條行號全中);記憶卡數為當日目錄實數。
- Life OS:2026-10-10 11:4x 本機實量。記憶卡=三個記憶目錄的卡片檔數(LINE 線共用 780、termi 243、筆記線 26、專案線 29);搜尋=
qmd status;判斷表=R10 列數;ADR=決策檔數;掛勾=本線設定檔裡掛上的程式;摘要=排程設定 1800 秒一次。 - 前一天另做過五套比較(含開源版 lifeos-memory、MemPalace、Obsidian 第二大腦):記憶系統比較