Skip to content
系列
10 篇文章

AI Agent 記憶工程

為什麼記憶是 agent 工程的核心難題:從 context 滿了怎麼辦到開源記憶框架選型,十篇各自解決一個記憶問題。

系列導讀:AI Agent 記憶工程

Agent 記憶不是一個功能,是至少四種不同的工程問題——working、episodic、semantic、procedural。這個十篇系列從分類框架到 coding agent 實作、平台 API、開源框架、安全攻擊面,再到 2026 的趨勢判斷,完整走一遍設計空間。

四種記憶與六個設計軸:Agent 記憶系統的設計空間

CoALA 框架把 agent 記憶分為 working、episodic、semantic、procedural 四種,但光靠四格分類不夠——同一種記憶在不同系統裡的設計選擇差很大。這篇用六個獨立設計軸(讀取形態、寫入時機、保真度、寫入權、遺忘、範圍)加一條光譜(檔案 ↔ 向量/圖),畫出 2026 年 agent 記憶系統的完整設計空間。

Context 滿了怎麼辦:七種答案,沒有一種是共識

Chroma 的對照實驗證明:就算塞得下,塞滿也會變差。於是各家 coding agent 發展出七種對策——壓縮、換手、剪枝、少載入、隔離、進模型、換單位。Amp 直接移除 /compact,Atlassian 說摘要該是最後手段,Cursor 的 A/B 測出 46.9% token 降幅。三場分歧的根源不是誰對,是各自在衡量不同的東西。

九家 Coding Agent 怎麼記東西:從 CLAUDE.md 到 MemFS

九家 coding agent 的長期記憶走了至少四條路:Claude Code 和 Codex 用 Markdown 檔(agent 寫、人可讀)、Antigravity CLI 繼承 Gemini CLI 的 inbox 核准(agent 提案、人拍板)、Copilot 用引用+JIT 驗證(28 天沒被驗證就自動刪)。Cursor 把 Memories 拔掉退回純 Rules。Hermes Agent、OpenClaw、Letta Code 則把記憶當成 harness 的核心元件,不只是外掛。寫入時機、遺忘機制、跨團隊共享上的選擇完全不同,而且沒有任何一家公布過記憶功能的對照實驗數據。

五朵雲的記憶 API:OpenAI、Anthropic、Google、AWS、Microsoft 怎麼讓 Agent 記住事情

五家雲平台都在 2025–2026 年推出 agent 記憶 API,但設計哲學分歧明顯:OpenAI 把記憶寫成檔案、Anthropic 把記憶掛載成目錄、Google 用向量加主題分類、AWS 用事件加策略管線、Microsoft 用 context provider 抽象。定價從免費到 $0.75/千筆/月不等,租戶隔離從「應用端自己來」到「IAM 一等公民」都有。

開源 Agent 記憶框架選型:七家拆解與決策指南

七套開源記憶框架分佈在「向量抽取」到「檔案系統」的光譜上:Mem0 一行 add() 自動抽取、Graphiti 用 bi-temporal 知識圖保留矛盾歷史、Letta 讓 agent 自己編輯釘在 system prompt 的 blocks、LangGraph 用 namespace Store 做跨 agent 共享、LlamaIndex 靠 block 優先級控制截斷順序、Cognee 走三種儲存混合管線、Supermemory 強調時態向量圖引擎。這篇整理各自的儲存形式、寫入與遺忘機制、租戶隔離、benchmark 數字,再按四種常見場景給選型建議。

Mem0 完整介紹:替 AI Agent 加上可控的長期記憶

Mem0 是介於 agent 與儲存層之間的記憶服務:從對話抽出值得保留的事實,以 user、agent、run 分區,再於下一次生成前搜尋;優勢是 API 簡單,風險則是抽取錯誤、過期記憶與權限邊界。

OpenViking:把 Agent 記憶做成虛擬檔案系統

火山引擎開源 OpenViking 把 agent 的記憶、知識、技能存成 viking:// 虛擬檔案系統,用 ls、tree、find 就能翻。三層載入(L0/L1/L2)讓平均檢索只用 550 tokens,LoCoMo 記憶準確率從 24–57% 提升到 80–83%。

Agent 記憶的攻擊面:當記憶變成持久化的後門

記憶是持久化的 prompt injection 載體:MINJA 證明只靠對話就能注入記憶(成功率 >95%),SpAIware 示範植入後每次回答都外洩資料。業界兩派防線——引用驗證(Copilot)和人工核准(Gemini CLI / Devin)——各有盲點。

2026 記憶系統往哪走:檔案贏了向量,遺忘才剛開始

2026 上半年 OpenAI、Anthropic、Letta、LangChain 不約而同選了 Markdown 檔案 + 索引取代向量資料庫;寫入權從 agent 交還給人;遺忘機制終於出現但沒人做 Ebbinghaus;LoCoMo 被 Penfield Labs 抓出 6.4% 錯答;三家同時用「Dreaming」指離線記憶整併。五個趨勢,一個結論:記憶不是功能,是架構決策。