所有標籤PageIndex(38.4k★,單日 +1,097)用目錄樹取代向量索引做推理式 RAG;iFixAi(18.3k★,+340)給 agent 配一個 120 秒稽核工具;Octop(6.2k★,+285)是騰訊雲開源的 local-first 多 agent 助理平台;BMAD-METHOD(53.7k★)把敏捷開發改寫成給 coding agent 用的 spec-driven 流程。Agno v3.1.0 加入 RBAC 權限套件但檔案系統要停機遷移;Pydantic AI v2.52.0 修了 web_fetch 的資安漏洞並把 harness 併入主倉庫。
dots(1.9k★,上線不到一天)用改過的 Firefox 引擎讓網頁 agent 不被偵測;context-mode(24.5k★,Hacker News 當日 #1)把工具輸出砍 98% 省 context;openrig(3k★)讓 Claude Code 和 Codex 組成同一個 team;dbx(23.2k★)把資料庫客戶端做成內建 AI 的 MCP server;universal-modder 讓 Claude Code 直接改遊戲 mod。Claude Code v2.1.286 版號是 patch,內容卻修了一批憑證洩漏漏洞,Haystack v3.3.0-rc1 修 anyio CVE 並調整 BM25 檢索行為。
paperclip(94.5k★)把 agent 當員工管,建組織圖、發預算、留稽核紀錄;Orca(81.6k★)讓你在各自的 git worktree 同時跑一整排 coding agent;Hindsight(42.8k★)把 agent 記憶拆成四層,從「記得」進化到「學會」;CLI-Anything(51k★)把任何軟體包成 agent 能穩定呼叫的 CLI;Cloudflare 開源自己拿來稽核程式碼的 security-audit-skill(23.2k★),靠「發現與驗證分屬兩個 agent」壓低誤判。crewAI 1.15.23 加入原生 Gemini 3.8 Flash 支援,Claude Code v2.1.285 則替背景長跑指令加上預設逾時。
Z.ai 的 ZCode(7k★)把桌面殼、瀏覽器介面和 Agent CLI 包進同一個 coding agent 工作台;magpie(1.6k★)在選單列一鍵切換 Claude Code / Codex / Gemini CLI 底層接的模型;jevgrep(1.3k★)用語意搜尋幫 coding agent 先找檔案,省掉部分來回 grep 的 token;golive-skill 和 agent-console 分別補上部署自動化與 session 可觀測性。Claude Code 今天發布 v2.1.284,新增 Sonnet 5.5 預設模型與多項終端機修復。
BuilderIO/agent-native(6.9k★)把 agent 工具和人類 UI 定義成同一份程式碼;yynxxxxx/Codex-X(4k★)幫 Codex CLI 包一層桌面圖形介面;career-ops-hq/career-ops(72.9k★)把 agent 塞進找工作這種私人任務,全程跑在本機 coding CLI 裡,不架網站也不上傳履歷。追蹤清單裡的框架今天沒有新的重大 release——Pydantic AI v2.51.0 與 Claude Code v2.1.283 都已在昨天報過。
Paperclip(86.7k★)用組織圖、預算、心跳排程把一群 agent 當員工管理;Block 開源的 Buzz(34.8k★)反過來讓人與 agent 用同一套 Nostr 簽章協定共用工作空間;智譜 Z.ai 開源 ZCode,加入自建 coding agent 殼的陣營;mobile-mcp 把 MCP 工具延伸到真實 iOS/Android 裝置。Notable Releases:Pydantic AI v2.51.0 加入 OpenAI GPT-Live 並收緊 realtime tool_choice/型號比對;Claude Code v2.1.283 新增 `deniedModels` 鎖模型設定與 `/doctor prompt-audit`。
Nokia 應用研究團隊開源 AnyJev,用 cyclic shift+批次先驗校正讓任何開源 LLM 免訓練吐出校準過的決策機率,官方測試把可自動判定流量從 7.7% 拉到 52.0%;DSPy 3.4.0 接上 TypeSafe client 並帶兩項 breaking changes;Pydantic AI v2.50.0 把上週的 `TypeSafeModel` 升級成正式的 `DecisionModel` 基底類別;另外還有幫 agent 產出接手上線部署的 golive-skill、讓 coding agent 換底層模型像點選單一樣簡單的 magpie、讓 Claude Code 和 Codex 組隊且會自我改寫 skill 的 sno-station。
google/ax 用 Kubernetes 風格的 Workspace/Task/Gateway/Model 四個原語跑 agent workload,今天狂漲 1,376 星;strands-agents/harness-sdk 把 agent loop 的 lifecycle、工具、MCP、多 agent、記憶全打包進 create_harness() 一行呼叫;HKUDS/CLI-Anything 幫任意軟體生成 agent 原生 CLI 介面,50,241 星、附 arxiv 技術報告;vectorize-io/hindsight 主打「會學習」的 agent 記憶,在 LongMemEval benchmark 宣稱業界最佳,今天單日漲 1,607 星;Haystack 3.2.0 加入摘要式 context 壓縮與 token 預算控制,但 Toolset 的 `+` 合併語法被整個移除。
browser-use/video-use 讓 Claude Code 直接剪片,靠 ElevenLabs 逐字稿定位時間軸,25,702 星;dream-num/univer 把辦公室 SDK 重新定位成「AI Agent 的 Office Harness」,今天登上 TypeScript 榜首;superdesigndev/treg 做「OpenRouter for agent tools」,讓 agent 免簽約、按次付費呼叫 3,000+ 個工具端點;davila7/claude-code-templates 破 3 萬星,靠一鍵安裝 agent/command/MCP 範本取代手刻設定;pydantic-ai v2.47.0 收緊型別驗證,`UserPromptPart.content` 型別錯誤不再靜默降級。
Microsoft 開源 agent-governance-toolkit(6,303 星)把 tool call 攔截做成程式碼層強制執行,引用 ICLR 2025 論文(對 GPT-4o/Claude 3/Llama-3 的自適應攻擊 100% 成功率)反駁純提示詞防護;ai-memory 一個月從 2,900 星漲到 7,575,讓長期記憶能跨 20 多種 coding agent CLI 共用;anthropics/financial-services 把金融垂直 agent 同時發成 Cowork plugin 跟 Managed Agents API 範本,35,728 星;MCP 官方 Inspector 出到 v2.7.0,web/cli/tui 三個 client 統一成一支 binary;coder/coder 把 AI coding agent 塞進 Terraform 定義的受控工作環境,API key 不進 workspace。
openclaw/openclaw 十個月衝上 39 萬星,但今天發的 v2026.9.5 也讓部分使用者升級後 session 消失、要等 8 小時才恢復;volcengine/OpenViking 直接拿 OpenClaw/Hermes/Claude Code 當對照組,證明外接 context database 能把長對話記憶準確率從 24-57% 拉到 80-83%;trycua/cua 發表 2.8MB 的 CUA-S1-FORMS,把填表格這種小決策從通用模型手上接走;pydantic-ai v2.46.0 也把同一種「窄任務轉交專門決策模型」的設計鋪進框架核心 API
affaan-m/ECC 靠「agent harness 效能優化」8 個月衝上 26 萬+ star,但成長速度快到該保守看待;cactus-compute/needle 用 8-29MB 模型犧牲聊天能力換工具呼叫精準度;Graphify-Labs/graphify 用本地 AST parsing 建知識圖譜取代向量資料庫;tinyhumansai/openhuman 把「認識使用者」當 agent 記憶的核心賣點;IvanMurzak/Godot-MCP 讓 agent 直接操作 Godot 編輯器;Claude Code v2.1.277 加入 AGENTS.md 支援
alibaba/open-code-review 用「確定性工程 + agent」取代純 prompt 審查,token 消耗只有通用 agent 的 1/9;cloudflare/security-audit-skill 把 Cloudflare 自己抓漏洞的六階段流程包成 skill 開源,強調對抗式驗證;microsoft/skills 把 175 個 Azure SDK 領域知識打包成一鍵安裝的 skill/MCP 組合;Pydantic AI 兩天內連發 v2.45.0、v2.46.0,加入 TypeSafeModel 與 Choices helper
NousResearch/hermes-agent 主打閉環學習——自己從經驗生技能、自己改進技能、跨對話記得你是誰;mksglu/context-mode 用 MCP + hooks 把工具輸出砍 98%,衝上 Hacker News 第一名;shinthink/blitzstrike 把偵察、靜態分析、live 驗證包成一支 MCP 滲透測試工具;pliablepixels/gap-trap 幫 vibe coding 裝 CI 閘門;Pydantic AI v2.44.0 一次修四個安全漏洞,CrewAI 1.15.22 加了跨模型路由的 `llm_overlay`
Cloudflare 開源 security-audit-skill,用六階段流程逼 agent 的資安稽核「發現者與驗證者永遠不同人」,上線單日暴漲 1,249 星;Vercel 推出 agent 框架 eve,往 LangGraph/Mastra 的地盤卡位;火山引擎 OpenViking 把知識、記憶、技能統一成一個可分層讀取的虛擬檔案系統;Anthropic 開源 11 個角色化 Claude plugin;Agno v3.0.10 把 shell 執行和公開 MCP 存取的預設值都收緊成需要顯式開啟
Alibaba 開源 Open Code Review,用「確定性引擎 + LLM agent」混合架構取代純 agent code review,token 只要 Claude Code Skills 的 1/9;pacifio/atlas 把 git 式版本控制搬進多 agent 協作,讓 Claude Code、Codex 共用 checkpoint 和記憶;alphaXiv/OpenResearch 把任何 coding agent 變成能自動跑實驗、留下可查證紀錄的 research agent;JustVugg/colibri 用純 C 引擎把 VRAM/RAM/硬碟當同一層記憶體,在消費級硬體上跑 2.8T 參數的 MoE 模型;今日無重要框架更新
CopilotKit/OpenBot 給每個 AI coworker 一台自己的電腦,所有動作先過閘門再執行;Tencent/teamai-cli 把 skill、rule、MCP 設定用「push → review → pull」同步給整團隊的 Claude Code / Codex / Cursor;VaderChen/YourDesk 新增 MCP,讓 agent 能直接連上、操作一台遠端桌面;agent-launcher 用一個桌面 App 統一管理六種 coding agent CLI 的帳號與設定;AgentVerse-OS 給每個專案一個獨立的 Incus 容器工作區,agent 只准在裡面跑;今日無重要框架更新
JustVugg/colibri 用記憶體多層調度把 744B–2.8T 參數的 MoE 模型塞進消費級硬體跑;tech-leads-club/agent-skills 想在 agent skill 變成下一個 npm 供應鏈風險之前先做好驗證;alphaXiv/OpenResearch 把 Claude Code / Codex 變成能跑實驗的研究員;calesthio/OpenMontage 用 agent 包辦從腳本到成片的整條影片產線;alibaba/open-code-review 用「規則引擎 + LLM agent」混合架構開源自家 code review 工具;Claude Code v2.1.269 把 Workflow tool 的並行 agent 上限拉到 256
max-sixty/worktrunk 把 git worktree 管理做得像切換分支一樣簡單,專為平行跑多個 coding agent 設計;melgarafael/DeskcommCRM 用 MCP 把整個 CRM 開放給 AI agent 操作,鎖定 WhatsApp 銷售場景;alsk1992/CloddsBot 內建 x402 協定讓 agent 互相付 USDC,同時也把 200 倍槓桿交易包進同一個聊天介面;vxcontrol/pentagi 用全自動 agent 在 Docker 沙箱裡跑滲透測試;DSPy 3.4.0 Beta 1 把 LM 執行層換成內建引擎,取代 3.3 版的實驗性型別
obra/superpowers 把整套開發方法論固化成可跨 8 種 harness 安裝的 skill;affaan-m/ECC 用 68 個 agent + 286 個 skill 做 agent harness 效能優化系統;cathrynlavery/diagram-design 單日漲 2,286 星,用 39 種編輯風格圖表取代 Mermaid;Tencent teamai-cli 讓團隊統一分發 skill/rule/MCP 設定;Pydantic AI v2.42.0 新增 GitHub Copilot provider
reverify 用二進位逆向工程的真實基準(97% 錯誤率全數攔下)證明確定性驗證比要求模型謹慎更有效;useAgent 把 Claude Code / Codex 包成雲端 AI 同事平台;bankmcp 讓 AI 透過 PSD2 唯讀讀取歐洲銀行帳戶;headcount 把 Claude Code skill 生態系拆成 16 個部門的公司架構;Pydantic AI 2.41 與 Agno 3.0.8 同日更新
DeepSeek Harness(dsh)用 everything-is-a-plugin 架構 3 週衝上 21.4 萬星;ponytail 用實測數據證明一個 skill 能讓 Claude Code 少寫 54% 程式碼;Magnitude 幫你的 coding agent 自動挑本地模型跑;wigolo 讓 agent 免 API key 搜尋、爬蟲、研究整個網路
NVIDIA SkillSpector 掃描 agent skill 的 71 種漏洞模式;context-mode 用 MCP sandbox 把工具輸出壓到 2%;VoiceStudio 16 引擎本地跑語音克隆不送雲端;Pydantic AI v2.40.0 加入 realtime barge-in 和 @agent.on_event
mattpocock/skills 單日暴漲 2,757 星,是今天 GitHub Trending 漲最快的專案;Anthropic 官方 anthropics/skills 與開源 coding agent anomalyco/opencode 同步在榜。另一頭,MCP server reverify 用 71 個真實 Windows 系統檔案的 benchmark 證明:AI 讀 binary 時有 97% 機率在瞎掰,唯有確定性工具能攔下來。框架端 pydantic-ai、agno、haystack 今天都只有例行 patch,無重大更新。
github/spec-kit 滿一年衝上 1.0.0,維護者特別強調穩定性讓位給適應力;stablyai/orca 讓你在各自 git worktree 同時跑一整支 coding agent 艦隊,單日狂漲 812 星;KeygraphHQ/shannon 3.0 上線,AI agent 自動滲透測試直接出 SARIF 報告接 CI/CD。瀏覽器端 ChromeDevTools/chrome-devtools-mcp 把官方 MCP server 開給任何 agent 操作 Chrome。框架端 Pydantic AI v2.38.0 改了一次性 capability 的合併規則(breaking),Claude Code v2.1.259 修掉多 session 互蓋設定的老問題。
NousResearch/hermes-agent 靠自我學習迴圈記住怎麼用你的工具、跨平台記得你是誰,239,994 星持續衝榜;pacifio/atlas 讓多個 coding agent 共用一套「看得到是誰改的」版本控制,一天漲 895 星;blader/humanizer 用 35 種模式把 AI 味洗掉但不竄改事實。文件處理端 firecrawl/pdf-inspector 用 Rust 在 50ms 內判斷 PDF 要不要 OCR;superlinked/sie 把 agent 會用到的所有模型收進一個自架推理叢集。框架端 AG2 v1.0.3 全面遷移 MCP 2.0(breaking change),並加入不靠 LLM 判斷的 TealTigerMiddleware 做 prompt injection 防護。
openclaw/openclaw 這款自架個人助理已經衝上 38 萬星,用單一 Gateway 串起 WhatsApp/Telegram/Slack 等聊天管道;同一週 NVIDIA 端出 SkillSpector,專門掃描 Claude Code/Codex/MCP skill 裡的 71 種漏洞模式,研究指出 26.1% 的 skill 有漏洞、5.2% 疑似惡意。另外 stablyai/orca 把多 agent 平行開發做成完整 IDE,VectifyAI/PageIndex 則用推理式樹狀索引挑戰「RAG 一定要向量資料庫」的預設。claude-code v2.1.257 新增 Containment Escape 安全規則,agno v3.0.5 把 embedding 失敗從默默吞掉改成如實回報。
HKUDS/nanobot 半年內衝上 4.7 萬星,示範「小核心+多管道+長期記憶」的自架個人 Agent;zhayujie/CowAgent(前身 chatgpt-on-wechat)用三層記憶架構和 Deep Dream 夜間蒸餾把老牌聊天機器人重生為完整 Agent Harness;conductor-oss/conductor 把耐久執行圖形引擎接上原生 MCP 工具呼叫,讓 agent 迴圈撐過當機或數週人工審核;mksglu/context-mode 直擊 MCP 工具呼叫塞爆 context window 的痛點,衝上 HN 第一。agno v3.0.4 是唯一達標的框架更新,把 KnowledgeManagementTools 的 ingest_path 改成預設關閉以堵安全缺口。
can1357/oh-my-pi 從知名 coding agent「Pi」fork 出來,靠死磕工具呼叫格式讓 Grok Code Fast 1 的任務成功率從 6.7% 衝到 68.3%;K-Dense-AI/scientific-agent-skills 把 163 個科研技能開放給任何相容 Agent Skills 標準的 agent;addyosmani/agent-skills 把資深工程師的六階段開發流程包成技能包,一週衝上 9 萬星;THU-MAIC/OpenMAIC v1.0.0 加入對話式 Pro workbench,把 multi-agent 落到課程內容產製這個具體垂直場景。框架端 agno v3.0.2 是本次唯一達標的重要更新:直接把 Agent/Team/Workflow 發布成具名 MCP tool,同時有多筆 breaking changes。
Google 官方的 ChromeDevTools/chrome-devtools-mcp(5 萬星)讓 coding agent 直接操控真實 Chrome 做效能分析與除錯;abhigyanpatwari/GitNexus 用純瀏覽器端知識圖譜取代「讀程式碼靠猜」;mksglu/context-mode 專攻 coding agent 的 context window 浪費問題;google/skills 是 Google 自家的官方 Agent Skills 套件庫;livekit/agents 語音 agent 框架持續活躍。框架端 pydantic-ai v2.36.0 加入 `@durable_operation`,讓第三方 durable execution 引擎可插拔進來。
calesthio/OpenMontage 用 12 條產線、700+ 個 skill 檔把通用 coding agent 變成影片後製棚,本週衝上 5 萬星;Anthropic 官方外掛市集 claude-plugins-official 單日 +292 星;rohitg00/agentmemory 用 BM25+向量+知識圖譜做 coding agent 跨 session 記憶,自家 benchmark 宣稱 LongMemEval-S R@5 95.2%;sodiumsun/agenttrail 幫 Claude Code / Codex / Cursor 做本機即時任務地圖。今日框架端無重大 release。
thedotmack/claude-mem 用壓縮記憶讓 context 跨 session 存活,總星數破 9 萬;volcengine/OpenViking 把記憶/RAG/skills 統一成用 viking:// 協定瀏覽的虛擬檔案系統,本週 +3,078 星;apache/maka 進 Apache Incubator,把 agent 執行過程做成可回放的 event-sourcing log;K-Dense-AI/scientific-agent-skills 讓 17.5 萬科學家用 163 個 skill 把通用 coding agent 變成領域專家。Haystack v3.1.0 加入 AgentTool 支援多 agent 委派。
deepseek-ai/deepseek-harness(dsh)用 Cordis 外掛架構把「模型/工具/沙箱/記憶」全部做成可替換元件,developer preview 上線一週已逼近 20 萬星;PrimeIntellect-ai/prime-agent 用 Recursive Language Model 架構做長跑研究型 coding agent,靠持久 IPython session 撐過終端機斷線;liqiwa/mcp-radar 反過來做這類 digest 的自動化版本,每天掃 GitHub 排名新出現的 MCP server。框架端 Mastra 1.61.0 補上可撐過當機的背景任務佇列,ComposioHQ/composio 0.17.0 把 SSRF 防護延伸到工具執行下載與 S3 上傳。
tinyhumansai/openhuman 用本地優先的 Memory Tree 壓縮數位生活、指揮多個 agent,早期 beta 已衝上 3.7 萬星;Vercel Labs 的 fx 用 Zig 寫出不到 8 MiB 的原生 coding agent CLI;NVIDIA 開源 labs-OO-Agents,把 agent 的 prompt/tool/workflow 收進單一 Python class;CopilotKit/OpenBot 把 agent 包進容器並加上治理閘門,動作先審後動。Agno v3.0.0 是需要跑資料庫遷移的重大 breaking release,Haystack v3.1.0 新增多 agent 委派工具 AgentTool 和上下文壓縮 CompactionHook。
GitHub PR 審查設定好後,由一隊 agent 依 repo 觸發模式審查,平均 20 分鐘、每則約 15–25 美元,findings 以 inline comments 貼在問題行上;改動夠大時用 /code-review ultra 開雲端深審,5–10 分鐘回報每條都經獨立驗證的 bug,單次約 5–25 美元、Pro/Max 有 3 次免費。
Panniantong/Agent-Reach 用一支 CLI 包住 yt-dlp、twitter-cli 等工具,讓 agent 讀遍 Twitter/Reddit/YouTube/Bilibili;LangChain 官方推出 deepagents,把檔案系統、sub-agent、skills 打包成開箱即用的 harness;Tracer-Cloud/opensre 把「AI SRE agent」做成有評分 RCA 題庫的框架;Anthropic 的 claude-plugins-community 市集靠審核流程幫社群外掛做信任背書,單日 +490 星。GitHub Copilot CLI v1.0.81-8(pre-release)加上 Grok 4.6 xhigh 推理與外掛即時熱重載。
duty1g/x64dbg-mcp-server 把逆向工程除錯器包成 MCP 工具,兩天衝上 563 星;Cripacx/mediagen 把歐盟 AI 法案要求的內容標記做進生圖 MCP server;QwenLM/qwen-code v0.22.0 公開 SWE-bench Verified 完整測試軌跡,77.08% 過關;open-gitagent/gitagent 把核心引擎搬到 Rust 重寫,agent 狀態整個活在 git repo 裡。框架端,GitHub 官方 MCP Server v1.10.0 是一次資安大掃除,`--tools` 打錯名稱現在會直接讓 server 啟動失敗。
CopilotKit/OpenBot 用 AG-UI 協定包出「每個都有自己電腦」的 AI coworker 框架,一週衝上 2,289 星;Bruno 官方 MCP server(usebruno/bruno-mcp)比社群版(Ostico/bruno-mcp-studio)晚兩個月才補上;browser-use 團隊另開 macOS Harness 專案,用六個 accessibility 原語讓 LLM 直接操控 Mac;搬到 Anomaly 底下的 opencode 星數(約 19.9 萬)已經超過 Anthropic 自家 Claude Code(約 14.2 萬)。框架端,MCP TypeScript SDK v2 把單一套件拆成 8 個子套件,並跟進協定的 stateless 改版,拿掉了 session handshake。
HKUDS/nanobot 靠 v0.3.0「The Agency Release」7 個月衝上 4.7 萬星,主打個人自架 agent runtime;genspark-ai/genoffice 用開源桌面應用做 AI 辦公套件,三週破 3,400 星;NVIDIA 發表 labs-OO-Agents(NOOA),把 agent 狀態收進單一 Python class;MCP server repo-context-mcp 幫 coding agent 讀 repo 不用整包塞進 prompt。框架端 Mastra 1.60.0 補上 durable execution 與 Cloudflare Sandbox;pydantic-ai v2.33.0 因 anthropic SDK 升級 httpx2 而有 breaking change。
CodeQL 先由 language extractor 建立 code database,再以 QL queries 查 AST、types、calls、control/data flow;深度來自 model,也帶來 build extraction 與 query maintenance 成本。
Cursor 開源官方外掛市集 cursor/plugins,用 plugin.json + skills + MCP 定義把生態標準化,一天 +470 星;apache/maka 進 Apache 孵化器,用 append-only 事件日誌記錄 agent 的每次工具呼叫與權限決策,主打可稽核的 local-first 工作台;magnitudedev/magnitude 幫你自動偵測硬體、下載並在本機跑模型,開箱即用的離線 agent;vercel/eve 把 agent 能力放進 tools/、skills/、schedules/ 等慣例目錄,檔案系統就是介面。框架端 pydantic-ai 補了 v2.32.1 patch。
Volcengine(字節跳動旗下)開源 OpenViking,用 viking:// 虛擬檔案系統取代黑盒向量搜尋做 Agent 記憶,官方測試把準確率拉到 80%+ 同時省 34–91% token;munder-difflin 把多個 coding CLI 包成桌面辦公室、用共享記憶層互相協作;ai-memory 用 Rust MCP server 解決『換 CLI 就失憶』的痛點;mukul975 的資安技能包一天內衝到近 2.8 萬星。pydantic-ai v2.32.0 補強 OpenRouter/xAI 附件搜尋與 instrumentation。
DeepSeek 開源的 agent harness「dsh」8/13 發布一小時內破 2 萬星,目前累積約 15.8 萬星,社群兩天湧入 2000+ 外掛提案;核心是 Cordis 驅動的「一切皆插件」架構,甚至能把 Claude Code、Codex 當子 agent 呼叫。RightNow-AI 用 Rust 從 OS 層級重新定義 agent(openfang),網易有道推出建立在 OpenClaw 之上的桌面 Agent LobsterAI,PrimeIntellect 的 prime-agent 主打自我改進推理迴路。CrewAI 1.15.16 補強 execution context 追蹤與 flow 錯誤記錄。
headroom 把送進 LLM 前的 tool output/log/RAG chunk 先做本地、內容感知的壓縮,7 個月衝上 6.6 萬星;agentmemory 讓 Claude Code、Cursor、Codex CLI 等十幾種 coding agent 共用同一份跨會話記憶,半年衝上 2.7 萬星;Andrew Ng 團隊的桌面 agent OpenWorker 把目標使用者從工程師擴大到一般知識工作者;NVIDIA 的 labs-OO-Agents 用物件導向重新設計 agent 抽象。Mastra 1.59.0 把 CostGuardProcessor 更名 TokenCostControl(breaking),browser-use 0.13.8 加入第一方 OpenClaw skill 支援。
forge 給自架 LLM 的 tool-calling 加一層可靠性 middleware,可直接代理 opencode/aider/Claude Code 免改程式;repo-context-mcp 用 MCP 提供 token 預算化的 repo context 打包,上線 5 天就做進 PR CI;DeepSeek 官方 harness dsh 一週內冒出至少 5 個獨立社群桌面包裝版,合計逼近 1,500 星;微軟研究院的瀏覽器 agent 框架 Webwright 靠 Skill Factory 把解過的任務蒸餾成免模型呼叫的可重跑腳本,在 WebArena 上拉高 15 個百分點的重用準確率;Mastra 1.59.0 把 CostGuardProcessor 更名 TokenCostControl(breaking),Pydantic AI v2.30.0 修了本機 web chat 介面的 DNS rebinding 資安漏洞。
Vercel 推出 filesystem-first 的 TypeScript agent 框架 eve,深度綁定自家 AI Gateway/Sandboxes;Prime Intellect 的 Prime Agent 把整個對話 context 當程式變數,搭配可自我改寫的 Continual Harness;aden-hive 的 Hive 用『複製 Queen』取代預先編譯的執行圖;HKUDS 的 nanobot 靠 v0.3.0 Agency Release 半年內衝上 4.7 萬星。今日 watchlist 框架無重大版號更新。
PM 在 Notion 勾選一張任務卡 → 系統自己同步成 GitHub issue → 寫成 plan → 寫成 code → 開 PR 給人類 review。這篇講這套系統做什麼、不做什麼、為什麼現在可行,給沒在寫 code 的人看。
GitHub Copilot Coding Agent 讓你把 Issue 指派給 Copilot,它在雲端沙箱裡自動開 branch、寫程式、跑 CI、開 PR。成功關鍵是設好 AGENTS.md,沒設定的話 agent 容易跑偏。適合定義清楚的中型任務,需 Pro+(每月 1,500 premium requests)或 Enterprise 方案。