數位員工:可靠度來自 harness,不來自模型
「數位員工」不是技術,是計價與課責單位。Anthropic Project Vend 讓 Claude 真的開了三家店,發現最有效的介入不是換更強的模型,而是強迫走流程——官方原話是「我們重新發現了 bureaucracy matters」。Gartner 估計數千家自稱 agentic 的廠商中只約 130 家是真的。
「數位員工」不是技術,是計價與課責單位。Anthropic Project Vend 讓 Claude 真的開了三家店,發現最有效的介入不是換更強的模型,而是強迫走流程——官方原話是「我們重新發現了 bureaucracy matters」。Gartner 估計數千家自稱 agentic 的廠商中只約 130 家是真的。
價值驗證的單位是假設不是點子。Kohavi 的資料顯示產業中位數只有 10% 的實驗會成功,這代表在 p<0.05 下約 22% 的「獲勝實驗」其實是假陽性;Sean Ellis 的 40% 門檻查不到任何公開資料集;AI 產品的留存要從 M3 而非 M0 起算,且 <$50/mo 的 GRR 只有 23%、>$250/mo 有 70%。
個人專案、玩具 demo、做 RAG 原型,不想第一步就掏卡。整理 2026/05 還在運作的 40+ 家 LLM inference 服務商,按免費資源「是持續補充還是一次性」分梯,標註綁卡需求、模型清單、付費起價,數字全部從官方 pricing 頁驗證。中國原廠含智谱 GLM(永久免費)、豆包(每日 200 萬 tokens)、Kimi、百煉、Ollama 本地跑法一併收錄。
Claude Code 從 $20/mo Pro 到 $200/mo Max 20x,Opus 4.6 推理深度業界最強,Max 方案吃到飽定價讓重度使用者省下 90%+ 的 API 費用。
Cursor CLI 將 IDE 的 Agent 帶入終端,支援 interactive TUI 與 headless 模式、Plan/Ask/Agent 三種模式、Cloud Handoff 雲端接力、CI/CD 整合,$20-200/mo。
⚠️ Gemini CLI 將於 2026/06/18 停服,官方接替方案為 Antigravity CLI。停服前:免費提供 60 req/min、1,000 req/day,含 Gemini 2.5 Pro 和 1M token context window。Skills、Hooks、Subagents 均可遷移延續。
Kiro 免費方案含 50 credits,Auto 模式自動混合多模型省成本,Spec-Driven 開發流程將 vibe coding 升級為可追蹤的結構化開發,Agent Hooks 實現本地 CI/CD 自動化。
Codex 綁定 ChatGPT 訂閱($20-200/mo),GPT-5.4 + mini 自動路由是亮點,CLI 支援 Plan 模式與 API Key 模式雙軌計費。