所有標籤OpenAI 於 2026-09-29 DevDay 為 GPT-6 Astra API 新增 Ultrafast 速度層級:input/output 漲到 Standard 的 6 倍(短 context $60/$300 per 1M tokens),換取 API 最高 6 倍、Codex 最高 8 倍的生成速度;同時 ChatGPT Pro 200 的 Codex/Work 用量上限從 20x Plus 砍到 10x Plus,既有訂閱戶延至 2026-10-29 才降級並獲發 2026-12-31 到期的 $2,500 usage credit;新方案 Pro 500($500/月、25x Plus)成為唯一內建 Ultrafast 的訂閱層級。
Claude Sonnet 5.5 於 2026-09-29 發表,API 定價與前代 Sonnet 5 完全相同:input $2.00、output $10.00、cache read $0.20(皆為 USD/1M tokens),單價變化是 0%。Anthropic 宣傳的『成本降最多 30%』來自同任務所需 token 數變少、工具呼叫次數變少,不是調降單價——這代表實際省多少完全取決於你的工作負載能不能吃到這個效率提升,不是保證值。
OpenAI 官方公告與定價頁確認:GPT-6 Sol input 從 $4.00 降到 $2.00/1M tokens(↓50%)、output 從 $20.00 降到 $10.00(↓50%);GPT-6 Luna input 從 $0.20 降到 $0.10(↓50%)、output 從 $1.20 降到 $0.50(↓58%),2026-09-22 生效。降價基準是 GPT-5.6 系列的『促銷價』而非原價,而 GPT-5.6 Sol 的促銷價官方寫明只保證到 2026-11-21——這代表 GPT-6 Sol 現在的 $2/$10 才是這輪真正該拿來比較的長期基準價。
Perplexity 官方定價文件與遷移指南確認:2026-09-27 起 Sonar Chat Completions API 停止支援,全面轉為 Agent API。舊制 Sonar 系列是「模型 token 價+依搜尋深度分級的固定請求費(每千次 $5~$12)」,新制 Agent API 是「第三方模型 token 價(如 gpt-5.6-luna input $0.20/1M)+每次工具呼叫費(web_search $0.0025、fetch_url $0.0005)」。以官方給的代表性用量估算,Sonar → fast 對應成本降約 49%,Sonar Pro → low 降約 84%,Sonar Reasoning Pro → medium 降約 71%;但 sonar-pro/sonar-reasoning-pro 在多數第三方閘道上直接停止可路由,只有基礎 sonar 模型會自動搬到 Agent API,其他分級都得改用新的 preset 系統手動遷移。
xAI 官方定價文件公告:2026-09-21 12:00 PT 起,Grok API 的 x_search 工具計價從「每千次呼叫 $5」改成「每千則抓到的貼文 $5、每千個抓到的 user profile $10」,thread 裡回傳的 parent/quoted post 也算進貼文數。web_search、code_execution 等其他工具價格不變,仍是每千次呼叫 $5。對每次查詢只回傳少量結果的用法影響不大,但對會拉出完整討論串(thread)、平均每次查詢回傳數十則貼文的社群監控類 Agent,帳單可能不降反升。
OpenAI 於 2026-09-14 公告:GPT-5.5 將於 2026-10-14 從 ChatGPT、ChatGPT Work、Codex 全部方案下架,但直接呼叫 OpenAI API 的 `gpt-5.5` 不受影響——這是產品層淘汰,不是 API 淘汰。官方定價表上 gpt-5.5 短內容 input/output 是 $5.00/$30.00(每百萬 tokens),Codex 官方導向的替代模型 GPT-5.6 Sol 是 $4.00/$20.00,換過去同時省錢(input ↓20%、output ↓33%)。從公告到下架只有一個月緩衝,比 OpenAI 自家文件寫的「GA 模型至少 6 個月通知期」短很多。
Anthropic 9/1 發布 Claude Fable 5.1,基礎 input/output 價格不變($10/$50,每百萬 tokens),但 cache read 從 $1.00 砍到 $0.25(↓75%),高度依賴重複 context 的 agent workload 最多可省 45%。Google 9/2 發布 Gemini 3.8 Flash,促銷價 $0.75/$3.75 只到 2026-12-31,2027-01-01 起漲回 $1.50/$7.50(雙倍)。兩家同一週都在用 cache/促銷窗口而非基礎牌價競爭。
OpenAI Assistants API(/v1/assistants、/v1/threads、/v1/threads/runs)已於 2026-08-26 正式停用,一年前公告、零延長、無自動遷移工具。這本身不是定價變動,但停用逼你重新選模型——原本掛在 Assistants 上的 o3($2.00/$8.00,每百萬 tokens input/output)沒有直接替代品,官方建議換成 GPT-5.6 Sol($4.00/$20.00,成本 ↑129%),但實務上 Terra($2.00/$12.00,↑29%)在多數場景已經夠用,兩者差 44%。
DeepSeek 自 2026-08-23 00:00(北京時間)起,週六、週日全天不再區分尖峰/離峰,一律以離峰價計費——原本週末仍套用平日的尖峰/離峰時段表,尖峰時段 V4-Pro Output 要價 $3.96/1M tokens,現在週末全天都是 $1.98/1M。平日計費規則不變。距 8/16 那次尖峰漲價(Output 漲 355%-371%)僅一週。
Google Cloud 為 Gemini Enterprise 新增 Flexible Savings Plans(月支出承諾制,1 年期折 10%、3 年期折 20%,無上下限)、新的 pay-as-you-go 消費方案,以及即將推出的離峰批次處理(最高省 50% inference 成本),2026-08-26 生效。這不是像 OpenAI GPT-5.6 Sol 那樣調降標價,而是新增一整套帳單結構工具——對比 OpenAI 打的是標價戰,Google 打的是 FinOps 治理戰。
同一個模型透過不同管道存取,價差可以到 2-5 倍。直連最簡單、聚合器(OpenRouter)最靈活、雲端平台(Bedrock/Vertex)最適合企業。這篇用 2026 年 8 月實際價格做橫向比較,附選擇決策樹。
MiniMax 從消費級聊天 App 起家,M2.5 在 SWE-bench Verified 拿 80.2% 但 API 價格只有 Claude Opus 的 1/10-1/20;M3(456B 總量 / 45.9B 啟用)是首個在 SWE-bench Pro 突破 59% 的開源權重模型,還有 1M context。
OpenAI 官方將 GPT-5.6 Sol 標準費率從 $5.00/$30.00 降到 $4.00/$20.00(每百萬 tokens input/output,input ↓20%、output ↓33%),2026-08-21 生效,促銷期至少到 11/21。這是 OpenAI 自己動手降價,不是 OpenRouter/Cloudflare 那種平台促銷(見前篇),且兩者現在疊加——OpenRouter 的 50% 折扣已改套用在新的 $4/$20 基準價上,變成 $2.00/$10.00。
GPT-5.6 Sol 標準費率透過 OpenRouter 與 Cloudflare AI Gateway 都從 $5.00/$30.00 降到 $2.50/$15.00(每百萬 tokens input/output,↓50%),Flex 最低到 $1.25/$7.50,促銷跑到 2026-09-18。折扣只適用兩平台的代管計費(Unified Billing/非 BYOK)流量,OpenAI 自家 API 直接叫用價格不變。
免費方案有每日或每月額度、餘額補回、持續限速與一次性試用;有些 API 沒有免費額度,必須預付或按量計費。
Amp 已於 2025 年 12 月從 Sourcegraph 獨立為 Amp Frontier Corporation,npm 套件也從 @sourcegraph/amp 改為 @ampcode/cli。它的識別特徵是持續砍功能:editor 擴充、Amp Tab、TODO 清單、Fork、custom commands、public threads 全部刪掉。2026-07-18 才首度推出月費訂閱(Megawatt $20、Gigawatt $200),此前只有 pay-as-you-go。現在主軸是 orbs——關掉筆電也會繼續跑的遠端機器。
Copilot CLI 於 2026-02-25 正式 GA,所有 Copilot 方案(含 Free)都包含。差異化不在 agent 本身,而在 GitHub 平台整合:內建 GitHub MCP server 直接操作 issue 與 PR、組織政策自動繼承、`&` 前綴把工作丟給雲端 coding agent。計費走 GitHub AI Credits(1 credit = $0.01),Pro $10/mo 含 $15、Pro+ $39 含 $70、Max $100 含 $200。
Workers AI 目錄目前 84 個模型。通用對話選 glm-4.7-flash($0.06 / $0.40 per M、131K context),要 vision 選 gemma-4-26b-a4b-it($0.10 / $0.30、256K),極省成本選 granite-4.0-h-micro($0.017 / $0.112),embedding 選 qwen3-embedding-0.6b 或 bge-m3(同為 $0.012 per M)。這篇會定期跟著官方目錄更新。
Claude Sonnet 5 原訂 9/1 從促銷價 $2/$10 漲回標準價 $3/$15,Anthropic 8/10 在官方定價頁面宣布這次調漲「不會發生」,$2/$10 變成永久定價。以每月 30 萬則客服對話的 workload 試算,等於避開了每月 $1,200(↓33%)的成本上升,也讓 Sonnet 5 從此永久比前代 Sonnet 4.6($3/$15)便宜。
個人怎麼接工具是偏好問題,組織怎麼接是治理問題——誰能碰什麼資料、金鑰放哪、成本算誰的。Anthropic 自己公布的十個團隊使用紀錄裡有個好指標:安全工程團隊佔了整個 monorepo 自訂 slash command 的 50%。採用不是均勻擴散的,它先在會自己造工具的團隊裡起飛。
DeepSeek V4-Pro 尖峰 Output 從 $0.87 漲到 $3.96/1M tokens(↑355%),V4-Flash 從 $0.28 漲到 $1.32(↑371%),2026-08-16 16:00 UTC 生效,同時導入離峰半價機制(01:00-04:00、06:00-10:00 UTC 為尖峰)。漲價後價格仍低於 GPT-5.6/Claude,但低價護城河明顯收窄。
「數位員工」不是技術,是計價與課責單位。Anthropic Project Vend 讓 Claude 真的開了三家店,發現最有效的介入不是換更強的模型,而是強迫走流程——官方原話是「我們重新發現了 bureaucracy matters」。Gartner 估計數千家自稱 agentic 的廠商中只約 130 家是真的。
價值驗證的單位是假設不是點子。Kohavi 的資料顯示產業中位數只有 10% 的實驗會成功,這代表在 p<0.05 下約 22% 的「獲勝實驗」其實是假陽性;Sean Ellis 的 40% 門檻查不到任何公開資料集;AI 產品的留存要從 M3 而非 M0 起算,且 <$50/mo 的 GRR 只有 23%、>$250/mo 有 70%。
個人專案、玩具 demo、做 RAG 原型,不想第一步就掏卡。整理 2026/05 還在運作的 40+ 家 LLM inference 服務商,按免費資源「是持續補充還是一次性」分梯,標註綁卡需求、模型清單、付費起價,數字全部從官方 pricing 頁驗證。中國原廠含智谱 GLM(永久免費)、豆包(每日 200 萬 tokens)、Kimi、百煉、Ollama 本地跑法一併收錄。
Claude Code 從 $20/mo Pro 到 $200/mo Max 20x,額度以 5 小時滾動視窗計算並疊加週上限,Claude 網頁/桌面/終端共用同一個池子。額度用完可選擇改走 API 費率的 usage credits 繼續做事,而不是硬停。
Cursor CLI 把 IDE 的 Agent 帶進終端,支援 interactive TUI 與 headless、Plan/Ask/Agent 三種模式、Cloud Handoff、CI/CD 整合。計費改為兩個獨立額度池:Cursor 自家模型(Grok 4.6/4.5、Composer 2.5)與第三方模型(Pro 含 $20、Pro+ $70、Ultra $400)。
Google 這條線的付費路徑對照:個人免費層與 Google AI Pro / Ultra 的 Gemini CLI 存取已於 2026/6/18 終止,個人只剩 Antigravity CLI 或自備付費 API key;企業授權與 Google Cloud 不受影響。零成本起步的選項已經換人。
Kiro 分五層:Free 50 credits、Pro $20/1,000、Pro+ $40/2,000、Pro Max $100/5,000、Power $200/10,000,加購 credit 一律 $0.04。Auto 模式混合模型省成本(同一任務走 Sonnet 要 1.3 倍 credit),Spec-Driven 流程把 vibe coding 變成可追蹤的結構化開發。
Codex 綁定 ChatGPT 訂閱(Free / Go $8 / Plus $20 / Pro 5x $100 / Pro 20x $200),2026/4/2 起計費改為按 token 計 credit。模型主線是 GPT-5.6 Sol / Terra / Luna;GPT-5.4 與 5.4 mini 將於 2026/8/31 在 ChatGPT 登入模式下退場。