所有標籤OpenAI 於 2026-09-29 DevDay 為 GPT-6 Astra API 新增 Ultrafast 速度層級:input/output 漲到 Standard 的 6 倍(短 context $60/$300 per 1M tokens),換取 API 最高 6 倍、Codex 最高 8 倍的生成速度;同時 ChatGPT Pro 200 的 Codex/Work 用量上限從 20x Plus 砍到 10x Plus,既有訂閱戶延至 2026-10-29 才降級並獲發 2026-12-31 到期的 $2,500 usage credit;新方案 Pro 500($500/月、25x Plus)成為唯一內建 Ultrafast 的訂閱層級。
GPT-6.1 Sol(`gpt-6.1-sol`):2026-09-29 DevDay 上線,1,050,000 tokens context window(最大輸入 922,000、輸出上限 128,000,與 GPT-6 Sol 同級);定價維持 input $2.00/output $10.00,但快取輸入從 GPT-6 Sol 的 $0.20 再砍半到 $0.10(比標準輸入價低 95%);DeepSWE v1.1 上以約 1/5 Astra 成本追平 Astra 表現,比 GPT-6 Sol 最高分高 6.4 個百分點;AutomationBench medium effort 贏 Claude Opus 5.5 2.2 個百分點且成本僅其約 1/3;同一週 OpenAI 也因安全疑慮擱置了旗艦升級版 GPT-6.1 Astra,未發佈
OpenAI 官方公告與定價頁確認:GPT-6 Sol input 從 $4.00 降到 $2.00/1M tokens(↓50%)、output 從 $20.00 降到 $10.00(↓50%);GPT-6 Luna input 從 $0.20 降到 $0.10(↓50%)、output 從 $1.20 降到 $0.50(↓58%),2026-09-22 生效。降價基準是 GPT-5.6 系列的『促銷價』而非原價,而 GPT-5.6 Sol 的促銷價官方寫明只保證到 2026-11-21——這代表 GPT-6 Sol 現在的 $2/$10 才是這輪真正該拿來比較的長期基準價。
GPT-6 Sol(`gpt-6-sol`)/GPT-6 Luna(`gpt-6-luna`):2026-09-22 上線,1,050,000 tokens context window(最大輸入 922,000、輸出上限 128,000,與旗艦 Astra 同級);Sol input $2.00/output $10.00,Luna input $0.10/output $0.50(每 1M tokens,較 GPT-5.6 促銷價再砍 50%);AutomationBench 上 Sol 33.2%(xhigh effort)贏過 Claude Opus 5 的 26.9%、成本僅其約 1/11;DeepSWE v1.1 上 Sol 68.8%/Luna 66.6%,逼近 Claude Fable 5.1 的 69.9%;內部模擬部署測試中 severity≥3 的 misalignment flag 從前代 66 次降到 42 次
五家雲平台都在 2025–2026 年推出 agent 記憶 API,但設計哲學分歧明顯:OpenAI 把記憶寫成檔案、Anthropic 把記憶掛載成目錄、Google 用向量加主題分類、AWS 用事件加策略管線、Microsoft 用 context provider 抽象。定價從免費到 $0.75/千筆/月不等,租戶隔離從「應用端自己來」到「IAM 一等公民」都有。
2026 年的 deep research 商用市場已經分化:OpenAI 全面、Perplexity 速度快、Gemini 生態整合、Claude 推理深、Grok 實時性強。這篇比較各家產品的差異——不是誰最好,而是誰最適合你的場景。
Agent 間通訊分三種模式:handoff(移交控制權)、delegate(委派後等結果)、mailbox(即時點對點訊息)。各家實作差異大,但 MCP 和 A2A 正在推動協定標準化。
子 agent 要不要看到父對話?Fork 帶完整歷史但 token 指數膨脹,Fresh 省錢但缺背景。業界共識:預設 Fresh,需要時才 Fork,且一定要搭歷史截斷和結果壓縮。
Multi-Agent 並行 + 巢狀 spawn 可以在單輪對話燒掉 200K+ tokens。業界從 Anthropic 到 Microsoft 都走向三級分級反應:壓縮 → 降級 → 停止,而非一刀切硬擋。
2026 年幾乎所有主流 coding agent 都支援 subagent。設計哲學分三派:腳本確定性編排(Claude Code Workflow)、model-driven 自主(Codex、Devin)、IDE 指揮台(Windsurf 2.0、VS Code)。這篇是系列總篇,整理產品定位、能力矩陣與架構光譜。
Multi-Agent 編排分三派:腳本確定性(LangGraph、Claude Code Workflow)可預測但僵硬,model-driven(Codex、Devin)靈活但不可控,混合派(Windsurf 2.0)當指揮台整合多家。選擇取決於你需要多少可預測性。
OpenAI 於 2026-09-14 公告:GPT-5.5 將於 2026-10-14 從 ChatGPT、ChatGPT Work、Codex 全部方案下架,但直接呼叫 OpenAI API 的 `gpt-5.5` 不受影響——這是產品層淘汰,不是 API 淘汰。官方定價表上 gpt-5.5 短內容 input/output 是 $5.00/$30.00(每百萬 tokens),Codex 官方導向的替代模型 GPT-5.6 Sol 是 $4.00/$20.00,換過去同時省錢(input ↓20%、output ↓33%)。從公告到下架只有一個月緩衝,比 OpenAI 自家文件寫的「GA 模型至少 6 個月通知期」短很多。
GPT-6 Astra(API ID:gpt-6-astra):OpenAI 於 2026-09-03 發佈,1,050,000 tokens context window、128,000 max output、input $10.00/output $50.00(每 1M tokens,cached input $1.00)、閉源;ARC-AGI-3 官方harness 99.9%(標準化 harness 62.7%)、FrontierMath Tier 4 97.6%、ExploitBench 100%;OpenAI Preparedness Framework 下首個「Critical」級網路安全能力模型;但中立的 Artificial Analysis Intelligence Index 僅 61 分,打平前代 GPT-5.6 Sol、落後 Claude Fable 5.1 的 66 分
OpenAI Assistants API(/v1/assistants、/v1/threads、/v1/threads/runs)已於 2026-08-26 正式停用,一年前公告、零延長、無自動遷移工具。這本身不是定價變動,但停用逼你重新選模型——原本掛在 Assistants 上的 o3($2.00/$8.00,每百萬 tokens input/output)沒有直接替代品,官方建議換成 GPT-5.6 Sol($4.00/$20.00,成本 ↑129%),但實務上 Terra($2.00/$12.00,↑29%)在多數場景已經夠用,兩者差 44%。
Looplane 把 OpenAI-compatible、Responses、Anthropic、Gemini、Workers AI、scripted 與 experimental Codex OAuth adapter 收斂成同一個 `ModelProvider` contract。Codex OAuth transport 讀 SSE,但仍在 adapter 內累積成一次性的 canonical `ModelTurn`;AgentRunner 不直接消費 token delta。
GPT 是 OpenAI 推出的 LLM 家族,從 2018 年的 117M 參數到 2026 年的 GPT-5.6 Sol/Terra/Luna 三層產品線,擁有超過 10 億使用者和 200 萬企業客戶。GPT-5.6 Sol 在 LiveBench 81.1%、Terminal-Bench 2.1 88.8%、Artificial Analysis Coding Agent Index 80 等多項 benchmark 領先,同時首次推出開源模型 GPT-OSS(Apache 2.0)。
OpenAI 官方將 GPT-5.6 Sol 標準費率從 $5.00/$30.00 降到 $4.00/$20.00(每百萬 tokens input/output,input ↓20%、output ↓33%),2026-08-21 生效,促銷期至少到 11/21。這是 OpenAI 自己動手降價,不是 OpenRouter/Cloudflare 那種平台促銷(見前篇),且兩者現在疊加——OpenRouter 的 50% 折扣已改套用在新的 $4/$20 基準價上,變成 $2.00/$10.00。
GPT-5.6 Sol 標準費率透過 OpenRouter 與 Cloudflare AI Gateway 都從 $5.00/$30.00 降到 $2.50/$15.00(每百萬 tokens input/output,↓50%),Flex 最低到 $1.25/$7.50,促銷跑到 2026-09-18。折扣只適用兩平台的代管計費(Unified Billing/非 BYOK)流量,OpenAI 自家 API 直接叫用價格不變。
Agent Plugins 1.0 是一個封裝格式標準,把 Agent Skills(Markdown 指令)和 MCP server 設定包成一個目錄,讓同一個 plugin 能被 ChatGPT、Cursor、GitHub Copilot、Kiro、VS Code 直接載入。它不是新的協議,是協議之上的包裝紙。Vercel 發起,OpenAI、AWS、Microsoft、Cursor 共同制定,Google 發佈當天加入——Anthropic 不在治理名單上,但 MCP 團隊正面回應。
MIT 研究說 95% 企業 AI pilot 零回報。OpenAI 和 Anthropic 在同一週各自宣布百億美元規模的合資公司,把 Palantir 用了十幾年的 Forward Deployed Engineer 模式整套搬進企業 AI 落地戰場。
OpenAI 在 2026 年 5 月公開 Codex 內部部署實踐:沙箱劃技術邊界、審批決定何時停下、Auto-review 用子代理代替人類審批、Managed configuration 由企業管理員強制下發。核心理念是:低風險動作零摩擦,高風險動作必經審查。
OpenAI 2026/4/22 推出 Workspace Agents,以 Codex 為底、可長時間在雲端執行、能串 Slack/Salesforce/Google Drive,是 Custom GPT 的企業版後繼者。
OpenAI 詳解 Codex 的 agent loop 設計:prompt 如何建構、multi-turn 對話如何管理、prompt caching 如何避免成本爆炸,以及 context window 自動壓縮的實作。
OpenAI 把 Codex harness 包裝成 JSON-RPC over stdio 的 App Server,讓 VS Code、JetBrains、Web、桌面 App 都能共用同一套 agent loop,三個核心 primitive:Item、Turn、Thread。
OpenAI 內部團隊 5 個月、3 人、0 行手寫程式碼,用 Codex 交付了一個完整產品。這篇整理他們在 AGENTS.md 設計、repo-local 知識庫、架構強制執行、entropy 管理上的核心心得。
按 GitHub Stars 排序,盤點 2026 年 15 個主流 AI Agent 框架的定位、特色與適用場景。不是排名,是地圖。
Codex CLI 是 OpenAI 的開源終端機 coding agent(Rust,Apache-2.0,約 106.6k stars),支援 MCP、subagents、圖片輸入、code review、Skills。模型主線已換成 GPT-5.6 Sol / Terra / Luna,桌面版、CLI 與 IDE 擴充共用一份 config.toml。
OpenClaw 對模型的硬需求是 tool use 加夠大的 context——onboarding 自動推薦本地模型的門檻是支援 tool 且 context 至少 16K。但更容易搞混的是 provider、model、agent runtime 其實是三層,`openai/*` 不等於走 Codex。