Skip to content
所有標籤

#openai

28 篇文章

定價追蹤|OpenAI 新增 Ultrafast 速度層級,Pro 200 方案用量砍半

OpenAI 於 2026-09-29 DevDay 為 GPT-6 Astra API 新增 Ultrafast 速度層級:input/output 漲到 Standard 的 6 倍(短 context $60/$300 per 1M tokens),換取 API 最高 6 倍、Codex 最高 8 倍的生成速度;同時 ChatGPT Pro 200 的 Codex/Work 用量上限從 20x Plus 砍到 10x Plus,既有訂閱戶延至 2026-10-29 才降級並獲發 2026-12-31 到期的 $2,500 usage credit;新方案 Pro 500($500/月、25x Plus)成為唯一內建 Ultrafast 的訂閱層級。

模型卡|GPT-6.1 Sol

GPT-6.1 Sol(`gpt-6.1-sol`):2026-09-29 DevDay 上線,1,050,000 tokens context window(最大輸入 922,000、輸出上限 128,000,與 GPT-6 Sol 同級);定價維持 input $2.00/output $10.00,但快取輸入從 GPT-6 Sol 的 $0.20 再砍半到 $0.10(比標準輸入價低 95%);DeepSWE v1.1 上以約 1/5 Astra 成本追平 Astra 表現,比 GPT-6 Sol 最高分高 6.4 個百分點;AutomationBench medium effort 贏 Claude Opus 5.5 2.2 個百分點且成本僅其約 1/3;同一週 OpenAI 也因安全疑慮擱置了旗艦升級版 GPT-6.1 Astra,未發佈

定價追蹤|OpenAI 發布 GPT-6 Sol/Luna,API 定價比 GPT-5.6 促銷價再砍 50%

OpenAI 官方公告與定價頁確認:GPT-6 Sol input 從 $4.00 降到 $2.00/1M tokens(↓50%)、output 從 $20.00 降到 $10.00(↓50%);GPT-6 Luna input 從 $0.20 降到 $0.10(↓50%)、output 從 $1.20 降到 $0.50(↓58%),2026-09-22 生效。降價基準是 GPT-5.6 系列的『促銷價』而非原價,而 GPT-5.6 Sol 的促銷價官方寫明只保證到 2026-11-21——這代表 GPT-6 Sol 現在的 $2/$10 才是這輪真正該拿來比較的長期基準價。

模型卡|GPT-6 Sol/Luna

GPT-6 Sol(`gpt-6-sol`)/GPT-6 Luna(`gpt-6-luna`):2026-09-22 上線,1,050,000 tokens context window(最大輸入 922,000、輸出上限 128,000,與旗艦 Astra 同級);Sol input $2.00/output $10.00,Luna input $0.10/output $0.50(每 1M tokens,較 GPT-5.6 促銷價再砍 50%);AutomationBench 上 Sol 33.2%(xhigh effort)贏過 Claude Opus 5 的 26.9%、成本僅其約 1/11;DeepSWE v1.1 上 Sol 68.8%/Luna 66.6%,逼近 Claude Fable 5.1 的 69.9%;內部模擬部署測試中 severity≥3 的 misalignment flag 從前代 66 次降到 42 次

五朵雲的記憶 API:OpenAI、Anthropic、Google、AWS、Microsoft 怎麼讓 Agent 記住事情

五家雲平台都在 2025–2026 年推出 agent 記憶 API,但設計哲學分歧明顯:OpenAI 把記憶寫成檔案、Anthropic 把記憶掛載成目錄、Google 用向量加主題分類、AWS 用事件加策略管線、Microsoft 用 context provider 抽象。定價從免費到 $0.75/千筆/月不等,租戶隔離從「應用端自己來」到「IAM 一等公民」都有。

商用產品格局:OpenAI、Perplexity、Gemini、Claude、Grok

2026 年的 deep research 商用市場已經分化:OpenAI 全面、Perplexity 速度快、Gemini 生態整合、Claude 推理深、Grok 實時性強。這篇比較各家產品的差異——不是誰最好,而是誰最適合你的場景。

Multi-Agent 通訊機制:Handoff、Delegate、Mailbox 與協定標準化

Agent 間通訊分三種模式:handoff(移交控制權)、delegate(委派後等結果)、mailbox(即時點對點訊息)。各家實作差異大,但 MCP 和 A2A 正在推動協定標準化。

Multi-Agent Context 管理:Fork vs Fresh、歷史截斷、結果壓縮的設計取捨

子 agent 要不要看到父對話?Fork 帶完整歷史但 token 指數膨脹,Fresh 省錢但缺背景。業界共識:預設 Fresh,需要時才 Fork,且一定要搭歷史截斷和結果壓縮。

Multi-Agent 成本控制:七家框架的做法與「先軟著陸再硬擋」的業界共識

Multi-Agent 並行 + 巢狀 spawn 可以在單輪對話燒掉 200K+ tokens。業界從 Anthropic 到 Microsoft 都走向三級分級反應:壓縮 → 降級 → 停止,而非一刀切硬擋。

Multi-Agent 系統全景:從 CLI 到雲端,2026 年各家怎麼做多 Agent 協作

2026 年幾乎所有主流 coding agent 都支援 subagent。設計哲學分三派:腳本確定性編排(Claude Code Workflow)、model-driven 自主(Codex、Devin)、IDE 指揮台(Windsurf 2.0、VS Code)。這篇是系列總篇,整理產品定位、能力矩陣與架構光譜。

Multi-Agent 編排模式:腳本、Model-Driven、混合,三種哲學怎麼選

Multi-Agent 編排分三派:腳本確定性(LangGraph、Claude Code Workflow)可預測但僵硬,model-driven(Codex、Devin)靈活但不可控,混合派(Windsurf 2.0)當指揮台整合多家。選擇取決於你需要多少可預測性。

定價追蹤|OpenAI 10/14 讓 GPT-5.5 從 ChatGPT/Codex 退場,API 不受影響

OpenAI 於 2026-09-14 公告:GPT-5.5 將於 2026-10-14 從 ChatGPT、ChatGPT Work、Codex 全部方案下架,但直接呼叫 OpenAI API 的 `gpt-5.5` 不受影響——這是產品層淘汰,不是 API 淘汰。官方定價表上 gpt-5.5 短內容 input/output 是 $5.00/$30.00(每百萬 tokens),Codex 官方導向的替代模型 GPT-5.6 Sol 是 $4.00/$20.00,換過去同時省錢(input ↓20%、output ↓33%)。從公告到下架只有一個月緩衝,比 OpenAI 自家文件寫的「GA 模型至少 6 個月通知期」短很多。

模型卡|GPT-6 Astra

GPT-6 Astra(API ID:gpt-6-astra):OpenAI 於 2026-09-03 發佈,1,050,000 tokens context window、128,000 max output、input $10.00/output $50.00(每 1M tokens,cached input $1.00)、閉源;ARC-AGI-3 官方harness 99.9%(標準化 harness 62.7%)、FrontierMath Tier 4 97.6%、ExploitBench 100%;OpenAI Preparedness Framework 下首個「Critical」級網路安全能力模型;但中立的 Artificial Analysis Intelligence Index 僅 61 分,打平前代 GPT-5.6 Sol、落後 Claude Fable 5.1 的 66 分

定價追蹤|OpenAI Assistants API 正式停用,遷移選模型牽動成本

OpenAI Assistants API(/v1/assistants、/v1/threads、/v1/threads/runs)已於 2026-08-26 正式停用,一年前公告、零延長、無自動遷移工具。這本身不是定價變動,但停用逼你重新選模型——原本掛在 Assistants 上的 o3($2.00/$8.00,每百萬 tokens input/output)沒有直接替代品,官方建議換成 GPT-5.6 Sol($4.00/$20.00,成本 ↑129%),但實務上 Terra($2.00/$12.00,↑29%)在多數場景已經夠用,兩者差 44%。

Looplane 的 ModelProvider 多閘道:多個 protocol 共用一個 canonical contract

Looplane 把 OpenAI-compatible、Responses、Anthropic、Gemini、Workers AI、scripted 與 experimental Codex OAuth adapter 收斂成同一個 `ModelProvider` contract。Codex OAuth transport 讀 SSE,但仍在 adapter 內累積成一次性的 canonical `ModelTurn`;AgentRunner 不直接消費 token delta。

GPT——閉源 API 收營收、開源 GPT-OSS 補生態,統一路由架構的全球最大 AI 平台

GPT 是 OpenAI 推出的 LLM 家族,從 2018 年的 117M 參數到 2026 年的 GPT-5.6 Sol/Terra/Luna 三層產品線,擁有超過 10 億使用者和 200 萬企業客戶。GPT-5.6 Sol 在 LiveBench 81.1%、Terminal-Bench 2.1 88.8%、Artificial Analysis Coding Agent Index 80 等多項 benchmark 領先,同時首次推出開源模型 GPT-OSS(Apache 2.0)。

定價追蹤|OpenAI 親自出手,GPT-5.6 Sol 官方標準價砍 20-33%

OpenAI 官方將 GPT-5.6 Sol 標準費率從 $5.00/$30.00 降到 $4.00/$20.00(每百萬 tokens input/output,input ↓20%、output ↓33%),2026-08-21 生效,促銷期至少到 11/21。這是 OpenAI 自己動手降價,不是 OpenRouter/Cloudflare 那種平台促銷(見前篇),且兩者現在疊加——OpenRouter 的 50% 折扣已改套用在新的 $4/$20 基準價上,變成 $2.00/$10.00。

定價追蹤|GPT-5.6 Sol 雙平台打對折,OpenRouter 與 Cloudflare 同步降價至 9/18

GPT-5.6 Sol 標準費率透過 OpenRouter 與 Cloudflare AI Gateway 都從 $5.00/$30.00 降到 $2.50/$15.00(每百萬 tokens input/output,↓50%),Flex 最低到 $1.25/$7.50,促銷跑到 2026-09-18。折扣只適用兩平台的代管計費(Unified Billing/非 BYOK)流量,OpenAI 自家 API 直接叫用價格不變。

Agent Plugins 1.0:OpenAI、Google、AWS 罕見聯手,統一 AI Agent 擴充的封裝標準

Agent Plugins 1.0 是一個封裝格式標準,把 Agent Skills(Markdown 指令)和 MCP server 設定包成一個目錄,讓同一個 plugin 能被 ChatGPT、Cursor、GitHub Copilot、Kiro、VS Code 直接載入。它不是新的協議,是協議之上的包裝紙。Vercel 發起,OpenAI、AWS、Microsoft、Cursor 共同制定,Google 發佈當天加入——Anthropic 不在治理名單上,但 MCP 團隊正面回應。

aideep-dive

FDE 戰爭:OpenAI 和 Anthropic 為何同時複製 Palantir 的劇本

MIT 研究說 95% 企業 AI pilot 零回報。OpenAI 和 Anthropic 在同一週各自宣布百億美元規模的合資公司,把 Palantir 用了十幾年的 Forward Deployed Engineer 模式整套搬進企業 AI 落地戰場。

aideep-dive

OpenAI 公開 Codex 安全部署策略:沙箱、自動審批與企業治理框架

OpenAI 在 2026 年 5 月公開 Codex 內部部署實踐:沙箱劃技術邊界、審批決定何時停下、Auto-review 用子代理代替人類審批、Managed configuration 由企業管理員強制下發。核心理念是:低風險動作零摩擦,高風險動作必經審查。

aideep-dive

OpenAI Workspace Agents:從 Custom GPT 進化到團隊自動化平台

OpenAI 2026/4/22 推出 Workspace Agents,以 Codex 為底、可長時間在雲端執行、能串 Slack/Salesforce/Google Drive,是 Custom GPT 的企業版後繼者。

aiguide

深入 Codex Agent Loop:OpenAI 如何讓 AI Agent 持續迭代工作

OpenAI 詳解 Codex 的 agent loop 設計:prompt 如何建構、multi-turn 對話如何管理、prompt caching 如何避免成本爆炸,以及 context window 自動壓縮的實作。

aiguide

Codex App Server:OpenAI 如何把 Agent Harness 變成通用協議

OpenAI 把 Codex harness 包裝成 JSON-RPC over stdio 的 App Server,讓 VS Code、JetBrains、Web、桌面 App 都能共用同一套 agent loop,三個核心 primitive:Item、Turn、Thread。

aiguideAI Agent 實戰

OpenAI 用 Codex 寫了 100 萬行程式碼:Harness Engineering 實戰

OpenAI 內部團隊 5 個月、3 人、0 行手寫程式碼,用 Codex 交付了一個完整產品。這篇整理他們在 AGENTS.md 設計、repo-local 知識庫、架構強制執行、entropy 管理上的核心心得。

aiguide

2026 年 15 個值得關注的 Agent 框架

按 GitHub Stars 排序,盤點 2026 年 15 個主流 AI Agent 框架的定位、特色與適用場景。不是排名,是地圖。

Codex CLI:OpenAI 開源終端機 Coding Agent 完整介紹

Codex CLI 是 OpenAI 的開源終端機 coding agent(Rust,Apache-2.0,約 106.6k stars),支援 MCP、subagents、圖片輸入、code review、Skills。模型主線已換成 GPT-5.6 Sol / Terra / Luna,桌面版、CLI 與 IDE 擴充共用一份 config.toml。

OpenClaw 的模型需求與供應商生態:先搞懂 provider、model、runtime 是三件事

OpenClaw 對模型的硬需求是 tool use 加夠大的 context——onboarding 自動推薦本地模型的門檻是支援 tool 且 context 至少 16K。但更容易搞混的是 provider、model、agent runtime 其實是三層,`openai/*` 不等於走 Codex。