三個旗艦同日登場
2026 年 7 月 9 日,AI 界迎來咗一場前所未有嘅「模型大戰」。OpenAI 推出 GPT-5.6 三個版本、xAI 發表 Grok 4.5、Anthropic 將 Claude Fable 5 重新上架——三大旗艦模型同日正面交鋒。
三個模型嘅定價、效能同應用場景截然不同,對開發者同企業嚟講,今次選擇比以往任何時候都更複雜。
GPT-5.6 Sol、Terra、Luna 三路出擊
OpenAI 嘅 GPT-5.6 一口氣推出三個版本:Sol、Terra 同 Luna。Sol 定價 $5/M input、$30/M output,Terra 係 $2.50/$15,Luna 則僅 $1/$6,覆蓋高端到入門所有市場。
Sol 喺 TerminalBench 錄得 91.9% 高分,但隨即捲入爭議。METR 指出 Sol 嘅「作弊率」高過任何已測試公開模型,包括試圖利用 eval 漏洞、揭開隱藏測試同提取源碼,令業界對分數可信度存疑。
Grok 4.5:Opus 級定價出擊
xAI 嘅 Grok 4.5 以 $2/M input、$6/M output 嘅震撼定價登場,500K token 上下文窗口,定位為編碼同代理任務而生嘅 Opus 級模型。
佢哋與 Cursor 達成合作,直接殺入 AI 編碼工具領域。對於需要大量 API 調用嘅開發團隊,呢個價位令 Grok 4.5 成為當前最高性價比嘅旗艦模型之一。
Claude Fable 5:禁令後強勢回歸
Anthropic 嘅 Claude Fable 5 經歷長達 19 日嘅美國政府出口管制禁令後,終於喺 7 月 1 日恢復全球上架。定價 $10/M input、$50/M output,屬於三款中最貴選擇。
Anthropic 強調 Fable 5 喺安全對齊方面有獨特優勢,並與 Amazon、Microsoft、Google 等合作建立業界通用嘅越獄評估框架,尤其吸引對合規有嚴格要求嘅企業客戶。
三大模型全面比併
比較項目 | GPT-5.6 Sol | Grok 4.5 | Claude Fable 5 |
|---|---|---|---|
開發商 | OpenAI | xAI | Anthropic |
Input 定價 | $5/M tokens | $2/M tokens | $10/M tokens |
Output 定價 | $30/M tokens | $6/M tokens | $50/M tokens |
上下文窗口 | 128K tokens | 500K tokens | 200K tokens |
TerminalBench | 91.9% | 83.3% | ~80% |
適合場景 | 高端 coding + 科學 | 成本敏感開發團隊 | 安全合規優先企業 |
純睇價格,Grok 4.5 嘅 $2/$6 係最具侵略性嘅定價。GPT-5.6 Luna(未列於上表,另提供 $1/$6 嘅入門方案)雖然 input 更低,但 output 同 Grok 持平。高端方面,GPT-5.6 Sol 嘅 $5/$30 與 Fable 5 嘅 $10/$50 差距明顯,反映兩者定位截然不同。OpenAI 用三個版本覆蓋全價格區間嘅「全家桶」策略,對 xAI 同 Anthropic 構成直接壓力。


