近期,各大人工智能企業密集發佈新模型。SpaceX 旗下的 xAI 發佈了 Grok 4.6,DeepSeek 推出了 V4 Pro 0813, Google 推出了 Gemini 3.7 Flash,而 OpenAI 則展示了每秒可處理 750 個 token 的 “UltraFast” 極速模式。Grok 評測機構 Artificial Analysis(AA)的分析報告顯示,Grok 4.6 的綜合智能指數達到 61 分,與 GPT-5.6 Sol 並列第三,較前代暴漲 23 分。
不僅如此,其價格保持不變(每百萬 token 輸入 US$2 (約 HK$16)、輸出 US$6 (約 HK$47)),遠低於同分數的 GPT-5.6 Sol。
在智能體任務方面,Grok 4.6 的表現也相當突出。GDPval-AA v2 得分 62% 僅次於 Claude Opus 5,而 τ 3 -Banking 金融測試則與阿里巴巴求文 Max 3.8 並列第一,被認為具有超越單價的結構性成本優勢。AA 智能指數方面,DeepSeek V4 Pro 0813 的 AA 智能指數達 53 分,在評測中排名第七。
其單任務成本僅需 6 美分,在全部 104 個模型中位居第二,是同價位段中最具性價比的選擇。然而,該公司宣佈上調 API 費用,高峯時段的緩存命中輸入費用將激增近 12 倍。業界指出,此舉可能動搖其“低成本實用型 AI”的市場定位。
Grok 4.6 在智能體任務中表現優異
Google 推出的 Gemini 3.7 Flash,AA 智能指數為 56 分。其最大亮點在於輸出速度——每秒可處理 340 個 token,較 GPT 5.6 Tera 快近 3 倍。此外,其較前代的定價便宜一半。OpenAI 為 GPT 5.6 Sol 模型新增了 “UltraFast” 模式,通過與 Cerebras 合作實現每秒 750 個 token 的輸出速度,較標準處理提升最高 14 倍,並宣稱“在保持智能無損的前提下實現高速運算”。
在此次模型競爭中,Anthropic 依然保持沉默。雖然有傳言稱 Fable 5.1 已完成開發,但按照 Anthropic 今年 4 到 8 周的發佈節奏,預計在 8 月下旬至 9 月初可能會有新品面世。

