智譜AI開源模型GLM-5.3-Flash在AA智能指數上以四十分之一的價格追平Anthropic的Claude Opus 4.8。
智譜AI開源模型GLM-5.3-Flash在AA智能指數上以四十分之一的價格追平Anthropic的Claude Opus 4.8。

智譜AI開源模型GLM-5.3-Flash在Artificial Analysis智能指數上以四十分之一的價格追平Anthropic的Claude Opus 4.8,加劇了一場已使中國模型佔據全球Token使用量逾六成的價格戰。
「對於編碼、數據提取和客戶支援等高頻重複性任務,中國領先模型已幾乎縮小了與西方專有系統的效能差距,同時以遠更低的成本提供相同輸出,」尼日利亞保險科技公司Curacel執行長亨利·馬斯科特(Henry Mascot)表示。
這款擁有3200億參數、180億活躍參數的模型是GLM-5系列首款原生多模態發布,在AA智能指數上得分57,與Claude Opus 4.8持平。智譜將GLM-5.3-Flash定價為其旗艦模型GLM-5.3的十分之一,限時優惠期間為二十分之一,僅為Opus 4.8價格的四十分之一。該公司證實,以「Ox Alpha」之名橫掃線上使用量排行榜的模型正是其GLM系列的新迭代版本,權重已於週三對外發布。
此定價出台之際,中國模型在聚合平台OpenRouter上全球月度Token使用量的佔比已從去年初的不到10%飆升至今年7月的逾60%。阿里巴巴的Qwen 3.7 Max以4.08美元建構了一個與Anthropic Fable 5完全相同的電子商務網站,而後者需花費48.99美元,在可比輸出下存在十二倍的差距。
本次發布加劇了對美國AI龍頭企業的競爭擠壓。OpenAI於7月底將其中階模型Terra和Luna的API價格分別下調20%和80%,而Anthropic以與Opus 4.8相同的價格發布Claude Opus 5——每百萬輸入Token 5美元、每百萬輸出Token 25美元——並宣稱其成本僅為旗艦模型Fable 5的一半,同時在編碼基準上得分差距在0.5%以內。Google將Gemini 3.6 Flash定價為每百萬輸入Token 1.50美元、每百萬輸出Token 7.50美元。
開放權重架構是處理敏感數據企業的決定性因素。非洲最大保險科技公司Curacel在美國模型之外,將智譜的GLM-5.3納入其保險理賠和欺詐檢測系統,理由是能夠在內部伺服器上運行銀行交易記錄和客戶盡職審查文件,而非將其傳輸至海外API。烏干達研究人員在比較了中美方案後,基於阿里巴巴的Qwen3基礎模型建構了「Sunflower」——一款支援超過30種當地語言的農業諮詢工具。
價格差距並非均勻一致。AlphaSense的研究發現,OpenAI的GPT-5.6 Sol和Anthropic的Opus 4.8在部分任務上以更低的總成本提供更高質量的回應,優於月之暗面的Kimi K3和智譜的GLM-5.2,原因在於中國模型需要更多Token才能完成答案。GPT-5.6 Sol每次查詢的中位總成本比Kimi K3低13%,而其質量得分高20%。Artificial Analysis採用不同方法估算,DeepSeek V4 Flash在高性能模型中錄得每次任務成本最低,為0.03美元。
價格壓力正重塑採購格局。美國工作流程新創公司Lindy於6月將其主力模型從Anthropic產品切換至DeepSeek,成本削減90%,而Palcia則將夜間任務分配給中國MiniMax模型。對投資者而言,問題在於美國AI龍頭能否在開源權重競爭對手縮小效能差距之際捍衛溢價定價——Anthropic和OpenAI已開始對中階產品線降價,壓縮了支撐其估值的單位經濟效益。
本文僅供資訊參考,不構成投資建議。