洩漏的 Astra 輸出顯示其可單次零樣本生成3D網頁,與 Anthropic 的 Fable 5.1 形成正面對決。
洩漏的 Astra 輸出顯示其可單次零樣本生成3D網頁,與 Anthropic 的 Fable 5.1 形成正面對決。

OpenAI Astra 檢查點(代號 mozaik-alpha-fdm)的洩漏輸出顯示,該模型能在單次零樣本(zero-shot)操作中生成完整的3D網頁與精緻的前端介面,這可能在預期的9月3日發布前數週內,對AI程式碼生成市場形成壓縮效應。
「前端已被攻克,」開發者 Chetaslua 在 X 平台上發文,並分享了一段 Astra 生成具備物理引擎與導航功能的互動式3D遊戲世界的影片。「這是歷史上第一次,擁有想法的人將比執行者更具優勢。」
洩漏的樣本包括一個具備導航與按鈕的 NACRE 品牌頁面、一個等距視角的 AURELION 遊戲世界,以及一個細節豐富的 PlayStation 5 手把渲染圖——全部在 OpenAI 最高推理設定「Max」級別下以零樣本方式生成。開發者 MeSun 使用 Astra 建立了一個具備可調節車架比例的3D自行車測試頁面,另一項測試則在單次操作中生成了第一人稱 roguelike 遊戲。這些輸出建立在 Astra 8月的預覽基礎之上,當時該模型在內部解決了10個重大數學與科學問題。
該模型預計於9月3日(週四)發布,屆時將直接與 Anthropic 的 Fable 5.1 正面交鋒——後者正瞄準同一時間窗口,並升級了前端程式碼生成能力與更長的思維鏈(chain-of-thought)推理。勝出者可能重塑AI程式碼助手市場,而 OpenAI 的 GPT-5.6 Sol 已將服務成本削減了20%。
前端生成長期以來一直是大型語言模型的弱點——後端邏輯運行流暢,但 UI 輸出往往會產生臃腫的 CSS 和衝突的配色方案。根據洩漏的細節與開發者分析,Astra 的零樣本結果暗示了四項結構性變革。
第一,端到端多代理協調。Astra 可能不再是一個單純的程式碼生成器,而是一個原生運行並發子模型的系統——實質上是讓 UI 設計師、前端工程師與程式碼審查員並行工作。這建立在 OpenAI 隨 GPT-5.6 以 beta 版推出的多代理功能之上,但 Astra 似乎已將其內化為一項原生、端到端訓練的能力。
第二,超長視野任務處理。涉及多個元件以及關聯 CSS 與 JavaScript 的複雜專案,歷史上曾觸發早期模型的「遺忘」與幻覺問題。Astra 能夠在整個3D場景中保持一致的設計語言,這表明其注意力機制能在擴展生成過程中維持連貫性——這也是其據報在10道內部數學與科學問題上取得成功的同一項能力。
第三,持續推理。在 Max 級別設定下,Astra 的思考量顯著超過 GPT-5.6 Sol,這指向一種內部迭代的機制——在輸出最終結果之前進行重新檢查、修正與精煉。這使模型能夠記住 DOM 樹結構,並在整個頁面中保持設計語言的一致性。
第四,即時自我修正。Astra 可能在內部沙盒中渲染其輸出,在呈現最終結果之前,透過虛擬渲染或 AST 語法檢查來運行程式碼。能夠以零樣本方式重現高細節的 PS5 手把渲染圖,正是這種自我檢查循環的間接證據。
Anthropic 正加速將 Fable 5.1 推向同一發布窗口,早期測試者回報的升級幾乎與 Astra 完全重疊:更穩定的前端程式碼、更強化的長思維鏈推理,以及針對代理工作流程的改進工具呼叫能力。兩家公司已經在直接互相較勁——一項生成「女性自畫像」SVG 向量圖像的對比測試顯示,Astra 與 Fable 5.1 在細節豐富度和結構整潔度上產生了明顯不同的結果。
關鍵決定因素可能不在於原始能力,而在於價格。如果 OpenAI 以低於 Fable 5.1 的 API 成本交付 Astra——建立在 Sol 削減20%服務成本的基礎之上——Anthropic 將不僅在基準測試上承受壓力,在單位經濟效益上同樣如此。OpenAI 在「Bell」模型與自研「Jalapeno」推論晶片(以能源效率與延遲為目標)上的並行工作,可能進一步拉大成本差距。
對投資人而言,風險是具體的。OpenAI 進軍程式碼代理領域,正威脅著AI開發工具廠商的定價能力,而 Anthropic 的 Fable 系列對其企業營收至關重要。9月3日的發布將檢驗兩家公司能否將模型能力轉化為可持續的訂閱與 API 營收——以及開發者所描述的「想法勝過執行」的轉變,是否會轉化為對AI輔助軟體開發的真實需求。
本文僅供資訊參考,不構成投資建議。