OpenAI的新一代模型Astra近日被曝已擴大內部測試,其前端生成能力在開發者社群引發轟動。一位ID為@Lentils80的開發者發現,OpenAI已將Astra的內部測試版本代號定為mozaik-alpha-fdm,並放出了兩個在Max effort模式下的零樣本生成結果:一個是3D畫素風格的城堡,另一個是完整的前端網頁,均一次直出,無需任何樣本參考。與此同時,一批獲得灰度測試資格的開發者幾乎同時放出了Astra的首批實測,展示出它對細節的強大把控力——統一的視覺語言、複雜元素間的空間關係、頁面層級以及互動所需的程式碼結構,都能一次性管理到位。有開發者看完後直接宣佈“Frontend is solved”(前端問題已解決)。業界普遍預測,Astra將在下週四(9月3日)前後正式面世,與Anthropic的Fable 5.1正面交鋒。
前端生成一直是大型語言模型的難點。以往模型在生成UI時,常出現CSS臃腫、配色刺眼、佈局錯亂等問題。而Astra在零樣本條件下展現出的細節控制力,讓不少觀察者看到了質變的苗頭。例如,它生成的可互動3D等距王國地圖,需要同時處理幾何透視、圖層堆疊、動態互動和視覺一致性,Astra在最大思考程度下能一次成型。另一位開發者MeSun用Astra直接生成了一個帶物理效果的3D腳踏車測試網頁(HTML),車身比例可隨意調整;甚至讓它生成一個3D第一人稱Roguelike遊戲,主打戰鬥爽感,結果同樣“一把過”。有爆料大咖感嘆,這是歷史上第一次“想法”開始碾壓“執行”——“你能想到的,AI就能給你做出來”。
Astra的前端能力為何能如此脫胎換骨?結合洩露特徵與行業預測,其核心技術突破可能集中在四個維度。第一是端到端多智慧體編排:Astra可能不再是一個單純的單體程式碼生成器,而是原生集成了多智慧體架構,例如讓Codex處理程式設計任務、另一個子模型處理自然語言查詢,最後由主模型整合結果。在生成3D網頁時,模型內部相當於併發運行了“UI設計師、前端工程師和程式碼審查員”,從而保證佈局、樣式和邏輯的三位一體。這與GPT-5.6中已以beta形態推出的Multi-agent功能一脈相承,但Astra可能將其內化為端到端訓練的原生能力。第二是超長程任務能力:以往模型在編寫涉及多元件和複雜CSS/JS聯動的專案時,極易出現“遺忘”和“幻覺”,而Astra展現出的完整度,證明其上下文視窗內的注意力機制得到最佳化,足以支撐從零構建複雜工程。它解決十個數學問題的表現也顯示,模型能在極長時間跨度內維持推理一致性,這對程式碼專案的持續開發、論文級研究任務以及複雜工作流的自主執行意義重大。第三是持久化推理模式:Astra在Max effort下的思考量顯著超過Sol,模型不會一次性輸出答案,而是在內部反覆驗證、糾錯、迭代,直到輸出滿意為止。這意味著它能“記住”當前DOM樹的結構,在後續生成中保持設計語言和程式碼規範的絕對一致。第四是即時自我糾錯:Astra可能在生成程式碼的同時,在內部沙盒中完成“虛擬渲染”或AST語法樹的邏輯跑通,自動發現前端錯位並重構,最後才將完美的零樣本結果呈現給使用者。零樣本復刻PS5手柄這類高細節渲染任務,本身就是自我糾錯能力的間接證據。
不過,好戲還在後頭。就在這一週,Anthropic也被曝正在加速推進Fable 5.1,其釋出時間視窗恰好與Astra前後腳。從灰度測試者反饋看,Fable 5.1的升級重點幾乎與Astra撞了個正著:前端程式碼更穩、複雜元件邏輯一次成型;長思維鏈推理更強,不容易推著推著就“忘了前提”;工具呼叫和分步規劃進一步強化,越來越接近成熟的AI Agent。兩家公司已殺進同一塊戰場:程式碼能力要更強,任務要跑得更久,過程中還得儘量少讓人接手。目前雙方甚至已開始隔空PK——同樣生成一張“女子自畫像”SVG向量圖,Astra與Fable 5.1的細節、結構、完成度被直接擺上檯面對比。
但真正可能決定勝負的,或許不只是模型能力。從爆料看,Astra除了效能強悍,還可能在價效比上繼續下壓。如果OpenAI真能以更低的API呼叫成本,交付一款自帶Max effort、自糾錯能力更強、又不需要複雜工程編排的模型,那麼Fable 5.1面對的就不只是Benchmark上的壓力。下週四的“巔峰之戰”,到底誰能拿下新王寶座,市場正拭目以待。