FB 建議貼文

選取貼文複製成功(包含文章連結)!

速度快也沒用!OpenAI 極速模型 Spark 上線半年宣告退役,工程師毒舌狂酸:只是更快產生 Bug

速度快也沒用!OpenAI 極速模型 Spark 上線半年宣告退役,工程師毒舌狂酸:只是更快產生 Bug

OpenAI 程式碼模型(Codex)負責人蒂博(Tibo)日前在社群平台 X 上宣布,上線僅七個月的 GPT-5.3-Codex-Spark 即將於下週正式退役。

這款曾經以每秒輸出超過 1,000 個 Token 傲視群雄、作為 OpenAI 擺脫輝達(NVIDIA)硬體依賴首款生產級模型的「極速代表」,最終因使用量持續雪崩而悄然退場。

花兩分鐘拿一堆 Bug?工程師道破背後的致命傷

在 Spark 剛上線的今年 2 月,整個 AI 圈曾為之震動。它主打即時編程體驗,首字延遲(Time-to-First-Token)直接腰斬,程式碼不再是一行行跳出,而是如瀑布般傾瀉於編輯器之中。

然而半年過去,社群的告別式卻顯得格外尷尬。除了 Hugging Face 開發者斯里瓦斯塔瓦(Vaibhav Srivastav)留下幾句感謝服役的客套話外,更多工程師給出的是無情差評。開發者 argofowl 便直言:「Spark 是個好玩的模型,但也是個極度糟糕、根本無法投入生產的模型。很高興它走了,我已經幾個月沒開過它。」

許多一線工程師反映,只要稍微涉及多檔案上下文理解或日誌分析,Spark 就會迅速把脈絡塞滿,甚至憑空捏造不存在的 API 端點或產出結構混亂的 JSON。

速度快也沒用!OpenAI 極速模型 Spark 上線半年宣告退役,工程師毒舌狂酸:只是更快產生 Bug

程式碼培訓機構涂林學院(Turing College)對此下了一針見血的評語:「沒有智慧的速度,只是更快地製造失敗。」對工程師而言,花 15 分鐘等待一個能夠通過測試的正確解法,永遠比花 2 分鐘拿到一份滿是 Bug、必須重新推倒重來的產物划算得多。

速度快也沒用!OpenAI 極速模型 Spark 上線半年宣告退役,工程師毒舌狂酸:只是更快產生 Bug

更致命的是,當初號稱的「15 倍效能躍升」很快被測試數據戳破。開發者范·蘭德舒特(Nicholas Van Landschoot)實測發現,官方所謂的 15 倍是拿 Spark 去對比開到最高推論強度的完整版模型;若在相同準確率基準下對比,Spark 的實際加速僅有 1.37 倍。

而在 Terminal-Bench 2.0 與 SWE-Bench Pro 評測中,Spark 的準確率被狠狠釘在 50% 上下,遠不及標準版 GPT-5.3-Codex 的水準。

正因如此,真正對 Spark 離場感到惋惜的少數使用者,惋惜的從來不是模型本體,而是它附帶的獨立使用額度——在主模型額度見底時,把它當作不用白不用的「備用油箱」頂一陣子而已。

當完整旗艦也能飆速,閹割版便失去存在價值

如果說智力不足讓 Spark 走向邊緣化,那麼 Cerebras 在 8 月推出的「Ultrafast 模式」,則是直接拔掉了它的呼吸器。

當初 Spark 之所以採取蒸餾閹割的小模型架構,是因為單一晶圓無法容納完整旗艦模型;然而,Cerebras 隨後透過跨 CS-3 節點的多層流水線切分技術,成功把未經閹割的旗艦 GPT-5.6 Sol 本尊送上了晶圓級晶片。在維持 100% 旗艦級推理解題水準的同時,Ultrafast 模式飆出了每秒 750 個 Token 的恐怖輸出速率,比標準模式快了整整 14 倍。在 GDP-Val 測試中,原本標準版 Sol 需要耗費 7.7 分鐘的複雜任務,切換到 Ultrafast 僅需 83 秒便能跑完,端到端速度快了 5.6 倍。

速度快也沒用!OpenAI 極速模型 Spark 上線半年宣告退役,工程師毒舌狂酸:只是更快產生 Bug

速度快也沒用!OpenAI 極速模型 Spark 上線半年宣告退役,工程師毒舌狂酸:只是更快產生 Bug

正如 Cerebras 執行長費爾德曼(Andrew Feldman)所言:「速度與智慧,自此不再互斥。」

速度不再是獨立模型,而是旗艦架構下的「檔位」

放眼過去一季,Spark 的退役只是 OpenAI 內部激烈產品大換血的一個縮影。從 6 月初淘汰 GPT-5.2 與初代 5.3-Codex,8 月底將 5.4 世代退役並引導用戶轉移至 5.6 系列,再到 9 月正式宣告 Spark 走入歷史,OpenAI 正在急速清空舊世代的歷史包袱。過去充斥著小數點與功能後綴的冗長型號,已被全面改寫為 Sol(太陽)、Terra(大地)、Luna(月亮)以及最新問世的 Astra(星辰)等自然天體命名系統。

這場架構整頓的背後,隱含著深層的商業與工程思維演進:以往「為了極速而單獨打造一款模型」的過渡路徑已被徹底封死,「速度」轉化為旗艦模型內建的一項付費檔位。

如同推論深度依據情境分為不同強度,現在的生成吞吐量也由 Standard、Priority 到 Ultrafast 層層遞進,讓企業與開發者依照預算彈性加價選購。作為 OpenAI 與 Cerebras 簽下 750 兆瓦合約後的首位探路者,Spark 確實證明了大規模生產流量能夠在輝達 CUDA 生態系之外穩健運行;而在這項歷史任務達成之後,探路者體面退場也是必然的歸宿。

生成式 AI 的算力軍備競賽已然改寫了遊戲規則:接下來各家巨頭要比拚的,不再是誰能把模型閹割得更小更快,而是誰能將最頂級的旗艦大腦,以毫無延遲的極限速度直接注入使用者的工作流。

 

 

 

IFENG
作者

鳳凰網(科技),集綜合資訊、視訊分發、原創內容製作、網路廣播、網路直播、媒體電商等多領域於一身,並於2011年在紐交所上市(紐交所代碼:FENG),成為全球首個從傳統媒體分拆上市的新媒體公司。

發表回應
謹慎發言,尊重彼此。按此展開留言規則