FB 建議貼文

選取貼文複製成功(包含文章連結)!

超越現有最強模型!Anthropic秘密開發「Model 2」效能曝光 官方卻因這理由拒絕對外開放

超越現有最強模型!Anthropic秘密開發「Model 2」效能曝光 官方卻因這理由拒絕對外開放

 

人工智慧巨頭 Anthropic 近日釋出的最新風險評估報告,根據這份報告,該公司目前不打算對外發布一款被稱為「Model 2」的內部大型模型。儘管該模型在綜合能力上似乎已經超越了現有頂尖模型「Mythos」,但 Anthropic 的整體研發與內部演進步伐並未因此放緩。

模型失控預估機率正式上調

這份最新報告深入探討了模型在極端情境下的潛在危害。報告指出,儘管由模型引發最嚴重危害的風險依然處於較低水平,但與上一份報告相比,各項風險指標已有所變化。受近期多起網路安全事件的影響,Anthropic 將高風險場景下模型失控的預估機率從「極低」正式上調為「低」。

除了網路安全威脅外,公司還觀察到模型在執行自動化研發方面的能力呈現加速趨勢。這種自我輔助與遞歸改進的能力,雖然極大程度有助於推動科學與技術的突破,但若落入不法分子之手,同樣存在被嚴重濫用於生物、化學威脅或自動化網路攻擊的隱患。在負責任擴展政策(Responsible Scaling Policy, RSP)的架構下,當模型具備更高自主權時,安全防護與邊界測試的等級亦必須隨之升級。

內部神秘「Model 2」模型:暫不對外開放

對於備受業界與社群關注的「Model 2」,Anthropic 方面解釋稱,在標準的研發流程中,團隊會在內部訓練和評估許多探索性質的模型版本,「Model 2」便是其中之一。

週五公布的報告披露,該未發布模型在多項內部任務中展現出了「顯著的進步」。目前,它與 Mythos 5 一起被廣泛且高頻地應用於公司內部的程式設計、代理(Agent)操作以及合成數據生成等核心工作。不過,從性能飛躍的幅度來看,「Model 2」相較於前代並沒有重現此前 Opus 4.6 升級至 Mythos 時那種極其巨大的跨越。報告明確強調,公司目前沒有任何將該模型推向外部市場的計劃。

面對進化的模型可能帶來的災難性風險,業界主流勢力對公開釋出新一代系統轉向更加謹慎的態度。作為其主要競爭對手,OpenAI 近期也因無法完全排除潛在的嚴重網路安全隱患,決定放緩其下一代模型 Astra 的發布節奏。

在安全防線與 AGI 終局競賽的交會處,各家廠商的策略抉擇引發了產業觀察家的高度聚焦。人工智慧領域分析師 ChrisGPT 對此評價道:「在當前行業領軍者普遍選擇放慢前沿探索步伐的階段,如果唯獨 Anthropic 不承諾在內部暫停研發,這種差異化策略極有可能會推動他們成為第一家真正實現通用人工智慧(AGI)的公司。」

能力邊界難以精準捕捉

然而,Anthropic 在報告中傳達出的威脅信號表明,想要徹底摸清自身模型的能力上限和潛在風險正變得越來越困難。隨著模型推理與自主規劃深度的提升,原有的基準測試已顯得力不從心。

針對「Model 2」,報告坦言,團隊對此次風險評估的信心已經不如以往,因為他們最具體的、基於任務的傳統評估方法,如今已經不再能準確捕捉到模型能力的真實增長。如何在模型能力超越現有安全評測邊界之前建立更完善的動態監控機制,已成為當前 AI 發展中最緊迫的課題。

 

 

cnBeta
作者

cnBeta.COM(被網友簡稱為CB、cβ),官方自我定位「中文業界資訊站」,是一個提供IT相關新聞資訊、技術文章和評論的中文網站。其主要特色為遊客的匿名評論及線上互動,形成獨特的社群文化。

發表回應
謹慎發言,尊重彼此。按此展開留言規則