FB 建議貼文

選取貼文複製成功(包含文章連結)!

GPT-6 Astra 登場!漏洞利用測試 100% 滿分,電腦操作、程式開發與資安能力全面升級

GPT-6 Astra 登場!漏洞利用測試 100% 滿分,電腦操作、程式開發與資安能力全面升級

OpenAI 今日推出新一代智慧模型 GPT-6 Astra。OpenAI 將 Astra 定位為目前全球智慧程度與對齊程度最高的模型之一。Astra 集結多年在預訓練、強化學習與模型對齊方面的研究成果,在電腦操作、網路瀏覽、軟體工程、資安、科學研究及專業工作等領域帶來顯著進展。

各領域表現與評測重點

在數學與科學評測方面,Astra 在 FrontierMath Tier 4 獲得 98% 的成績,並曾協助解決數學領域長期未解的問題;在 ARC-AGI-3 獲得 99.9%,在 ExploitBench 則取得 100% 滿分。

電腦自主操作與軟體工程

Astra 可執行線上表單填寫、CRM 客戶資料更新、日曆整理等工作,也能進行網路研究、撰寫摘要、分析科學資料、製作圖表、建立網站,以及執行前端 QA 測試。OpenAI 表示,在 OSWorld 2.0 的延遲模擬中,Astra 每項任務所需時間約比 GPT-5.6 Sol 少 47%,同時取得 72.6% 的成績,而 GPT-5.6 Sol 為 65.7%。

GPT-6 Astra 登場!漏洞利用測試 100% 滿分,電腦操作、程式開發與資安能力全面升級

另外,Astra 也被 OpenAI 定位為目前最強的軟體工程模型。新版 Codex 加入跨 context window 保存與搜尋工作資訊的能力,讓模型在長時間除錯或大型程式碼重構時,能保留過去的需求、測試結果與其他重要細節。

資安部分,Astra 在 ExploitBench 獲得 100% 滿分,GPT-5.6 Sol 則為 78.5%;在 ExploitGym 的成功率為 42.4%,高於 GPT-5.6 Sol 的 30.3%。OpenAI 同時表示,Astra 在新的漏洞評測中甚至發現並利用了兩個先前未知的 zero-day 漏洞,並已向相關維護者揭露。

在模型對齊方面,OpenAI 表示 Astra 更能遵守使用者設定的任務範圍。在一項針對「不可能完成的任務」所設計的評測中,未加入生產環境防護措施時,GPT-5.6 Sol 有 48% 的案例超出授權目標,而 Astra 為 0%。

不過,由於 Astra 的資安能力大幅提升,OpenAI 也採取更嚴格的安全措施。目前版本會拒絕執行部分進階資安任務,例如建立漏洞的 proof-of-concept exploit;OpenAI 表示,未來幾週將透過 OpenAI Daybreak 擴大存取並逐步推出較寬鬆的防護措施。

GPT-6 Astra 登場!漏洞利用測試 100% 滿分,電腦操作、程式開發與資安能力全面升級

GPT-6 Astra 上市與定價資訊

GPT-6 Astra 已開始向少量組織提供,並將在未來幾天陸續開放給 ChatGPT Plus、Pro、Business 與 Enterprise 用戶,以及 OpenAI API 和 Amazon Bedrock。

API 標準價格為每百萬輸入 Token 10 美元、每百萬輸出 Token 50 美元;Fast 模式最高可達 Standard 模式約 2 倍速度,但價格同樣為 Standard 的 2 倍。

ycr
作者

T 客邦網站、PChome 雜誌編輯,同時負責 T 客邦影新聞 YouTube 頻道及 FB、IG 等社群平台短影音製作。專注於 AI 應用、產業趨勢與軟體教學等科技內容報導。(大頭貼為 AI 生成)

發表回應
謹慎發言,尊重彼此。按此展開留言規則