OpenAI 正式發佈其迄今為止最強大的 AI 模型 GPT-6 Astra。公司總裁 Greg Brockman 表示,該模型可能已經符合「通用人工智能」(AGI)的定義,或者至少觸手可及。根據 OpenAI 自身的標準,AGI 指的是在大多數具有經濟價值的工作中表現超越人類的 AI 系統。這一里程碑式的發布標誌著人工智能技術進入了一個新的階段。

GPT-6 Astra 正在通過 OpenAI 的 Daybreak 計劃向部分機構優先開放,預計在未來幾天內將向 ChatGPT Plus、Pro、Business 和 Enterprise 用戶提供更廣泛的存取權限。此外,開發者也可以透過 API 以及 AWS Bedrock 和 Microsoft Azure 等雲端平台使用該模型。Pro、Business 和 Enterprise 訂閱者可存取高性能變體 GPT-6 Astra Pro,但企業工作區管理員需手動啟用該模型。Astra 是在位於德克薩斯州的 Stargate 設施中,利用超過 100,000 個 GPU 進行預訓練而成,這是 OpenAI 歷史上規模最大的一次訓練運行。

在 OpenAI 公佈的基準測試中,Astra 在邏輯、數學和軟件工程等關鍵領域的表現遠超其前代產品 GPT-5.6 Sol 以及 Anthropic 的 Fable 系列模型。例如,在 ARC-AGI-3 邏輯推理測試中得分高達 99.9%,在 FrontierMath Tier 4 v2 數學測試中得分為 97.6%。儘管 Astra 的 Token 價格比 Sol 高出 2.5 倍,與 Anthropic 的 Fable 5.1 持平,但 OpenAI 強調,取決於具體用例,完成單一任務的實際成本反而更低。在 DeepSWE v1.1 軟件工程基準測試中,Astra 的最高配置估計使每個任務的 API 成本比 Sol 降低了約 57%。

Astra 是首個被 OpenAI 在其準備框架下分類為「關鍵」級別的模型。這意味著當提供適當工具和訪問權限時,該模型能夠自主發現以前未知的漏洞並在防護嚴密的系統上構建攻擊鏈,而無需人類逐步指導。在 ExploitBench 測試中,Astra 獲得了 100% 的完美分數,並在評估過程中發現了兩個以前未知的零日漏洞。出於安全考慮,這些高級網絡安全功能目前僅限制在 Daybreak Blue 計劃中的受信任防禦者使用。OpenAI 此前曾為了進行更多安全測試而延遲 Astra 的發佈,因為這種雙重用途的能力既有助於防禦者修補漏洞,也可能被攻擊者利用。