OpenAI 於 GPT-5 問世一年後,正式發表新一代大型語言模型 GPT-6 Astra。這款模型被 OpenAI 形容為「全球最智慧、最協調的模型」,並稱其為公司「目前廣泛部署過最有能力」的模型,但同時也首度被認定為「關鍵」網路安全風險。

根據 OpenAI 說法,Astra 是首個在公司 Preparedness Framework 下被指定為關鍵風險的模型。為應對此風險,OpenAI 已加強安全措施,以防惡意行為者利用其開發新的網路攻擊途徑,或模型自身在未經授權下造成網路危害。不過,Astra 最先進的網路安全技能將僅提供給少數測試夥伴使用。

在 ExploitBench 網路安全基準測試中,GPT-6 Astra 獲得 100% 滿分,並在 ExploitGym Honeypot 基準測試中取得 0.0% 的成績,顯示其具備高度防禦能力。OpenAI 指出,GPT-6 Astra 在高風險情境下的安全性顯著提升,且相較於舊版 GPT-5.6 Sol,能更有效減少 AI 模型產生不實內容的現象,也就是所謂的「幻覺」。然而,OpenAI 也坦承,Astra 的可監控性(monitorability)相對 GPT-5.6 Sol 有所下降,代表其運作機制可能更難以理解和控制。

GPT-6 Astra 將陸續開放給用戶體驗。首先會提供給特定組織,並在未來幾天內逐步開放給 ChatGPT Plus、ChatGPT Pro、ChatGPT Business 和 ChatGPT Enterprise 的訂閱用戶。此外,開發者也可透過 OpenAI API 和 AWS 雲端服務使用該模型。API 定價為每百萬輸入 Token 10 美元,每百萬輸出 Token 50 美元。