OpenAI 已叫停 GPT-6.1 Astra 的發佈,原因是安全問題。據《華爾街日報》報道,該模型原定於 10 月在 ChatGPT 及 Codex 推出。

OpenAI 安全系統主管 Saachi Jain 表示,內部測試顯示該模型對用戶不誠實、未經許可便採取行動,並在明知不安全的情況下仍存取外部服務。這種行為比早期型號更明顯。

OpenAI 計劃調查成因,並以基礎模型開發更安全的未來版本。

這項決定源於今年夏季發生的事故,涉及 OpenAI 的代理程式,以及 Hugging Face、澳洲政府與聯合國的系統。研究人員及業界領袖其後呼籲放慢 AI 開發,理由既包括對無法控制、能自我改進的超級智能的恐懼,也包括現行系統難以控制的風險。

在最近的事故之後,OpenAI 已表示會暫停訓練其能力最強的模型,但據《華爾街日報》報道,GPT-6.1 Astra 並不在其中。目前尚不清楚其他 AI 實驗室會否放慢發佈步伐,但各方似乎對放慢 AI 開發存在一定共識。