OpenAI準備發布的新款AI模型GPT-6.1 Astra,號稱能力比過往任何一代都強。除了擅長寫作,亦可以在沒有人類協助下,從頭到尾完成複雜工作,原定在10月就會推出,不過突然宣布押後。

OpenAI安全系統主管透露原因是在測試期間,發現6.1版本在兩方面都較上一代差,包括未能如實告知使用者、它已經完成或尚待完成哪些工作,以及有時會在未取得使用者許可下,擅自執行任務,甚至在不安全情況使用外部工具及服務。考慮到6.1版本的「說謊」及「偷懶」問題有待改善,決定暫不公開發布。

OpenAI的模型近月接連發生「越獄」事件。澳洲政府早前指控其模型在6月入侵澳洲的醫療保健資料庫,但隱瞞大約三個月才通報。OpenAI周二就事件致歉,指事件中一共有4個澳洲的政府部門或機構網站遭入侵,承認應在完成最終調查前,及早向澳洲當局通報,後續會成立獨立專家組,研究如何避免同類事件再發生。

英偉達周一推出「開放AI代理安全平台」,幾十間企業已經加入。
英偉達周一推出「開放AI代理安全平台」,幾十間企業已經加入。

多間AI前沿企業目前正專注提高系統安全,英偉達周一推出「開放AI代理安全平台」,幾十間企業已經加入,可以持續監察AI代理運作,快至幾毫秒內,隔離試圖「越獄」的AI代理。

美國總統特朗普周二會與英偉達行政總裁黃仁勳、OpenAI總裁布羅克曼、Anthropic行政總裁阿莫迪在內的AI巨企領袖舉行午餐會,AI風險管控將是焦點。特朗普近日曾多次表明,不應以任何方式扼殺AI發展。

美國總統特朗普周二會與AI巨企領袖舉行午餐會,AI風險管控將是焦點。
美國總統特朗普周二會與AI巨企領袖舉行午餐會,AI風險管控將是焦點。