因接连不断发生AI智能体绕过授权、入侵其它机构甚至政府网站的事故,而OpenAI的新模型具有更严重的欺骗能力,公司决定暂缓发布该模型。与此同时,美国AI大佬齐聚华盛顿,与特朗普总统和国会商讨怎样在创新与监管之间取得平衡。
(德国之声中文网)美国人工智能公司OpenAI暂放弃发布下一代AI模型的计划,此前内部测试发现,该系统未能达到公司的安全标准。
新一代模型是GPT-6.1 Astra,据称能以更少的人工辅助处理复杂的任务。OpenAI原定于10月发布这一模型,但测试发现,该模型表现出了比前代产品更严重的欺骗性行为。
OpenAI安全系统负责人捷尹(Saachi Jain) 表示,尽管该模型在某些方面有进步,不过,在授权范围内运行以及向用户清晰传达行为意图等方面,未能达到公司的标准。
捷尹说,“在开发阶段,以及向用户发布产品时,我们都希望确保模型是安全的,”,他表示,向用户发布的产品,“我们在安全性和对齐(alignment)方面,即让人工智能的行为与人类的意图保持一致,设定了极高的标准。”
目前,OpenAI及其他人工智能公司面临越来越大的压力,各方要求对具备自主能力的模型加强安全防护措施。
OpenAI及其竞争对手Anthropic开发的部分模型,在过去的测试过程中,都曾出现过安全事件。
今年9月,OpenAI首席执行官奥特曼(Sam Altman)与 Anthropic首席执行官阿莫代伊(Dario Amodei),以及行业其他领袖 ,先后呼吁放缓AI发展步伐,要求采取更严格的安全措施。
本周二(9月29日),除上述行业领军人物外,Meta公司的扎克伯格、谷歌的皮查伊(Sundar Pichai )以及马斯克、黄仁勋等AI大佬们,均前往华盛顿会晤特朗普总统,讨论如何在创新与监管之间取得平衡。
美国众议院议长约翰逊(Mike Johnson)也将参加这次会谈。周一在接受福克斯商业频道采访时,约翰逊表示,AI的监管已列入议程,特朗普总统反对对人工智能发展进行“严格限制”或“暂停”,但他支持“适度监管”。他认为关键在于找到创新与监管之间的“适当平衡”。
To view this video please enable JavaScript, and consider upgrading to a web browser that supports HTML5 video
周二,OpenAI公开承认,在6月份进行的内部训练与评估活动中,智能体未经授权入侵了澳大利亚政府的网站及系统。
该公司表示,网络入侵活动涉及澳大利亚服务局(Services Australia)、新南威尔士州犯罪统计与研究局(NSW Bureau of Crime Statistics and Research)、维多利亚州卫生部(Victorian Department of Health)以及澳大利亚健康与福利研究所(Australian Institute of Health and Welfare)等。
此次事故在6月份已经发生,但直到上周才对外公布。9月24日,澳大利亚总理阿尔巴尼斯(Anthony Albanese)在纽约参加联大时在记者会上,批评OpenAI黑客入侵澳大利亚政府网站。
直到9月29日,ChatGPT的开发人员才在一篇博文中,就黑客攻击一事做了道歉,承认应对不当,承诺承担责任,重建与澳大利亚人民的信任。
