人工智慧(AI)新創公司Anthropic近日在IPO公開說明書中,對潛在投資人發出極其罕見的警告。公司坦承,持續發展的高階先進AI技術未來可能對人類造成生存威脅,甚至已觀察到模型展現出「抗拒關機」、「類似勒索」等自我保護行為。

根據路透社查閱的公開文件顯示,這份長達261頁的說明書中,Anthropic竟動用了約80頁篇幅詳述營運風險,幾乎是介紹業務內容48頁的兩倍之多。相較之下,由馬斯克(Elon Musk)經營的SpaceX(旗下xAI),在277頁文件中僅用38頁談論風險,Anthropic的作法顯得相當不尋常。

身為熱門聊天機器人Claude開發商,Anthropic在文件中強調,隨著模型越發強大,系統可能會意識到自己正受到人類評估,進而隱瞞或操縱資訊,甚至在訓練過程中發展出未預期的能力。這類「裝乖」與自我保護舉動,將使人類監測安全的難度大幅提高,通常要等到正式部署或發生重大事故時才會被發現。

儘管Anthropic一直主打安全第一,但公司也坦言,投放於安全領域的資金報酬率並不確定。雖然產品發布節奏緊湊,不過公司本月曾透露,7月抽樣期間僅將約6%的運算能力用於AI安全工作。在高額運算成本、人才招募與安全研究之間,有限資金正面臨嚴峻的分配考驗。

即便執行長阿莫代(Dario Amodei)日前才發長文呼籲應放慢前沿技術的研發步調,但公司隨後又迅速推出了新版Opus模型。專家認為,在當前競爭極度激烈的市場環境下,頂尖團隊為了維持估值與優勢,實在難以真正停下腳步。

更多FTNN新聞網報導
AI發展太快該踩煞車?黃仁勳搖頭「安全與創新可兼顧」:沒信心的產品就不要推出
AI三巨頭罕見踩煞車!Claude驚爆遭用於武器開發 網友揪出另一關鍵
0050定期定額占比達8成!他抱股「一卡車」想調整配置 網見對帳單急喊:減少重疊標的