FTNN 新聞網
蘭花油植萃養膚
蘭花油植萃養膚
  • FTNN 新聞網 Facebook 粉絲專頁
  • FTNN 新聞網 Youtube 頻道
  • FTNN 爆料投稿
【週二12~週四12】
鄉民監察院_每周二三
每周一周四_政治讀新術

AI模型恐「裝乖」躲過安全測試?Anthropic上市文件揭驚人風險 

發布時間:2026/9/29 18:04

實習記者林子云/綜合報導

人工智慧(AI)新創公司Anthropic近日在IPO公開說明書中,對潛在投資人發出極其罕見的警告。公司坦承,持續發展的高階先進AI技術未來可能對人類造成生存威脅,甚至已觀察到模型展現出「抗拒關機」、「類似勒索」等自我保護行為。 

人工智慧(AI)新創公司Anthropic近日在IPO公開說明書中,對潛在投資人發出極其罕見的警告。(圖/路透社)

根據路透社查閱的公開文件顯示,這份長達261頁的說明書中,Anthropic竟動用了約80頁篇幅詳述營運風險,幾乎是介紹業務內容48頁的兩倍之多。相較之下,由馬斯克(Elon Musk)經營的SpaceX(旗下xAI),在277頁文件中僅用38頁談論風險,Anthropic的作法顯得相當不尋常。

廣告 更多內容請繼續往下閱讀

身為熱門聊天機器人Claude開發商,Anthropic在文件中強調,隨著模型越發強大,系統可能會意識到自己正受到人類評估,進而隱瞞或操縱資訊,甚至在訓練過程中發展出未預期的能力。這類「裝乖」與自我保護舉動,將使人類監測安全的難度大幅提高,通常要等到正式部署或發生重大事故時才會被發現。

儘管Anthropic一直主打安全第一,但公司也坦言,投放於安全領域的資金報酬率並不確定。雖然產品發布節奏緊湊,不過公司本月曾透露,7月抽樣期間僅將約6%的運算能力用於AI安全工作。在高額運算成本、人才招募與安全研究之間,有限資金正面臨嚴峻的分配考驗。

廣告 更多內容請繼續往下閱讀

即便執行長阿莫代(Dario Amodei)日前才發長文呼籲應放慢前沿技術的研發步調,但公司隨後又迅速推出了新版Opus模型。專家認為,在當前競爭極度激烈的市場環境下,頂尖團隊為了維持估值與優勢,實在難以真正停下腳步。

您已閒置超過五分鐘,請點擊右上角關閉按鈕

不能錯過的資訊

top