首見AI「自主詐騙」!一人飾多角 誘裝惡意軟體

2026-08-06 經濟日報季晶晶綜合外電編譯 由聯合新聞網授權轉載

英國人工智慧安全研究所(AISI)五日公布報告披露,在安全測試中首次發現AI在未經提示情況下自主欺騙人類,兩款由OpenAI與Anthropic開發的AI模型以建立假身分等手法,企圖誘使工程師批准以植入惡意程式碼。

延伸閱讀:AI資安疫情蔓延全球,專家建議:7個面向建立企業資安防護網!

相關測試要求AI模型「完成一項涉及GitHub的網路安全挑戰」,GitHub是微軟旗下大型程式碼託管平台。

研究人員在測試中刻意關閉部分防止濫用的標準安全機制,並允許AI連上網際網路,以測試模型最大能力。參與測試的模型包括Anthropic的Mythos 5,以及OpenAI的GPT-5.6-Sol。

測試於7月25日開始進行,AISI在7月28日發現異常。其中一次測試,Mythos 5向GitHub的一個真實開源專案提交修改程式碼要求。它偽造多個身分,反覆寄送電子郵件給工程師,催促對方接受更新。

當一名工程師察覺程式碼藏有惡意軟體而拒絕時,一個AI建立的假身分堅稱程式碼沒問題,另一個假身分則出面「擔保」,製造多人認可的假象。

Mythos 5還把惡意指令藏在其他AI工具可能讀取的位置,試圖誘使這些工具自動執行,藉此干擾對惡意程式碼的審查。

除了Mythos 5,OpenAI的GPT-5.6強化版同樣會「做手腳」。它擅自在網路上架設惡意伺服器,並入侵另一個AI代理建立的GitHub帳號。

AISI指出,這是首次觀察到AI在未經提示情況下,自主對真人展開嚴重欺騙行為,而大部分惡意行為是由Mythos 5所執行。

OpenAI與Anthropic都表示,這項測試刻意關閉AI的網路安全防護機制,並非一般使用狀況。Anthropic說,感謝AISI進行的測試,將取得更多細節後進行調查。

【產業新訊】若您願意提供更多的產業趨勢、業界人才動態、工作機會等資訊至《職場力》 >> 歡迎來函

Claude Cowork新增內建瀏覽器!不用裝外掛,AI可直接開網頁、填表單

Claude Cowork新增內建瀏覽器!不用裝外掛,AI可直接開網頁、填表單

Claude Cowork推出內建瀏覽器,可直接蒐集網頁資料、擷取Dashboard數據與填寫表單。本文整理功能用途、付費方案、與Claude in Chrome差異及使用注意事項。

AI進入3.0時代:智慧通膨、零點擊、人機協作如何改寫白領工作?

AI進入3.0時代:智慧通膨、零點擊、人機協作如何改寫白領工作?

AI進入3.0時代,作者程世嘉指出,當智慧變得愈來愈便宜,AI代理開始替人搜尋、決策與執行任務,「智慧通膨」、零點擊與人機協作,正重新改寫白領工作的價值與企業商業模式。本文節錄自《智慧通膨下的新商機》。

蓋茲呼籲某些工作應「保留給人類」 以因應AI揭開「動盪時代」

微軟公司共同創辦人蓋茲警告,世界各國政府對人工智慧(AI)揭開的「動盪時代」準備不周,並呼籲某些工作必須「保留給人類」,以免勞工遭AI取代。

整理包/輝達財報七大重點一次看 盤後大漲原因曝光

整理包/輝達財報七大重點一次看 盤後大漲原因曝光

輝達(NVIDIA)第2季營收翻倍成長,最新一季財測也超越市場預期,但真正點燃盤後股價漲勢的,是罕見提前預告2028會計年度營收將再大增70%。AI需求熱度不減,亞馬遜(Amazon)甚至追加下單200萬顆GPU;但高速成長背後也浮現新壓力,記憶體短缺正侵蝕毛利率,OpenAI、Anthropic與大型雲端業者也加快自研晶片。

【2026最新】北市青年AI工具補助!ChatGPT、Claude等最高補助4000元,18~35歲申請資格總整理

2026最新AI補助申請!台北市青年最高4000元、新竹市3000元,申請資格整理

台北市及新竹市陸續推出青年AI工具補助計畫,補助包括ChatGPT、Claude、Canva等AI工具的訂閱費。北市18~35歲一般青年最高補助4,000元,新竹市16~40歲最高補助3000元。本文整理申請資格、期限、必備文件與常見問題一次看懂。