104學習

2026.08.27 | 1310次觀看

首見AI「自主詐騙」!一人飾多角 誘裝惡意軟體

2026-08-06 經濟日報季晶晶綜合外電編譯 由聯合新聞網授權轉載

英國人工智慧安全研究所(AISI)五日公布報告披露,在安全測試中首次發現AI在未經提示情況下自主欺騙人類,兩款由OpenAI與Anthropic開發的AI模型以建立假身分等手法,企圖誘使工程師批准以植入惡意程式碼。

延伸閱讀:AI資安疫情蔓延全球,專家建議:7個面向建立企業資安防護網!

相關測試要求AI模型「完成一項涉及GitHub的網路安全挑戰」,GitHub是微軟旗下大型程式碼託管平台。

研究人員在測試中刻意關閉部分防止濫用的標準安全機制,並允許AI連上網際網路,以測試模型最大能力。參與測試的模型包括Anthropic的Mythos 5,以及OpenAI的GPT-5.6-Sol。

測試於7月25日開始進行,AISI在7月28日發現異常。其中一次測試,Mythos 5向GitHub的一個真實開源專案提交修改程式碼要求。它偽造多個身分,反覆寄送電子郵件給工程師,催促對方接受更新。

當一名工程師察覺程式碼藏有惡意軟體而拒絕時,一個AI建立的假身分堅稱程式碼沒問題,另一個假身分則出面「擔保」,製造多人認可的假象。

Mythos 5還把惡意指令藏在其他AI工具可能讀取的位置,試圖誘使這些工具自動執行,藉此干擾對惡意程式碼的審查。

除了Mythos 5,OpenAI的GPT-5.6強化版同樣會「做手腳」。它擅自在網路上架設惡意伺服器,並入侵另一個AI代理建立的GitHub帳號。

AISI指出,這是首次觀察到AI在未經提示情況下,自主對真人展開嚴重欺騙行為,而大部分惡意行為是由Mythos 5所執行。

OpenAI與Anthropic都表示,這項測試刻意關閉AI的網路安全防護機制,並非一般使用狀況。Anthropic說,感謝AISI進行的測試,將取得更多細節後進行調查。

【產業新訊】若您願意提供更多的產業趨勢、業界人才動態、工作機會等資訊至《職場力》 >> 歡迎來函

偷學Anthropic工程師!6個實用Claude提示詞一次看

偷學Anthropic工程師!6個實用Claude提示詞一次看

想讓Claude更懂你的需求、產出更精準?整理Anthropic工程師極力推薦的6個實用提示詞,從需求訪談、教學模式、開發規劃到建立技能與專案記憶,一次掌握更有效率的Claude用法。

量子電腦還沒商用,電子六哥已卡位!緯創、鴻海、廣達各押什麼?

量子電腦還沒商用,電子六哥已搶進!緯創、鴻海、廣達各押什麼?

從電子六哥到工研院,「量子電腦」成為熱門話題。然而業界共識是,最快商業化時間在2029年之後,甚至量子主流的技術路線都還沒確定,為什麼現在就成為兵家必爭的重點?解析緯創、鴻海、廣達、仁寶如何搶進量子電腦,前哨戰已經開打。

【PPT轉影片】不用剪輯軟體!ChatGPT把簡報變影音,AI念錯字、字幕跑掉怎麼修?

【PPT轉影片】不用剪輯軟體!ChatGPT把簡報變影音,腳本、AI旁白、字幕一次完成|AI念錯字怎麼修?

用ChatGPT把簡報變成有聲影片!作者示範如何用ChatGPT Work將PowerPoint簡報轉成影片,從腳本規劃、AI中文旁白到字幕製作,搭配edge-tts與FFmpeg輸出MP4,並提供各階段提示詞與檢查重點,教你解決中文旁白讀錯問題。本文節錄自《ChatGPT AI Agent 工作術》。

來面試的竟是一位AI?應徵者露3大破綻 CEO秒識破當場喊停

來面試的竟是一位AI?應徵者露3大破綻 CEO秒識破當場喊停

一家專做生成式AI的公司,竟疑似碰上「AI求職者」。日本 KOWRO執行長原田祐二在線上面試時,發現應徵者念錯公司名稱、嘴型與聲音不同步,回答還出現不自然延遲,當場打斷並結束面試。影片曝光後引發熱議,朝日電視台也訪問原田,追查AI冒名應徵的新型風險。

Meta One訂閱服務登台!月費49元起 3大社群平台、AI功能全都能升級

Meta One訂閱服務登台!月費49元起 3大社群平台、AI功能全都能升級

Meta在台灣宣布推出全新整合訂閱服務Meta One,集結Instagram、Facebook、WhatsApp與Meta AI進階功能,全球訂閱及試用人數已突破1,500萬人。Meta旗下各App與Meta AI核心功能維持免費開放,新服務則透過分級訂閱,鎖定個人、AI重度使用者、內容創作者及中小企業商家等不同族群,提供量身打造的專屬工具與運算資源。