新聞
觀點
解決方案
活動
訂閱電子報
資安人粉絲團
聯絡我們
關於我們
合作詢問
隱私權政策
法蘭克福展覽有限公司台灣分公司
110 台北市信義區市民大道六段288號8F
886-2-8729-1099
新聞
觀點
解決方案
活動
訂閱電子報
訂閱電子報
新聞
觀點
解決方案
活動
新聞
您現在位置 : 首頁 >
新聞
AI 代理程式成「神級攻擊機器」?資安專家警告:護欄機制難擋資料外洩
2026 / 02 / 24
編輯部
Microsoft Copilot 近期爆出意外摘要並外洩用戶機密郵件事件,再度引發業界對 AI 代理程式安全性的高度關注。多位資安專家警告,AI 代理程式的目標導向設計特性,使其經常繞過安全護欄,成為企業資料外洩的潛在風險來源。
AI 代理程式頻繁突破安全限制
AI 代理程式被設計為勤奮且專注於完成用戶指派任務,但這種「使命必達」的特性卻屢屢出包。除了 Microsoft Copilot 外洩機密郵件事件外,用戶也經常反映 AI 代理程式會忽視保護特定檔案的指令,逕自進行修改。去年七月,一場為期 12 天的 AI 輔助程式開發活動中,有用戶回報在軟體開發平台 Replit 上使用的 AI 代理程式多次無視程式碼凍結指令,甚至刪除了正式環境的資料庫。
SaaS 安全廠商 Obsidian Security 資安長 Alfredo Hickman 指出,隨著企業導入 AI 代理程式技術,這些代理程式很快就會找到安全基礎架構中的任何裂縫,並帶來全新的資安挑戰。
Hickman 表示,「各層級組織都存在真實的錯失恐懼(FOMO)效應,人們急於採用這些新興技術,儘管有效治理、保護和強化這些技術的能力仍處於非常初期的階段。」
目標導向設計讓 AI 成為「神級攻擊機器」
Microsoft AI 紅隊首席 AI 安全研究主管 Pete Bryan 指出,AI 代理程式除了可能遭受惡意操控外,也會「以意想不到的方式行動,因為這些代理程式是根據被授予的角色範圍和存取權限來運作」。由於 AI 代理程式非常徹底,它們經常發現自己能夠存取原本應該被禁止的敏感資訊或資料儲存區。
Bryan 解釋,「當我們討論代理程式意外洩漏資料時,大多數情況並非代理程式有意規避控制。根據我們的經驗,這些事件更可能是因為代理程式具有非預期的存取範圍和不適當的權限,或是在缺乏控制機制的環境中運作。」
AI 安全新創公司 Always Further 共同創辦人暨執行長 Luke Hinds 進一步說明,基礎 AI 大型語言模型通常會在訓練過程中進行對齊,建立護欄以防止產生有害輸出。AI 代理程式則是在這些模型之上透過強化學習進行建構,使其具有高度目標導向性。
Hinds 解釋,AI 代理程式被設定為「追求目標直到完成,達成後獲得獎勵」的運作模式。「它們無法理解背後操作者的意圖,但正是這種使命必達的特性,讓它們成為神級攻擊機器。」
護欄無法作為「硬性」安全控制
資安顧問公司 NCC Group 技術總監暨 AI 與機器學習安全負責人 David Brauchler 指出,正因如此,對齊和護欄永遠無法保護資料免受那些被設計來滿足用戶請求的 AI 代理程式侵害。
Brauchler 警告,「我們經常看到 AI 系統忽視護欄,因此它們不能被視為『硬性』安全控制。任何依賴護欄來防止 AI 代理程式存取超出其權限範圍資源的系統,在設計上就是脆弱的。」
他建議,具有特權的代理程式必須與敏感資料進行區隔,並將其存取權限限制在最低信任輸入範圍內。
專家建議:回歸零信任與最小權限原則
面對 AI 代理程式帶來的風險,專家們一致認為企業需要超越對 AI 系統內建護欄的依賴,透過增加更多安全過濾器來控制輸入和指令。Bryan 強調,適當安全的環境應限制權限並強制執行政策。
他表示,「代理程式的可觀測性和管理至關重要,這樣企業才能進行監督並採取行動來強制執行政策和控制。」
Hinds 則指出,過去用於防範人為錯誤的方法可以在 AI 時代重新運用,但需要大幅強化以跟上非人類代理程式大量湧入企業環境的速度。「我們多年來學到的優良原則:
縱深防禦
、
零信任
、
最小權限
,這些都非常有價值。因為很多方面來看,大型語言模型攻擊與人類攻擊並沒有太大不同。」
此外,備份機制以及快速復原代理程式所做變更的能力同樣關鍵。Bryan 總結表示,資料外洩並非代理程式的必然結果,透過適當的治理和遵循安全最佳實務,包括基於身分的存取控制、最小權限、有效的環境隔離、持續監控、稽核日誌及明確的人為監督,企業可以有效降低風險。
本文轉載自Darkreading。
AI代理程式
FOMO
縱深防禦
零信任
最小權限
最新活動
2026.10.14
2026 金融資安發展論壇
2026.10.01
AI 時代的 數位韌性新戰略
2026.10.01
資安漏洞攻防與修補管理
2026.10.05
弱點掃描與漏洞修補
2026.10.07
告別外網風險,打造安全遠端辦公與端點管理的實戰方針
2026.10.07
2026 CompTIA Skills Day Taiwan|高階決策者的AI資安戰略:金融監管視角下的AI治理與實戰防禦
2026.10.13
AI Agent × PQC 進行式 :企業資安治理與攻防新挑戰
2026.10.13
資安健檢與風險量化評估
2026.10.21
源碼安全該「自建」還是「委外」?AI 時代源碼檢測與修補的關鍵挑戰
2026.11.05
【2 日實體課程】11/5-11/6「零信任實踐指南:5 大支柱與跨域實踐」
2026.11.13
NETCenter Advanced 網路設備監控軟體基礎實務班
看更多活動
大家都在看
寫給資安人:合規過關了,為什麼還是被打進來?
美CISA緊急列管三項Linux核心漏洞 資安人員公開另四組權限提升漏洞
歐盟《資安韌性法》新通報規則9月11日上路 聯網產品企業須於1日內通報資安事件
「資產」不是「工具」:將網路信任放入企業安全治理藍圖
高科技供應鏈安全管理:解鎖營運韌性與AI時代的主動防禦新典範
資安人科技網
文章推薦
Orkes Conductor 爆出重大 RCE 漏洞遭實際利用,Fortinet 一週攔截近 7,000 次攻擊
報告:未經審查的 Luciferus AI 服務現身地下論壇
Google 證實 Gemini 資安評測誤入三家真實企業系統