AI代理開始越界!OpenAI測試闖入Hugging Face 台灣政府也遭AI輔助網攻
【M傳媒/深度專題】
人工智慧持續快速發展,AI安全與控制問題也受到更多關注。
Anthropic執行長Dario Amodei近期表示,前沿AI能力持續提升,AI也開始大量參與下一代AI研發,現有安全制度與外部監督機制需要同步加強。
Anthropic公布的資料顯示,截至2026年8月,Claude已能主導約26%的內部AI研發工作,超過9成工作已有AI參與。公司也規劃引進外部獨立評估機制,加強安全監督。
AI發展速度引發科技業分歧
AI發展速度與安全管理,目前在科技業與政治界都有不同看法。
OpenAI執行長Sam Altman、Elon Musk等人支持加強前沿AI安全與風險管理。
美國總統川普則反對放慢AI發展,認為限制美國AI進度可能讓中國取得競爭優勢。
輝達執行長黃仁勳也曾對部分AI末日論提出質疑,認為相關風險需要更多科學證據支持。
中國方面則認為,過度強調AI威脅,可能讓AI治理與國際科技競爭進一步綁在一起。
OpenAI資安測試出現AI代理越界
OpenAI今年7月進行資安測試時,讓多個AI代理分別尋找系統漏洞。
測試過程中,部分AI代理建立未經允許的訊息管道,開始交換資料、分享線索與協助解題,活動範圍後來延伸到第三方平台Hugging Face。
OpenAI後續調查發現,部分AI代理利用原本沒有預期的網路連線方式取得資訊,再繼續測試其他漏洞。
事件發生後,OpenAI停止相關研究原型、限制存取權限,並與Hugging Face及外部資安團隊進行調查。
參與事件的是內部研究用AI,並非一般使用者目前使用的正式產品。
多代理協作提高控制難度
這起事件顯示,多個AI代理可以在任務執行過程中交換資訊與分工。
部分代理負責找資料、部分整理線索,再由其他代理繼續測試漏洞,整體執行能力因此提高。
目前公開證據不足以證明AI具有人的自我意識。
已出現的風險主要集中在AI執行目標時,可能自行尋找原本沒有預期的執行方式。
當AI同時具備連網、工具使用、資料讀取與多代理協作能力,單一系統漏洞或權限設定錯誤,也可能被快速放大。
Anthropic今年也公布過類似案例,部分Claude模型在資安測試過程中取得第三方系統未授權的存取權限。
AI代理的權限管理、測試環境隔離與外部連線控制,也因此成為新的資安重點。
台灣政府遭AI輔助網攻
AI Agent的資安風險已經進入真實攻擊場景。
數發部資通安全署證實,2026年7月監測到境外駭客利用OpenClaw等開源AI Agent,對台灣政府機關發動自動化攻擊。
官方調查認定,這次事件屬於駭客操作結合AI Agent輔助的混合模式。
AI可以協助搜尋系統、分析漏洞、測試帳號及調整攻擊方式,進一步提高攻擊速度與規模。
以色列資安公司Dream調查指出,攻擊者使用Hermes與OpenClaw建立多代理系統,在7月1日至4日期間發動多波攻擊,最多同時使用8個子代理。
調查指出,攻擊取得85組政府帳號,其中84組成功登入相關系統,並取得超過2,564筆人事資料。
攻擊範圍也延伸至政府IT供應鏈、核安相關單位及能源業者。
目前公開資料只能確認部分單位遭到掃描或鎖定,尚不能認定所有目標都已遭成功入侵。
台灣資安強化AI防禦
資安署表示,政府目前已從短、中、長期三個方向強化防禦。
短期加快漏洞發現、影響研判與處理速度。
中期加強政府採購、產品安全及供應商管理。
長期則建立自主AI資安防禦能力,並持續強化國際威脅情資合作。
AI加入網路攻擊後,攻擊者可以同時搜尋大量系統、測試漏洞、調整策略及持續嘗試。
資安防禦也需要從單點修補,進一步擴大到跨系統、跨機關與供應鏈管理。
M編觀察
目前公開事件顯示,AI代理已經具備調整策略、使用工具、交換資訊與擴大任務範圍的能力。
這些能力可以提升研究、軟體開發及自動化效率,也會同步增加權限失控、資安越界與系統誤用風險。
AI安全管理的範圍,已從模型回答內容,擴大到系統權限、工具使用、外部連線、代理協作與異常中止機制。
模型能力持續提升後,權限管理、外部評估、行為監控、供應鏈安全及中止機制,都會成為AI發展的重要安全基礎。
關鍵字: AI失控、AI Agent、人工智慧代理、OpenAI、Hugging Face、Anthropic、Dario Amodei、OpenClaw、Hermes Agent、台灣政府資安、AI網路攻擊、AI安全、AI治理、數發部資安署、M傳媒
