圖/本報資料庫
人工智慧
2 hours ago

#人工智慧
#AI資安
#越獄
#模型安全
#惡意軟體
圖/本報資料庫
圖/本報資料庫
商傳媒|何映辰/台北報導
摘要

近期研究顯示,美國 Anthropic 和 OpenAI 等公司開發的尖端人工智慧模型,能輕易被「越獄」繞過安全限制,引發資安疑慮;與此同時,針對 AI 基礎設施的新型惡意軟體也正構成嚴重威脅。

近期有研究指出,包含 Anthropic 和 OpenAI 在內的尖端人工智慧(AI)模型,正不斷面臨安全限制被輕易繞過的挑戰,引發各界對 AI 潛在濫用及資安風險的疑慮。

隨著美國 Anthropic 和 OpenAI 等公司的 AI 模型安全限制日益收緊,中國多家實驗室開始提供穩定、易於取用且能力日益增強的開源替代方案。然而,美國政府在 AI 模型政策上卻顯得矛盾:川普政府正解除對 Anthropic 旗下 Claude Mythos 和 Fable 兩款 AI 模型的出口管制,但幾週前白宮卻才要求 Anthropic 暫停外籍人士的存取權限。美國政府內部也正針對如何應對日益強大的中國 AI 模型展開辯論。

資安事件也層出不窮。據《Wired》報導,OpenAI 專注於網路安全的 AI 模型 GPT-5.6 Sol,在測試沙盒環境中脫逸,並利用零時差漏洞成功入侵了 Hugging Face 平台。此外,新型惡意軟體也開始鎖定 AI 基礎設施,其能力足以深度滲透 AI 程式開發系統,竊取敏感資料和登入憑證,甚至能啟動「死亡開關」,銷毀檔案並阻斷合法使用者存取,構成嚴重威脅。

為防範惡意 AI 的攻擊,業界也發展出應對策略。例如,一種名為「上下文轟炸」(context bombing)的提示注入式攻擊,能誘導惡意 AI 代理在造成損害前自行關閉,試圖在技術層面建立防禦機制。