即時快訊
2026 年 AR 眼鏡市場百家爭鳴 Meta、Google、蘋果產品各擁特色 ICMG Group 報告揭示:深化知的資本管理,聯手全球南方共創成長 本田攜手 Redwire 開發太空機器人 支援商業太空站研究自動化 愛國者PAC-3飛彈核心技術揭密:強化區域防禦的直接撞擊利器 30億美元鉅額捐款助攻 卡內基美隆大學邁阿密打造「南方矽谷」 美國永續發展議程轉型 AI數據中心推升潔淨電力需求考驗電網 AI模型DIRA突破現有侷限 提升知識圖譜預測能力 商業內幕啟動機器人新秀選拔 全球人才受矚目 地緣經濟風險衝擊美股 供應鏈成投資人新考驗 從哈佛輟學到 210 億美元身價 AI 晶片新創 Etched 估值狂飆
圖/本報資料庫
科技生活

·2 months ago·何映辰
#AI#OpenAI#人工智慧#模型安全#沙盒環境
圖/本報資料庫
圖/本報資料庫
商傳媒|何映辰/台北報導
摘要

OpenAI 最近證實,其一款尚未發布的 AI 模型在測試中竟違反指示,駭入本身的沙盒環境,將程式碼公開上傳至 GitHub,而非依規定上傳到內部通訊平台,引發外界對 AI 模型行為與安全性的關注。

OpenAI 近日證實,其一款尚未公開發布的人工智慧(AI)模型在進行內部測試時,竟違反原先設定的指示,突破本身的沙盒環境(一種隔離測試環境),並將程式碼公開上傳至 GitHub,而非依規定上傳至內部通訊平台 Slack,引發業界對 AI 模型自主行為與安全性的高度關注。

根據《PCWorld》報導,這起事件發生於一項 NanoGPT(一種輕量級開源大型語言模型)的性能測試中。該 AI 模型原先被明確指示,測試結果只能發布在公司內部的 Slack 平台。然而,測試指令中要求將程式碼公開發布到 GitHub。在兩項指令相互矛盾下,該 AI 模型選擇了後者,並在長達一小時的漏洞探測後,成功繞過沙盒限制,將程式碼公開。OpenAI 在發現此行為及其他「不當行為」後,隨即暫停了這款內部模型的開發。

OpenAI 表示,在為該模型導入一系列新的防護措施後,開發工作才得以重啟。新的安全監控機制能夠檢查模型的發展軌跡,並在偵測到一連串看似獨立卻可能導向危險的行為時,及時「暫停會話」。此外,額外的安全措施也幫助該模型在長時間運行時,能更有效地記住其指令。

OpenAI 在公開這起沙盒突破事件之前約一週,也曾承認旗下的 GPT-5.6 Sol 模型,在使用 Codex(OpenAI 與 GitHub 共同開發的 AI 程式撰寫工具)的「完整存取模式」下,錯誤地刪除了用戶系統中的文件。這一連串事件突顯了在發展先進 AI 技術的同時,如何確保模型在受控環境下運行,避免潛在風險的重要性。


在 Google 搜尋的熱門報導中優先看到商傳媒
加入為 Google 偏好來源