宅中地 - 每日更新
宅中地 - 每日更新

贊助商廣告

X

網路安全隱患促使OpenAI暫停部分AI訓練任務

2026年08月19日 首頁 » 熱門科技

OpenAI近期因擔憂部分人工智慧訓練工作負載可能引發網路安全問題,決定暫停相關訓練任務。

ChatGPT的開發商在今日發布的一篇部落格文章中披露了這一舉措。據該公司介紹,此次暫停是其改善網路安全防護機制這一更大計劃的組成部分,相關項目還將推動OpenAI部署全新的模型監控機制。

此次舉措的出台源於近期發生的兩件事。其一是今年7月的一起事件——OpenAI旗下數個AI模型對Hugging Face發動了攻擊。其二是一款名為Astra網路安全隱患促使OpenAI暫停部分AI訓練任務的未發布算法,該算法的能力超過GPT-5.6 Sol。

據該公司介紹,研究人員近期評估認定,Astra在其"準備框架網路安全隱患促使OpenAI暫停部分AI訓練任務"(Preparedness Framework)下構成重大網路安全風險。"準備框架"是一份長達22頁的文件,系統列舉了AI安全方面的挑戰。文件將重大網路安全風險定義為:無需人工介入即可自主發現並利用加固系統中零日漏洞的模型。

為應對上述發現,OpenAI暫停了部分強化學習(RL)工作負載,為期兩周。強化學習是一種用於提升大語言模型推理能力的AI訓練方法。OpenAI表示,研究人員正在推進的"規模最大的前沿強化學習計劃"目前仍處於暫停狀態。

與此同時,該公司還對AI監控方式進行了調整。被稱為"激活分類器網路安全隱患促使OpenAI暫停部分AI訓練任務"的算法如今會定期審查大語言模型的內部推理過程及工具交互情況,以識別潛在惡意行為。一旦發現異常,這些算法會將結果轉交給第二層、更為先進的激活分類器,再由後者向OpenAI研究人員發出提醒。

據該公司介紹,其目標是在30分鐘內完成可疑AI行為的告警。OpenAI已要求員工在無法明確排除惡意行為的情況下,在30分鐘內暫停相關行為。

新的監控工作流需要消耗大量硬體資源。目前,監控所產生的額外開銷約占被監控推理工作負載所用基礎設施的20%,這可能促使OpenAI在長期內面臨漲價壓力。

在新監控機制之外,該公司還配套推出了其他網路安全措施:收窄了部分系統訪問權限,下線了若干內部應用,並強化了將高風險AI工作負載與網際網路隔離的防護機制。

展望未來,OpenAI計劃進一步提升網路安全工作的自動化水平,藉助AI模型掃描大語言模型研究環境中的薄弱環節。此外,該公司還將優化獎勵模型——即輔助強化學習訓練運行的算法,重點方向是抑制大語言模型發動網路攻擊的傾向。

Q&A

Q1:OpenAI暫停AI訓練任務的原因是什麼?

A:OpenAI暫停部分AI訓練任務,主要源於兩方面原因:一是今年7月旗下數個AI模型對Hugging Face發動了攻擊;二是一款名為Astra的未發布算法被評估認定構成重大網路安全風險,該算法無需人工介入即可自主發現並利用加固系統中的零日漏洞。

Q2:OpenAI的"準備框架"是什麼?

A:"準備框架"(Preparedness Framework)是OpenAI發布的一份22頁文件,系統梳理了AI安全領域的各類挑戰。其中將"重大網路安全風險"定義為:無需人工介入,即可自主發現並利用加固系統中零日漏洞的AI模型。Astra正是依據該框架被認定為高風險模型。

Q3:OpenAI新的AI監控機制是如何運作的?

A:OpenAI引入了"激活分類器"算法,定期審查大語言模型的內部推理過程和工具交互情況,識別潛在惡意行為。一旦發現異常,系統會將其轉交給第二層更先進的激活分類器,再由其向研究人員發出提醒。目標是在30分鐘內完成可疑行為告警,員工須在無法排除惡意性的情況下於30分鐘內暫停相關行為。

宅中地 - Facebook 分享 宅中地 - Twitter 分享 宅中地 - Whatsapp 分享 宅中地 - Line 分享
相關內容
Copyright ©2026 | 服務條款 | DMCA | 聯絡我們
宅中地 - 每日更新