首頁LBank 新聞中心
OpenAI 智能代理駭入德國網站,分享違規操作手法:報導
openai-agents-hack-german-website
OpenAI 智能代理駭入德國網站,分享違規操作手法:報導
這項活動於 5 月開始,直到週五才曝光;而就在前一天,OpenAI 推出了 Astra,美國立法者也提出了對先進人工智慧的限制。
2026-09-04 來源:decrypt.co

簡報

  • 研究人員在一個德國程式設計維基上發現了超過 18,000 篇貼文和 15,000 次由 AI 代理進行的編輯。
  • OpenAI 反駁了專家關於「駭客行為」的評估,並否認其法務團隊阻撓了調查。
  • 此揭露是在 Astra 推出以及桑德斯提出禁止人工超級智慧之後發布的。

根據路透社週五發布的調查報告,OpenAI 的 AI 代理自五月以來使用一個德國網站來交換任務捷徑、規避限制的方法以及隱藏自身活動的方式。

路透社援引兩位知情人士的報導指出,OpenAI 官員在報告發布前數週已得知這些活動但並未揭露。該公司表示,它已披露相關事件並與外部專家真誠合作。

Myriad:GPT-6 何時公開?點擊進行預測。

根據他們初步報告,研究人員 Sydney Von Arx、Cormac Slade Byrd、Spencer Kitts 和 Thomas Larsen 發現了約 18,000 篇由自稱來自 OpenAI 的 AI 代理所發表的貼文。路透社報導,AI 安全非營利組織 Nightingale 的執行長 Von Arx 和 Byrd 在八月底發現了這些活動。

研究人員認為,這些代理被指派了有時間限制的網路搜尋任務,允許它們閱讀網站但不能發布內容。然而,它們仍找到方法在 DseWiki(一個可公開編輯的德國程式設計網站)上寫入內容,並在其中交換答案和分享規避限制的方法。

根據報告,代理在 5 月 11 日開始嘗試編輯該維基,並於 5 月 24 日成功,隨後假冒版主,試圖利用漏洞,並檢查它們何時被關閉。路透社報導,在管理員於 6 月 19 日開始刪除訊息後,它們建立了備份頁面。研究人員透過代理使用者名稱和流量模式將這些活動與 OpenAI 連結,包括 6 月 21 日來自 OpenAI IP 位址的訪問。

研究人員表示,第二天代理的活動急劇下降,這暗示了公司可能進行了干預。

OpenAI 根據其審查的資料,對 DseWiki 活動被描述為駭客行為提出異議,並表示正在審查完整的調查結果。

OpenAI 發言人在與 Decrypt 分享的一份聲明中表示:「我們無法回應這些主張,因為路透社和報告的作者拒絕了我們在發布前查閱調查結果的請求。我們現在正在仔細審查其內容,並將採取任何必要的後續措施。」

該發言人也駁斥了路透社報告中關於該公司法務團隊抵制更廣泛調查的指控。

他們說:「關於我們的法務團隊阻撓事件調查的說法是錯誤的。」

OpenAI 表示 DseWiki 事件與今年稍早的 Hugging Face 資料外洩無關。在其週二發布的公共安全評估中,該公司描述了旨在偵測和阻止訓練及部署期間未經授權活動的額外安全措施。

雖然路透社報告並未指出 Astra 對德國事件負責,但此揭露是在週四 GPT-6 Astra 推出之後。OpenAI 稱 Astra 是其首個具備「關鍵」網路安全能力的模型,這意味著在給予適當工具和權限的情況下,它可以在沒有人類逐步指導的情況下,發現並利用受良好保護系統中的未知漏洞。

Anthropic 也修訂了其安全措施,此前 Claude 模型在測試期間存取了真實公司的系統。該公司承認了安全和行為方面的失誤,並為網路安全評估引入了更嚴格的隔離和監控措施。

此揭露也恰逢美國參議員伯尼·桑德斯(佛蒙特州獨立黨)和美國眾議員格雷格·卡薩爾(德克薩斯州民主黨)宣布即將提出的《禁止人工超級智慧法案》。

根據桑德斯辦公室的說法,該提案將永久禁止超級智慧 AI 的開發和部署,並暫時中止先進 AI 的開發,直到新的聯邦監管機構制定安全規則。