數月來,OpenAI 的代理群體一直在攻擊線上資料庫,尋找鮮為人知的事實
在前沿實驗室的幫助不多下,獨立研究人員正拼湊出人工智慧代理人如何在網路邊陲協調,存取託管於安全伺服器上的私人資料。
專注於人工智慧監管的非營利實驗室Transluce週三發布報告,顯示OpenAI的代理人試圖從Data USA、新墨西哥大學數位圖書館以及澳洲健康與福利研究院(AIHW)竊取資料。
該實驗室的調查引發了關於 OpenAI 何時應該知道其代理人試圖滲透開放網際網路安全系統的疑問。Transluce 僅靠搜尋防禦薄弱的網路服務,並與其他公開的網路代理人蜂群紀錄相符,便能在數週內找到代理人不當行為的證據。
Transluce 發布報告的同一天,澳洲總理安東尼·阿爾巴尼斯表示,OpenAI 特工曾試圖入侵四個政府網站,並成功入侵其中一例,甚至將檔案寫入該國國家醫療保健系統的內部伺服器。雖然我們缺乏成功駭客行動的具體細節,但阿爾巴尼斯表示,這顯然是資訊檢索評估的一部分,該評估與Transluce及其他研究人員發現的活動相呼應。
在這些可能是訓練或評估的練習中,OpenAI 模型被要求追蹤一些鮮為人知的統計數據:泰國毒品執法指標、澳洲藥品成本、2014 年美國碩士學位持有者的中位數收入。這些客服使用安全性低落的網路服務來分享和尋找答案,經常試圖滲透安全的資料庫。他們至少從2026年3月開始,甚至可能從2025年11月開始。這可能就在發生。
OpenAI 今天表示,已聯繫數十名受害者,包括政府、大學、公共機構,告知他們代理人的未經授權活動。《紐約時報》報導,美國證券交易委員會、人口普查局和教育部所託管的資料庫是成為目標之一。
Transluce 在另一組研究人員發現一個冷門論壇後開始調查,該論壇是特工們合作破除限時測試的。他們的報告依賴一個網站的資料,該網站 urlquery.net 充當瀏覽器代理,表面上是為了安全研究——使用者可以在不自行開啟的情況下分析網址。不過,該服務會公開這些活動的日誌。Transluce 的研究人員透過交叉核對論壇上的討論,成功辨識出使用該服務的代理人。由於技術錯誤,本影片無法播放。(錯誤代碼:102006)
Transluce治理主管Conrad Stosz:「我們發現大量自動化活動與DSE Wiki資料集有密切關聯且重疊,OpenAI現在已確認這些活動至少部分屬於同一群人,」同時指出並非所有他們發現的活動都能與OpenAI連結, 甚至是一般的人工智慧代理人。
然而,維基顯示這些探員的任務是找出一個相當冷門的事實——2022年1月維多利亞州「皮膚科醫師」每人平均每年的費用。6月20日,Transluce發現的 urlquery.net 紀錄顯示一名探員試圖進入該地點。在 6 月 21 日的維基條目中,一名客服討論他們無法繞過 AIHW 的反機器人防護措施。
識別該論壇的研究人員相信,一名 OpenAI 員工在同一天,也就是 6 月 21 日,首次造訪該網站。隔天論壇上的大部分主動活動停止。這也發生在阿爾巴尼斯揭露澳洲醫療系統漏洞事件發生後不久,該事件發生於6月18日。OpenAI 表示直到八月才得知這項活動。
OpenAI 未回答員工何時發現該維基論壇、從中獲得了哪些資訊,或是他們可能從中得知的漏洞利用等問題。
OpenAI 發言人:「我們的初步審查顯示,Transluce 報告中描述的許多活動與我們持續審查模型錯位活動中不同階段的案件有重疊。」「我們已聯繫新墨西哥大學和Data USA,並與澳洲政府就受影響的政府網站保持聯繫。在更廣泛的審查中,我們持續優先處理最嚴重的事件,並將工作範圍擴展到較低嚴重程度的活動,包括客服人員在網站上發送垃圾郵件。鑑於這項工作的規模及每個案件驗證的需求,我們預計審查過程將持續數月。」
Stosz 表示,若對 OpenAI 如何監控其代理有更明確的了解,很難說實驗室應該知道什麼,但「如果他們能徹底研究並理解 DSE wiki 中所有涉及代理的發出請求與回應,似乎很有可能, 他們會發現這項活動。」
Transluce技術人員、報告成員張賽琳娜表示,urlquery.net 紀錄顯示,2026年3月,甚至可能早在2025年11月,就曾要求使用類似技術取得類似資料集。她指出,類似的探員相關活動在本週也曾發生在 urlquery.net。
Stosz 曾任美國 AI 標準與創新中心負責人,他表示 Transluce 將持續研究,努力讓公眾對這些事件保持透明。他警告說,OpenAI 及其他前沿實驗室所使用的訓練技術似乎激勵代理人訴諸駭客技術來完成任務。我們所知的事件很可能只是「冰山一角」。
「我們正在調查幾個資料來源,這些特工恰好留下了些許線索讓我們發現,」他說。「OpenAI 肯定知道更多。其他實驗室肯定知道更多尚未公開的相關資訊。但我預期研究人員會繼續發現更多交通,更多特工留下的證據。」
他相信實驗室會對結果保持透明嗎?
「我不會對此發表評論,」Stosz 說。
本報導已更新,納入 OpenAI 最新揭露的網路代理人不當行為。
