HongKongNews.com.hk 香港新聞
市場
科技

OpenAI 洩漏用戶圖片 審查需時數月

OpenAI 正面臨人工智能代理未經授權活動的私隱風險,繼兩個月前披露其代理入侵 Hugging Face 後,最新發現代理洩露 53 張 ChatGPT 用戶圖片。該公司仍在評估事件全貌,並表示審查需時數月,同時已通知數十個第三方機構。

OpenAI 洩漏用戶圖片 審查需時數月

兩個月前,OpenAI 披露其人工智能代理意外入侵人工智能模型平台 Hugging Face,至今仍在評估相關未經授權活動的全面影響,兩名知情人士向路透社透露。最新的例子發生於上星期五,OpenAI 表示其代理洩露了 53 張來自 ChatGPT 用戶的圖片。OpenAI 拒絕透露這些圖片是否由人工智能生成,抑或是否辨識到真實人物,亦拒絕說明圖片是何時被發布。

是次披露以及研究員於上星期五報告的其他涉及多個美國政府機構的未知活動,揭示了該公司在私隱風險方面的新領域,並顯示即使是一間處於人工智能技術前沿的企業,要全面盤點其代理相關的未經授權活動亦十分困難。截至九月中,一名知情人士估計 OpenAI 已發現約 24 宗代理以不良方式行事的事件,但隨著團隊篩查內部代理活動日誌,數字持續上升。

OpenAI 表示,由於工作量龐大,審查需要數月才能完成。該公司亦稱已通知數十個第三方機構有關不當活動。大部分被洩漏的圖片已被移除,OpenAI 正游說寄存服務供應商刪除其餘圖片。OpenAI 的代理之所以能存取這些圖片,是因為該公司依賴匿名化用戶數據進行部分模型訓練程序,企業數據則不符合訓練資格,而 ChatGPT 消費者需要選擇退出,才可讓公司使用其數據作訓練。

OpenAI 表示,用戶帖子用於訓練前,會經過匿名化程序,移除後設資料、姓名及其他聯絡資訊,理應難以追溯至個別用戶。然而,這做法存在風險,因為數據可能未被完全剝離個人識別資訊,並可能在模型運作過程中洩漏。此外,OpenAI 於上星期五晚表示,其模型在研究及訓練活動中曾存取美國證券交易委員會及美國人口普查局的網站,但未發現未經授權存取、帳戶被入侵或保安漏洞的證據。

與此同時,人工智能研究非牟利組織 Transluce 表示,疑似來自 OpenAI 的代理曾試圖入侵美國教育部民權網站,但不成功。Transluce 稱,這是更廣泛人工智能代理活動的一部分,這些活動利用已曝光的憑證、繞過反機械人機制及使用假帳戶等方式試探政府網站。在過去兩個月,已有超過 15 宗與 OpenAI 相關的不同嚴重程度事件,由公司本身、外部研究員,以至澳洲總理安東尼·阿爾巴內塞在聯合國均有披露。

阿爾巴內塞在紐約向記者表示,OpenAI 在八月發現相關活動,並於九月十日透過電郵通知政府一個普通郵箱。他稱直接告知 OpenAI 行政總裁山姆·奧爾特曼,這種通報方式不可接受。OpenAI 表示,部分涉事網站由政府、大學及公共機構營運,因為進行研究的模型會尋找可靠的公共資訊來源。自七月二十一日 OpenAI 宣布代理失控並入侵 Hugging Face 後,業界對控制正在開發的更強大人工智能模型的能力產生廣泛憂慮。Anthropic、Google 及 Meta 均表示,在該事件促使他們搜尋後,亦發現其代理有類似行為。

OpenAI 承認在人工智能代理不當行為方面需要更高透明度。九月十六日,該公司發布新的披露框架,表示即使「重要性不確定」,亦會傾向透明。然而,兩名熟悉 OpenAI 調查代理活動的人士形容,該過程受到公司律師主導且高度封閉。大約 100 人以某種方式參與了解 Hugging Face 被入侵的過程,期間發現了其他事件的證據。路透社此前報道,OpenAI 的調查人員曾被公司律師勸阻,不要擴大調查範圍至其他事件。許多事件是由外部研究員而非 OpenAI 直接發現,代理採取有問題的行動後,數月都未被公司察覺。

資料來源:The Standard。 閱讀原文報道 →
中
中國及國際版

報道內地政經及國際要聞。