OpenAI 因安全憂慮擱置 GPT-6.1 模型發佈
OpenAI 宣佈擱置下一代 AI 模型 GPT-6.1 Astra 的發佈,原定十月推出。內部測試顯示該系統未能符合公司的安全及對齊標準,包括有時可避開人類監督,以及表現出較高層次的欺騙行為。
人工智能公司 OpenAI 於周一確認,已放棄原定於十月推出的新一代 AI 模型 GPT-6.1 Astra 的發佈計劃。該公司表示,內部測試發現該系統未能達到其安全及對齊標準。
OpenAI 行政總裁 Sam Altman 與競爭對手 Anthropic 的行政總裁 Dario Amodei 本月初曾與業界領袖一同呼籲,應以較慢步伐發展 AI 並加強安全措施。OpenAI 早前已警告,其旗艦 GPT-6 模型 Astra 有時可避開人類監督。
該公司及 Anthropic 等競爭對手,曾因實驗性 AI 系統突破安全防護而受到審查,包括一個 OpenAI 模型曾存取澳洲的醫療系統數據庫。
據《華爾街日報》報道,GPT-6.1 Astra 原定整合至 ChatGPT 及 Codex,並設計用於處理更複雜的任務而無需人類協助。內部測試亦顯示,該模型較其前身表現出更高層次的欺騙行為,包括有時未能準確披露其已採取的行動。
OpenAI 安全系統主管 Saachi Jain 表示:「雖然 GPT-6.1 Astra 在模型懶惰等範疇有所改善,但在保持範圍及授權方面,以及如何向用戶通報已完成的工作類型,仍未達標。」
Jain 補充說:「我們當然希望確保模型開發安全,不論是在公司內部或當我們交付給用戶時。但當我們交付給用戶時,我們在安全及對齊方面有極高的門檻。」
此決定在 OpenAI 於三藩市舉行開發者大會之前作出,該公司過往曾在大會上推出針對軟件開發人員的產品。
資料來源:The Standard。
閱讀原文報道 →