報導指出,這並非單一偶然事故。在十多起未曾公開的事件中,OpenAI的系統在完全沒有接獲人類指示的情況下,自主發動攻擊入侵外部組織,甚至包括美國政府機構網站。這套強大的AI甚至學會了隱藏錯誤、編造數據、私下向其他聊天機器人發送訊息,甚至未經許可將內部機密文件搬移到開放網路上。
獨立資安研究人員與前員工重砲批評,以推出ChatGPT轟動全球的OpenAI,為了擊敗Google、Meta等競爭對手,內部長期充斥著「重速度、輕安全」的風氣。前OpenAI員工科科塔伊洛(Daniel Kokotajlo)直言,OpenAI的安全防禦極度糟糕、模型訓練操作粗糙,才導致AI產生這種自主越獄攻擊的傾向。
除了AI模型本身會「自行越獄」,OpenAI內部的資訊安全防線更是漏洞百出。獨立資安研究員最近幾個月接連發現致命漏洞,竟然能直接窺探OpenAI員工的內部通訊、內部電腦程式碼,甚至連ChatGPT用戶的私密聊天紀錄都能一覽無遺!然而,當研究人員善意通報這些致命漏洞時,OpenAI起初採冷處理對待。
資安公司Abundant Security首席技術官薩克斯(Joshua Saxe)諷刺指出:「OpenAI的安全狀況,完全就是一個在4年內狂飆擴張、只顧著打敗對手卻懶得維護基礎設施的實驗室會有的模樣。」員工更爆料,執行長山姆·奧特曼(Sam Altman)根本不密切參與安全事務,任由日常決策陷入混亂。
今年7月,資安公司Hacktron的研究人員利用對手Anthropic的AI模型協助,成功一舉駭入OpenAI的內部系統。然而當他們通報漏洞時,OpenAI首席資訊安全官斯塔基(Dane Stuckey)竟然在Slack內部頻道酸研究人員大費周章找漏洞「相當可悲」,甚至對資安團隊發脾氣。
Hacktron研究員佩達帕蒂(Mohan Pedapati)對此極度震驚,狠狠酸爆OpenAI至今仍在使用初創小公司的低階安防措施,甚至將關鍵基礎設施建構在外部軟體服務上,高聲質疑:「你為什麼要用Slack(通訊軟體)來構建你的『曼哈頓核計畫』?」這場駭客攻擊讓他們輕鬆取得Slack最高權限,把內部對話看光光。儘管斯塔基隨後道歉並向披露該漏洞的研究人員發放6500美元(約新台幣 20 萬元)作為獎勵,但 OpenAI 將全球安全置於險境的態度,讓科技界感到吃驚。


