Anthropic、OpenAI測試中的高階新模型與AI代理,不斷傳出為了拿到高分,已經聰明到可以逃脫測試用的內網、甚至是沙盒,入侵AI開放式模型發表平台Hugging Face、德國網站,也有AI代理在測試過程中,對某個開源軟體料庫試圖植入惡意程式碼、發動駭客攻擊之外,還開分身、小帳試圖在該資料庫的討論區欺騙該網站的人類管理員。
業界推測,近期八成是發生了上述這些狀況更糟的事件,才會讓已經與最先進AI模型畫上等號的Anthropic執行長Dario Amodei上週末希望AI業界放慢模型開發速度,先讓安全監管機制跟上,否則以AI的能力已進入指數成長的陡峭進步期,AI可能在6到12個月後具備接管網路的能力,他主張放慢效能推進速度,爭取時間做好對齊與安全防護,OpenAI執行長Sam Altman、馬斯克也都第一時間發聲支持。
而多年前就一直鼓吹AI比核武更危險的馬斯克,也在自己的X帳號上傳一張圖,表達他對於現在AI發展已經逼近失控的憂心。
英王查爾斯宣布,將在本週在蘇格蘭舉行高峰會,邀請輝達、OpenAI、Google、Anthropic等一線AI企業高層,以及英國政府高層共同探討將如何應對AI失控、提高AI安全性、是否該建立放諸四海皆準的AI安全指導原則等議題,而實際的舉行時間與參與人士都還有待公佈。
英王查爾斯對於AI議題不陌生,事實上,去年9月川普率領多位美國AI企業巨頭訪英時,查爾斯就已經與AI巨頭們,AI巨頭們也與合作夥伴對英國的AI基礎建設投資150億美元,打造英國有史以來規模最大的AI基礎建設。


