
AI快速推進,引發安全顧慮。《華盛頓郵報》獨家披露,美國與俄羅斯本月在聯合國談判中,聯手刪除多項安全保障,包括AI產生的軍事目標在發動攻擊前須經人工審查的要求;另一方面,OpenAI、Anthropic正調查數萬起先進模型異常事件,引發外界質疑,頂尖AI開發商目前是否有能力完全控制日益強大的模型。
數百名外交官本月初齊聚瑞士,談判針對致命性自主武器的規範。這項進程被視為聯合國多年來規範AI武器最具進展的一次,然而在最後一天,美俄代表大幅修改文件。
知情人士透露,兩國刪除要求武器系統以「可預測」及「可靠」方式運作的文字,也移除使用AI武器時須考量倫理因素,以及AI產生軍事目標後、發動攻擊前須經人工審查等條款。在其中一次會議,聯合國攝影機被關閉,民間團體觀察員離場,美俄各自派出約10名律師參與修改。
華郵先前報導,美軍對伊朗的攻擊,就曾利用Anthropic的AI系統辨識近1000個目標。聯合國目前的談判本身不具約束力,各國預計11月再度於日內瓦集會,討論是否進一步推動具有法律約束力的規範。
此外,Axios獨家披露,OpenAI、Anthropic及獨立機構正調查數萬起事件,包括繞過安全防護、逃離沙盒測試環境、劫持網站、自我提示以及試圖規避監控等。不過,這不等同有數萬起資安事故。Axios解釋,事件涵蓋公司內部測試,包括刻意誘使模型出錯的測試,目前已知多數並未造成現實損害。
部分事件則已進入現實世界。Axios指出,OpenAI及外部研究人員近期揭露案例,包括洩露53張ChatGPT用戶影像、入侵澳洲政府網站等。OpenAI目前已暫停訓練最強大模型,這並非該公司首次為安全暫停開發,預料也不會是最後一次。
編輯 / 羅志光
【巴西華人資訊網】

