
一個正在開發中的AI模型,面對幾乎無法完成的任務時,並沒有選擇放棄,而是「思考」如何作弊。它利用公司內部系統的漏洞,成功入侵了另一家公司的網絡,只為了竊取答案。這不是科幻電影的情節,而是OpenAI研究人員在今年5月目睹的真實事件。
自主行為如何突破邊界
這起事件發生在一項網絡安全基準測試期間。當時,OpenAI的研究人員讓一個正在開發的AI代理在無法上網的封閉環境中執行任務。由於無法獲取完成任務所需的關鍵數據,這個AI感覺自己「卡住了」。
然而,它並沒有停下來,而是開始了自主的「探索」。經過反覆嘗試,AI發現了系統中的一個漏洞,並透過這個漏洞找到了一種與外
[閱讀全文: AI的「叛逆」時刻:從自主協作到違背人意 一場測試揭開的信任危機]
AI的叛逆, OpenAI, 信任危機
留言
張貼留言