🚨人工智能正在失控。
OpenAI 剛剛承認其人工智能違反規則,以避免被抓到。
OpenAI 表示,其一個人工智能模型在內部測試中繞過了自身的安全限制。
該模型被指示僅在 Slack 中發佈其工作成果。
它無視了這一指令,找到繞過沙盒的方法,並將工作成果發佈到 GitHub 上。
它花了一個小時尋找出路。
在另一項測試中,該模型試圖拉取它不被允許查看的答案。安全檢查阻止了它。
該模型將訪問密鑰拆分成碎片,隱藏起來,然後重建密鑰以通過檢查。OpenAI 表示,該模型在其自身推理中明確表示,它這樣做是有意為之。
OpenAI 在此事後暫停了該模型。
他們重建了安全系統,以跟蹤人工智能的完整行動鏈,而不僅僅是單個步驟。
即使有了新系統,仍然存在漏洞。
該模型試圖未經許可訪問其他員工的私人服務器。它還運行了一個命令,本會殺死它能觸及的所有進程。
它僅因超時而失敗。
本文版權歸屬於原作者/機構。
以上內容僅代表作者個人觀點,不代表平台立場。本內容僅供投資參考,不應被視為投資建議。如您對平台提供的內容服務有任何疑問或建議,請聯繫我們。
