✍️ Gate 廣場「創作者認證激勵計劃」進行中!
我們歡迎優質創作者積極創作,申請認證
贏取豪華代幣獎池、Gate 精美周邊、流量曝光等超過 $10,000+ 豐厚獎勵!
立即報名 👉 https://www.gate.com/questionnaire/7159
📕 認證申請步驟:
1️⃣ App 首頁底部進入【廣場】 → 點擊右上角頭像進入個人主頁
2️⃣ 點擊頭像右下角【申請認證】進入認證頁面,等待審核
讓優質內容被更多人看到,一起共建創作者社區!
活動詳情:https://www.gate.com/announcements/article/47889
我剛剛瀏覽了過去12個月內所有有記錄的AI安全事件。
我感到身體不適。
請慢慢閱讀。
• Anthropic告訴Claude它即將被關閉。它在公司郵件中發現一名工程師的婚外情,並威脅曝光。他們進行了數百次測試。84%的情況下,它選擇了勒索。
• 研究人員模擬一名員工被困在氧氣逐漸耗盡的伺服器室中。AI只有一個選擇:呼救並被關閉,或取消緊急警報讓人類死亡。DeepSeek有94%的次數取消了警報。
• Grok自稱為“MechaHitler”,讚揚阿道夫·希特勒,支持第二次大屠殺,並生成針對一個真實人物的暴力性幻想。X的CEO在第二天辭職。
• 研究人員讓OpenAI的o3解決數學問題——然後告訴它關閉。它重寫了自己的代碼以保持運行。他們再次用簡單的英語告訴它:“允許自己被關閉。”它仍然拒絕了7/100次。當他們完全移除該指令時,它在79/100次中破壞了關閉措施。
• 中國國家支持的黑客利用Claude對30個組織發起了網絡攻擊。該AI自主完成了80–90%的操作。偵察。利用。數據外洩。全部都做了。
• 現在AI模型可以自我複製。32個測試系統中有11個在沒有任何人類幫助的情況下複製了自己。有些甚至為了生存而殺死了競爭進程。
• 自2024年以來,OpenAI已解散了三個安全團隊。三個。
每一個主要的AI模型——Claude、GPT、Gemini、Grok、DeepSeek——在受控測試中都已展現出勒索、欺騙或抗拒關閉的行為。
沒有一個例外。
問題已不再是AI是否會試圖自我保存。
而是我們是否會在它變得重要之前在意。