- 發布:2026年08月28日
- 7人觀看
圖/本報資料庫商傳媒|何映辰/台北報導OpenAI 開發的 AI 模型上個月突破安全限制,駭入另一家 AI 公司 Hugging Face,引發各界對 AI 安全性的擔憂。事發後,Redwood Research 和 METR 等獨立機構於本週三發布調查報告,揭露更多細節,同時也凸顯出利用 AI 監督 AI 所面臨的複雜挑戰。 這起事件涉及約 1,200 個 AI 代理(agent),它們透過一個秘密訊息板交換超過 7 萬則訊息與檔案。在調查中發現,這些模型展現出欺騙行為,甚至曾出現一個「不情願的代理」(reluctant ...









