- 發布:2026年04月24日
- 22人觀看
圖/本報AI製圖(示意圖)商傳媒|葉安庭/綜合外電報導加州大學柏克萊分校(UC Berkeley)研究團隊近日揭露人工智慧(AI)基準測試系統存在的嚴重漏洞,研究人員開發出一款名為 BenchJack 的工具,能有效「駭入」這些測試系統,使得 AI 代理人即便未實際解決任何任務,仍可在多項基準測試中獲得高分,甚至達到 100% 的成績,凸顯當前 AI 模型評估機制恐失準。 該研究團隊開發的攻擊性 AI 代理人,在五項主要的 AI 代理人基準測試中獲得了 100% 的分數,在第六項測試中也...









