- 發布:2026年05月15日
- 16人觀看
商傳媒|何映辰/台北報導微軟研究人員近期透過一項新研究示警,當前領先的大型人工智慧模型(LLMs)在處理文件時,會「靜默」地引入錯誤並改寫內容,導致高達四分之一的文件資訊遭到損毀。這項發現對日益普及的AI自主代理(AI agents)應用,投下嚴峻挑戰。 該研究團隊開發了「DELEGATE-52」基準測試,旨在模擬涵蓋金融會計、軟體工程、晶體學及音樂符號等多達52個專業領域的多步驟自主工作流程。這項測試透過「往返接力模擬」方法,自動測量文件內容在長時間、連續20次...









