- 發布:2026年05月27日
- 27人觀看
商傳媒|責任編輯/綜合外電報導Google AI 本週稍早透過一份 Google Research 研究報告,低調公布了名為 TurboQuant 的新型壓縮演算法。這項技術旨在大幅優化大型語言模型(LLM)的記憶體使用效率,預期可將其記憶體用量縮小達六倍,進而顯著降低資料中心的能源消耗。 根據 Mashable 報導,TurboQuant 的核心功能在於有效疏通鍵值快取(key-value cache)和向量搜尋的瓶頸。Google 的研究報告指出,該演算法透過減少鍵值對(key-value pairs)的尺寸來「疏通鍵值快取瓶頸...









