- 發布:2026年04月28日
- 30人觀看
AI示意圖商傳媒|記者顏康寧/台北報導科技圈近期迎來一次令人頭皮發麻的「系統更新」。DeepSeek V4 正式登場,這款模型最受關注的指標,不在於單純堆高參數,而在於對 KV Cache 的極致優化。官方資料顯示,V4-Pro 採用 MoE 架構,總參數達 1.6 兆、啟動參數約 49B,並支援 100 萬 token 長上下文。更關鍵的是,在相同長上下文條件下,其 KV Cache 負擔可降至前代約 10%,單 token 推論運算量也明顯下降。這對長期承受「記憶體擠壓」的 AI 基礎設施而言,無疑是一場軟體...









