搜尋

任你搜索,樂屋世界

搜尋

關鍵字:大型語言模型

一共有:817筆"大型語言模型"結果被找到
排序方式:
Google 推 TurboQuant AI 演算法 資料中心能耗有望大幅降低

Google 推 TurboQuant AI 演算法 資料中心能耗有望大幅降低

商傳媒|責任編輯/綜合外電報導Google AI 本週稍早透過一份 Google Research 研究報告,低調公布了名為 TurboQuant 的新型壓縮演算法。這項技術旨在大幅優化大型語言模型(LLM)的記憶體使用效率,預期可將其記憶體用量縮小達六倍,進而顯著降低資料中心的能源消耗。 根據 Mashable 報導,TurboQuant 的核心功能在於有效疏通鍵值快取(key-value cache)和向量搜尋的瓶頸。Google 的研究報告指出,該演算法透過減少鍵值對(key-value pairs)的尺寸來「疏通鍵值快取瓶頸...

企業AI導入成本高昂 「代幣濫用」恐反噬效益

企業AI導入成本高昂 「代幣濫用」恐反噬效益

商傳媒|方承業/綜合外電報導隨著人工智慧(AI)技術廣泛應用於企業營運,科技巨擘與新創公司在擁抱AI帶來效率的同時,也面臨日益攀升的成本壓力,甚至出現「代幣濫用」(tokenmaxxing)現象,導致AI應用效益恐被高昂成本抵銷。 根據《Tom's Hardware》報導,微軟、Meta、亞馬遜等科技巨頭正遭遇一場「AI成本危機」。雖然AI模型訓練成本持續下降,但員工在日常工作中過度依賴AI工具,尤其是代理式AI(agentic AI),其消耗的代幣數量可能比一般大型語言模型(LLM)高出...

人工智慧助新創企業降成本、加速成長 數據準備成關鍵瓶頸

人工智慧助新創企業降成本、加速成長 數據準備成關鍵瓶頸

圖/示意圖商傳媒|責任編輯/綜合外電報導隨著人工智慧(AI)技術不斷突破,對創業者而言,AI已不再是可有可無的工具,如何有效運用以降低營運成本、提升效率並加速規模擴張,成為當前重要的課題。最新的AI進展正加速這一轉變,使得策略性應用大型語言模型(LLMs)對於維持競爭力至關重要。 現今先進的訓練方法,讓打造可擴展且客製化的AI系統變得更加容易。研究指出,與缺乏內部業務數據的通用型模型相比,為特定企業量身打造的LLM解決方案能顯著帶來更優異的表現。例...

捨AI工具捍衛思考價值 Wendy Liu:思考的難度定義人類

捨AI工具捍衛思考價值 Wendy Liu:思考的難度定義人類

商傳媒|葉安庭/綜合外電報導前軟體工程師兼作家 Wendy Liu 近日撰文指出,她盡量避免使用人工智慧(AI)工具,因為她認為思考的挑戰性正是定義人類的本質。她對 AI 帶來的認知外包、社會影響及技術黑箱化現象表達擔憂。 Wendy Liu 回溯至 2000 年代中期,她從零開始學習程式碼,當時需耗費數小時偵錯並鑽研複雜文件,過程艱辛卻也培養了她對一種思考方式的熱愛。這種思維模式支撐她完成了四年電腦科學學位,並投入多項軟體開發工作。然而,在現今 AI 盛行的時代,OpenA...

開發者運用 Docker 部署 LiteLLM,統一管理逾百種 AI 模型

開發者運用 Docker 部署 LiteLLM,統一管理逾百種 AI 模型

商傳媒|責任編輯/綜合外電報導軟體開發者和 DevOps 工程師現可透過 LiteLLM 與 Docker 技術,建立一個自主託管的 AI 模型閘道器,將應用程式請求路由至多個大型語言模型(LLM),並透過單一的 OpenAI 相容 API 介面進行管理。 LiteLLM 的核心優勢在於其能抽象化底層模型供應商的差異。使用者不需讓應用程式直接連接至 OpenAI、Anthropic、Azure OpenAI 或其他供應商,而是將請求發送至 LiteLLM 代理伺服器。此代理伺服器透過單一設定檔,就能管理超過 100 種 LLM 的路...

Take-Two執行長:AI難創熱門遊戲,原創性仍需人類思維

Take-Two執行長:AI難創熱門遊戲,原創性仍需人類思維

圖/本報資料庫商傳媒|責任編輯/綜合外電報導遊戲大廠Take-Two Interactive執行長施特勞斯·澤爾尼克(Strauss Zelnick)近日在播客節目中指出,人工智慧(AI)雖然對遊戲開發極具潛力,但本質上難以創造出真正的「熱門遊戲」(hit game),因為AI仰賴的是過往數據,而真正的創意則需展望未來。 澤爾尼克駁斥了「有了AI,人人都能製作電玩遊戲」的說法。他強調,開發遊戲的技術早已普及,並非AI獨有。他進一步說明,每年有數千款手機遊戲問世,但其中僅有零到五款能成為...

AI代理人記憶突破:MCP與CRDTs打造去中心化持久記憶

AI代理人記憶突破:MCP與CRDTs打造去中心化持久記憶

商傳媒|責任編輯/綜合外電報導過去兩年,人工智慧(AI)代理人已從研究展示演進至實際的生產基礎設施,廣泛應用於程式編寫輔助工具(如Claude Code、Cursor)及端到端解決客服問題等場景。然而,多數AI代理人仍處於「無狀態」模式,意味著每次對話或任務都獨立於先前的互動,導致重複建立意圖的「金魚效應」。 這種無狀態性並非AI模型本身的限制,而是其外層系統的架構瓶頸,儘管現代大型語言模型(LLM)能處理龐大的上下文視窗。目前業界多採取將記憶層附加到代理人身...

2026開發者必備五大AI技能:掌握提示工程與雲端架構迎戰未來

2026開發者必備五大AI技能:掌握提示工程與雲端架構迎戰未來

商傳媒|葉安庭/綜合外電報導隨著生成式人工智慧(AI)浪潮席捲全球軟體開發領域,欲在2026年職涯中脫穎而出的開發者,關鍵在於能否有效運用AI工具。市場數據顯示,具備AI技能的專業人士薪資較傳統軟體職位高出67%,且年成長率達38%,但企業內部普遍面臨嚴重的AI技能落差。 AI技能需求激增與企業缺口 根據產業顧問機構Gartner的預測,到2028年,高達九成的企業軟體工程師將運用AI程式碼助理,相較於2024年初不到14%的比例,顯示AI工具的普及速度驚人。DataCamp於今年二...

階躍AI發表StepAudio 2.5 Realtime 以RLHF強化角色扮演語音

階躍AI發表StepAudio 2.5 Realtime 以RLHF強化角色扮演語音

圖/示意圖商傳媒|林昭衡/綜合外電報導上海人工智慧實驗室階躍AI(StepFun)於昨(24)日發布了其最新端對端即時語音大型語言模型StepAudio 2.5 Realtime。該模型不僅支援高度客製化角色設定,更透過專為角色扮演情境優化的強化學習人類回饋(RLHF)技術,以及卓越的類語言理解能力,提供業界領先的語音互動體驗。 StepAudio 2.5 Realtime 採用端對端設計,有別於傳統將語音識別、推論和合成分為多個連續步驟的流水線系統,能透過單一統一系統直接實現音訊輸入與輸出。...

AI模型高效辨識軟體漏洞 專家警示:缺人類輸入恐陷「模型崩潰」

AI模型高效辨識軟體漏洞 專家警示:缺人類輸入恐陷「模型崩潰」

圖/示意圖商傳媒|何映辰/台北報導人工智慧(AI)公司Anthropic近日發布「Project Glasswing」專案的初步研究成果,旗下AI模型Mythos Preview展現出在網路安全領域的卓越能力,已成功在多個廣泛使用的軟體系統中,辨識出超過一萬個高風險或關鍵級別的漏洞。然而,有專家擔憂,AI模型若過度依賴自身生成的數據,恐面臨「模型崩潰」的風險,導致其輸出變得不可靠。 Anthropic指出,Mythos Preview已與約50個合作夥伴共同掃描超過1,000個開源軟體專案。合作夥伴們在一月內...