Ramp Labs提出多智能体記憶共享新方案,Token消耗最高降低65%
By: theblockbeats.news|2026/04/11 06:19:36
0
分享
BlockBeats 消息,4 月 11 日,AI 基礎設施公司 Ramp Labs 發布研究成果「Latent Briefing」,通過直接壓縮大型模型 KV 快取實現多智能體系間的高效記憶共享,在不損失準確率的前提下大幅降低 Token 消耗。
在主流多智能體架構中,編排者(Orchestrator)將任務拆解並反覆調用工作者(Worker)模型,隨著推理鏈路不斷延伸,Token 用量呈指數級膨脹。Latent Briefing 的核心思路是:借助注意力機制識別上下文中真正關鍵的部分,在表示層直接丟棄冗余信息,而非依賴速度慢的 LLM 摘要或穩定性差的 RAG 檢索。
在 LongBench v2 基準測試中,該方法表現亮眼:Worker 模型 Token 消耗降低 65%,中等長度文檔(32k 至 100k)的 Token 節省中位數達 49%,整體準確率較基線提升約 3 個百分點,而每次壓縮的額外耗時僅約 1.7 秒,較原始算法提速約 20 倍。
實驗以 Claude Sonnet 4 作為編排者、Qwen3-14B 作為工作者模型,覆蓋學術論文、法律文書、小說及政府報告等多類文檔場景。研究還發現,最優壓縮閾值因任務難度和文檔長度而異——難題適合激進壓縮以過濾投機性推理噪音,長文檔則更適合輕度壓縮以保留分散的關鍵信息。
-- 價格
--
--
--
本內容僅供參考,不構成任何金融、投資、法律或稅務建議。文中提及的任何活動、獎勵、線上活動或相關資訊,不應被視為對購買、出售或交易任何加密資產的推薦、招攬或邀請。加密資產具有高波動性,存在價值損失風險。WEEX服務、產品及相關活動的可用性可能因地區而異。用戶在參與前有責任確保符合當地適用法律法規。
猜你喜歡

Anthropic 超過四成收入來自雲廠商間接渠道

瑞銀調研中國AI產業鏈:大模型加速迭代,資金開始湧向半導體

GoPlus DeepScan全面升級:推出AI智能合約安全全生命周期防護體系

美國銀行啟用AI模型性能與成本比較追蹤器
美國銀行(Bank of America·$BAC)正在運行一個內部AI模型追蹤器,用於比較大型語言模型的性能和成本。企業人工智慧(AI)...

DeepSeek漲價首日全球分叉:國內大廠跟價分三派,海外廠商還在打折

數位資產投資指標 xRev 的計算方法論及分析工具

超過53,000名加密貨幣擁有者本週失去了非金錢的東西

ZCode 免費送 1 億 GLM-5.3 Token 活動上線一小時暫停

模型可替換、工具可插拔:DeepSeek把Agent競爭從「大腦」推向「操作系統」

法國AI初創Kog押注軟體提速GPU推理

Temple透過Token Terminal上架公開了Canton應用指標
機構用非託管交易平台Temple在Token Terminal上架後,Canton網絡內的應用活動指標開始公開。

AI時代未來最重要的5個習慣

廣東首個詞元經濟金融產品 Token 貸 發布

K25.ai 啟動 KXXV 代幣社區輪,認購額度為 20 萬美元

閃迪投資者日的口號,高盛如何解讀

OpenAI 上線 Computer History 替代 Chronicle

Writer發布新模型Palmyra X6主打降本

















