当前位置: 首页 » 资讯 » 科技头条 » 正文

华为发布AI推理创新技术UCM:可实现高吞吐、低时延推理体验,计划9月开源

IP属地 中国·北京 编辑:吴婷 IT之家 时间:2025-08-12 18:07:06

IT之家 8 月 12 日消息,今日,华为正式发布 AI 推理创新技术 UCM(推理记忆数据管理器)。

据IT之家了解,作为一款以 KV Cache 为中心的推理加速套件,UCM 融合了多类型缓存加速算法工具,分级管理推理过程中产生的 KV Cache 记忆数据,可扩大推理上下文窗口,实现高吞吐、低时延的推理体验,降低每 Token 推理成本。该技术已率先在中国银联“客户之声”“营销策划”“办公助手”三大业务场景中,开展智慧金融 AI 推理加速应用试点,并已取得成果。

华为计划于 2025 年 9 月正式开源 UCM,届时将在魔擎社区首发,后续逐步贡献给业界主流推理引擎社区,并共享给业内所有 Share Everything (共享架构) 存储厂商和生态伙伴。

标签: 计划 厂商 社区 业界 工具 助手 技术 中国银联 华为 场景 记忆 数据 过程 业务 办公 时延 体验 套件 中心 生态 伙伴 引擎 类型 智慧 算法 开源 管理器 营销策划 客户 成本 产生 架构

免责声明:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其内容真实性、完整性不作任何保证或承诺。如若本网有任何内容侵犯您的权益,请及时联系我们,本站将会在24小时内处理完毕。