推理加速存储AS3000G7发布:以存代算 节省算力消耗

内容摘要快科技7月31日消息,据媒体报道,2025(第二届)产融合作大会在北京召开。会上,浪潮存储重磅发布了推理加速存储产品AS3000G7,旨在解决大模型推理中因KV Cache重复计算导致的算力浪费和时延问题,为金融、科研等领域的模型规模化落地

联系电话:400-962-3929

快科技7月31日消息,据媒体报道,2025(第二届)产融合作大会在北京召开。会上,浪潮存储重磅发布了推理加速存储产品AS3000G7,旨在解决大模型推理中因KV Cache重复计算导致的算力浪费和时延问题,为金融、科研等领域的模型规模化落地提供关键支撑。

当前,大模型推理高度依赖昂贵的GPU服务器,其利用效率直接决定了模型从 实验室 走向 生产线 的速度。

与此同时,IDC预测未来五年智能算力规模将增长1.7倍,且到2027年,推理工作负载占比将超过70%,提升GPU利用效率的需求愈加迫切。

浪潮存储AS3000G7创新性地提出 以存代算 方案。该产品能够集中存储所有KV Cache及多轮对话结果。

其架构将KV Cache从GPU本机内存,通过高速网络缓存至AS3000G7。在后续对话中,系统可按需直接拉取缓存,彻底避免了重复计算。

这一突破性设计显著节省了算力消耗,提升了宝贵的GPU资源利用率,加速了大模型在实际场景中的高效应用。

推理加速存储AS3000G7发布:以存代算 节省算力消耗

 
举报 收藏 打赏
今日推荐
浙ICP备19001410号-1

免责声明

本网站(以下简称“本站”)提供的内容来源于互联网收集或转载,仅供用户参考,不代表本站立场。本站不对内容的准确性、真实性或合法性承担责任。我们致力于保护知识产权,尊重所有合法权益,但由于互联网内容的开放性,本站无法核实所有资料,请用户自行判断其可靠性。

如您认为本站内容侵犯您的合法权益,请通过电子邮件与我们联系:675867094@qq.com。请提供相关证明材料,以便核实处理。收到投诉后,我们将尽快审查并在必要时采取适当措施(包括但不限于删除侵权内容)。本站内容均为互联网整理汇编,观点仅供参考,本站不承担任何责任。请谨慎决策,如发现涉嫌侵权或违法内容,请及时联系我们,核实后本站将立即处理。感谢您的理解与配合。

合作联系方式

如有合作或其他相关事宜,欢迎通过以下方式与我们联系: