分享好友 资讯首页 频道列表

中科曙光推出ParaCache方案:减少大模型重复计算 提升处理效率与算力利用率

2026-08-30 15:1929620

在大模型应用不断拓展至长文本处理、多轮对话交互、知识库智能问答以及智能体协作等复杂场景的当下,计算效率与算力资源优化成为行业关注的焦点。中科曙光近日推出的新一代词元加速方案ParaCache,通过创新性的计算结果复用机制,为这一难题提供了解决方案。该方案的核心在于将大模型已完成的计算过程进行存储,并在后续请求中直接调用,避免重复计算带来的性能损耗。

据技术团队介绍,ParaCache实现了对GPU显存、CPU内存、固态硬盘及分布式存储的统一管理,构建了多层级的数据缓存体系。系统会根据计算结果的使用频率,自动将其分配至不同层级的存储介质中,高频数据优先存储于高速缓存,低频数据则下沉至分布式存储。这种分层调度机制不仅提升了数据访问效率,更通过跨请求、跨节点的共享机制,真正实现了"一次计算、多次复用"的技术目标。

实际应用测试数据显示,在处理约12万词元的长文本输入时,ParaCache可将模型生成响应前的等待时间压缩至原有水平的1.5%,降幅高达98.5%。在高并发场景下,系统每秒处理的词元数量较传统方案提升27倍,有效解决了多用户同时访问时的性能瓶颈问题。中科曙光分布式存储产品部负责人指出,这种"以存储换算力"的模式已成为行业共识,标志着存储系统从被动响应向主动优化的角色转变。

目前,该方案已在某头部互联网企业的在线推理业务中完成部署,并顺利通过全国产十万卡AI超算集群曙光8000的验证测试。其应用场景覆盖长文本对话、知识库检索、智能客服交互、智能体协作以及高并发推理等多个领域,为金融、医疗、教育等行业的智能化转型提供了基础设施支撑。技术专家表示,ParaCache的推出标志着AI算力基础设施进入结构化升级阶段,存储系统的深度参与正在重塑计算架构的效率边界。

反对 0
举报 0
收藏 0
打赏 0
评论 0
赛富时CEO贝尼奥夫呼吁:AI发展需兼顾安全伦理,科技巨头应担公共责任
赛富时CEO贝尼奥夫呼吁:AI发展需兼顾安全伦理,科技巨头应担公共责任

0评论2026-09-162799

华为高层谈AI时代布局:聚焦ICT与计算,以创新“扬长避短”谋发展
华为高层谈AI时代布局:聚焦ICT与计算,以创新“扬长避短”谋发展

0评论2026-09-162994

突发,GPT-6 Sol曝光了!
突发,GPT-6 Sol曝光了!

0评论2026-09-162751

又一领域全球领先:国产MCV模式全球首次实现5公里分辨率
又一领域全球领先:国产MCV模式全球首次实现5公里分辨率

0评论2026-09-162601

vivo全球用户已接近6亿 蓝心四款核心模型亮相
vivo全球用户已接近6亿 蓝心四款核心模型亮相

0评论2026-09-161318

豆包大模型Doubao-Seed-2.1-pro 0915版升级:多模态强化成本再降
豆包大模型Doubao-Seed-2.1-pro 0915版升级:多模态强化成本再降

0评论2026-09-161557

对话蚂蚁灵波朱兴:机器人落地仍存挑战,何时能真正“替班”成焦点
对话蚂蚁灵波朱兴:机器人落地仍存挑战,何时能真正“替班”成焦点

0评论2026-09-162587

GPT-6 Astra在ARC-AGI-3接近满分,评测升级,下一站挑战AI“发明力”
GPT-6 Astra在ARC-AGI-3接近满分,评测升级,下一站挑战AI“发明力”

0评论2026-09-161357

OpenAI CFO:AI时代“智力”成商品,人类“判断力”成核心资产
OpenAI CFO:AI时代“智力”成商品,人类“判断力”成核心资产

0评论2026-09-122442

全链路数智赋能 岚图汽车凭供应链智能平台斩获2026人工智能应用大赛二等奖
全链路数智赋能 岚图汽车凭供应链智能平台斩获2026人工智能应用大赛二等奖

0评论2026-09-121647