巨人天成
产经 科技 企业 数据 峰会 快讯 商业

中科曙光推出ParaCache方案:减少大模型重复计算 提升处理效率与算力利用率

2026-08-30来源:快讯编辑:瑞雪

在大模型应用不断拓展至长文本处理、多轮对话交互、知识库智能问答以及智能体协作等复杂场景的当下,计算效率与算力资源优化成为行业关注的焦点。中科曙光近日推出的新一代词元加速方案ParaCache,通过创新性的计算结果复用机制,为这一难题提供了解决方案。该方案的核心在于将大模型已完成的计算过程进行存储,并在后续请求中直接调用,避免重复计算带来的性能损耗。

据技术团队介绍,ParaCache实现了对GPU显存、CPU内存、固态硬盘及分布式存储的统一管理,构建了多层级的数据缓存体系。系统会根据计算结果的使用频率,自动将其分配至不同层级的存储介质中,高频数据优先存储于高速缓存,低频数据则下沉至分布式存储。这种分层调度机制不仅提升了数据访问效率,更通过跨请求、跨节点的共享机制,真正实现了"一次计算、多次复用"的技术目标。

实际应用测试数据显示,在处理约12万词元的长文本输入时,ParaCache可将模型生成响应前的等待时间压缩至原有水平的1.5%,降幅高达98.5%。在高并发场景下,系统每秒处理的词元数量较传统方案提升27倍,有效解决了多用户同时访问时的性能瓶颈问题。中科曙光分布式存储产品部负责人指出,这种"以存储换算力"的模式已成为行业共识,标志着存储系统从被动响应向主动优化的角色转变。

目前,该方案已在某头部互联网企业的在线推理业务中完成部署,并顺利通过全国产十万卡AI超算集群曙光8000的验证测试。其应用场景覆盖长文本对话、知识库检索、智能客服交互、智能体协作以及高并发推理等多个领域,为金融、医疗、教育等行业的智能化转型提供了基础设施支撑。技术专家表示,ParaCache的推出标志着AI算力基础设施进入结构化升级阶段,存储系统的深度参与正在重塑计算架构的效率边界。

深圳迈思克全智能压铆机:以多重技术保障,适配复杂工厂网络环境
在钣金加工行业,随着自动化产线对设备互联与数据实时采集的需求日益增长,全智能压铆机的网络连接稳定性成为工厂管理者关注的焦点。深圳市迈思克科技有限公司的工程师现场勘测后,在车间中部增设一台工业级交换机,并采用光…

2026-08-30

从黔中算力筑基到民生AI落地:中国移动数博会绘就数智转型新画卷
上述负责人坦言,中国移动的答案,是一条“数据→模型→服务”的全流程流水线,整套能力在贵州完成实践验证,并面向全国行业客户开放输出。 坚实的算力底座、充沛的数据资源、成熟的大模型能力,最终的价值刻度,仍然落在具…

2026-08-29

OpenAI高管揭秘:ChatGPT与Codex融合之路,迈向个人AGI新时代
今年6月的巴黎VivaTech大会上,他就对Fortune说过,要做的是一个统一界面,让你去沟通、驾驭和监督你自己的个人AGI。 Tibo在DeepMind的本行是研究基础设施和研发工具,说白了就是给做研究…

2026-08-29

Meta发布XR Operator工具:AI智能体助力VR应用调试,简化开发者流程
IT之家 8 月 29 日消息,Meta 宣布推出一款名为 Meta XR Operator 的实验性开发者工具,旨在让 AI 智能体测试 VR应用,目前相应工具已集成在 Meta XR SDK v205 …

2026-08-29