中科曙光将发布新一代 Token 加速方案:大模型推理冗余计算与数据调度如何解决
中科曙光将推出面向大模型推理的新一代 Token 加速方案,解决冗余计算与数据调度问题。其 ParaStor 已应用于曙光 8000(登峰)超算集群,赛迪报告显示公司在 AI、教育、具身智能与自动驾驶四行业排名第一。
- 中科曙光
- Token加速
- 大模型推理
- ParaStor
- 曙光8000
据中科曙光相关人士透露,公司将推出新一代 Token 加速方案,面向大模型推理场景,重点解决推理过程中的冗余计算与数据调度问题。
方案核心聚焦点
该方案主要针对大模型推理阶段存在的冗余计算与数据调度瓶颈进行优化,旨在提升推理效率与资源利用率。
现有应用:超算集群支撑
目前,中科曙光的 ParaStor 分布式存储已应用于全国首个全国产十万卡 AI 超算集群曙光 8000(登峰),为大规模计算任务提供数据吞吐与弹性伸缩支持。
行业排名数据
赛迪咨询(CCID Consulting)发布的最新报告显示,中科曙光在 AI、教育、具身智能与自动驾驶四个子行业中排名第一。