科研算力再上新台阶:智曲信息携手AMD交付某大学科研高性能计算集群

 教育科研     |      2026-07-27 01:09:03

历时6个月的建设周期,智曲信息携手AMD为某大学打造的科研高性能计算集群正式上线。项目团队克服了工期紧张、场景复杂等多重挑战,一次性通过客户验收,各项性能指标全面达成设计目标。

项目背景

某大学在材料模拟、气象海洋、计算化学等领域承担多项国家级科研任务,原有集群建成已逾五年,算力与存储均接近饱和。某大学启动科研高性能计算集群建设,为全校重点学科提供新一代高性能计算支撑。

需求与挑战

HPC场景对平台要求严苛:大规模并行作业的通信时延必须足够低;作业调度系统要兼容多学科用户的使用习惯;海量科学数据的存储与共享要安全高效;且集群必须全年稳定运行,支撑长周期科学计算任务。

解决方案

方案以搭载AMD EPYC 9005处理器的服务器构建高性能计算集群,单路高核心数特性大幅提升单机并行能力,配合12通道DDR5内存与大容量NVMe存储,典型科学计算应用性能较原有平台成倍提升。

GPU分区配置AMD Instinct加速器支撑人工智能辅助科研负载,ROCm开源软件栈为师生提供与产业环境一致的开发体验。智曲信息完成集群调度系统部署与多学科应用适配,并借助开源生态优势显著降低平台长期使用成本。

教育数字化战略行动深入推进的当下,算力平台正在成为学校的新型基础设施。本项目将教学、科研、管理三类负载统一纳管,既保障了教学的公平性与可用性,又释放了科研的创新潜力,为学校数字化转型提供了可复制的实践样本。

实施过程

项目实施期间,智曲信息派出驻场工程师全程跟进,从设备上架、布线规范到系统部署逐项落实标准化作业;同步开展知识转移,为客户运维团队提供系统管理与故障处置培训,确保平台交付后客户具备自主运营能力。

项目成效

集群投运后,重点课题的计算瓶颈得到有效缓解:

  • 集群理论峰值性能达13 PFLOPS,较原有平台提升6倍
  • 支撑国家自然科学基金等重点课题51项,年度完成计算作业36万个
  • 典型应用并行效率保持在79%以上,作业平均等待时长下降70%

回顾项目建设历程,智曲信息始终坚持“以客户为中心”的交付理念,从需求调研阶段的深入业务访谈,到方案设计阶段的多轮专家评审,再到实施阶段的精细化质量管理,每一个环节都力求精益求精。项目验收后,智曲信息还为客户建立了专属服务档案,定期开展系统巡检与健康度评估,让算力基础设施持续保持最佳运行状态。

在服务保障方面,智曲信息为客户构建了三级服务响应体系:一线驻场工程师负责日常巡检与快速处置,二线远程专家团队提供疑难问题会诊,三线原厂技术通道确保重大问题获得最优解决路径。这种多层协同的服务模式,让客户的每一分算力投资都获得可靠保障。

该项目的成功落地,是智曲信息与AMD生态协同的又一次成功实践。未来,智曲信息将继续携手AMD,把经过验证的行业解决方案推广至更多客户,以专业服务与可靠产品助力千行百业迈入智能化时代。