降本增效新样本:智曲信息携手浪潮信息交付某数字内容企业大模型推理服务平台

 人工智能     |      2026-06-10 07:45:16

在数字化转型浪潮下,某数字内容企业选择与智曲信息及浪潮信息合作,共同推进大模型推理服务平台建设。依托浪潮信息领先的人工智能基础设施产品技术与智曲信息专业的集成服务能力,项目实现了高质量按期交付。

项目背景

随着某数字内容企业的智能客服、智能办公助手等大模型应用全面上线,用户规模在数月内增长数十倍,原有分散部署的推理资源已无法支撑业务高峰。某数字内容企业决定建设统一的大模型推理服务平台,实现推理算力的集中调度与弹性供给。

需求与挑战

线上推理业务具有典型的潮汐特征,高峰期每秒请求数可达平日的数十倍;同时,智能体应用对首字响应时延高度敏感,任何抖动都会直接影响用户体验。平台必须在高吞吐与低时延之间取得平衡,并支持模型的灰度发布与快速回滚。

解决方案

作为全球领先的服务器厂商,浪潮信息为本项目提供了以NF5688M6 AI服务器为核心的智算集群方案。NF5688M6在4U空间内支持8张高性能AI加速卡,通过全互联架构提供澎湃训练算力;针对推理场景,平台同步引入元脑R1推理服务器,单机可部署16张标准PCIe双宽卡,兼顾大模型推理的吞吐与成本。整机全面导入冷板式液冷散热,配合智算中心级机柜设计,实现高密度部署下的长期稳定运行。

在软件层面,方案部署了AIStation智算管理平台,实现算力资源统一纳管、多租户隔离与作业智能调度,训练任务提交效率大幅提升。智曲信息作为项目总集成方,完成了从机房勘察、方案设计、设备部署到集群调优的全流程交付,并组建专属运维团队提供7×24小时保障服务。

从产业趋势看,算力基础设施正从“堆硬件”走向“系统级创新”。本项目的价值不仅在于交付了一套高性能算力平台,更在于建立了算力、算法、数据协同的一体化运营体系,为客户在人工智能时代的持续创新奠定了坚实基础。

实施过程

项目实施期间,智曲信息派出驻场工程师全程跟进,从设备上架、布线规范到系统部署逐项落实标准化作业;同步开展知识转移,为客户运维团队提供系统管理与故障处置培训,确保平台交付后客户具备自主运营能力。

项目成效

平台上线后经受住了多轮业务高峰的考验:

  • 平台峰值每秒可处理46万token,首字响应时延低于26毫秒
  • 高并发场景下服务可用性保持在99.9%以上,全年无重大事故
  • 单位推理成本较原架构下降31%,年节约算力支出数百万元
  • 弹性扩容时间由小时级缩短至分钟级,资源利用率提升20%

客户相关负责人对项目交付质量给予高度评价,并表示平台上线以来运行稳定、性能达标,为业务发展提供了有力支撑。智曲信息将持续跟进平台运行情况,以全生命周期服务保障客户投资价值,携手浪潮信息深化行业智能化探索。