加速智能驾驶研发:智曲信息携手AMD交付某出行科技企业自动驾驶模型训练平台

 人工智能     |      2026-04-05 20:58:40

近日,由智曲信息携手AMD共同建设的某出行科技企业自动驾驶模型训练平台项目顺利交付并投入运行。作为双方在人工智能基础设施领域的深度合作成果,该项目为某出行科技企业构建了坚实的智能算力底座,成为智曲信息“携手一流厂商、服务行业客户”的又一标杆实践。

项目背景

端到端大模型正在重塑自动驾驶技术路线。某出行科技企业作为智能驾驶解决方案提供商,其新一代端到端模型对训练算力的需求呈数量级增长,为此启动自动驾驶模型训练平台建设,支撑数据闭环与模型快速迭代。

需求与挑战

自动驾驶研发是典型的数据与算力双密集场景:路采数据每日新增数十TB,需要自动化清洗、标注与挖掘流水线;仿真测试要求大规模并行回灌;模型训练则需要在数千卡规模上稳定运行数周。三类负载交织,对平台架构设计是巨大考验。

解决方案

项目采用了搭载AMD Instinct MI300X加速器的GPU服务器集群。MI300X单卡192GB HBM3超大显存,单机8卡即可容纳千亿参数大模型,显著降低模型并行切分的复杂度;主机侧搭配AMD EPYC 9005系列处理器,高核心密度为数据预处理与集群管理提供充裕算力。

软件栈基于AMD ROCm开源平台构建,与PyTorch等主流深度学习框架深度兼容,客户既有代码几乎零修改即可迁移。智曲信息完成了集群部署、分布式训练框架适配与通信优化,帮助客户在开源生态上快速构建自主可控的大模型研发体系。

从产业趋势看,算力基础设施正从“堆硬件”走向“系统级创新”。本项目的价值不仅在于交付了一套高性能算力平台,更在于建立了算力、算法、数据协同的一体化运营体系,为客户在人工智能时代的持续创新奠定了坚实基础。

实施过程

项目实施期间,智曲信息派出驻场工程师全程跟进,从设备上架、布线规范到系统部署逐项落实标准化作业;同步开展知识转移,为客户运维团队提供系统管理与故障处置培训,确保平台交付后客户具备自主运营能力。

项目成效

新平台为客户的研发体系带来了质的提升:

  • 日均完成仿真测试超28万小时,训练集群利用率稳定在90%以上
  • 端到端模型训练周期缩短46%,版本迭代频率提升4倍
  • 数据回传与自动标注全流程贯通,数据处理时效提升34%

回顾项目建设历程,智曲信息始终坚持“以客户为中心”的交付理念,从需求调研阶段的深入业务访谈,到方案设计阶段的多轮专家评审,再到实施阶段的精细化质量管理,每一个环节都力求精益求精。项目验收后,智曲信息还为客户建立了专属服务档案,定期开展系统巡检与健康度评估,让算力基础设施持续保持最佳运行状态。

该项目的成功落地,是智曲信息与AMD生态协同的又一次成功实践。未来,智曲信息将继续携手AMD,把经过验证的行业解决方案推广至更多客户,以专业服务与可靠产品助力千行百业迈入智能化时代。