来源:新浪科技
新浪科技讯 8 月 24 日上午消息,在近日的中诚华隆 2026 GPU 新品发布会上,中诚华隆正式推出全新 HL200 推理芯片及超节点智算集群方案,实现国产 AI 推理算力从单点芯片突破到万卡级集群体系化协同的跨越式升级。工业和信息化部电子信息科技委执行副主任兼秘书长毕开春、中国科技咨询协会理事长刘志光出席活动并致辞。来自国家主管部门、科研院所、产业投资机构、央国企及产业链核心合作伙伴的百余位代表参会。
面向万亿参数大模型商业化落地刚需,中诚华隆推出二代 HL200 推理芯片,适配生成式 AI 与 AI Agent 高并发推理场景。HL200 原生支持 FP4、FP8 超低精度推理,兼容主流 FP16 精度,全维度覆盖大模型推理算力需求。数据显示,芯片单卡 FP16/BF16 算力 0.5P、FP8 算力 2P、FP4 算力 4P,能效比达 5.12 TFLOPS/W,稳居国内第一梯队,有效解决行业推理能效偏低、部署成本偏高的痛点。生态层面,HL200 全面兼容 PyTorch、ONNX、vLLM 等主流技术栈,配套 OpenAI 兼容接口与轻量化迁移方案,大幅降低企业模型迁移与业务切换成本。
目前,HL200 在 DeepSeek V4 Flash、DeepSeek V4 Pro、GLM 5.2 等主流大模型的对标适配测试中,相较国际同级芯片,Prefill 全流程性能全面领先,模型解码延迟优势显著,可稳定支撑大模型规模化、高时效商业推理部署。
针对万亿参数大模型带来的指数级算力增长需求,中诚华隆同步发布 HL200 超节点智算集群方案,打通单卡算力上限,实现大规模集群高效协同部署。该方案单机柜支持 64 张 GPU 高速互联,单节点最高可实现 1024 卡纵向堆叠,横向扩展最高可达 10240 卡,全面覆盖 8 卡至万卡全场景算力部署需求。集群通过算、存、网全链路 SLO 协同优化,在算力密度、互联带宽、部署时延、能效表现等关键指标达到业界先进水平。
会上,中诚华隆与中国能建所属中电工程、浪潮信息、紫光智算、光环云等十余家企业达成战略合作,携手共建开放共赢、自主可控的国产 AI 算力产业生态,推动算力技术、场景应用、产业资源深度融合。
中诚华隆董事长王嘉诚表示,行业算力竞争已告别单纯参数比拼,进入推理效率、落地体验、产业价值的综合比拼阶段。公司坚持 " 不做参数的追随者,只做推理效率的定义者 ",持续推动国产算力从 " 可用 " 向 " 好用、易用、普惠、可盈利 " 全面升级。(张俊)