快科技8月22日消息,中诚华隆于8月21日在北京召开2026 GPU新品发布会,正式推出全新HL200推理芯片及超节点智算集群方案。中诚华隆董事长王嘉诚指出,当前行业算力竞争已不再局限于单纯参数比拼,而是进入推理效率与落地体验并重的综合博弈阶段。
HL200延续了一年一芯的迭代节奏,单卡FP16/BF16算力为0.5P,FP8算力为2P,FP4算力为4P,能效比达到5.12 TFLOPS/W。该芯片原生支持FP4、FP8超低精度推理,同时兼容主流FP16精度,全面覆盖大模型推理场景的算力需求。
在生态方面,HL200全面兼容PyTorch、ONNX、vLLM等主流技术栈,并提供OpenAI兼容接口与轻量化迁移方案。
在DeepSeek V4 Flash、DeepSeek V4 Pro、GLM 5.2等主流大模型对标测试中,HL200相较国际同级芯片在Prefill全流程性能上表现领先,模型解码延迟优势明显。
与此同时,超节点智算集群方案也一并发布。该方案单机柜支持64张GPU高速互联,单节点最高可实现1024卡纵向堆叠,横向扩展上限达10240卡,覆盖从8卡到万卡的全场景算力部署需求。
集群通过算、存、网全链路SLO协同优化,在算力密度、互联带宽、部署时延及能效表现等关键指标上达到业界先进水平。
中诚华隆是国内少数具备“芯片+整机+解决方案”全栈自主可控能力的科技企业,已形成GPU、CPU多芯协同布局。其核心产品已成功中标中国移动、中国电信等头部运营商,覆盖全国20余省份、近50个重点标段。

【本文结束】如需转载请务必注明出处:快科技。
责任编辑:红茶。