注册

华东首座国产TPU千卡智算集群于杭州落成

来源:科创板日报       

2026世界人工智能大会举办期间,华东地区(杭州)首座国产TPU千卡智算集群落成仪式正式举办。该集群由杭州电信、中兴通讯、中昊芯英三方联合打造,同时为中国电信体系内首个实现大规模部署的国产TPU算力集群项目。

整套智算集群依托中昊芯英自研“泰则®”全栈智算平台搭建,面向通用大模型训练、高并发AI推理、工业科学计算场景提供完整国产化算力底座。集群核心硬件单元为“泰则®”2.0人工智能服务器,整机搭载两路高性能中央处理器,配套8颗中昊芯英自研TPU架构AI芯片“须臾®”,单机混合精度总算力达到7.168P。

集群互联架构具备强扩展能力,单套超节点架构最高支持2048片“须臾®”芯片直连组网,可稳定承载万亿参数大模型分布式训练、多智能体协同运算等高负载任务。配套运维系统集成硬件状态监控、故障预警、算力计费、模型调度等全流程功能,可快速交付商用算力服务。

软件生态层面,泰则®2.0平台兼容PyTorch、vLLM、SGLang等主流深度学习框架,适配DeepSpeed、Megatron-LM分布式训练工具链,现已完成通义千问Qwen全系列、DeepSeek、GLM等主流国产大模型深度适配,企业无需大规模修改代码即可完成模型迁移,降低国产算力落地门槛。

硬件芯片参数方面,第二代TPU“须臾®”单芯片混合精度浮点算力896TFLOPS,综合性能较上一代“刹那®”提升3倍,8bit推理算力1792TOPS;芯片额定功耗600W,同等算力规格下功耗较传统算力芯片降低50%,整机运行能耗仅为同规格GPU服务器的80%,适配低碳智算中心建设需求。芯片针对长文本上下文、海量Token并发推理完成张量架构专项优化,缓解深度学习存储墙瓶颈。

项目建设采用分工协同模式,中昊芯英提供底层TPU芯片、服务器整机与配套软件栈;中兴通讯负责整机集成、高速互联组网与集群系统调优;杭州电信承担机房部署、算力运营与政企客户算力服务输出,形成芯片、通信设备、算力运营商全链条协同落地模式。项目一期采用初代TPU搭建千卡算力规模,二期规划搭载“须臾®”芯片扩容,测试设备已进入机房验证,计划2026年9月上线,远期规划向万卡级国产TPU集群拓展,总算力突破万P级别。

公开资料显示,中昊芯英2018年成立,是国内较早实现量产落地的专用TPU芯片研发企业,初代“刹那®”芯片已在多地运营商智算中心批量商用;本次千卡集群落地,标志国产TPU架构从单芯片、单机试点迈入规模化商用阶段,为长三角AI产业提供自主可控算力供给。