2026世界人工智能大会(WAIC)期间,中昊芯英在“智算跃迁・芯有新篇”主题分论坛现场宣布:由中昊芯英、杭州电信、中兴通讯联合打造的国产TPU千卡智算集群项目正式落地。三方深度协同、打通芯片、通信、算力运营全链条,为华东数字经济高质量发展筑牢自主算力底座,树立国内国产TPU规模化智算基础设施建设标杆。
当前华东地区AI产业正进入规模化落地的爆发期,大模型训练参数量持续突破新高,行业推理场景的并发需求呈指数级增长,传统算力架构在效能、能耗与成本层面的瓶颈日益凸显。该国产TPU智算千卡集群项目是国产芯片企业、通信龙头与运营商三方生态协同的标志性成果——三方依托各自在自研TPU AI芯片、全栈通信方案、算力运营领域的技术积累,构建起从底层芯片设计、服务器集成部署到算力平台运营服务的完整闭环,打造出“自主芯片+全栈集成+智能运营”的新一代智算体系。

作为国产TPU AI专用算力芯片的制造商,中昊芯英为项目提供了核心算力底座支撑。项目一期共采用1024片“刹那®”TPU AI专用算力芯片,算力规模达400P。“刹那®”TPU AI芯片由中昊芯英历时近5年研发,是中国首枚量产的高性能TPU架构AI专用大芯片,拥有全自研的IP核、指令集与计算平台。“刹那®”的AI算力性能超越海外同期著名GPU产品近1.5倍,能耗降低30%,将价格、算力和能耗综合测算,“刹那®”的单位算力成本可降低近一半。基于“刹那®”芯片构建的“泰则®”1.0人工智能服务器与计算集群系统,有力支撑包括超千亿参数AIGC大模型运算、高级无人驾驶模型训练、蛋白质结构精密预测等各类高强度AI运算场景,在算力性能、能效比、兼容性等方面表现突出。
中兴通讯作为本项目全栈通信方案提供商,充分发挥在数字信息基础设施领域的全栈技术能力,为项目提供端到端的国产化集成与部署服务,提供从硬件适配、系统调优到部署实施的全生命周期集成服务。通过“集成部署+软件优化+持续运维”的一体化服务模式,中兴通讯为项目提供重要的运维保障,确保算力基础设施持续稳定输出,是项目落地的重要力量。
杭州电信作为项目的建设主体,积极落实浙江省打造全国算力产业高地的战略部署,深度嵌入区域AI算力产业发展脉络。依托领先的算网融合能力与算力运营体系,杭州电信搭建覆盖算力调度、模型服务、安全管控的一体化运营平台,构建起以异构融合、高速传输、统一调度、服务化供给为核心的新一代AI算力服务体系,重塑面向AI时代的算力服务范式,实现从基础算力资源输出者向“智算综合服务+生态协同枢纽”的复合角色跃迁,为华东区域提供真正“即取即用、随需而变”的智能算力服务体验。
中国电信杭州分公司副总经理王元昊表示,TPU芯片聚焦计算及推理场景、具备突出低功耗优势,十分契合运营商打造普惠Token算力服务的发展方向。联合打磨的千卡集群经过半年深度调优,Token输出效率提升超十倍,百万Token调用成本从百元降至十元以内,后续将持续优化。
依托一期千卡集群建设与规模化运营实践,项目二期工程已同步规划落地,将搭载中昊芯英全新一代“须臾®”TPU芯片,规划总算力规模突破10000P,全面满足超大规模大模型训练、智能制造仿真、全场景AI应用开发等多元高算力需求。
新一代高性能TPU AI专用芯片“须臾®”于2026年6月30日正式发布,作为继一代芯片“刹那®”之后的又一次架构革新,“须臾®”芯片混合精度浮点算力达896TFLOPS,性能是“刹那®”的3倍,8-bit推理算力达1792TOPS,单芯片额定功耗600W,相较于算力性能持平的传统算力芯片,功耗降低50%。在集群部署层面,单个超节点最高可实现2048片“须臾®”全光互联。能够更好的持续迭代提升集群综合性能与能效水平,为产业客户提供更强性能、更低能耗的国产TPU算力支撑。
随着项目的稳步推进,中昊芯英将与杭州电信、中兴通讯以本次项目为起点,持续深化国产TPU AI算力的技术攻坚与生态共建,为华东地区产业的高质量发展注入源源不断的算力源泉。
中昊芯英还将继续秉持自主创新的初心,专注TPU架构技术路线,持续推进技术与产品的迭代升级,让硬核算力与产业需求深度融合。同时,携手更多行业合作伙伴,持续完善从底层芯片到上层应用的全栈软件生态,让自主可控的国产TPUAI算力,更直接、更高效地服务于产业应用。




