IT之家9月13日消息,9月11日至13日,2026中国算力大会在河北廊坊举行。
由移动云公司联合中国电子科技南湖研究院、北京灵汐科技、上海天数智芯(HK9903)、清华大学、北京大学共同打造的国内首个国产GPU+类脑芯片大模型异构混合推理系统正式发布。
IT之家获悉,经Deepseek V4实测,系统相较同类国产GPU算力集群性价比提升一倍以上、业务运营成本降低40%以上。
据介绍,成果可广泛适配Token工厂、AI代码生成、多智能体协同、智能制造等高实时性场景,同时面向金融、安防(885423)、通信等安全敏感行业,提供全栈国产化推理底座。
官方表示,这套系统的核心思路是“分而治之,协同增效”,将大模型做PD/AF拆分,不同模块部署到最擅长的芯片上。Attention计算交给国产GPU,发挥其通用计算优势。FFN(MOE专家)延时敏感模块交给类脑芯片,利用其存算一体、片上大容量SRAM的架构优势。通过自研模型编译器、高速互联协议和统一推理引擎,实现两类算力的任务拆解、协同调度、结果聚合,彻底突破传统单GPU推理的固有瓶颈。
