万卡集群轰鸣,制裁倒逼自研,昆仑芯十五年熬出什么?

万卡集群轰鸣,制裁倒逼自研,昆仑芯十五年熬出什么?

百度最高奖这次把百万美元奖金颁发给了两个团队。其中一个团队负责做的内容,是有关天池超节点方面的,用它来应对万亿参数规模的大模型;另一个团队则是做了面向企业级的Agent员工系统。更为吸引我关注的地方,是它们背后的昆仑芯,这个产品正在把国产算力的整体格局加以改变。

昆仑芯是由百度旗下芯片部门分拆独立出来的一家公司。在二零二六年的年初,它秘密地向港交所递交了A1申请,到了五月份的时候,又启动了科创板上市辅导相关工作,走的是A加H双轨上市这个路线。百度集团方面持有它百分之五十九点四五的股份,处于绝对控股的地位。

在二零二五年的上半年,百度方面点亮了国内首个全自研的三万卡集群,把昆仑芯P800三代当作核心部件来使用,这个规模相当于把几千台服务器摞在一起,让它们在AI任务方面共同运行。

天池超节点方面明确了商业化的具体时间表。二百五十六卡版本会在上半年推出,五百一十二卡版本则在下半年跟上这个节奏。招商银行、中国移动、国家电网等机构,已经用上了昆仑芯的相关芯片产品。

昆仑芯方面对外表示,P800这个产品在特定的AI推理任务当中,它所拥有的算力大约能达到英伟达H20的两倍左右。超节点方案可以把六十四张加速卡统统塞进一个机柜当中,这样就能够干完以往需要一百台服务器才能完成的那些活儿。

国产芯片在某些场景当中,比国外的同类产品要更具效率。这背后的缘由,是经历了十五年磨一剑的积累过程,百度从二零一零年开始着手芯片方面的工作,先是借助FPGA来开展摸索,之后又依靠深度学习研究院进行攻坚,到了二零一八年的时候,首代芯片得以亮相,而在二零二一年则完成了独立分拆。

在这十五年当中,百度方面累计为最高奖发放了近四亿元的奖金,更为关键的方面,是它把搜索、文心大模型、智能云这些真实业务拿来喂养芯片的迭代过程。芯片公司往往最害怕的事情,就是流片出来之后没有人愿意用,而昆仑芯凭借百度海量的负载作为支撑,也就有了相对充裕的容错空间。

制裁方面的政策在不断收紧,国产算力要摆脱对英伟达的依赖,已经成了一道必答题。互联网大厂们只能自己动手来造相关的东西。昆仑芯的突围之路,恰恰卡在了这个节骨眼上。

AI产业的重心正从大模型训练这个方向,逐渐转向Agent应用和推理这个领域。推理芯片方面,相对更为看重的是成本、延迟以及能效比这些指标。昆仑芯的M100这个产品,主打的是推理市场,会在今年上市;而M300则是面向多模态训练和推理,计划在二零二七年的时候上市。

算力领域的军备竞赛,其胜负手已经从单卡参数这个维度,转到了集群调度和互联效率这个方向。天池超节点把卡间互联这个东西,做成了系统级工程。

昆仑芯上市之后,不应按照传统半导体公司的算法来计算市盈率,它更像是一个把AI算力运营和云服务订阅结合在一起的混合体。它的核心资产,是经过了那套三万卡集群验证的调度系统以及工程代码。

百度方面能够熬到今天这个地步,依靠的是持续地用真实业务场景来喂养技术。昆仑芯这个产品证明了,国产算力可以在高强度的商用环境当中实现自我进化。

Agent元年正在把算力分配的格局加以重塑。未来的护城河,在于系统级工程能力以及故障恢复效率这些方面。天池架构在获奖之后迅速完成了产品化,这说明了中国AI基建已经迈入了比拼集群互联效率的新阶段。

从百万美元的支票,到三万卡集群,再到港交所和科创板的申报工作,昆仑芯这十五年所做的事情,正是一场精密工程意义上的突围。真正能够支撑AI商业化的东西,是底层算力所具备的效率和韧性。中国AI的下半场,依靠的是把基础设施一寸寸夯实的那种笨功夫。