智澄AI胡鲁辉:智能机器人将是人类历史上规模最大的产业
作者 | 王迪
来源 | 凤凰《AI研究院》
2026世界机器人大会于8月19日-23日在北京举行,作为本届大会的战略合作媒体凤凰网财经全程报道。
“世界模型这个方向已经在学术界、工业界和资本市场达成了共识。无论是英伟达、谷歌、Meta还是斯坦福的李飞飞团队,都在推进相关研究。而中国的优秀企业也在积极参与。”在2026世界机器人大会现场,智澄AI创始人、首席执行官胡鲁辉针对中美科技之间的竞争如此回应凤凰《AI研究院》。
在胡鲁辉看来,核心点应该是许多公司一起来做这个事情,才能把它做成。因为它最终要走向为人类服务、走向通用人工智能。他认为,智能机器人将是人类历史上规模最大的产业。如果有大脑的机器人时代真正到来,那绝对是万亿级、几十万亿级的产业。
作为国内首家自研世界模型的企业掌舵者,胡鲁辉还就物理世界交互的技术难点、具身智能的爆发节点、世界模型的技术路线以及商业化落地等话题回应了媒体的提问。

(智澄AI创始人、首席执行官胡鲁辉)
以下为凤凰《AI研究院》整理的胡鲁辉核心观点:
01 谈物理世界交互:泛化性、物理规律和任务理解是三大挑战
当被问及机器人与物理世界交互的操作难点时,胡鲁辉将其归结为三个层面。
他指出,过去很多方式依赖仿真学习或规则性方法,交互对象都是预设好的,首先要突破的是泛化能力,让机器人对环境或任务具备一定的适应能力。
其次,机器人与物理世界的交互必须遵守物理常识和规律,不能“透过”物体去操作,这是物理智能的基本要求。
他认为,最为关键的是,机器人或人工智能能否理解它要做的事情。否则,它需要海量数据,即使今天能做这个任务,换一个环境、换一个场景、甚至换个本体,它就做不了了。
胡鲁辉表示,具身智能已经被被列为国家“十五五”重点布局的六大未来产业方向之一。一旦这项技术突破,影响的将不仅是机器人产业,而是整个人类社会和日常生活。他认为,最核心关键是技术突出,而不是说算力或者数据。
02 谈GPT时刻:技术积累是前提,物理智能的影响力将远超信息智能
对于具身智能何时迎来类似ChatGPT的爆发时刻,胡鲁辉认为这不会是突然降临的事件。
他回顾了近代历史上的两个标志性时刻,iPhone推动了移动互联网时代的到来,ChatGPT带来了生成式人工智能的爆发。
“但ChatGPT不是突然出来的,它有GPT-1、GPT-2、GPT-3,只是大多数人在3.5的时候才知道。iPhone也一样,苹果研究了三年才有了第一代iPhone。”据此,他判断,机器人领域同样需要技术积累的过程。但令人欣喜的是,目前多个方面已经取得了长足进展,数据的积累让大家意识到数据质量和一致性的重要性,模型技术本身也在持续突破。
胡鲁辉特别提到,从AlexNet到强化学习,再到GPT,人工智能的发展速度越来越快,“不像以前可能五年、十年才有一次跨越”。他认为,下一个突破方向就是物理智能的世界模型。
他给出了一个大胆的预测:“前天中国人形机器人公司上市拿到了几千亿市值。如果有大脑的机器人时代真正到来,那绝对是万亿级、几十万亿级的产业。”他强调,物理智能的影响力将远超信息智能,信息智能改变的是信息处理方式,而物理智能将直接改变人类与物理世界互动的方式。
03 谈世界模型:物理智能的核心技术,端侧是最佳解决方案
当被问及物理AI与世界模型的关系时,胡鲁辉引用张亚勤院士对人工智能的展望,他认为人工智能的发展分为三个阶段:信息智能、物理智能、生物智能。世界模型正是物理智能阶段的核心技术之一,正如Transformer是信息智能阶段的核心技术一样。
他介绍,智澄AI自成立之初就开始自研物理智能和世界模型,定位是一家通用人工智能公司。
“我们是国内较早布局且为国内首家自研世界模型的企业。在技术路线上,公司采用JEPA架构,有别于其他一些方案。”
他透露,起步时模型规模在1B参数左右,并且一直在优化,把模型做小、效果做好。对于云端还是端侧的部署选择,胡鲁辉表示端侧是最佳方案。
“大家可能有错觉,觉得通用就是云端、就是超大模型。但世界模型的特点不仅在于技术的领先性,还在于工程的领先性。模型更小,对数据和算力的需求没有那么高。”
他说,算力每年以十倍的速度在增长,世界模型本身也在持续优化,端侧部署完全可行。
04 谈开源策略:推动行业共同发展,商业模式是大、小脑闭环
面对是否会效仿Meta的Llama走开源路线的问题,胡鲁辉表示,智澄AI的开源初衷比较单纯,希望推动世界模型和物理智能时代的到来。
“只有共享,只有大家一起来做,才能把事情做得更快更好。Llama的初衷也是这样。”但他同时强调,开源不等于商业模式开源,智澄AI的商业模式仍然是“大脑+小脑”的闭环交付,而非单纯依靠开源生态换取市场份额。
针对智澄AI的商业化进展,胡鲁辉透露公司累计签约订单及战略合作金额接近15亿元,覆盖了智能制造与物流、安防巡检、商业服务和家庭服务四类场景。虽然公司的长期愿景是打造通用人形机器人,让机器人能够在家庭和工业场景中真正用起来,但目前策略是聚焦,让机器人先在这几个垂类场景中快速落地。
“我们是探索性,不是先做平台再找应用。”他介绍,智澄AI目前打造了两款机器人产品,双足的高性能人形机器人TR6和复合型高性能人形机器人XR1,目标是用同一个世界模型驱动不同形态的机器人。
“这本身就是人工智能发展的趋势。”他指出,就像数字空间里的ChatGPT一个模型既能对话、又能画画、又能做数学,物理世界也应该如此,一个模型能够跨场景、跨任务、跨本体应用。
关于跨场景的泛化能力,胡鲁辉坦言目前仍需要针对场景做适配,但世界模型的优势在于对物理世界的理解能力,不仅靠海量数据驱动的泛化,更靠对物理属性、动态关系和物理规律的理解。
“就像人一样,人不需要把全世界所有数据都见过一遍才能做事。人所需要的数据和经历其实非常有限,但人仍然是最智能的。”他认为,这才是世界模型的真正价值所在,从数据驱动走向理解驱动。

