新媒体矩阵

具身智能迈入万亿关口,从技术验证到规模商用的跨越

从2018年的2133亿元到2025年的9150亿元,再到2026年突破万亿关口,这条赛道用八年时间完成了从萌芽到规模化的跨越。

2026年7月,具身智能产业进入一个关键节点。《中国具身智能产业发展报告(2026)》显示,2026年中国具身智能市场规模预计达到1.09万亿元,年均复合增长率为22%至23%。从2018年的2133亿元到2025年的9150亿元,再到2026年突破万亿关口,这条赛道用八年时间完成了从萌芽到规模化的跨越。

image.png

产业规模的快速扩张来自顶层设计的持续加码。

2025年《政府工作报告》首次将具身智能列入国家未来产业重点培育清单,“十五五”规划纲要进一步提出推动具身智能成为新的经济增长点。2026年2月,《人形机器人与具身智能标准体系(2026版)》正式发布。6月,工信部与国资委联合启动“2026年度人形机器人与具身智能实景实训专项行动”,要求到2026年底带动形成万台级规模落地能力。

据IT桔子统计,2026年上半年国内具身智能赛道融资总金额达935亿元,较2025上半年提升近5倍,融资事件322笔,同比增长137%。估值百亿元的独角兽企业从2025年的3家增至22家,资本涌入的速度和规模在近年来的科技赛道中处于高位。2026年上半年超过一半流向了具身智能通用大模型与算法企业,机器人本体厂商拿到的资金不到20%。

VLA(视觉-语言-动作模型)是当前具身智能领域企业普遍采用的主流方案,其核心是将机器人动作参数编码为文本特征,使之能够像自然语言词元一样加入模型训练。但VLA的能力边界正在显现——物理理解缺失、泛化能力弱、长时序规划不足等问题开始制约其表现。世界模型则聚焦于对现实世界规则的模拟预判,被视为远期通用智能的方向。在实际技术架构中,世界模型并非独立于VLA运行,而是作为核心模块嵌入VLA体系内部,但两条路线正在走向融合。

2026年被称为具身智能的“元年”。在刚刚结束的2026世界人工智能大会上,曾经占据C位的武术表演和舞蹈编排大幅减少,取而代之的是拆垛、上料、装配、巡检等作业场景。机器人咖啡馆、零售店、洗衣房等场景在展台上呈现,几十台人形机器人现场协同上岗。

这意味着,从“表演”到“作业”的转变已经发生,但距规模化商用仍有距离。当前行业出货集中在教育科研和数据采集等领域,这些仍是过渡性需求。数据瓶颈是最主要的制约——具身智能需要千万条级数据才能实现类似大模型的突破,但全球高质量数据总量仍然有限,同时具备大规模运营交付能力的团队极为稀缺。

万亿市场的大门已经打开,产业仍站在从技术验证迈向规模化商用的关口上。接下来考验行业的是数据积累的速度、模型泛化的突破和工程化交付的能力。

底部.png

评论 0