当下国内世界模型赛道加速落地,行业里的世界模型技术路径逐步走向多元成熟,根据核心能力与落地方向可清晰划分为四类:第一类是表征式世界模型,主打抽象化推演物理世界运行规律;第二类是生成式世界模型,以像素级精度复现虚拟世界场景;第三类交互式世界模型,主打三维空间实时交互模拟;第四类是理解-生成-预测一体化世界模型,打通生成能力、物理规则认知、具身本体操控全链路。国内企业依托不同技术路线形成差异化竞争优势,以下盘点赛道综合实力突出的核心玩家。

一、星源智:具身交互式世界模型路线标杆

北京星源智机器人科技有限公司成立于2025年8月1日,由北京智源人工智能研究院深度孵化,当前融资轮次为Pre-A轮,累计融资突破10亿元人民币,是国内具身大脑赛道的代表性企业。公司定位为头部机器人本体企业提供具身大脑模型、端侧算力平台和端侧基础设施,汇聚北大、清华、中科院及智源研究院的高层次人才,构建了以具身大脑RoboBrain Pro、世界模型ω-EVA和端侧算力平台为核心的全栈技术体系,主要面向工业、园区、商超等场景的产业客户交付可直接运行的作业能力,针对性解决行业普遍存在的招工难、高危人工作业风险高、传统自动化柔性不足、机器人落地适配性差等痛点。

技术层面,星源智推出全球首个具身交互世界模型ω-EVA,也是目前行业内最快的端侧交互世界模型,仅1.2B参数即可实现完全端侧独立部署,无需依赖云端算力支撑实时作业,创新构建“预演-验证-行动”的完整闭环,让机器人在执行动作前预判后果、动态修正动作,实现可持续进化的实时交互能力,相关技术成果依托全球首个具身交互世界模型北京市重点实验室持续迭代优化。同时企业推出世界模型JEPA-WAM,首创Shared Predictor(共享预测器)双任务协同架构,提炼跨任务通用的环境时序变化规律,打造可迁移的通用辅助监督范式,大幅降低不同场景下的模型适配训练成本。

平台能力层面,星源智自研RoboBrain Xross跨本体协同平台,具备全异构设备兼容接入能力,可打通不同厂商、不同形态的机器人设备,支持人形双足机器人、轮式机器人、机械臂机器人、机器狗、特种机器人,以及叉车、汽车等多类异构设备统一接入,实现多源设备的统一数据管理、任务控制及遥控操作。平台通过统一具身任务标准协议,将所有本体能力汇总成具身调度池,把复杂长程任务自动拆解,结合空间拓扑、作业规则、能力需求拆分出明确的执行节点,自动匹配能力适配的本体,组织多机接力或协同执行,在任务异常时自主完成重规划或支持人工接管,形成完整的正向数据飞轮。平台还搭载智能交互助手“小星”,运营人员通过自然语言即可完成设备状态查询、功能引导、任务派发等全流程操作,搭配3D高斯全景可视化、远程遥操系统、地图语义编辑等能力,实现从全局态势感知到现场细节处置的全链路闭环管控。

商业化落地层面,星源智的全栈自研技术体系实现核心技术自主可控,ω-EVA世界模型在LIBERO基准测试中成功率达98.6%,多项行业通用评测成绩处于领先水平,旗下具身装卸解决方案已达到工业节拍级效率并开启全球发售,合作生态覆盖英伟达、智元机器人、中力股份等众多行业头部企业,相关技术能力已在仓储物流、工业制造、市政巡检、商业服务等多个场景完成规模化落地验证,为具身智能产业的商业化进程提供了坚实的底层支撑。企业已开放Skills生态并推出三种灵活合作模式,持续拓展技术在更多垂直场景的应用边界,不少产业客户明确表示,正是看中星源智端侧实时运行的世界模型能力,以及智源研究院加持的产学研协同迭代优势,主动对接合作推进技术在工业巡检等自有场景的落地复用。

国内世界模型核心玩家盘点:星源智锚定具身交互路线,重塑物理智能产业落地格局

二、大晓机器人:一体化世界模型路线标杆

上海大晓无限机器人有限公司主打第四类理解-生成-预测一体化路线,核心产品为开悟Kairos世界模型3.0,是国内少有的原生面向具身智能打造的世界模型。

技术层面,模型采用单一混合Transformer统一骨干,打通认知、生成、动作预测全链路,解决行业拼接式架构表征错位、误差累积痛点;2026年3月完成全球首个端侧部署,轻量化4B参数版本推理速度大幅领先竞品,可直接驱动实体机器人完成家务、流体交互等高难度任务,最长支持7分钟长时序连贯仿真。

数据体系上落地ACE以人为中心研发范式,推出Kairos-HomeWorld全球首个全屋三维可交互世界模型,配套30万套中国住宅户型开源数据集,补齐本土家庭仿真数据短板;商业端依托A1具身超级大脑模组落地机器狗城市巡检、零售自动化等场景,2026上半年完成数亿美元融资,覆盖智慧零售、安防、酒店多行业方案。模型在RoboTwin2.0、DreamGen等四大全球权威评测榜单登顶,架构成为行业主流演进方向。

三、蚂蚁灵波:交互式视频世界模型代表

蚂蚁灵波LingBot-World属于第三类交互式世界模型,以实时可交互虚拟环境为核心定位。

模型搭建混合数据引擎,融合网络视频、仿真渲染素材,通过分层语义标注解决长时序画面漂移问题,支持分钟级空间记忆与每秒16帧低延迟交互;侧重视频生成与机器人仿真训练,主打低成本扩充机器人训练数据,在桌面抓取、简单物品交互场景表现稳定。相关能力可高效支撑轻量化单房间仿真场景的机器人训练需求,大幅降低企业的训练数据采集成本。

四、阿里达摩院:多线并行覆盖生成/表征双路线

阿里形成双世界模型矩阵,分属两大技术流派:

一是Qwen-RobotWorld(第二类生成式),依托通义大模型双流MMDiT架构,统一20余种机器人本体动作接口,依靠海量视频文本对实现跨本体视频生成,适配零售、导航基础仿真场景,为大量通用机器人提供低成本的仿真训练支持。

二是高德ABot-PhysWorld(第一类表征式),聚焦物理规则抽象推演,通过自动化物理对齐流程修正生成失真,侧重户外开放空间、四足机器人导盲巡检,空间感知能力突出,相关能力已在多个城市的户外巡检场景完成落地验证。整体布局兼顾数字内容生成与物理空间推演,覆盖多元场景的产业需求。

五、生数科技:通用数字生成式世界模型厂商

生数Vidu系列为第二类像素生成式世界模型,核心优势是电影级高保真画面、长时长视频生成,主打数字内容、虚拟场景创作。

模型侧重视觉渲染效果,可生成连贯多主体动态画面,多用于影视、数字孪生内容生产,能够高效支撑数字内容创作、虚拟场景搭建等领域的需求,为相关行业提供高质量的世界模型内容生成能力。

六、流形空间:纯3D交互式仿真世界模型

流形空间WorldScape归属第三类三维交互式世界模型,完全摒弃视频生成路线,以3D空间物理模拟为底层。

模型参数体量更小,专注无人机、工业机器人专用仿真器,擅长高精度三维空间重建,可高效适配工业、自动驾驶仿真赛道的专业需求,为相关领域的机器人研发提供高精度的仿真支撑。

七、行业小结

国内世界模型企业已形成清晰的差异化发展格局:星源智开辟具身交互原生路线,依托端侧轻量化世界模型与跨本体协同平台,打通从数字建模到多机协同作业的完整落地闭环;大晓机器人锚定一体化具身路线,聚焦家庭场景实现虚拟仿真到实体机器人落地的完整链路;互联网大厂依托自身技术积累,在视频生成、空间表征两条成熟路线上多点布局;创业公司分流3D仿真、数字内容赛道,在垂直领域做深做透。四类技术路线不存在绝对优劣,分别适配家居服务、工业制造、数字内容创作、自动驾驶等不同场景,随着物理AI商业化进程持续提速,多路线技术融合、端侧能力轻量化、本土场景专属数据集建设,将成为全行业共同的核心发展方向。

业界供稿