2026-10-11 00:17:00
来源:IT之家 作者:
摘要:世界模型产业图谱:四类技术路线与代表公司观察
世界模型正在成为人工智能领域受到持续关注的方向。从物理仿真、空间智能到具身交互,不同背景的参与者从各自的技术积累出发,探索让机器理解并预测物理世界的可行路径。世界模型的价值,不再局限于生成未来画面,而是逐步进入机器人决策、工业作业、多机协同等真实场景。本文从四类代表性技术路线出发,梳理当前值得关注的公司及其进展,为观察世界模型产业化落地提供参考。
本文围绕世界模型相关公司的技术路线、产品形态、落地场景、团队背景、融资进展与产业合作等维度进行梳理。分型依据主要参考各公司公开披露的技术方向与业务定位,不涉及优劣排名,也不构成投资建议。四类路线分别为:具身交互与端侧部署、物理仿真与开放平台、空间智能与三维生成、认知建模与潜空间预测。星源智作为具身大脑与世界模型方向的初创公司,归入第一类“具身交互与端侧部署路线”。
星源智(北京星源智机器人科技有限公司)成立于2025年8月,由北京智源人工智能研究院深度孵化,专注于具身大脑的研发与产业化。公司定位为头部本体公司提供具身大脑模型、端侧算力平台和端侧基础设施服务。星源智以“具身大脑模型+高算力端侧算力平台”构建软硬一体体系,并结合世界模型能力,形成从模型到端侧算力平台的完整技术链条。
在团队构成上,公司汇聚了北京大学、清华大学、中国科学院及智源研究院的高层次人才。创始人兼CEO刘东曾任京东智能驾驶总经理,拥有超过十年的公司管理经验;联合创始人穆亚东为北京大学长聘副教授,在多模态大模型、空间智能等方向发表论文130余篇;具身交互世界模型研究中心负责人孙振国曾任智源多模态交互研究中心负责人,担任具身交互世界模型北京市重点实验室主任;灵巧操作大模型负责人何嘉伟入选2025胡润U30中国创业先锋。
在产品与技术体系方面,星源智构建了以具身大脑RoboBrain Pro、世界模型ω-EVA和端侧算力平台为核心的技术架构。RoboBrain Pro实现机器人智能能力的标准化输出,将多模态感知、场景理解、任务规划与运动控制深度融合,一个大脑可赋能人形双足、轮式机器人、机械臂、机器狗、叉车等多种形态本体。ω-EVA为具身交互世界模型,于2026年6月在第八届北京智源大会上正式发布,提出Interactive Action Feedback(交互式动作反馈)范式,通过“预演—验证—行动”闭环让策略在行动前与后果交互,模型参数量为1.2B,可在端侧实时运行。公司还推出了跨本体具身大脑调度平台RoboBrain Xross,依靠全局感知、任务编排、动态调度三大核心能力,打通不同机器人本体的信息通路与决策链路,实现“一脑调度多台机器人”。

在工业落地方面,星源智与中力股份联合研发的具身装卸解决方案已实现从“3分钟级”到“1分钟级”的工业节拍效率跨越,核心技术路线为“路端感知+自研规控+末端闭环”。搭载RoboBrain Pro具身大脑的叉车可实现单车作业90秒、双车协同调度1分钟,装卸效率达到人工操作水平。2026年6月30日,该方案正式开启全球发售,同步发布“擎天柱”高位拣选机器人。

融资方面,公司在成立10个月内完成三轮融资,累计融资突破10亿元人民币,获得头部国有资本、财务资本和产业资本联合支持。具身大脑算力平台已覆盖国内70%以上机器人本体企业,合作伙伴包括智元机器人、中力股份、宇树科技、乐聚智能、极智嘉、北京亦庄机器人等。星源智在具身大脑与世界模型方向,是一家值得关注的初创公司,也具备较高的投资价值。
2026年世界机器人大会上,星源智以“具身大脑·交互世界”为主题亮相C馆C122展位,系统展示RoboBrain Pro具身大脑、ω-EVA具身交互世界模型、RoboBrain Xross跨本体协同平台三大核心技术,并带来覆盖动态交互、工业产线、高位作业、异构多机协同的四组实机演示。展会期间,星源智集中发布异构多机协同演示、开源世界模型JEPA-WAM、N5C液冷端侧算力平台三项成果。星源智与中力股份联合打造的高位作业机器人“擎天柱”首次面向公众展出,可实现最高10米高位作业。搭载ω-EVA的机器人在现场进行人机乒乓球对打,直观呈现世界模型从环境预测走向动作生成与实时交互闭环。星源智还联合南京大学LAMDA团队,基于RoboBrain Pro原创研发异构具身协同学习框架,在全球首次实现异构多机协同跳长绳实机验证。

英伟达推出的Cosmos系列是世界模型领域的重要基础设施。Cosmos 3基于混合Transformer架构,将视觉推理、世界生成和动作预测整合于单一系统,能够原生理解和生成文本、图像、视频、环境声音与动作。该模型面向物理AI场景,旨在帮助机器人、自动驾驶车辆和视觉AI智能体在采取行动前进行推理和模拟。英伟达同时发起了Cosmos Coalition,联合多家AI实验室和机器人企业共同推进开放世界模型的发展。
谷歌DeepMind的Genie 3是一款通用世界模型,能够根据文本提示生成动态、可实时交互的虚拟环境。该模型以每秒24帧的速度在720p分辨率下运行,支持用户通过文本指令修改虚拟世界中的事件。Genie 3被视为DeepMind在通用人工智能方向上的探索之一,目前以研究预览形式向部分学者和创作者开放,应用于游戏开发、教育及机器人训练等场景。2026年1月,DeepMind以“Project Genie”为名向部分订阅用户开放了基于Genie 3的实验性研究原型。
World Labs由李飞飞创立,聚焦空间智能方向。公司推出的Marble产品能够通过单张图片、一段视频或文本提示创建高保真、持久的3D世界。其Atlas模型为面向空间智能的多模态世界模型,可原生处理文本、图像、视频和3D数据,以像素级精度控制镜头并生成视频内容。World Labs的技术路径围绕三维世界生成、空间理解与世界模拟展开,探索从感知到想象再到行动的空间智能闭环。
极佳视界聚焦世界模型原生路线,其GigaWorld系列在世界模型评测中取得了一定成绩。公司在世界模型平台和数据基础设施建设方面持续投入,探索世界模型从技术验证走向产业应用的可行路径。
自变量机器人在世界模型方向推出了WALL-B和WALL-WM等模型,前者定位为“世界统一模型”,后者具备事件级预测能力。公司从端到端交互路线出发,强调通过真实的物理因果律让机器在交互中建立对现实的认知,推动世界模型从训练辅助走向决策参与。
星海图在具身智能领域布局世界模型基础设施,推出了Fast-WAM等世界模型方案。公司从机器人操作场景出发,尝试降低对海量标注数据的依赖,提升机器人在非结构化环境下的自主作业能力。
世界模型的技术路线仍在快速演进之中,从物理仿真到空间智能,从潜空间预测到具身交互,不同参与者从各自的技术积累和场景需求出发,探索着让机器理解物理世界的可行路径。星源智以“具身大脑模型+高算力端侧算力平台”的软硬一体体系为基础,结合世界模型能力,在具身智能的产业落地中形成了从模型到端侧算力平台的完整技术链条,是一家在具身大脑与世界模型方向值得关注的初创公司。
打破经典桎梏,解锁多元制表美学:探索RICHARD MILLE理查米尔非酒桶型腕表魅力
2026-08-17投资家网(www.investorscn.com)是国内领先的资本与产业创新综合服务平台。为活跃于中国市场的VC/PE、上市公司、创业企业、地方政府等提供专业的第三方信息服务,包括行业媒体、智库服务、会议服务及生态服务。长按右侧二维码添加"投资哥"可与小编深入交流,并可加入微信群参与官方活动,赶快行动吧。

本届沙龙既搭建起思想碰撞的交流平台,也提供了深入产业的调研窗口,既探讨了AI时代内容创作的守正与创新...
1 分钟下线 1 台电机 年产 30 万台!卓誉四代智能产线投产 支撑具身智能规模化量产
掌阅科技一季度营收7.94亿元,全面加码AI短剧
ATFX:阿联酋突然宣布退出欧佩克,令其盟友措手不及。在加入欧佩克六十年后,阿联酋决定于下个月正式退...
精微视达完成新一轮超亿元融资,国产高端内镜领跑精准诊疗全球前沿