世界模型吸走百亿资金,魔芯科技如何让AI“预测下一个世界”
用户上传一张普通街景照片,几分钟后,一个完整的3D世界就能在屏幕中自由旋转、漫步,每栋建筑的轮廓、每扇窗户的位置、每条街道的走向都清晰可辨。这不是科幻电影的桥段,而是魔芯科技最新发布的MoWorld世界模型正在实现的事情。
魔芯科技创始人兼CEO陈天润,这位出生于2000年、师从潘云鹤院士的浙大直博生,正在带领一支平均年龄不到30岁的团队,试图重新定义物理AI的基础设施。


过去两年,大语言模型让机器学会了对话。而魔芯科技正在做的事情更进了一步:给AI当前的场景和某种扰动条件,让它推演出下一秒这个世界会变成什么样。
陈天润表示:“我们在做世界模型的时候,是在让AI理解3D世界。让AI学习它所在的环境,甚至让模型去预测下一个世界的状态。这个通常只有所谓‘第六感’或者人类依靠经验形成的‘直觉’才能做到。现在我们发现,通过得当的训练,AI也能够学到这样的预测能力。”
以机器人倒茶为例,这个动作看似简单,但涉及对杯子惯性、桌面摩擦、机械臂关节扭矩等多重物理变量的实时响应,工程师需要为每一种可能的场景编写繁复的规则和参数。而世界模型尝试提出一种新的路径:让机器人先在大脑中模拟出整个过程中世界状态的连续变化,再反向推导出完成这一变化所需的最优动作。
2026年,“世界模型”无疑是人工智能领域最炙手可热的方向。知名科学家悉数下场,李飞飞创办World Labs,图灵奖得主杨立昆创立AMI Labs;截至7月,中国已有30余家以“世界模型”为核心概念的创业公司,累计融资超过260亿元人民币。在一片热潮中,一家中国年轻公司试图给出自己的答案。
7月7日,魔芯科技正式发布了“国产自研超高帧率交互式世界模型”产品MoWorld,它能在纯国产华为昇腾NPU平台上实现最高50FPS的实时交互推理,而目前主流世界模型的帧率普遍在30帧以下。
为什么帧率如此重要?“速度对于世界模型驱动的各类决策系统至关重要,不管是实时机器人控制还是导航,都需要世界模型高效响应。”陈天润解释。在他看来,帧率低于30FPS,沉浸感就会被打破,“高帧率才能保持世界模型在真实场景中可用”,这被他总结为“Flash World Model”的核心概念。
MoWorld更大的突破,在于它证明了国产算力可以独立支撑大规模世界模型的训练与实时部署。
当全球同行还在围绕英伟达GPU构建算力体系时,魔芯科技选择了全栈国产NPU。从数据构建、模型训练、蒸馏优化到实时推理部署,每一个环节都围绕华为昇腾平台原生重构。
“魔芯和华为团队共同进行了极致优化,”陈天润说。双方在高效融合算子研发上深度协作,系统性优化多卡通信性能瓶颈。在华为昇腾平台上,一个14B参数的MoE世界模型实现了最高超过50FPS的实时推理速度。
更关键的是成本。“我们能够以同行30%的成本去提供同样的服务。”陈天润说。这意味着MoWorld在保持大模型生成质量的同时,推理成本比同规模GPU方案降低了70%。“这让世界模型首次具备了规模化落地的经济可行性。”
陈天润透露,魔芯科技正与华为进一步深化合作。“不仅推动模型本身的进展,也在推动整个国产算力的生态建设。”
7月16号,在杭州滨江的国家人工智能应用中试基地(具身智能)发布会上,MoWorld 3D正式宣布上线华为云,成为面向全行业开放的世界模型基础设施。MoWorld 3D的核心技术突破在于“空间建模”,不只是让机器理解平面画面,而是理解画面背后的三维空间中每一个要素的坐标、尺寸和运动演化。

“过去我们要得到一个三维空间的测量,如果用传统方法去建模,至少需要几天甚至数周的时间,”陈天润说,“现在我们用世界模型的手段,能够在几分钟之内得到一个完整的三维空间。”
他用一个具体的案例来说明:“我们能做到把一个真实环境用三张照片变成一个3D场景,甚至达到360度环绕。”这意味着过去需要用专业传感器设备才能完成的工作,现在用普通照片就能实现。
“在实现同样效果的基础上,相较传统方案成本差距可达20倍。”陈天润说。
从技术参数来看,MoWorld可维持约2分钟的长时序连续生成,并在生成过程中保持较稳定的场景一致性,支持1080P全高清实时交互,并实现6自由度精确相机控制。用户在虚拟场景中自由走动、转身、返回,所有物体的空间关系和视觉细节始终保持一致,这一表现已在场景稳定性上超越部分海外公开方案。
技术突破之后,更大的命题是产业化。魔芯科技是目前世界模型赛道上少数已经实现商业化落地的团队之一。
“公司已与部分具身智能企业开展合作。”陈天润介绍,“还有很多需求是我们跟客户共创的成果。比如一些数字工厂,还有一些3D空间地面要素的测量。”
陈天润透露,目前魔芯已经在影视制作、具身智能、自动驾驶等领域同步推进落地。“在街道重建场景中,过去需要大量人力对一个街区反复航拍、渲染,效果不佳还得推倒重来,而MoWorld可以在同等效率下完成可用级别的三维重建。”
陈天润表示:“从去年到今年,魔芯的模型尺寸从几B增长到了14B,精度呈稳定提升。明年可能会做一个二十多B的模型。”
“从早期做3D物体的建模,包括3D打印大批量的终端应用,我们积累了很多3D资产。”陈天润介绍,“我们正在逐渐把那些分散的资产组装成完整的4D场景。另外,在过去这些年当中,我们开发了很多创作3D模型的工具,这些工具本身让生产数据的速度更快。”
这意味着魔芯构建了一条从数据生产工具到数据资产到模型训练到实时推理的完整自循环链条,这在3D数据仍属稀缺资源的今天,构成了一个难以被快速复制的竞争壁垒。
截止到目前为止,魔芯科技已累计完成近10亿元融资,获得国家级战略储备资本、知名美元机构、头部市场化基金及包括华为哈勃在内的十余家产业资本支持,即将正式启动资本市场进程,向着更高阶的产业发展目标迈进。
在巨头林立的赛道上,陈天润不觉得年轻是劣势。
他说,“虽然大模型是个非常复杂的系统工程,但它会因为几个人的想法或者几行代码产生决定性变化。”
他提到一个观察:年轻的伙伴们亲手把模型训练出来、调出来、部署到线上。“我们更真切地了解背后的原理、机制到底是什么。”
“我们面对的是一个全新的行业,很多过去的经验在现在这个充满变革的时代可能不适用了。”陈天润说,“年轻人更能用更敏锐的、更激进的方式去抓住新的机会。”
他把这归结为一种“冒险精神”。“我们虽然路很长,但还是愿意去做一些充满冒险精神的事情。”
当被问到世界模型什么时候会迎来自己的“ChatGPT时刻”,陈天润给出了一个明确的时间预期。
“我觉得可能两年到三年就会完成。看谁做得快,我希望是魔芯。”
他描绘了那个时刻到来后的图景:在真实世界中,AI能实现完全的L4自动驾驶,能在家庭中完成泛化的物理操作,成为每个人的“个人物理助理”。在虚拟世界中,数字内容的创作将被深刻改变,不再需要实拍,真正的自由创作将成为可能。
回到校园时的初心,他这样总结:“我希望我的发明创造和想法能让更多人的生活和工作得到改变,把我的价值观传递给大家。”
五年后,他希望人们提起魔芯科技时想到的是——“3D世界模型的ChatGPT时刻””。从滨江的国家人工智能应用中试基地到上海世博展览馆的WAIC展台,从一张照片到几分钟内生成一个完整的3D世界,魔芯科技正在把这个时刻加速拉近。
当那个时刻到来时,魔芯科技可能正是创造者之一。
