6 月 13 日,第十二届中国(上海)国际技术进出口交易会圆满落幕,全栈具身智能企业魔法原子携全套自研技术矩阵亮相展会,国内首次公开展示两大核心底座模型 ——Magic-VLA K02 具身大模型、Magic-Mix 世界模型,同步展出 MagicBot Gen1 人形机器人、Z1 双足机器人、MagicDog 四足机器狗、商用咖啡机器人等全系列整机,覆盖工业、商业、家庭多场景,标志企业全栈自研技术体系完成整体升级。
展会现场真机演示直观验证双模型协同能力,搭载两套模型的机器人稳定完成叠衣物、折叠纸盒两大行业公认高难度长时序任务。面对观众随意挪动物件、改变现场光照等动态干扰,机器人可实时感知环境变化、自主调整操作策略,闭环完成完整任务。其中柔性衣物折叠难点在于布料形变无固定规律,对动态物理感知、实时纠错、柔顺力控要求极高;纸盒折叠属于多步骤精密工序,微小动作误差会随流程持续放大,极易任务失败,两大任务综合考验模型环境理解、长时序规划、动态自适应三大核心能力。
Magic-Mix 内置 WAM 环境解析引擎与 Creator 数据生成双引擎,一方面能够深度解析复杂非结构化真实环境,建立完整物理因果认知;另一方面可自主生成百万小时级高质量仿真训练数据,数据产出效率提升万倍,破解行业真机采集成本高、优质数据供给不足、模型迭代缓慢的核心痛点,为长时序复杂作业、跨场景泛化筑牢数据与感知底层支撑。
区别于传统线性指令驱动的 VLA 模型,Magic-VLA K02 专为长周期复杂任务打造分层解耦双中枢架构,规划、执行分层协同,彻底打破 “指令直接映射动作” 的能力上限,让机器人读懂任务逻辑、自主规划调整,完成从机械执行到自主理解的质变。
高层宏观规划中枢依托理解 - 生成一体化模型,把用户模糊全局目标拆解为带目标特征的精细化原子任务;搭载动态记忆更新机制,全程记录任务进度,实时修正规划路径,规避长流程下遗忘目标、路径固化等问题。
低层动作执行中枢融合 VLM 主干网络与动态专家模块,借助未来状态潜空间预测预判环境变化,搭配扩散动作生成输出平滑连续、低抖动操作,保障各类精细抓取、折叠工序精准落地。
依托双层协同架构,Magic-VLA K02 具备四大核心优势:
长程任务可控性强:动态记忆持续更新任务进度,解决传统模型长流程失效、路径僵化问题;
零样本组合泛化:依靠原子动作自由重组,无需专项示范数据即可适配全新复合任务;
全域跨本体兼容:创新元数据描述体系,无缝适配机械臂、人形、四足等各类机器人硬件;
高容错落地稳定性:分层约束 + 自适应容错算法,抓取失败、环境突变可自动重试调整,大幅降低真机微调数据需求。
模型采用 “海量第一视角人类视频预训练 + 少量真机示范对齐” 四阶段分层训练方案,搭配 “认知 - 执行 - 适配” 三阶推理流程,平衡超大模型算力消耗与终端实时响应需求,兼顾理论性能与工程落地实用性。
魔法原子已打通核心零部件、机器人本体、具身 VLA 大模型、世界模型、数据生成工具完整全栈链路,本次双模型线下真机落地演示,充分验证 “本体 + 模型 + 数据” 一体化技术路线成熟度。后续企业将持续加码基础大模型、世界模型研发,持续优化机器人通用作业能力,面向工业制造、商业服务、家庭陪护输出高稳定、可规模化复制的软硬件一体化解决方案,加速具身智能从实验室技术走向真实产业场景。