7 月 18 日,腾讯 Robotics X 实验室、福田实验室联合腾讯混元推出全套具身智能技术成果,包含三款具身基座模型、两套专属智能体,首次系统性打通感知、本体、行动完整技术闭环,推动 AI 摆脱纯线上离身智能局限,进化为能够和物理世界持续交互的具身原生智能,助力相关技术走出实验室落地实体生产力场景。
本次推出的三款基座模型均基于腾讯混元大模型训练,分工清晰形成完整认知执行体系。Hy-Embodied-VLM-1.0 承担视觉感知功能,如同机器人右脑,负责解析图像内容、识别空间方位、理解场景环境;Hy-Embodied-RxBrain-1.0 作为核心具身大脑,统筹环境认知、任务规划,同时预判动作执行后的未来场景状态;Hy-Embodied-VLA-0.5 衔接小脑与机器人本体,将高层文字指令拆解为连贯、支持实时纠错的实体动作。
配套同步发布持续在线具身智能体 Apexio、原生机器人开发框架 TairosAgent,依靠智能体调度能力整合三类基座模型与机器人硬件,构建一体化运行体系,让机器人实现不间断环境感知、动态决策、连续作业执行。
在 2026 WAIC 腾讯 AI 应用创新论坛上,腾讯首席科学家、两大实验室负责人张正友剖析当前通用大模型核心短板,现有 AI 即便拥有强大文本推理、内容生成能力,本质仍是脱离物理交互的 “缸中之脑”,无法真实理解物体空间位置、物件操作属性,也不能在动态变化的现实环境里边执行、边接收环境反馈、边自主修正动作。他提出,语言只是智能对外输出的载体,完整通用智能必须打通语言、视觉、空间认知、肢体控制、环境反馈的完整链路,依靠真实物理交互完成认知校验。本次发布的五项技术成果,正是腾讯围绕从离身智能转向具身原生智能、从碎片化模块走向一体化闭环的核心研发路线产出,补齐 AI 与真实世界交互的关键能力。