知识卡片:腾讯发布Hy-Embodied系列具身模型与智能体
英文标题:Tencent Releases Hy-Embodied Series of Embodied Models and Agents
英文关键词:Hy-Embodied; embodied intelligence; VLM; RxBrain; VLA; Apexio; TairosAgent
一句话结论
腾讯Robotics X实验室联合混元发布Hy-Embodied系列三个基座模型,首次系统性打通“感知—身体—行动”闭环,已在日化品工厂实测中实现作业成功率高于95%、节拍快于6秒每件,同步推出两个智能体并保持开源开放。
事件概述
2026年7月20日,腾讯Robotics X实验室与混元联合推出Hy-Embodied系列具身模型与智能体成果。该系列包含三个基座模型(VLM、RxBrain、VLA)和两个智能体(Apexio、TairosAgent),并同步升级了Tairos开放平台。模型已进入日化品工厂实测,展示出高成功率与快速节拍,标志着腾讯在具身智能领域的系统化突破。
方法/产品要点
- 三个基座模型:
- VLM模型:负责理解场景,提供视觉与语言理解能力。
- RxBrain:统一推理与想象,作为中间层协调高层认知与行动规划。
- VLA模型:连接身体输出动作,实现从感知到执行的闭环。
- 两个智能体:
- Apexio:具体功能未详细说明(待核实)。
- TairosAgent:基于Tairos开放平台,支持机器人任务执行。
- 平台与开源:Tairos开放平台全面升级,并保持开源开放策略。
主要结果或产业意义
- 在日化品工厂实测中,作业成功率 高于95%,每个作业节拍 快于6秒,证明模型具备高可靠性和效率。
- 首次系统性打通“感知—身体—行动”闭环,为具身智能从实验室走向工业场景提供了可复用的技术路径。
- 开源开放策略有助于降低行业研发门槛,推动具身智能生态发展。
为什么重要
- 弥补了具身智能领域“感知-行动”链路断裂的痛点:此前大多数模型分别优化感知或控制,腾讯Hy-Embodied首次将VLM、推理想象(RxBrain)和动作输出(VLA)整合为一个完整闭环。
- 工业落地验证:在真实工厂环境中达到95%以上成功率,说明该方案已具备实用价值,相比通用机器人研究更接近商业化。
- 与已有相关卡片的区别:与SIMA 2(虚拟世界通用代理)、Together Inference Engine(编码智能体推理优化)、Cursor Design Mode(UI修改代理)不同,本卡片聚焦物理世界具身模型与工业场景应用,提供了垂直领域的实证数据。
局限与不确定性
- 材料未披露模型的参数量、训练数据规模、具体架构细节,以及工厂实测的具体场景类型、样本量、持续时长(待核实)。
- 成功率95%+ 是否覆盖所有操作类型(如抓取、放置、装配等)未说明(待核实)。
- Apexio智能体的具体能力与用途未展开,TairosAgent的通用性边界未知(待核实)。
- 与同类具身模型(如谷歌RT-2、丰田Punyo等)的对比数据缺失(待核实)。
- 开源范围(模型权重、推理框架还是仅部分代码)未明确(待核实)。
可用于图书/PPT/简报的角度
- 标题建议:“腾讯Hy-Embodied:从实验室到工厂,具身智能的闭环打通”
- 数据亮点:成功率>95%、节拍<6秒/件,适合作为工业机器人效率提升的案例。
- 技术架构图:可绘制“VLM→RxBrain→VLA”三层架构图,突出感知、推理、动作的闭环。
- 产业影响:腾讯开源+实测的成功模式,可能加速日化、轻工业等领域的自动化部署。
- 对比视角:与Google SIMA 2(虚拟世界)对比,展示物理世界具身智能的落地难度与突破。
原始材料
- 来源:腾讯研究院AI速递 20260720(搜狐文章)
- URL:https://m.sohu.com/a/1052230396_455313?scm=10001.325_13-325_13.0.0-0-0-0-0.5_1334&digest_item=5
- 相关段落原文:
七、腾讯发布Hy-Embodied一系列具身模型与智能体成果
1.腾讯Robotics X实验室联合混元发布Hy-Embodied系列三个基座模型,首次系统性打通"感知—身体—行动"闭环;
2.VLM模型负责理解场景、RxBrain统一推理与想象、VLA连接身体输出动作,同步发布Apexio和TairosAgent两个智能体;
3.模型已进入日化品工厂实测,作业成功率高于95%、节拍快于6秒每件,Tairos开放平台全面升级并保持开源开放。