AI消息速览

腾讯发布Hy-Embodied系列具身模型与智能体

事件日期 2026-07-20 · 产业观察 · 已接受

事件日期2026-07-20
信息日期2026-07-20
入库日期2026-07-20
通道产业观察
状态已接受
来源腾讯研究院(搜狐同步)

知识卡片:腾讯发布Hy-Embodied系列具身模型与智能体

英文标题:Tencent Releases Hy-Embodied Series of Embodied Models and Agents
英文关键词:Hy-Embodied; embodied intelligence; VLM; RxBrain; VLA; Apexio; TairosAgent

一句话结论

腾讯Robotics X实验室联合混元发布Hy-Embodied系列三个基座模型,首次系统性打通“感知—身体—行动”闭环,已在日化品工厂实测中实现作业成功率高于95%、节拍快于6秒每件,同步推出两个智能体并保持开源开放。

事件概述

2026年7月20日,腾讯Robotics X实验室与混元联合推出Hy-Embodied系列具身模型与智能体成果。该系列包含三个基座模型(VLM、RxBrain、VLA)和两个智能体(Apexio、TairosAgent),并同步升级了Tairos开放平台。模型已进入日化品工厂实测,展示出高成功率与快速节拍,标志着腾讯在具身智能领域的系统化突破。

方法/产品要点

  • 三个基座模型
    • VLM模型:负责理解场景,提供视觉与语言理解能力。
    • RxBrain:统一推理与想象,作为中间层协调高层认知与行动规划。
    • VLA模型:连接身体输出动作,实现从感知到执行的闭环。
  • 两个智能体
    • Apexio:具体功能未详细说明(待核实)。
    • TairosAgent:基于Tairos开放平台,支持机器人任务执行。
  • 平台与开源:Tairos开放平台全面升级,并保持开源开放策略。

主要结果或产业意义

  • 在日化品工厂实测中,作业成功率 高于95%,每个作业节拍 快于6秒,证明模型具备高可靠性和效率。
  • 首次系统性打通“感知—身体—行动”闭环,为具身智能从实验室走向工业场景提供了可复用的技术路径。
  • 开源开放策略有助于降低行业研发门槛,推动具身智能生态发展。

为什么重要

  • 弥补了具身智能领域“感知-行动”链路断裂的痛点:此前大多数模型分别优化感知或控制,腾讯Hy-Embodied首次将VLM、推理想象(RxBrain)和动作输出(VLA)整合为一个完整闭环。
  • 工业落地验证:在真实工厂环境中达到95%以上成功率,说明该方案已具备实用价值,相比通用机器人研究更接近商业化。
  • 与已有相关卡片的区别:与SIMA 2(虚拟世界通用代理)、Together Inference Engine(编码智能体推理优化)、Cursor Design Mode(UI修改代理)不同,本卡片聚焦物理世界具身模型与工业场景应用,提供了垂直领域的实证数据。

局限与不确定性

  • 材料未披露模型的参数量、训练数据规模、具体架构细节,以及工厂实测的具体场景类型、样本量、持续时长(待核实)。
  • 成功率95%+ 是否覆盖所有操作类型(如抓取、放置、装配等)未说明(待核实)。
  • Apexio智能体的具体能力与用途未展开,TairosAgent的通用性边界未知(待核实)。
  • 与同类具身模型(如谷歌RT-2、丰田Punyo等)的对比数据缺失(待核实)。
  • 开源范围(模型权重、推理框架还是仅部分代码)未明确(待核实)。

可用于图书/PPT/简报的角度

  • 标题建议:“腾讯Hy-Embodied:从实验室到工厂,具身智能的闭环打通”
  • 数据亮点:成功率>95%、节拍<6秒/件,适合作为工业机器人效率提升的案例。
  • 技术架构图:可绘制“VLM→RxBrain→VLA”三层架构图,突出感知、推理、动作的闭环。
  • 产业影响:腾讯开源+实测的成功模式,可能加速日化、轻工业等领域的自动化部署。
  • 对比视角:与Google SIMA 2(虚拟世界)对比,展示物理世界具身智能的落地难度与突破。

原始材料

  • 来源:腾讯研究院AI速递 20260720(搜狐文章)
  • URL:https://m.sohu.com/a/1052230396_455313?scm=10001.325_13-325_13.0.0-0-0-0-0.5_1334&digest_item=5
  • 相关段落原文:

    七、腾讯发布Hy-Embodied一系列具身模型与智能体成果
    1.腾讯Robotics X实验室联合混元发布Hy-Embodied系列三个基座模型,首次系统性打通"感知—身体—行动"闭环;
    2.VLM模型负责理解场景、RxBrain统一推理与想象、VLA连接身体输出动作,同步发布Apexio和TairosAgent两个智能体;
    3.模型已进入日化品工厂实测,作业成功率高于95%、节拍快于6秒每件,Tairos开放平台全面升级并保持开源开放。