宇树科技(Unitree)宣布推出H2 Plus人形机器人,该产品被定位为NVIDIA Isaac GR00T参考平台,主要面向学术研究领域;具体技术参数与上市时间待核实。
根据公开元数据,宇树科技于2026年6月1日前后(待核实)发布了H2 Plus,这是一款以NVIDIA Isaac GR00T为底层框架的参考级人形机器人,目标用户为学术研究机构。消息来源为企业官方新闻页面。
宇树科技(Unitree)宣布推出H2 Plus人形机器人,该产品被定位为NVIDIA Isaac GR00T参考平台,主要面向学术研究领域;具体技术参数与上市时间待核实。
根据公开元数据,宇树科技于2026年6月1日前后(待核实)发布了H2 Plus,这是一款以NVIDIA Isaac GR00T为底层框架的参考级人形机器人,目标用户为学术研究机构。消息来源为企业官方新闻页面。
据新智元报道,AI在2026年5月至8月连续“攻入”多个长期未解的数学问题:推翻了埃尔德什单位距离猜想、给雅可比猜想在高维找到反例,并在第三方评测中达到“可发表”水平;但多位数学家认为,AI真正加速的是生成与验证证明,而人类的理解、解释和共同体传承仍是数学的核心,数学正在从“证明稀缺”走向“证明过剩”。
2026年5月,OpenAI一个尚未公开的内部模型推翻了埃尔德什1946年提出的单位距离猜想,该猜想悬置约80年,普林斯顿的Noga Alon称它“大概是离散几何里最有名的问题”。 2026年7月,Anthropic研究员Levent Alpöge发推称,Claude Fable找到了雅可比猜想(Jacobian conjecture)在高维的一个反例。…
Databricks 基于自身 3000 多名工程师的真实业务代码,覆盖三家主流云厂商和多种编程语言,对编码智能体进行了大规模基准测试。测试聚焦于模型在实际开发场景中的质量和成本,并评估了不同执行框架的差异。
Together Inference Engine 在编码智能体生产工作负载上,相比 TensorRT-LLM 实现了 31% 更高的 TPS,在饱和状态下 TTFT 提升 2 倍,且相比 Claude Opus 4.6 成本降低 76%(或相比 Claude Opus 4.8 每个请求节省 70%)。
传统推理基准测试通常测量单个用户访问专用端点,无法反映生产环境中多用户并发、共享 KV 缓存和 GPU 资源时的真实表现。本文旨在构建针对编码智能体工作负载的真实推理基准,重点评估高并发、长上下文场景下的性能退化曲线。
1X 宣布收购人形机器人初创公司 Kind Humanoid,双方团队将合并,加速开发能与人类共同生活、学习的安全人形机器人。
2025 年 1 月 27 日,人形机器人公司 1X 宣布收购 Kind Humanoid。Kind Humanoid 是一家位于加州帕洛阿尔托的初创公司,由前斯坦福科学家、谷歌机器人团队成员 Christoph Kohstall 创立,曾开发出用于家庭和医疗领域的双足人形机器人 Mona。1X 表示,此次收购将两支愿景一致的团队联合起来,共同推进人形机器…
待核实。根据标题推测,Figure 公司于2026年4月29日宣布其第三代人形机器人Figure 03进入量产爬坡阶段,但具体细节无法从当前元数据确认。
待核实。元数据仅显示新闻标题为“Ramping Figure 03 Production”,发布日期为2026年4月29日,属于行业(industry)与AI产业(ai-industry)主题。正文内容未被抓取,无法得知量产规模、时间表或技术细节。
π0.7 是 Physical Intelligence 发布的一个通用机器人基础模型,其在未经微调的情况下即可执行多种灵巧操作任务,并展现出**组合泛化**(compositional generalization)的初期迹象——能够将训练中学到的技能重新组合,解决完全未见过的任务(如使用新家电、在从未训练过的机器人上叠衣服)。
该模型于 2026 年 4 月 16 日发布。 核心问题:如何构建一个真正的通用机器人模型,使其具备类似大语言模型(LLM)那样的组合泛化能力——即在训练数据中从未直接出现的任务上,也能通过重组已有技能来解决问题。 此前机器人基础模型虽能理解语义概念,但通常需要对特定技能进行微调才能达到最佳性能;π0.7 尝试打破这一局限。
在Anthropic内部的一次“让Claude接管自家App日常维护”的实验中,AI生成了388个PR,其中180个被合并;人类工程师的主要工作不再是写代码,而是审查和决定是否合并。产业链上的瓶颈正从“写代码”转移到“审代码”。
Anthropic工程师Boris Cherny在X上公布了一个持续数周的“奇怪实验”:让Claude通过一个名为`proj-claude-maintains-apps`的Slack频道,每天自动维护Anthropic的App。实验覆盖iOS、Android、桌面端、Web、CLI和Agent SDK六类环境,每条线一个独立Routine,进展发到频道顶层…
ParseBench 是一个开源基准测试,包含约 2,000 页人工验证的企业文档及超过 167,000 条测试规则,用于从五个关键维度评估解析器性能,填补了 AI Agent 文档解析评测的空白。
LlamaIndex 于 2026 年 4 月 13 日发布 ParseBench,这是首个专门针对 AI Agent 的文档解析基准测试。它覆盖了约 2,000 页经过人工标注的企业文档,并包含超过 167,000 条测试规则,旨在系统性地衡量解析器在五个关键维度上的表现。
ParseBench 是一个开源基准测试,包含约 2,000 个人工验证的企业文档页面和超过 167,000 条测试规则,用于从五个关键维度评估文档解析器的性能。
LlamaIndex 于 2026 年 4 月 13 日发布 ParseBench,这是首个专门针对 AI 代理的文档解析基准测试。该基准旨在弥补现有文档解析评测的空白,为解析器在真实企业场景下的能力提供标准化评估。
人形机器人因 AI“大脑”的快速进步而迎来转折点,但真正的推理能力、数据获取限制以及行业炒作周期仍对规模化、有意义部署构成挑战。
2026 年 4 月 2 日,丰田研究所(TRI)首席执行官 Gill Pratt 在 IEEE Spectrum 发表文章,指出人形机器人正在经历一个关键的转折点——其“大脑”(AI 系统)正在追赶硬件发展。然而,他同时警告,当前仍面临真实推理能力不足、训练数据有限以及炒作周期等问题,阻碍了机器人实现可扩展且有意义的部署。
丰田汽车制造加拿大公司在成功试点后,与 Agility Robotics 签署了机器人即服务(RaaS)商业协议,计划在其工厂部署通用人形机器人 Digit,以支持制造、供应链和物流运营,提升员工体验和运营效率。
2026年2月19日,Agility Robotics 与丰田汽车制造加拿大公司(TMMC)联合宣布达成商业协议。此前 TMMC 已完成 Digit 试点,并决定采用机器人即服务(RaaS)模式正式部署该机器人。TMMC 是丰田在日本以外最大的制造基地,拥有安大略省剑桥和伍德斯托克的两家整车组装厂。双方将在部署之外继续评估更多使用场景,探讨利用机器人和人工…
Epoch AI 的“Trends in Artificial Intelligence”仪表盘显示,前沿 AI 模型能力自 2024 年初以来加速增长,模型能力指数(ECI)每年上升约 15.5 分(约等于 GPT-4 到 o1 的差距);自 2020 年以来,前沿语言模型训练算力每年增长约 5 倍,AI 芯片总计算能力每年增长约 3.4 倍。
该页面是 Epoch AI 维护的 AI 趋势与统计仪表盘,更新于 2026 年 2 月 5 日,旨在用可量化指标回答“AI 进展有多快”,以及算力、硬件性能、软件效率和投资如何共同驱动这一进展。
Figure AI于2026年1月27日发布了名为Helix 02的新产品,核心卖点为“全身自主性”,但具体技术细节与能力尚未能从原始材料中确认。
根据原始元数据,Figure AI在官网(www.figure.ai/news/helix-02)发布了关于Helix 02的公告,官方标题为“Introducing Helix 02: Full-Body Autonomy”。由于未能抓取正文,该产品的具体功能、发布时间背景、适用场景等信息均待核实。
Manus 发布致用户信,宣布恢复独立公司运营;此前 Meta 以 20 亿美元收购 Manus 的交易出现反转,为配合监管合规,用户需在 8 月 23 日前手动备份数据、8 月 25 日重新上传。
Manus 发布致用户信,宣布恢复独立公司运营。此前 2025 年 12 月底 Meta 以 20 亿美元收购 Manus 的交易出现反转。 为配合监管合规,收购当天(即 2025 年 12 月 29 日)之后产生的数据需要处理;用户须在 8 月 23 日前手动备份,8 月 25 日重新上传。官方以免单与回归大礼包作为补偿。 该交易因涉及公司控制权、数据处…
Mercado Libre与Agility Robotics达成商业协议,在德州配送中心部署Digit人形机器人,计划未来扩展至拉丁美洲,旨在缓解劳动力短缺、提高效率并改善员工安全。
2025年12月10日,拉丁美洲领先的电商与金融科技平台Mercado Libre(纳斯达克:MELI)与Agility Robotics(Digit人形机器人的开发商)宣布签署商业协议。Digit将首先部署在Mercado Libre位于德州圣安东尼奥的设施中,执行支持电商履约的任务。双方计划探索更多应用场景,并逐步将AI驱动的人形机器人扩展至Merca…
Physical Intelligence 开发了 **Recap**(基于优势条件策略的强化学习与纠正经验)方法,将模仿学习、专家纠正和强化学习结合,训练出 **π*0.6 模型**,使机器人能在真实世界中以高鲁棒性和高吞吐量完成制作浓缩咖啡、组装盒子和折叠衣物等复杂任务,在关键任务上吞吐量提升超过 2 倍、失败率降低 2 倍以上。
2025 年 11 月 17 日,Physical Intelligence 发布博客,介绍了其最新 VLA(视觉-语言-动作)模型 **π0.6** 以及用 **Recap** 方法进行强化学习训练后得到的 **π*0.6** 模型。该模型基于 5B 参数量的视觉-语言模型骨干,并新增动作专家模块(action expert)。通过在真实机器人上执行数小…
SIMA 2 是 Google DeepMind 基于 Gemini 模型构建的通用 AI 代理,能够理解自然语言指令、进行复杂推理、与用户对话,并在多种 3D 虚拟世界中通过自我改进不断进步,标志着从专用指令跟随者向通用具身智能体的重要跨越。
**发布时间**:2025 年 11 月 13 日(来源:官方博客) **研究问题**:如何让 AI 代理不仅能在虚拟环境中执行简单指令,还能像人类一样推理、协作并自主提升? **前代基础**:2024 年发布的 SIMA(Scalable Instructable Multiworld Agent)已能跟随超过 600 种语言指令(如“左转”“爬梯子”)…
Figure AI 于2025年10月9日正式发布了Figure 03,但其具体功能、技术规格和产业意义均待核实。
根据元数据,Figure AI 在2025年10月9日通过官方新闻页面(https://www.figure.ai/news/introducing-figure-03)宣布推出新一代产品或机器人“Figure 03”。由于原始正文未能抓取,详细内容需从其他渠道补全。
根据新闻标题,Aurora 公司在 2025 年 8 月 7 日宣布其无人驾驶卡车实现昼夜不间断运行,但提供的材料仅包含标题和日期,具体内容待核实。
**标题**:The Road Never Sleeps: Aurora’s Trucks Go Driverless Day and Night **发布日期**:2025 年 8 月 7 日 **发布方**:Aurora 公司(新闻栏目 “Progress”) 材料仅包含新闻列表页面的导航和类型筛选信息,未提供该新闻的正文内容,因此事件具体细节(如运行…