AI消息速览

知识卡片

按事件日期排列,包含已接受、待审核和稍后处理的卡片。待审核内容仅供参考。

显示第 261-280 条,共 2259 条
第 14 / 113 页
事件日期 2026-08-28

该综述认为,2025–2026年的神经网络优化已不能简单描述为“新Adam变体的序列”;矩阵感知(matrix-aware)优化器是真实进展,但不存在独立于具体情境的AdamW替代品。

本文是arXiv上的一篇博客式综述(作者Ruoran Xu,2026-08-28发布,分类cs.LG/cs.AI),试图为近期优化器与训练优化方法提供一个系统化视角。它提出四个大致独立的设计轴:时间估计、更新几何、时间跨度管理、表示与系统;并认为优化器设计已从坐标级更新规则扩展到矩阵/层/系统层面,同时优化器状态表示需兼容分片(sharding)与低精度计…

学术前沿 · 原始来源:arXiv 论文 · foundation-model
事件日期 2026-08-28

大语言模型在面对“同一事实存在多个版本”的长尾分歧知识时,往往只回忆起其中一个版本;ElephantBench 上性能最强的模型也仅在 52.4% 的问题中同时恢复两个版本,说明参数化记忆存在明显的认知短视。

标准事实问答通常假设每个问题只有一个标准答案,这会掩盖模型是否真正记住了长尾事实中的分歧性叙述。为了弥补这一空白,论文提出 ElephantBench,一个闭卷(closed-book)知识探针,用来检验 LLM 是否保留同一事实的不同版本。

学术前沿 · 原始来源:arXiv 论文 · foundation-model
事件日期 2026-08-28

本文提出一种基于 nnU-Net 家族、结合解剖(器官)监督与在线交互式涂鸦提示的全身病灶分割模型,用于 FDG 和 PSMA PET/CT,在 AUTOPET V 挑战中通过四折交叉验证取得稳定最优性能。

面向 AUTOPET V 挑战,解决 FDG 与 PSMA PET/CT 全身病灶分割问题。 核心难点:示踪剂类型(FDG 或 PSMA)在推理时未知;生理性摄取会造成假阳性;单一模型难以同时泛化两种示踪剂。 提出两阶段训练策略:预训练获得强初始分割,在线交互阶段学习利用涂鸦(scribble)提示逐步细化预测。

学术前沿 · 原始来源:arXiv 论文 · foundation-model
事件日期 2026-08-28

Aero Hand Open 是一款开源的腱驱动拟人灵巧手,随附仿真模型、双向驱动映射和强化学习训练包,作者宣称可以让策略完全在仿真中训练后直接部署到实体手,无需微调或状态估计。

腱驱动手通过将驱动器移出关节来降低成本:缆绳传动使电机不必安装在关节内部,因此更小更便宜的电机即可满足要求;同时一个电机可以通过一根缆绳驱动多个关节,从而减少电机数量。但这种欠驱动传动也带来学习困难:产生上述成本优势的传动结构本身难以在仿真器中表示,而且一根缆绳驱动的多个关节无法独立控制。本文提出 Aero Hand Open,作为仿真就绪的腱驱动手平台,…

学术前沿 · 原始来源:arXiv 论文 · foundation-model
事件日期 2026-08-28

本研究对 scikit-rebate 包进行重构、优化与扩展,加入 SWRF*、mu-Relief 及 5 种新 Relief 变体,并在模拟基因组数据上比较发现:除 mu-Relief 外,多数 RBA 能有效检测噪声数据中的二阶交互;采用“far”评分的变体(尤其 MultiSWRFDB*)最擅长检测二阶交互但对主效应不敏感;综合主效应与二/三阶交互,…

研究问题:高维生物医学数据建模前,特征选择至关重要。多数过滤式特征选择方法难以检测特征交互,而包装式或嵌入式方法计算昂贵。Relief-based algorithms(RBAs)作为过滤方法,既能感知特征交互,又相对高效,但已有实现和比较仍不充分。 本文做了两件事:(1) 重构、优化并扩展 scikit-rebate Python 包,纳入已有和新提出的…

学术前沿 · 原始来源:arXiv 论文 · foundation-model
事件日期 2026-08-28

AcrossVAM1.0 是一个 0.28M 参数的轻量级文本辅助视频动作模型,通过将未来预测分解为“语义粒子运动 + 稠密外观生成”来预测机器人未来 5 帧;在自建 VRS 基准上,粒子动力学使轨迹误差比“持续最后一帧”基线降低 21.0%,但语言指令的影响仍较弱(正确 vs 打乱语言仅带来 2.8–3.1% 的轨迹误差变化),外观交付也尚未在 LPIP…

研究问题:机器人视频预测既需要精确的运动推理,又需要保持高频外观;传统整体式像素模型把这两个目标纠缠在一起,且容易被“直接复制最后一帧”这类强基线掩盖其真实进展。 核心思路:将未来预测解耦为“以物体为中心的粒子运动”和“稠密外观生成”两条路径,而不是用一个单体像素生成模型同时完成两个目标。 数据与基准:使用作者自建的 VRS benchmark,由多种真实…

学术前沿 · 原始来源:arXiv 论文 · foundation-model
事件日期 2026-08-28

听者无法仅从话语形式(utterance form)完全恢复说话者的意图;无论使用多少文本数据、多少监督信号,任何文本表示(包括当代大语言模型的隐藏状态)在解码意图时都会受到形式对意义内在不确定性的上界限制。

这篇论文用一个信息论框架回答了一个经典问题:一个听者能否仅凭话语的形式本身,就确定说话者想表达的意义?作者将语言使用建模为“意义—语境—话语”的联合分布,并从理论上推导出:从话语表征中恢复说话者意图的成功概率存在上界。该上界适用于任意文本特征化器(featurizer),因此也适用于大语言模型。

学术前沿 · 原始来源:arXiv 论文 · foundation-model
事件日期 2026-08-27

按该速递摘要,Anthropic 应用 AI 团队发布《AI Native SDLC Playbook》,认为 AI 让写代码变快后,真正的“新卡点”是评审、测试、发布等上下游流程仍停留在人工速度;解法是把单向开发流水线改成循环 Loop,并用版本化产物让 AI 与人可接续、可审计地协作。

该手册的研究对象是:当 AI 已经能快速生成代码时,为什么端到端软件开发没有同样变快?材料给出的判断是:编码环节已提速,但规划、设计、构建、部署、维护等阶段之间的交接仍按人工速度运行,尤其是评审、测试、发布等环节。手册因此提出从“单向流水线”转向“循环 Loop”的 AI Native 软件开发组织方式。

产业观察 · 原始来源:腾讯研究院(搜狐同步) · benchmark-evaluation, agent
事件日期 2026-08-27

Pavo 上线 Agnes Video 2.5 系列,其中 Flash 型号完全免费,并配套短剧 Harness 与无限画布,推动 AI 视频生成从单镜头生成走向多集短剧的连续化制作工作流。

本条来自“腾讯研究院AI速递 20260827”,介绍 Pavo 平台上线 Agnes Video 2.5 系列。除免费 Flash 档位外,还发布了面向短剧制作的配套工具 Harness 和无限画布,重点解决连续剧情中的角色场景一致性、资产复用与难镜头控制问题。

产业观察 · 原始来源:腾讯研究院(搜狐同步) · ai-industry
事件日期 2026-08-27

OpenAI与博通联合打造的推理芯片Jalapeño,在Hot Chips大会公布的首份跑分中显示,三款公开模型上的每千瓦吞吐量达英伟达系统1.5至1.9倍;该芯片从设计到流片仅用9个月,计划2026年底以极小规模部署。

在Hot Chips大会上,OpenAI公布了与博通联合研发的首款自研推理芯片Jalapeño的首份跑分结果。材料显示,该芯片在三款公开模型上的每千瓦吞吐量达到英伟达系统的1.5至1.9倍。芯片从设计到流片仅用9个月,远快于行业通常的18至24个月。OpenAI借助Codex等AI生成kernel,加速了芯片设计全流程。

产业观察 · 原始来源:腾讯研究院(搜狐同步) · ai-industry
事件日期 2026-08-27

智谱上线并开源GLM-5.3-Flash(320B-A18B),这是GLM-5系列首个原生多模态模型,AA综合智能指数为57分,与Claude Opus 4.8持平;定价仅为GLM-5.3的1/10,限时低至Claude Opus 4.8的1/40,并首次部署在大规模国产芯片集群上。

根据腾讯研究院AI速递20260827的报道,智谱上线并开源GLM-5.3-Flash(320B-A18B),定位为GLM-5系列首个原生多模态模型。报道同时给出该模型在AA综合智能指数上的得分为57分,并介绍了其架构、定价与国产芯片部署情况。

产业观察 · 原始来源:腾讯研究院(搜狐同步) · ai-industry
事件日期 2026-08-27

Figure 推出 Index 数据采集项目,通过众包方式收集人类真实任务视频,为机器人基础模型 Helix 补充现实经验,并计划未来 12 个月在数据和算力上投入超 10 亿美元。

Figure 同步上线了 iOS 与 Android 版 Index 应用,邀请全球用户成为“创作者”,用手机或头显记录整理房间、叠衣、清洁厨房、换机油等真实任务,目的是为机器人基础模型 Helix 提供现实世界的经验数据。

产业观察 · 原始来源:腾讯研究院(搜狐同步) · ai-industry
事件日期 2026-08-27

OpenAI 正在扩大其在巴西的存在,深化与开发者、企业和社区的合作,以支持该国对 AI 的采用。(待核实)

根据来源元数据,该条动态为“Expanding OpenAI’s presence in Brazil”,即 OpenAI 宣布在巴西扩展业务。具体举措、合作对象、投资规模等信息均未在已有材料中确认。(待核实)

产业观察 · 原始来源:OpenAI · ai-industry
事件日期 2026-08-27

腾讯混元通过2-bit与1.25-bit两套极致量化方案,将端侧翻译模型Hy-MT2-1.8B从约3.3GB压缩至440MB,翻译质量几乎无损,并在FLORES-200评测上优于微软、豆包等商业翻译API。

为降低端侧翻译模型的部署门槛,腾讯混元尝试将1.8B参数量级模型压缩到几百MB量级,同时保持翻译质量。速递显示,该工作已形成2-bit和1.25-bit两条量化路线,并联合英特尔、哔哩哔哩推进算子优化与实时弹幕翻译落地。

产业观察 · 原始来源:腾讯研究院(搜狐同步) · ai-industry
事件日期 2026-08-27

一项针对1000多名学生的随机研究,考察了ChatGPT、批判性思维训练、原创性与真实大学作业表现之间的关系;具体结论暂无法从材料中确认,待核实。

该研究来自OpenAI官网发布的内容,核心关注点包括:

产业观察 · 原始来源:OpenAI · ai-industry
事件日期 2026-08-27

Anthropic 于 2026 年 8 月 27 日发布“模型硬件标准”(Model Hardware Standard, MHS)的研究预览,这是一个让 AI 代理安全操作物理设备的共享规范,旨在将实验室和工厂的设备集成时间从数周甚至数月缩短到几小时或几分钟。

Anthropic 宣布向首批科研实验室和先进制造商开放 MHS 的研究预览。MHS 由 Anthropic 与 HHMI Janelia Research Campus 合作开发,目前已在生物技术、机器人、量子计算等领域的少量实验室和硬件制造商中进行了早期测试。Anthropic 计划在将该标准开源之前,与合作伙伴共同构建安全评估体系并制定 AI 系统操…

产业观察 · 原始来源:Anthropic 博客 · ai-industry
事件日期 2026-08-27

比尔·盖茨警告,AI在生物、网络攻击、心理社会影响、破坏就业乃至失控风险上均已跨过原本应提前设防的临界点;他认为行业无法自我监管,需要“人类保留岗位”、机器人税、token税等激进政策干预。

腾讯研究院AI速递20260827第八条摘编显示,比尔·盖茨在一篇新文章及采访中公开警告:AI的多种风险已“跨过危险临界点”,但行业之外几乎无人讨论。他认为这次AI革命不同于以往技术革命,AI能以远低于人力的成本替代大批白领和入门岗位;机器人临界点一旦跨过,可能瞬间冲击近30%就业;生物恐怖主义风险比自然大流行可怕约50倍。

产业观察 · 原始来源:腾讯研究院(搜狐同步) · ai-industry
事件日期 2026-08-27

据AGIBOT官网新闻标题,AGIBOT创始人兼CEO Deng Taihua入选《时代》TIME100 AI 2026榜单;新闻正文未抓取到,具体评选细节待核实。

2026-08-27前后,AGIBOT官网新闻中心发布消息,标题为“AGIBOT Founder and CEO Deng Taihua Named to the TIME100 AI 2026 List”。据此可确认,消息主体是AGIBOT创始人兼CEO Deng Taihua入选TIME100 AI 2026榜单。

产业观察 · 原始来源:agibot.com · ai-industry
事件日期 2026-08-27

Shopify CEO Tobi Lütke 正考虑禁用 Claude Code,直到其支持读取 `AGENTS.md`、`.agents/skills` 等文件。核心争议不是模型能力,而是多工具并存时项目规则文件不能“各读一套”。

Shopify CEO Tobi Lütke 公开表示,考虑禁用 Claude Code,原因是 Claude Code 坚持读取 `CLAUDE.md`,而不读取 `AGENTS.md`、`.agents/skills` 等文件。Shopify 担忧这会导致使用不同 AI 编码工具的开发者拿到不同项目规则,在大型工程中难以统一。

产业观察 · 原始来源:腾讯研究院(搜狐同步) · agent
事件日期 2026-08-27

MiniMax最新披露:2026年8月ARR超8亿美元(2月为1.5亿美元,约5.3倍);上半年收入1.166亿美元,同比增283.1%;B端收入占比升至63.4%,7月Token消耗量达1月的20倍。这一轮增长主要由企业客户和开发者的Agent工作负载驱动,被视为“Agent红利”在财务上的体现。

MiniMax于2026年8月27日披露最新数据和财报要点。核心现象是:收入规模、ARR、B端收入占比、Token消耗量四个指标几乎同步快速上升。值得研究的问题是:为什么B端业务恰在此时成为增长主力?Agent工作流如何改变大模型公司的收入结构?

产业观察 · 原始来源:量子位 · agent
每页 20 条