AI消息速览

知识卡片

按事件日期排列,包含已接受、待审核和稍后处理的卡片。待审核内容仅供参考。

显示第 1441-1460 条,共 2269 条
第 73 / 114 页
事件日期 2026-07-24

英伟达CEO黄仁勋公开反对限制美国公司使用中国开源模型,认为“后门”担忧是误解,且免费AI实际利好芯片与数据中心,但美国政界同时对中国模型发起蒸馏指控与制裁威胁,行业出现产业链两头罕见站在一起的反对声音。

2026年7月,英伟达创始人黄仁勋公开呼吁美国政府不要阻止美国公司使用中国开源模型。他澄清“后门论”是误解,指出开放权重的模型可以通过沙盒环境安全部署,并直言免费AI反而会刺激芯片与数据中心需求。埃隆·马斯克在相关帖子下回复“True”表示背书。

产业观察 · 原始来源:腾讯研究院(搜狐同步) · ai-industry
事件日期 2026-07-24

2026年7月24日晚,英伟达CEO黄仁勋在X平台发出人生第一条推文,附上一封由25家机构联署的公开信《Open Weights and American AI Leadership》,强调开源对AI生态安全、竞争与自主控制的重要性。 公开信签署方包括英伟达、微软、Meta、IBM、a16z、YC等,但OpenAI、Anthropic、谷歌(闭源三巨头)均…

产业观察 · 原始来源:新智元 · ai-industry
事件日期 2026-07-24

Jul 24, 2026 Product Introducing Claude Opus 5

产业观察 · 原始来源:Anthropic 博客 · ai-industry
事件日期 2026-07-24

OpenAI推出名为Presence的企业级AI智能体运营平台,整合模拟运行、安全护栏、人工复核和AI评估等工具,可调用Codex分析智能体短板并提出优化建议,内置AI语音对话技术,标志着OpenAI从模型销售商向企业软件服务商转型。

2026年7月,OpenAI发布企业AI智能体运营平台Presence。该平台面向企业客户,旨在帮助部署、管理和优化AI智能体。目前处于有限开放阶段,需工程师协助部署。平台配备模拟运行环境、安全护栏、人工复核与AI评估工具用于校验输出,并可调用Codex分析智能体短板提出优化建议,同时内置AI语音对话技术。

产业观察 · 原始来源:腾讯研究院(搜狐同步) · agent
事件日期 2026-07-24

Mind Lab 推出首个正式版 MoE 智能体模型 Macaron-V1(含 748B 旗舰版和 50B 可本地部署版),采用 Mixture-of-LoRA 架构大幅降低训练成本,商业化两周内年化经常性收入(ARR)突破千万美元,标志智能体模型从理论到商用的全链路闭环初步打通。

Mind Lab 于 2026 年 7 月发布 Macaron-V1 模型,这是其首个公开的 MoE(混合专家)智能体模型。该模型包含两个版本:旗舰版“Venti”(748B 参数)和可本地部署的“Tall”(50B 参数)。模型在长程自主智能体任务上对标国际顶尖模型。商业层面,7 月开启商业化后仅两周 ARR 即突破千万美元;6 月已完成近 5000 万…

产业观察 · 原始来源:腾讯研究院(搜狐同步) · agent
事件日期 2026-07-24

腾讯云发布的CodeBuddy NPC是能自主完成方案规划、代码开发、提交PR、执行测试并按CI结果持续修改直至交付的云端研发智能体,经优化后首轮Token消耗从2万降至约2000(降幅超90%),企业可按任务复杂度灵活调度模型以平衡性能与成本。

2026年7月24日,腾讯云上线云端研发智能体CodeBuddy NPC。开发者只需派发任务,智能体即可自主完成方案规划、代码开发、提交PR、执行测试,并根据CI结果持续修改直至交付。该智能体依托研发平台CNB,将Issue、代码仓库、PR、CI作为原生“研发记忆”上下文,支持@协作,并可组建NPC Team分工完成复杂研发乃至整款游戏。

产业观察 · 原始来源:腾讯研究院(搜狐同步) · agent
事件日期 2026-07-24

Anthropic 在托管智能体平台 CMA 上一次性推出六项关键更新,将单个 agent 的技能上限从 20 提升至 500,并引入多档思考力度调节、种子会话预置、子 agent 线程级可观测性以及七种 webhook,使平台从单纯的 API 产品进化为可运维的企业级智能体平台。

2026 年 7 月 24 日,Anthropic 对其托管智能体平台 CMA(Claude Managed Agent)进行重大升级,共推出六项更新。核心变化包括:技能上限从 20 大幅拉升至 500,使单个会话能够挂载整座企业知识库;通过中央协调器统一调度各 agent,并共享内存与环境;思考力度支持 low 至 max 五档调速,不同 agent 可…

产业观察 · 原始来源:腾讯研究院(搜狐同步) · agent
事件日期 2026-07-24

长内容创作者(如网文作者、报告撰写者、自媒体人)长期面临AI“失忆”困境:即使模型拥有很长的上下文窗口,也无法有效管理、梳理和利用这些信息,导致万字报告前后口径打架、角色设定OOC(偏离人设)、关键引用无处可查。文章指出,“长任务的天花板≠模型上下文窗口长度”,现有Agent在这一场景下表现欠佳。元石科技推出的**问小白5 Pro**,定位为“新一代长内容…

产业观察 · 原始来源:量子位 · agent
事件日期 2026-07-24

金山办公发布的“灵犀专业版”是一个独立(而非内嵌于WPS)的AI办公Agent,其核心价值在于理解个人工作历史与项目上下文,将AI的起点从单次提示词推进到用户完整的工作流程,并保持最终交付文件的严肃性与可编辑性,本质上是对办公软件角色的重新定义。

金山办公于2026年7月发布“灵犀专业版”,这是其独立的AI办公Agent,定位为“每个人的办公助理”。与WPS形成明确分工:灵犀负责理解项目、调动资料和执行任务,WPS负责文件编辑与正式流转。其关键问题在于:当AI的通用能力(搜索、生成、操作软件)趋于同质化后,办公软件应如何重新定义自身价值?金山办公给出的答案是:处理的不只是文件,而是一整项工作。

产业观察 · 原始来源:量子位 · agent
事件日期 2026-07-24

本文认为,即使是大规模文生图扩散模型,只要使其内部结构可见且可操作,也能成为艺术家的创造性材料;通过集成到 ComfyUI 的模型弯曲与交互检查界面,艺术家可以调试模型特定组件并观察到一致性的视觉效果,从而形成实用的逐层直觉。

**背景**:可解释人工智能(XAI)在创意实践中可以不再是技术中心的解释,而是赋予艺术家检查、修改和调试模型的能力。 **问题**:当前大规模文生图扩散系统通常作为不透明的端到端工具呈现,限制了艺术家对模型的“物质性参与”(material engagement)。 **主张**:即使是大模型,只要其内部结构被可视化并支持操控,就能作为创造性材料使用。

学术前沿 · 原始来源:arXiv 论文 · foundation-model
事件日期 2026-07-24

Twins 通过通道级拼接 ViT 与 VAE 特征构建统一的连续 token 空间,并引入针对流匹配的焦点回归损失,缓解了多模态理解与生成任务中不同表征之间的优化不平衡,在 ImageNet 上无分类器引导时比朴素 MSE 损失提升达 10.57 gFID。

统一多模态模型期望一个共享的视觉 token 空间同时支持理解(如分类、分割)和生成(如图像合成)。离散方法通过共享码本统一接口,而连续方法通常依赖两套分离的表征——理解侧使用语义特征(如 ViT),生成侧使用低层潜变量(如 VAE)——导致潜在空间不匹配。本文提出 Twins,旨在构建统一的连续 token 空间,同时解决联合建模中出现的严重优化不平衡问…

学术前沿 · 原始来源:arXiv 论文 · foundation-model
事件日期 2026-07-24

TRACE-ROUTER 是一种任务级路由框架,通过将每个任务一次性分配给一个LLM后端(使用上下文赌博机),并利用任务的终端奖励更新策略,从而在智能体工作流中实现比逐调用路由更优的精度-延迟权衡。

现有的大语言模型(LLM)路由方法通常对每次LLM调用独立做出路由决策,但智能体应用以长时间工作流方式执行,其质量仅由延迟的任务级结果决定。这种错位使得逐调用路由器无法正确地将反馈归因于单个路由决策,导致路由策略次优。

学术前沿 · 原始来源:arXiv 论文 · foundation-model
事件日期 2026-07-24

数据集的 AI 就绪性不是一成不变的固有属性;随着生物学知识的快速更新,模型与数据之间的对齐必须通过持续学习和基础设施支持来动态维护。

2026 年 7 月 24 日,《自然-机器智能》社论聚焦“数据 AI 就绪性”的深层挑战。传统上,社区遵循 FAIR 原则(可查找、可访问、可互操作、可重用)来准备生物医学数据集,但 AI 工具的迅速发展使得 FAIR 已不够用。NIH 于 2022 年启动 Bridge2AI 项目,英国开放数据研究所发布了 AI 就绪框架(涵盖数据集属性、元数据、基础…

学术前沿 · 原始来源:nature.com · foundation-model
事件日期 2026-07-24

V折刀切法(V-fold jackknife)是一种计算高效且理论严谨的半参数推断替代方案,无需推导影响函数,对固定V可得到Studentized统计量收敛于t分布(自由度V‑1),从而给出有效的置信区间。

过去几十年,bootstrap因其广泛适用性和最小分析需求成为统计推断的默认工具。然而,bootstrap在众多现代半参数估计和机器学习估计中的理论性质尚未得到充分研究,但其仍被常规使用,且计算成本高昂。本文针对这一问题,开发了V折刀切法作为替代。

学术前沿 · 原始来源:arXiv 论文 · foundation-model
事件日期 2026-07-24

技能对LLM智能体的净收益被平均成功率所掩盖;技能的主要差异不在于谁“增益”更多,而在于谁“回归”更少——即技能引入后导致原本可解决的任务反而失败的现象。

以往评估LLM智能体添加程序性技能(procedural skills)时,通常只看平均任务成功率提升,但这隐藏了一个重要成本:技能也可能使智能体变得更差。 本研究通过对比**有技能**和**无技能**的LLM智能体在近6000次运行中的表现,区分两种失败类型: **回归(regression)**:无技能时能成功,有技能后反而失败。 **残余失败(res…

学术前沿 · 原始来源:arXiv 论文 · foundation-model
事件日期 2026-07-24

论文提出可感架构(SUSA)——一种针对波动率预测的储层设计原则,其两个复值储层变体在16个美国股票/ETF序列上与GARCH表现相当,对IWM和XLP资产有统计显著的QLIKE改进,且其预测与HARQ型预测互补,堆叠集成可在75%测试场景中超越最强单一模型。

波动率预测长期受限于持久性效应和测量噪声,留给非线性模型可挖掘的残差结构非常有限。该工作试图回答:能否设计一种专门针对波动率序列微弱非线性信号的储层架构,使其在传统GARCH模型占据主导的领域仍取得竞争性表现?

学术前沿 · 原始来源:arXiv 论文 · foundation-model
事件日期 2026-07-24

SM4RT提出了一种结构化运动4D重建Transformer,通过将场景运动分解为若干SE(3)刚体运动基元,实现了从单目RGB视频中端到端联合推断3D几何、世界坐标系运动与场景运动结构。

现有几何基础模型在单目3D重建上取得了显著进展,但将其推广到4D动态理解仍面临根本挑战。主流运动感知方法(如稀疏跟踪、稠密逐点光流)将运动视为独立的逐点位移,忽略了物理运动的结构化特性——真实世界物体通常遵循刚体运动学,点群集体运动而非孤立运动。

学术前沿 · 原始来源:arXiv 论文 · foundation-model
事件日期 2026-07-24

Skill Self-Play(Skill-SP)提出一种**技能协同演化框架**,通过生成器、求解器和动态技能控制器在强化学习循环中持续自对弈,在保持任务多样性的同时获得可靠的验证信号,从而在工具使用和推理基准上持续提升大语言模型性能,甚至扭转初始不匹配模型的表现。

Skill Self-Play: Pushing the Frontier of LLM Capability with Co-Evolving Skills

学术前沿 · 原始来源:arXiv 论文 · foundation-model
每页 20 条