AI消息速览

知识卡片

按事件日期排列,包含已接受、待审核和稍后处理的卡片。待审核内容仅供参考。

显示第 681-700 条,共 2259 条
第 35 / 113 页
事件日期 2026-08-16

Anthropic首次公开Claude文本水印的技术细节,并已在最新模型中内置;该水印通过密钥控制的选词规律嵌入文本,持密钥者可验证AI参与痕迹,但可被释义工具以约4美分成本移除,且无法区分“AI写的”还是“AI改的”。

2026年8月16日,新智元报道,Anthropic发布官方博客,首次公开解释Claude文本水印的技术细节。最新一批模型已全部内置水印,老模型也在适配中。官方表示这与欧盟AI法案要求标记AI生成内容有关,并称水印对输出质量无影响。

产业观察 · 原始来源:新智元 · ai-industry
事件日期 2026-08-16

WorkSwarm 是 openJiuwen 推出的“蜂群办公智能体”,通过多 Agent 自主组队、共享上下文、真实操作文件与工具,把 AI 从一个单一助手升级为一支可与人类并肩工作的“团队”,已率先上架鸿蒙 PC 应用市场,并支持 Windows、Mac 等平台。

2026 年 8 月 16 日,量子位报道,openJiuwen 宣布旗下蜂群智能体全面升级为 WorkSwarm 蜂群办公智能体。文章通过音乐创作、多人接力写作、办公汇报和编程开发等演示,说明这种“多 Agent 团队协作”的工作方式,并将其能力归纳为四项关键能力。

产业观察 · 原始来源:量子位 · agent
事件日期 2026-08-15

据新智元报道,中国初创公司宇生月伴(VUI Labs)发布语音模型 Luna-TTS,宣称在 Hugging Face TTS Arena 登顶全球第一,并在 Artificial Analysis 的 Speech Arena 榜单上超越谷歌、获得全球第三。其核心路线是用非自回归扩散式 TTS 替代传统自回归逐 Token 生成,试图同时实现高情感表现力…

2026年8月15日,新智元报道称,宇生月伴(VUI Labs)的 Luna-TTS 模型在 Hugging Face TTS Arena 上击败 ElevenLabs、MiniMax、Cartesia 等厂商,登顶全球第一。 文章称,在 Artificial Analysis 的 Speech Arena 榜单上,Luna-TTS 超越谷歌,获得全球第三…

产业观察 · 原始来源:新智元 · ai-industry
事件日期 2026-08-15

鸿蒙通过ASCF跨端框架、HarmonyOS开发助手AI插件和AI零代码工具,把元服务的开发与分发重构为“低成本投入、高效率交付、高回报增长”的闭环,让开发者“按时吃饭”。

2026年8月15日,量子位发布文章,介绍鸿蒙元服务背后的开发体系。文章用“服务厨房”作比喻,解释鸿蒙如何通过场景感知和智能分发,将原本锁在App里的服务“解耦”为最小服务单元,并以卡片、动态、对话等形式主动触达用户。

产业观察 · 原始来源:量子位 · ai-industry
事件日期 2026-08-15

OpenAI 在《GPT-5.6 构建者指南》中披露:换用 Responses API 并开启“推理保留”与“压缩”后,GPT-5.6 Sol 在 ARC-AGI-3 公开题集上从 13.3% 提升到 38.3%,输出 Token 减少 6 倍;家族最小模型 Luna 在 BrowseComp 上以 84.04% 的成绩逼近 GPT-5.5 的 84.36…

2026年8月15日,新智元报道 OpenAI 发布《GPT-5.6 构建者指南》(Builders Guide to GPT-5.6),展示 GPT-5.6 在性能、成本与推理加速方面的改进。 重点围绕三类工程手段:程序化工具调用、原生多智能体、提示词缓存;以及 Ultrafast 模式预览版。

产业观察 · 原始来源:新智元 · ai-industry
事件日期 2026-08-14

Optima 是 Artificial Analysis 推出的自定义基准构建工具,让用户将自己的任务/数据转化为可重复的基准,在最新模型上运行,并对质量、成本与耗时进行对比;标准化基准无法回答“哪个模型最适合我的具体场景”,Optima 试图填补这一空白。

根据 Artificial Analysis 官网页面,Optima 允许用户“自带数据集、代理轨迹或自己的代理”,通过“构建 -> 运行 -> 评分”三步建立面向自身业务场景的基准测试,并比较前沿模型在性能、成本和耗时上的表现。页面展示了示例“Contract Review Benchmark”(合同审查基准),用于评估模型审查供应商合同、标记风险与提取…

产业观察 · 原始来源:artificialanalysis.ai · benchmark-evaluation
事件日期 2026-08-14
Grok 4.6 已接受

Grok 4.6 在 Artificial Analysis 综合智能指数上拿到 61 分,追平 GPT-5.6 Sol,仅落后 Fable 5 一分;在 GDPVal、AA-Briefcase、Harvey LAB 等基准上反超 Fable 5,同时 API 价格保持不变。

据腾讯研究院 AI 速递(2026-08-14)报道,马斯克发布旗舰模型 Grok 4.6。该模型在 Artificial Analysis 综合智能指数中得 61 分,进入第一梯队,追平 GPT-5.6 Sol,仅落后 Fable 5 一分。在 GDPVal、AA-Briefcase、Harvey LAB 等基准上反超 Fable 5,法律场景以 22%…

产业观察 · 原始来源:腾讯研究院(搜狐同步) · benchmark-evaluation
事件日期 2026-08-14

dots.tts是一个20亿参数的全连续端到端自回归语音合成基座模型,跳过离散Token量化,直接在连续隐空间建模并还原波形,在Seed-TTS-Eval三个子集上平均内容准确度与说话人相似度达到SOTA,并支持流式输出与低延迟双流模式。

小红书dots团队与上海交大X-LANCE实验室联合开源了dots.tts,定位为可持续扩展的语音合成基座。与主流TTS路线不同,dots.tts不依赖离散语音Token的量化步骤,而是直接在连续隐空间执行逐块自回归建模,再还原为波形。项目采用Apache 2.0协议,开放六个检查点及训练、推理、微调、蒸馏全套代码。

产业观察 · 原始来源:腾讯研究院(搜狐同步) · benchmark-evaluation
事件日期 2026-08-14

腾讯WorkBuddy发布5.3.11版本,将资料库升级为AI原生知识管理空间,新增HTML、Markdown等格式支持,实现人与AI共同读写、协同编辑,并能用一句话搭建可存数据的“轻应用”。

本次更新来自腾讯研究院AI速递(2026-08-14),核心变化是将WorkBuddy资料库从传统文件管理升级为AI原生知识管理空间:除Word、Excel、PPT外,新增HTML、Markdown等格式,并强调“人与AI可共同读写协同编辑”。

产业观察 · 原始来源:腾讯研究院(搜狐同步) · ai-industry
事件日期 2026-08-14

Cohere 的硬件感知动态投机解码(DSD)根据批大小(BS)等硬件约束动态选择草稿 token 数 K,在保留标准投机解码低 batch 加速的同时,避免固定 K 在大 batch 的 compute-bound 场景下变慢;在 Command A(Dense)上,DSD 在 BS 128/256 比固定 K SD 快约 23%,在 Command A…

LLM 推理通常一次生成一个 token;标准投机解码(SD)用小模型草拟多个 token,再由目标大模型在一个时间步内验证,每步可接受多个 token,从而加速。 SD 利用 GPU 计算与内存带宽的权衡:小 batch 时推理受 memory bandwidth 限制,大 batch 时受 compute 限制。现代 GPU 计算单元通常比内存带宽快约…

产业观察 · 原始来源:Cohere 博客 · ai-industry
事件日期 2026-08-14

2026年8月14日,智谱发布开源模型GLM-5.3,主打Coding与安全两大能力。据量子位报道,它在多项主流基准上为排名最高的开源模型,编程与智能体能力接近Claude Fable 5,并成为“最强开源安全模型”。

智谱在DeepSeek V4 Pro正式版、Grok 4.6发布后不久推出GLM-5.3。文章称,在Coding方面,GLM-5.3比GLM-5.2明显提升,能完成长时间自主规划、3D场景制作和可交付的模拟游戏;在安全方面,GLM-5.3在CyberGym白盒代码审查中得分84.5%,高于GLM-5.2的77.2%,并略高于Mythos 5和GPT-5.6…

产业观察 · 原始来源:量子位 · ai-industry
事件日期 2026-08-14

2026年8月,SpaceX以600亿美元完成对AI编程工具公司Cursor的收购,Cursor不再作为独立公司存在,其品牌与业务并入SpaceXAI;这被描述为“史上最大规模创业公司收购案例”,也标志着AI应用“绝对中立时代”的结束。

据新智元报道,2026年4月SpaceX与Cursor签署的协议中包含一项条款:SpaceX要么花100亿美元继续合作,要么以600亿美元整体收购Cursor。马斯克选择了后者。6月SpaceX宣布执行收购,8月16日官方正式确认交易完成。

产业观察 · 原始来源:新智元 · ai-industry
事件日期 2026-08-14

Cursor 已被 SpaceX 正式收购,收购流程自 2026 年 4 月与 SpaceXAI 合作启动后完成;双方将利用全球最大 GPU 集群,开发更强且更经济的模型。

2026 年 8 月 14 日,Cursor 官方博客宣布,Cursor 正式被 SpaceX 收购。该收购始于 2026 年 4 月,当时 Cursor 宣布与 SpaceXAI 合作以加速模型训练。收购完成后,Cursor 将获得 SpaceX 全球最大 GPU 集群的访问权限,用于构建更强大且运行成本更低的模型。作为合作的早期成果,Cursor 已于…

产业观察 · 原始来源:Cursor 博客 · ai-industry
事件日期 2026-08-14

未来 Claude 模型生成的文本将包含一种对读者不可见、不影响质量/价格、且不携带用户身份信息的“文本水印”。Anthropic 表示,这是为了遵守欧盟《人工智能法案》(EU AI Act)的要求;检测方只能推断“Claude 参与生成的可能性”,不能证明文本一定由 Claude 或人类单独完成。

2026年8月14日,Anthropic 发布文章解释其文本水印技术。 文章称,未来 Claude 模型会在生成文本中加入水印;Anthropic 与多家主要 AI 提供商一起实施这一改变,以符合 EU AI Act。 自2026年8月2日起,欧盟要求服务其市场的 AI 提供商对 AI 生成内容进行标记。 Anthropic 于2026年7月签署欧盟《AI…

产业观察 · 原始来源:Anthropic 博客 · ai-industry
事件日期 2026-08-14

腾讯混元3D团队推出开放世界生成框架WorldClaw,用户输入一句文本即可生成可自由探索、可继续编辑的大规模3D世界;生成过程采用由粗到细的Agentic方式,由多Agent协作完成规划、生成与自动修正。

一份AI行业速递报道,腾讯混元3D团队推出了开放世界生成框架WorldClaw。与“文本生成单个3D模型”不同,WorldClaw面向“整个3D世界”的生成,强调可自由探索和可继续编辑,并展示了海盗岛屿、沙漠战场等案例。WorldClaw的具体发布时间、官方公告等细节在速递中未展开,待核实。

产业观察 · 原始来源:腾讯研究院(搜狐同步) · agent
事件日期 2026-08-14

谷歌Pixel 11系列是一次“硬件半代升级”:四款机型全系256GB起步,平均涨价约100美元;新增的HiLight呼吸灯、Gemini Intelligence等AI功能与Gemini深度绑定,但媒体评价其“类智能体能力提升有限”,Pixel似乎正从独立智能手机沦为Gemini的物理容器。

根据发布会前解禁的上手信息,谷歌Pixel 11系列共四款:标准版、Pro、Pro XL和Pro Fold。全系存储起步为256GB。价格方面,基础款899美元,Pro和Pro XL分别为1099美元和1299美元,Pro Fold达到1899美元,平均上涨约100美元。多家媒体将其评为“半代升级”。

产业观察 · 原始来源:腾讯研究院(搜狐同步) · agent
事件日期 2026-08-14

谷歌DeepMind团队在Nature发表观点文章,提出用“自主性、效能、目标复杂度、泛化”四个维度刻画AI Agent,取代“是否为Agent”的二元分类,并指出“更强的Agent不一定需要更多治理”,关键在于能力类型对应的治理方式。

现有AI Agent讨论常陷入“是否为Agent”的简单二分,但真实系统中的Agent能力差异巨大,且同一模型在不同部署环境中的风险可能完全不同。谷歌DeepMind团队试图建立一种更细致的共同语言,用于描述Agent的核心属性,从而支撑技术审计、权限管理、责任分配和监管分级。

产业观察 · 原始来源:腾讯研究院(搜狐同步) · agent
事件日期 2026-08-14

阿里首次开源Max级旗舰模型Qwen3.8-2.4T-A95B权重,总参数2.4万亿、每Token激活950亿,主打长周期自主智能体任务;在PaperBench、OSWorld-Verified、CAD基准上超过Fable 5,但在TerminalBench、SWE-bench Pro等任务上仍落后于GPT-5.6 Sol与Fable 5。

腾讯研究院AI速递(20260814)报道,阿里首次开源Max级旗舰模型,开放Qwen3.8-2.4T-A95B权重。 该模型与Grok 4.6、DeepSeek V4 Pro同夜发布,当晚的大模型发布均突出Agent能力。 命名中的“2.4T-A95B”表示总参数2.4万亿、每Token激活950亿;材料未明确说明具体架构细节。

产业观察 · 原始来源:腾讯研究院(搜狐同步) · agent
每页 20 条