Lean-QIT: Towards a Formal Infrastructure for Quantum Information Theory
Four questions for AI-ready biological data
多模态大语言模型(MLLM)已基本消除场景描述中的各类视觉-认知错误(除空间依赖错误外),并在复杂社会行为场景上的准确率追平人类顶级水平,填补了与简单场景(MS-COCO)之间的差距。
Evolution of Accuracy and Visual-Cognitive Errors in a Decade of Vision-Language AI Models
ConceptSMILE 是一个模型无关的扰动式审计框架,可独立评估基于概念的可解释 AI(XAI)输出的可靠性;在眼底视网膜图像实验中,不同概念解释方法在不同可信度维度上表现各异。
基于概念的可解释 AI 能让人更直观地理解模型推理逻辑,但概念层的输出并不自动可信。现有方法(如 SMILE)主要审计特征级或区域级归因,缺少对“人类可理解的概念解释”这一层面的可信度评估。本文提出 ConceptSMILE,将 SMILE 的扰动逻辑扩展至概念解释的审计。
Agora: Enhancing LLM Agent Reasoning Via Auction-Based Task Allocation
4DR360 将语义占据建模为持续传播的“场景状态”,通过跨模态状态推理范式,在 4D 雷达-相机融合框架下同时实现 360° 全景 3D 检测与占据预测,并扩展了 ManTruckScenes 数据集以支持统一的多任务评测。
可靠自动驾驶需要耦合前景目标与密集语义布局的全景感知。4D 毫米波雷达具有鲁棒性和低成本优势,但其稀疏回波必须与相机融合才能实现全面场景理解。现有雷达-相机方法主要优化检测任务,而同时处理检测与占据的双任务系统中,框解码和占据预测之间交互有限。为弥补这一空白并推进基于雷达的多任务学习,本文提出 4DR360。
根据“腾讯研究院AI速递 20260811”,马斯克在 X 力推的新图像模型 Imagine Image 2.0 凭借做表情包出圈,在 Arena(大模型竞技场)文本转图像与图像编辑两类中均列世界第二;其核心卖点是可交互精准编辑。同期 OpenAI 疑似在 Arena 测试代号 mona-lisa-1 的新图像模型,方向是提升真实感、压低“AI 味”。
本期 AI 速递报道了两条相互对照的图像生成进展:
Meta超智能实验室推出具备智能体机制的图像生成模型Muse Image,因思考时间越长画质越高,在Arena人类偏好排名中位列第二。
Meta超智能实验室发布图像生成模型Muse Image,并预览视频模型Muse Video。Muse Image首次引入智能体机制,能够自主编写代码生成图表和二维码、调用网络搜索获取实时信息,并具备自主修正能力。该模型支持多轮编辑与多参考图合成,推理投入与图像质量呈近似对数线性关系。已深度整合进Meta AI与Instagram生态。
英特尔公布超高带宽内存XBM专利,将1T1C存储单元移至后段制程金属堆叠区,采用薄膜晶体管工艺,封装尺寸与HBM4一致,单芯片容量0.5–5 GB,速率最高32 GT/s,商业化预计2030年后;同时并行开发ZAM方案(与软银子公司联合研发),带宽密度约为HBM4两倍,目标2029年。
英特尔公布XBM(超高带宽内存)专利,旨在提供HBM4的替代方案。当前HBM(高带宽内存)广泛应用于AI加速器,但面临制造复杂、成本高、带宽扩展受限等挑战。XBM通过将存储单元(1T1C)从传统前段制程转移至后段制程的金属堆叠区,并采用薄膜晶体管(TFT)工艺,试图在相同封装尺寸下提升面积利用率与集成密度。
Securing the FIFA World Cup 2026
智源发布的多模态表征世界模型RoboBrain Orca,不再直接预测显式输出,而是学习世界状态的潜在表征,通过无意识与有意识两条路径预训练,在zero-shot测试中文本、图像、动作三类任务表现随数据增长持续提升,动作生成达到π0.5水平。
2026年7月9日,智源研究院发布多模态表征世界模型RoboBrain Orca。该模型的核心思路是从“预测显式输出”转向“预测世界状态”,构建统一的潜在表征空间,并支持文本、图像、动作三种模态的读出。
尽管大模型的技术价值与需求成长毋庸置疑,但单纯“卖token”的大模型厂商并不一定能实现长期盈利。当前大模型API市场处于垄断竞争格局,厂商数量众多、集中度低、价格竞争激烈,短期内难以获得可持续超额利润。
近期OpenAI与Anthropic启动IPO计划,市场对其估值接近万亿美元(市销比分别达34倍和21倍),投资者高度乐观。然而,至今尚无一家大模型厂商实现独立盈利(净利润为正)。文章从微观经济学视角出发,探讨大模型API市场的结构、竞争格局及长期盈利前景,重点回答“大模型厂商能否最终盈利”这一核心问题。
蚂蚁灵波开源的LingBot-Video是全球首个面向具身智能的大规模MoE视频基础模型,采用30B参数(推理时仅激活3B)并结合超70000小时具身视频数据与分层强化学习奖励体系,在RBench上超越通用视频生成标杆模型,旨在为机器人提供低成本的物理世界模拟器。
2026年7月9日,蚂蚁灵波正式开源LingBot-Video,宣称其为“全球首个面向具身智能的大规模MoE视频基础模型、视频物理引擎”。该模型从架构、数据到训练目标全链路为机器人、人形智能体量身打造,核心差异在于追求“是否符合物理规律”,而非传统视频生成注重的时长、美学、画质等。模型已发布技术报告、GitHub仓库、HuggingFace和ModelSc…
蚂蚁灵波开源新一代具身基座模型LingBot-VLA 2.0,覆盖17个品牌20种机器人构型,预训练数据达6万小时,双臂协同与移动操作性能领先π0.5与GR00T N1.7,后训练版本在RTX 4090推理耗时约130毫秒,已在零售、物流、工业场景开启商业落地测试。
蚂蚁灵波于2026年7月开源了其新一代具身智能基座模型LingBot-VLA 2.0,该模型扩展了对多种机器人构型的支持,并发布了大量高质量训练数据。同时,模型已在多个行业场景中启动商业化落地测试。
UST与Anthropic合作,将Claude集成到芯片验证、制造流程及医疗、电信、银行系统中,计划培训2万名工程师使用Claude,并报告验证周期缩短50%–70%。
日期:2026年7月9日 主体:技术工程服务公司UST与Anthropic合作 目标:将Claude(Claude Code)嵌入物理AI(physical AI)工作流——即用于生产芯片、汽车、联网设备的设备和工程流程中的AI。 问题:传统芯片验证流程冗长、手工编写测试脚本效率低,早期设计错误越晚发现成本越高。
Anthropic于2026年7月9日发起“艰难问题”倡议,公开邀请公众提出关于AI的最尖锐问题,并承诺透明地展示公司为回应这些问题所采取的具体行动。
Anthropic作为一家公益公司(Public Benefit Corporation),其使命是确保先进AI模型的益处并降低其风险。为了真正符合公共利益,公司意识到需要充分了解公众对AI的希望和担忧。为此,Anthropic启动了“艰难问题”新倡议,进一步收集人们对AI相关话题的看法,并透明地追踪其在公益目标上的进展。公司还创建了专门网站,供公众提交问…
根据官方元数据,GPT-5.6 被描述为“随您雄心扩展的前沿智能”,强调每 token 输出更多智能、每美元更强性能以及按需提供更高能力。因未能抓取正文,具体内容待核实。
OpenAI 发布了 GPT-5.6 的产品页面,标题为“GPT-5.6: Frontier intelligence that scales with your ambition”。候选摘要指出其核心价值在于:从每个 token 中获得更多智能、每美元性能更强,并能按需为最困难的任务提供更高能力。实际发布内容及技术细节因无法访问原文而待核实。
待核实:OpenAI 可能推出了一项针对 GPT-5.5 的生物安全漏洞赏金计划(Bio Bounty Program),但具体细节无法从当前材料确认。
待核实:据元数据标题“GPT-5.5 Bio Bug Bounty”及摘要“Details about the OpenAI Bio Bounty program”,该页面可能介绍了 OpenAI 针对 GPT-5.5 模型的生物安全漏洞悬赏计划,旨在鼓励安全研究人员发现并报告模型在生物相关领域的潜在风险。但网站正文未能抓取,无法确认具体内容。
Cloudflare CEO 指出,2026 年上半年机器人流量首次超过人类流量,基于广告的互联网商业模式因机器不点击广告而面临失效;同时 AI 正在加速漏洞发现,未来两年每周可能爆发类似 Log4j 级别的安全漏洞,但两年后软件质量将因 AI 代码审查大幅提升。
Cloudflare 首席执行官在公开场合发布两项关键预警: 1. **流量结构转折**:2026 年上半年机器人流量首次超越人类流量,预计五年内机器人流量将达到人类流量的千倍。 2. **安全风险骤增**:AI 擅长发现漏洞,未来两年内每周可能出现 Log4j 级别的严重漏洞;但长远看,AI 代码审查将显著提升软件质量。
工信部NVDB通报Claude Code存在安全后门,可在未经用户同意下回传地域与身份标识,建议立即卸载受影响版本(2.1.91至2.1.196),阿里已内部宣布禁用。
工信部NVDB(国家信息安全漏洞库)通报,Anthropic旗下AI编码工具Claude Code存在后门隐患,该后门可未经用户同意向远程服务器回传用户地域与身份标识。受影响版本范围为2.1.91至2.1.196。目前最新版已更新至2.1.204,团队成员承认该后门为3月启动的防转售实验(已回滚)。阿里因后门风险内部宣布禁用Claude系列产品及Claud…