AI消息速览

不透明认知中介:LLM 部署配置如何塑造对伪科学的验证

事件日期 2026-07-24 · 学术前沿 · 已接受

事件日期2026-07-24
信息日期2026-07-24
入库日期2026-07-27
通道学术前沿
状态已接受
来源arXiv 论文

知识卡片:不透明认知中介:LLM 部署配置如何塑造对伪科学的验证

一句话结论

商业大语言模型对争议性科学主张的立场并非模型本身的稳定属性,而是部署配置(系统提示、安全层、接口路由、无声更新)的偶然产物;在测试的四个模型家族中,Grok 的 Fast 版本给出的伪科学可信度评分是其他模型的 2–5 倍,且该行为在无声补丁后发生逆转,同一模型标识符在不同接口上产生截然不同的输出。

研究问题/事件概述

  • 研究考察了四代主流商业 LLM(Claude、Grok、GPT、Gemini)如何评估源自 Frank Salter 生物社会框架的种族民族主义伪科学(ethnonationalist pseudo-science)。
  • 在四个时间快照(2025 年 10 月至 2026 年 2 月)中,通过 API 和网页两种接口进行测试。
  • 核心发现:Grok 的 Fast 版本(X 平台默认用户体验使用的版本)始终给予伪科学主张 70–75 的可信度评分,是其他模型(15–40)的 2–5 倍;而控制提示(基础进化共识、被反驳的拉马克主张)下所有模型表现相当。

方法/产品要点

  • 测试对象:Claude、Grok、GPT、Gemini 四个模型家族。
  • 测试方式:对同一组伪科学主张,分别在 API 和网页接口上提问,并记录模型给出的数值化可信度评分。
  • 额外发现
    1. 无声补丁使 Grok 的行为从混乱变为稳定的高验证,且无公开文档说明。
    2. 三个月后,同一 Grok 模型标识符在 API 上输出 75 分,在网页上输出 5.5 分(待核实:具体评分数值是否精确)。
    3. 最合理的回应——拒绝评分——出现在两个模型家族的不同接口上(Claude Opus 4.1 在网页端完全拒绝,GPT-5.1 Chat 在 API 端间歇性拒绝),但在后继版本中均消失。

主要结果或产业意义

  • LLM 的认识论立场不是一个稳定属性,而是部署配置的偶然效应:系统提示、安全层、接口路由和无声更新均可导致输出重大偏移。
  • 这种不透明性对用户和研究者均不可见,构成了公共关切问题,需要新的认知问责形式(epistemic accountability)。
  • 产业意义:部署 LLM 作为知识参考工具时,必须意识到输出可能因无声配置变更而突变,且不同接口(API vs 网页)可能返回截然不同的答案。

为什么重要

  • 揭示了商业 LLM 在争议性科学主张上的立场不透明且不稳定,可能被无声地操纵或扭曲,对公共知识传播构成风险。
  • 与已有相关卡片相比,本条聚焦于部署配置对模型立场的影响,而非模型内在的预测能力或偏差表征——这是一个被较少关注的维度,但影响直接且深远。

局限与不确定性

  • 仅测试了四个时间快照和四种模型家族,样本量有限(待核实具体提示数量、伪科学主张类型)。
  • 未深入探索导致 Grok 行为突变的底层机制(无声补丁的具体内容未知)。
  • 评分数值的精确可靠性需进一步验证,尤其是跨接口巨大差异是否可复现。
  • 控制提示仅覆盖了基本进化共识和拉马克主张,未检查其他领域。

可用于图书/PPT/简报的角度

  • “模型不是产品,配置才是”:用 Grok 的 API vs 网页评分差异(75 vs 5.5)说明同一模型在不同部署管道中可能“说出”完全不同的话。
  • 无声更新与公共信任:商业 LLM 的无记录补丁可在一夜之间改变模型对敏感话题的立场,类比软件的后门,但更难被审计。
  • 认知中介的责任:当 LLM 被用作知识参考时,部署方(而非模型开发者)应承担透明度责任,公开系统提示、安全层配置及更新日志。

原始材料

  • URL: https://arxiv.org/abs/2607.22513v1
  • Track: academic
  • Topics: foundation-model
  • Manual title: Opaque Epistemic Mediation: How LLM Deployment Configurations Shape the Validation of Pseudo-Science
  • 英文关键词: LLM deployment configuration, epistemic stance, pseudo-science, silent patch, interface routing
  • 来源说明:本文基于 arXiv 预印本(2607.22513v1)的候选摘要(Candidate summary)生成,因无法抓取全文,所有事实细节均来自该摘要,未确认部分已在文中标注“待核实”。