知识卡片:AI系统与世界英语中(标准)语言意识形态的再生产
英文标题:AI systems and the reproduction of (standard) language ideologies in World Englishes
英文关键词:AI systems; language ideologies; World Englishes; standard language; large language models; delve
一句话结论
该论文认为,生成式AI系统在训练数据、设计协议、评估基准、用户反馈和公共评论等层面,再生产了以“内圈”英语规范为标准的语言意识形态,并可能使非支配性英语使用者被与“AI生成语”混为一谈;同时,AI也可能通过广泛语料和全球南方用户的标注工作带来“标准化悖论”——既同质化英语,又多元化英语。
事件概述或研究问题
- 研究问题:在大型语言模型快速发展的背景下,谁有权判定什么是合法英语?谁的英语会被怀疑?AI系统及其使用和话语如何反映、强化甚至偶尔挑战(标准)语言意识形态?
- 论文以“世界英语”(World Englishes)为视角,讨论“内圈”规范如何被赋予特权,非支配性英语如何被边缘化。
- 根据摘要,论文的证据来源包括实证研究、媒体评论、社交媒体争论和AI输出示例。
方法/产品要点
- 该论文属于观点/理论驱动型学术分析,而非产品介绍。
- 分析层面:训练数据、设计协议、评估基准、用户反馈、公共评论。
- 核心案例:围绕“AI腔”语言的公共争议,尤其是对单词 delve 的聚焦,用以说明全球北方英语使用者如何“规训”全球南方英语使用者的语言规范。
- 理论资源:引用Christian Mair的“标准化悖论”(standardisation paradox)——AI可能因偏好标准形式而同质化英语,同时又因接触广泛语料和全球南方用户的标注工作而多元化英语。
- 作者主张:需要更具包容性的设计方法,承认英语的多元性,以应对将某些英语视为“更合法”所带来的现实负面后果。
主要结果或产业意义
- 生成式AI正在重新点燃世界英语领域关于标准化、合法性、英语所有权的长期争论。
- 这些争论如今出现在算法系统、模型训练、评估实践和公共话语中。
- 一个值得注意的现象是:非支配性英语日益被与AI生成语音/文本混为一谈。
- 对AI产业的意义:模型训练、评估和反馈机制不能默认以“标准英语”为唯一基准;否则可能对全球南方英语使用者造成真实世界的不利影响。
为什么重要
- 将大模型讨论从“性能表现”扩展到“语言权力”:LLM不仅是技术系统,也是语言意识形态被(再)生产的场所。
- 为AI公平性讨论增加社会语言学维度:除了种族、性别等偏见,还需关注英语内部变体的等级制,以及全球南方群体的语言主权。
- 与已有相关卡片无重复陈述;本条增量信息在于揭示“AI腔”争议(如 delve)与全球英语规范之间的关联。
局限与不确定性
- 待核实:完整论文正文未获取,摘要未给出具体实证研究样本、案例细节以及“偶尔挑战”意识形态的具体机制。
- 待核实:作者对“全球北方英语使用者”“全球南方英语使用者”的操作性定义。
- 待核实:“非支配性英语日益被与AI生成语音混为一谈”的具体证据来源和程度。
- 该文是观点性/理论驱动分析,不是实验性结果,因此“主要结果”属于论点而非可复现数据。
可用于图书/PPT/简报的角度
- 角度1:从“delve 被嘲讽”看AI时代的英语语言权——为什么一个普通词会变成“AI腔”标志?
- 角度2:LLM训练数据中的英语等级制:谁的标准被默认为“默认标准”?
- 角度3:标准化悖论:AI既是英语的“压路机”又是“搅拌机”。
- 角度4:设计包容性AI:在训练、评测和反馈环节纳入多元英语。
原始材料
- 英文标题:AI systems and the reproduction of (standard) language ideologies in World Englishes
- arXiv ID:2607.28528v1
- 作者:Kingsley Ugwuanyi
- 提交/更新时间:2026-07-30T17:01:58Z
- 分类:cs.CL
- URL:https://arxiv.org/abs/2607.28528v1
- PDF:https://arxiv.org/pdf/2607.28528v1