📊 已收录 306+ 个 AI 工具 · 12+ 分类 · 142 篇深度评测✉️ 提交工具
首页/评测/行业观察:当 AI 开始解数学猜想,数学家为何先写了一封反对信?
返回评测列表
行业观察:当 AI 开始解数学猜想,数学家为何先写了一封反对信?

行业观察:当 AI 开始解数学猜想,数学家为何先写了一封反对信?

2026-09-22 8 分钟阅读 0 次浏览 宜修

OpenAI 内部模型解出百余个数学开放问题,数学家随即发公开信抗议「以解题为基准」。OpenAI 组建独立咨询小组回应——能力油门仍在公司手里,独立性成焦点。

背景

2026 年 9 月 21 日,OpenAI 发布公告《数学与人工智能咨询小组》,披露了一件颇具冲击力的事:自 8 月 28 日开始训练的一个新内部模型,在解决了 Navier–Stokes 千禧年难题之后,又解出了 100 多个长期悬而未决的数学开放问题,横跨数学的大部分分支。OpenAI 坦言,"数学模型进展的速度让公司内部的数学家都感到意外"。

但真正值得关注的不是模型有多强,而是 OpenAI 在公告里主动提到的那封信:部分数学家发表公开信《AI 在数学中的严重失准》,对"以解出开放问题作为衡量新 AI 系统的基准"这一做法表达了担忧。

事件要点

其一,能力进展快到让人不安。 一个训练仅数周的模型,连续攻克千禧年难题与上百个开放问题——这种速度已经超出了学术共同体习惯的节奏。数学是"基础科学",新发现可能带来广泛的应用,这让"负责任地开发与部署"变得格外重要。

其二,数学界担心的不是 AI 解题本身,而是"解题被当作基准"的外部性。 如果"能解出多少开放问题"成为衡量 AI 的指标,那么解题过程可能被异化——为了刷指标而抢先发表、绕过严谨的同行评审流程,甚至损害数学研究的学术规范。这种担忧并不抽象,它关乎一个学科的知识生产秩序。

其三,OpenAI 的回应是"建立桥梁"而非"自行宣布"。 公司宣布与数学家共同组建一个独立的数学咨询小组,成员包括 Timothy Gowers(剑桥/法兰西公学院)、Martin Hairer(EPFL)、Edward Witten(IAS)、Ulrike Tillmann(牛津)等一众顶尖数学家。该小组将协助评估新结果的意义、协调成果的发布、并就数学研究的学术与专业标准提供建议,同时指导教师如何使用 AI 工具开展研究。

其四,独立性被明确写入机制。 公告强调:小组独立运作,可以提出 OpenAI 未要求的建议、可以公开评论 OpenAI 对数学的影响、成员不由 OpenAI 支付报酬,并可自行调整成员构成。但同时也划清了边界——小组不负责就 OpenAI 内部数学研究的推进节奏提供建议。换言之,能力推进的"油门"仍掌握在公司手中,小组管的是"如何负责地说出去"。

为什么重要

这起事件是 AI 与学术共同体关系的一个缩影。过去几年,前沿 AI 的能力突破越来越频繁地"闯进"原本由人类专家把守的领域——数学证明、法律检索、医疗诊断、科学发现。随之而来的问题不再是"AI 能不能做",而是"当 AI 做了,谁来验证、按什么标准、以什么节奏公开"。

OpenAI 选择主动建立咨询机制,是比"闷头宣布结果"更成熟的做法;但机制本身的独立性——尤其是"不干预研究节奏"这一条——也留下了疑问:如果小组只能建议"怎么发布"而不能影响"是否推进",那它更像是危机沟通的缓冲垫,而非真正的治理约束。

对普通用户意味着什么

  • 别只看"解出多少题"的标题:AI 能力指标的热闹背后,往往对应着专业共同体的秩序问题。理解这种张力,能帮你更冷静地看待每一次"AI 又突破了"的新闻。
  • 验证机制正成为标配:无论是数学、法律还是金融,AI 越深入专业领域,"谁来评估、如何复核"就越关键。这与我们在其他测评里反复强调的"人工确认节点"是同一件事。
  • 独立与透明是关键词:判断一个机构的 AI 治理诚意,看它是否愿意引入独立、无偿、可公开发声的第三方——而不是只找"配合演出"的顾问。

小结

AI 解出数学难题是能力的里程碑,数学家写反对信则是共同体的觉醒。两者同时发生,恰恰说明前沿 AI 的发展已经进入"技术能力与社会机制必须同步演进"的阶段。OpenAI 的咨询小组是一个开始,但真正的考验在于:当下一批结果到来时,这份独立性是否经得起压力。

来源:OpenAI 官方公告《Advisory Group on Mathematics and Artificial Intelligence》(2026-09-21)、数学家公开信《A Severe Misalignment of AI in Mathematics》(mathandai.org)、《The Verge》2026-09 相关报道。