OpenAI公布未发布模型的数学成果手稿
先了解这件事
OpenAI 公开了一个未发布前沿模型产出的数学成果:722 篇手稿、覆盖 372 个结果族,OpenAI 称其中包含对数百个开放数学问题的解答,托管在 GitHub 仓库并附论文修订与引用协议。OpenAI 称多数结果来自对单个 AI 智能体的单次提示,“平均结果”消耗约三小时 ChatGPT Pro Thinking 算力;The Decoder 报道称其中包含对重要计算机算法的改进以及与黎曼假设相关的进展,部分证明提供了 Lean 形式化,OpenAI 计划补充更多形式化并资助相关研讨会和会议。 TechCrunch 报道称,这些解答未完全达到学界标准:719 份手稿中仅 10 份公开了模型的思维链,仅 42% 的证明未经过形式化;普林斯顿高等研究院的 AGMAI 首要要求是停止在专有模型上测试高难数学问题,而 OpenAI 明确表示正用开放研究问题评估其专有模型,AGMAI 还要求提供关联自然语言与形式化产物的机器可读元数据,OpenAI 此次未提供。这些解答是否经过同行验证,报道未作说明。
AI 根据报道生成 · 2 天前更新
事件进展
2 个进展
- 10月9日 02:10 · 1 篇报道TechCrunch报道OpenAI数学证明未达学界标准TechCrunch · AI:OpenAI 数学解答未达学界标准,AGMAI 准则与形式化缺口受质疑
- 10月6日 20:00 · 3 篇报道OpenAI公布数学开放问题新结果OpenAI News:OpenAI 公开前沿模型在数学开放问题上的进展
报道时间线
沿着报道,了解事件的不同侧面。
- TechCrunch · AIOpenAI 数学解答未达学界标准,AGMAI 准则与形式化缺口受质疑
OpenAI 本周发布数百个高难数学问题的解答,称已咨询精英数学家顾问组,但未完全达到学界标准。普林斯顿高等研究院的 AGMAI 提出首要要求是停止在专有模型上测试高难数学问题,而 OpenAI 明确表示正用开放研究问题评估其专有模型;719 份手稿中仅 10 份公开了模型的思维链,仅 42% 的证明未经过形式化。
- The Decoder精选OpenAI 在 GitHub 发布 372 条 AI 生成的数学证明
OpenAI 发布 372 条由内部前沿模型生成的数学结果,每条据称解决或推进了一个开放问题,其中包含对重要计算机算法的改进以及与黎曼假设相关的进展。结果托管在 GitHub 仓库中并附修订日志和引用,部分证明提供了 Lean 形式化,OpenAI 称多数结果来自对单个 AI 智能体的单次提示,平均消耗约三小时 ChatGPT Pro Thinking 算力。
- Latent Space精选OpenAI 发布内部模型产出的 722 篇数学论文,称解决 500 个公开难题中的 90 个
OpenAI 在一个公开 GitHub 仓库中发布了内部前沿模型产出的数学成果,称这批 722 篇手稿分为 372 个相关结果族,来自约 4000 个研究问题的评估,平均每个结果消耗约三小时 ChatGPT Pro 的思考算力,模型本身尚未发布。
- The Verge · AI精选OpenAI 发布 722 篇数学手稿,称解决数百个开放问题
OpenAI 发布了一批共 722 篇手稿,覆盖 372 个结果族,称其中包含对数百个开放数学问题的解答,这些结果由一个未发布的前沿模型产出。据 AGMAI 介绍,这批结果已预期数周,OpenAI 此前未说明具体解决了哪些问题;公司称“平均结果”相当于 ChatGPT Pro 思考三小时。
本事件热度走势
- 可比范围当前
- 4
- 可比范围峰值
- 2310月7日 17:00
- 近 24 小时变化
- -64%
趋势仅比较持续完整观测到的相同主体,范围可能小于当前热度统计。移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。