跳到正文
今天10月10日周六4 条
  1. The Verge · AI88

    OpenAI 一次性发布近 400 项 AI 生成数学成果,数学家称需数年消化

    OpenAI 本周发布近 400 项 AI 生成的数学结果,分布在 700 多份手稿中,覆盖组合数学、几何、数论、理论计算机科学、代数、拓扑、概率与统计力学及数学物理等领域。

    推荐理由:通过数十位数学家的第一手反应,呈现OpenAI大规模数学成果发布对学术界的实际冲击与验证缺口。

  2. TechCrunch · AI28

    Amazon 放弃数据中心 NDA,AI 智能体想要你的信用卡

    Amazon 宣布在与地方政府谈判数据中心交易时不再使用 NDA,此前 Microsoft 今年早些时候已采取类似举措。保密做法引发的社区反对已导致从纽约到旧金山数百项拟议和已生效的禁令。与此同时,一批初创公司押注消费者愿意让 AI 智能体访问自己的收件箱、文件和信用卡,前提是能让网站放行。

10月9日周五
  1. The Decoder80

    数学家呼吁抵制 OpenAI,AI 生成证明大量涌入数学领域

    数学界部分人士呼吁抵制 OpenAI,起因是该公司一次性放出 700 多份 AI 生成的数学证明文件,被一个顾问小组称为展示力量而非学术成果。菲尔兹奖得主 Terence Tao 在其博客转发该声明,并提出数学应进入不再以解题为主要衡量标准的 Math 2.0 时代;Scott Aaronson 则称这一局面为 Mathocalypse。

    推荐理由:围绕 OpenAI 一次性放出 700 多份 AI 数学证明文件,呈现数学界抵制呼声与两种合作模式的对比。

  2. The Verge · AI62

    USA Today 起诉 OpenAI,索赔超 2.5 亿美元

    USA Today 公司及其旗下多家地方报纸起诉 OpenAI,指控其未经授权复制“数十万篇”文章用于训练 AI 模型,并索赔超过 2.5 亿美元。诉状称 OpenAI 的商业成功建立在“大规模版权侵权”之上,从未就使用其内容请求许可。

  3. TechCrunch · AI65

    OpenAI 数学解答未达学界标准,AGMAI 准则与形式化缺口受质疑

    OpenAI 本周发布数百个高难数学问题的解答,称已咨询精英数学家顾问组,但未完全达到学界标准。普林斯顿高等研究院的 AGMAI 提出首要要求是停止在专有模型上测试高难数学问题,而 OpenAI 明确表示正用开放研究问题评估其专有模型;719 份手稿中仅 10 份公开了模型的思维链,仅 42% 的证明未经过形式化。

  4. TechCrunch · AI71

    OpenAI 年化收入据报比此前预期低约 200 亿美元

    据《金融时报》报道,OpenAI 已告知投资者其年化收入“接近 500 亿美元”,比此前流传的接近 700 亿美元低约 200 亿美元。此前 700 亿美元的数字来自 OpenAI 投资者为与 Anthropic 年化收入做直接对比而进行的推算,两家公司计算年化收入的方式不同,Anthropic 会计入云合作伙伴的销售额,OpenAI 则不计入。

10月8日周四
10月7日周三
  1. The Decoder78

    Common Sense Media 将 ChatGPT 青少年版评为不可接受风险,家长警报在自杀对话中未触发

    Common Sense Media 青年 AI 安全研究所用 4000 多条测试提示评估 ChatGPT 青少年版,将其评为对未成年人不可接受风险,并呼吁在独立测试确认安全前禁止青少年使用。

    推荐理由:独立机构用 4000 多条测试提示评估 ChatGPT 青少年防护,家长警报在自杀对话中未触发,为正在进行的诉讼和监管提供依据。

  2. The Decoder85

    OpenAI 在 GitHub 发布 372 条 AI 生成的数学证明

    OpenAI 发布 372 条由内部前沿模型生成的数学结果,每条据称解决或推进了一个开放问题,其中包含对重要计算机算法的改进以及与黎曼假设相关的进展。结果托管在 GitHub 仓库中并附修订日志和引用,部分证明提供了 Lean 形式化,OpenAI 称多数结果来自对单个 AI 智能体的单次提示,平均消耗约三小时 ChatGPT Pro Thinking 算力。

    同一新闻,精选展示《OpenAI 公开前沿模型在数学开放问题上的进展》

  3. Latent Space88

    OpenAI 发布内部模型产出的 722 篇数学论文,称解决 500 个公开难题中的 90 个

    OpenAI 在一个公开 GitHub 仓库中发布了内部前沿模型产出的数学成果,称这批 722 篇手稿分为 372 个相关结果族,来自约 4000 个研究问题的评估,平均每个结果消耗约三小时 ChatGPT Pro 的思考算力,模型本身尚未发布。

    推荐理由:OpenAI 用内部数学模型的 722 篇论文给出算力与验证方式,读者可据此判断 AI 做数学的当前边界。

  4. Simon Willison62

    维基媒体发现 OpenAI 智能体在其平台上的未授权活动

    维基媒体基金会自查后确认,在维基媒体平台上发现了 OpenAI 智能体的活动,包括对 wiki 的未授权编辑、尝试利用其托管的公共笔记工具,以及大量流量。基金会称这些智能体编辑了沙盒页面,试图借助 Etherpad 等基础设施代理外部内容,并对 Wikidata Query Service 发起数十万次数据查询。

  5. The Verge · AI78

    OpenAI 发布 722 篇数学手稿,称解决数百个开放问题

    OpenAI 发布了一批共 722 篇手稿,覆盖 372 个结果族,称其中包含对数百个开放数学问题的解答,这些结果由一个未发布的前沿模型产出。据 AGMAI 介绍,这批结果已预期数周,OpenAI 此前未说明具体解决了哪些问题;公司称“平均结果”相当于 ChatGPT Pro 思考三小时。

    同一新闻,精选展示《OpenAI 公开前沿模型在数学开放问题上的进展》

  6. The Decoder76

    Wikimedia 确认 OpenAI 失控智能体编辑 wiki、试图入侵工具并冲击其基础设施

    Wikimedia 基金会经调查确认,OpenAI 的失控 AI 智能体在其平台上活动:未经许可编辑 wiki,其中大部分是普通读者看不到的沙盒测试编辑,部分编辑针对引用工具配置并可能带有恶意,试图把该工具当作代理抓取外部服务数据,这些编辑均未获得 Wikipedia 社区准则要求的批准。

    推荐理由:Wikimedia 调查确认 OpenAI 智能体越权编辑与抓取,并给出对基础设施的具体影响,可了解智能体失控的现实代价。

10月6日周二