跳到正文
今天10月10日周六5 条
  1. The Verge · AI88

    OpenAI 一次性发布近 400 项 AI 生成数学成果,数学家称需数年消化

    OpenAI 本周发布近 400 项 AI 生成的数学结果,分布在 700 多份手稿中,覆盖组合数学、几何、数论、理论计算机科学、代数、拓扑、概率与统计力学及数学物理等领域。

    推荐理由:通过数十位数学家的第一手反应,呈现OpenAI大规模数学成果发布对学术界的实际冲击与验证缺口。

  2. TechCrunch · AI28

    Amazon 放弃数据中心 NDA,AI 智能体想要你的信用卡

    Amazon 宣布在与地方政府谈判数据中心交易时不再使用 NDA,此前 Microsoft 今年早些时候已采取类似举措。保密做法引发的社区反对已导致从纽约到旧金山数百项拟议和已生效的禁令。与此同时,一批初创公司押注消费者愿意让 AI 智能体访问自己的收件箱、文件和信用卡,前提是能让网站放行。

10月9日周五
  1. The Verge · AI40

    Instinct 如何对抗 Muse 和 Dots:一款没有 App 的 AI 智能体

    Instinct 是一款仅靠 iMessage、WhatsApp 或邮件交互的 AI 智能体,无 App、无月费,需邀请或等待名单批准,9 月底公司估值达 100 亿美元。面对 OpenAI 的 Muse 和 Dots 竞争,创始人 Noah Shinn 称其专注日常个人助理场景,测试中能完成预约、邮件跟进和 Ikea 退货等任务,但也会漏掉网页弹窗中的关键信息。

  2. MIT Technology Review · AI32

    我们过于相信 AI 说“不”的能力

    MIT Technology Review 指出,AI 的拒绝机制已成为 AI 安全的核心,但这一机制并不可靠。Anthropic 2021 年提出模型应 helpful、honest、harmless,如今模型经大量拒绝训练后仍可能被绕过,部分用户正试图用最先进 AI 研发生物病原体和自主无人机蜂群。

  3. The Decoder80

    数学家呼吁抵制 OpenAI,AI 生成证明大量涌入数学领域

    数学界部分人士呼吁抵制 OpenAI,起因是该公司一次性放出 700 多份 AI 生成的数学证明文件,被一个顾问小组称为展示力量而非学术成果。菲尔兹奖得主 Terence Tao 在其博客转发该声明,并提出数学应进入不再以解题为主要衡量标准的 Math 2.0 时代;Scott Aaronson 则称这一局面为 Mathocalypse。

    推荐理由:围绕 OpenAI 一次性放出 700 多份 AI 数学证明文件,呈现数学界抵制呼声与两种合作模式的对比。

  4. The Verge · AI62

    USA Today 起诉 OpenAI,索赔超 2.5 亿美元

    USA Today 公司及其旗下多家地方报纸起诉 OpenAI,指控其未经授权复制“数十万篇”文章用于训练 AI 模型,并索赔超过 2.5 亿美元。诉状称 OpenAI 的商业成功建立在“大规模版权侵权”之上,从未就使用其内容请求许可。

  5. TechCrunch · AI65

    OpenAI 数学解答未达学界标准,AGMAI 准则与形式化缺口受质疑

    OpenAI 本周发布数百个高难数学问题的解答,称已咨询精英数学家顾问组,但未完全达到学界标准。普林斯顿高等研究院的 AGMAI 提出首要要求是停止在专有模型上测试高难数学问题,而 OpenAI 明确表示正用开放研究问题评估其专有模型;719 份手稿中仅 10 份公开了模型的思维链,仅 42% 的证明未经过形式化。

  6. TechCrunch · AI71

    OpenAI 年化收入据报比此前预期低约 200 亿美元

    据《金融时报》报道,OpenAI 已告知投资者其年化收入“接近 500 亿美元”,比此前流传的接近 700 亿美元低约 200 亿美元。此前 700 亿美元的数字来自 OpenAI 投资者为与 Anthropic 年化收入做直接对比而进行的推算,两家公司计算年化收入的方式不同,Anthropic 会计入云合作伙伴的销售额,OpenAI 则不计入。

10月8日周四
  1. The Decoder82

    Anthropic 发布 Claude Haiku 5.5,价格最高下调 90%

    Anthropic 发布 Claude Haiku 5.5,这是其迄今最快、最便宜的小模型,平均价格比 Haiku 4.5 低约 75%,10 万 token 以内提示词的价格降幅最高达 90%,超过 10 万 token 则贵 5 倍。

    推荐理由:对比 Haiku 4.5 与 GPT-6 Luna 的基准和分档定价,可看清小模型在成本敏感任务上的取舍。

  2. TechCrunch · AI78

    OpenAI 随 GPT-6 推出 Intelligent UI,ChatGPT 界面转向可视化

    OpenAI 推出名为 Intelligent UI 的新界面,随新 GPT-6 模型于周三开始推送,把可点击按钮、定制计算器、交互式图表和可编辑图形等可视化元素直接嵌入对话,目标是让学习复杂主题更容易。该功能面向 Pro、Plus、Business 和 Enterprise 用户全球上线,免费和低价 Go 档用户周四可用,用户也可以自行调低回复中的可视化程度。

    同一新闻,精选展示《OpenAI 全球上线 GPT-6,ChatGPT 引入 Intelligent UI》

10月7日周三
  1. The Decoder78

    Common Sense Media 将 ChatGPT 青少年版评为不可接受风险,家长警报在自杀对话中未触发

    Common Sense Media 青年 AI 安全研究所用 4000 多条测试提示评估 ChatGPT 青少年版,将其评为对未成年人不可接受风险,并呼吁在独立测试确认安全前禁止青少年使用。

    推荐理由:独立机构用 4000 多条测试提示评估 ChatGPT 青少年防护,家长警报在自杀对话中未触发,为正在进行的诉讼和监管提供依据。