跳到正文
10月9日周五
  1. The Decoder80

    数学家呼吁抵制 OpenAI,AI 生成证明大量涌入数学领域

    数学界部分人士呼吁抵制 OpenAI,起因是该公司一次性放出 700 多份 AI 生成的数学证明文件,被一个顾问小组称为展示力量而非学术成果。菲尔兹奖得主 Terence Tao 在其博客转发该声明,并提出数学应进入不再以解题为主要衡量标准的 Math 2.0 时代;Scott Aaronson 则称这一局面为 Mathocalypse。

    推荐理由:围绕 OpenAI 一次性放出 700 多份 AI 数学证明文件,呈现数学界抵制呼声与两种合作模式的对比。

  2. The Verge · AI62

    USA Today 起诉 OpenAI,索赔超 2.5 亿美元

    USA Today 公司及其旗下多家地方报纸起诉 OpenAI,指控其未经授权复制“数十万篇”文章用于训练 AI 模型,并索赔超过 2.5 亿美元。诉状称 OpenAI 的商业成功建立在“大规模版权侵权”之上,从未就使用其内容请求许可。

  3. TechCrunch · AI65

    OpenAI 数学解答未达学界标准,AGMAI 准则与形式化缺口受质疑

    OpenAI 本周发布数百个高难数学问题的解答,称已咨询精英数学家顾问组,但未完全达到学界标准。普林斯顿高等研究院的 AGMAI 提出首要要求是停止在专有模型上测试高难数学问题,而 OpenAI 明确表示正用开放研究问题评估其专有模型;719 份手稿中仅 10 份公开了模型的思维链,仅 42% 的证明未经过形式化。

  4. TechCrunch · AI38

    Anthropic 更新使用政策:禁止模型滥用与选举干预

    Anthropic 周四更新使用政策,新增禁止选举干预、武器软件与监控等条款,并明确禁止用户对模型进行持续言语辱骂。该政策称仅适用于用户反复恶意对待模型且无明显目的的极端情况,不涉及常见的用户不满、反驳或黑暗创作主题。政策另设“不得破坏民主进程”章节,禁止用 Claude 运营虚假账号、捏造新闻媒体或欺骗选民。

  5. TechCrunch · AI71

    OpenAI 年化收入据报比此前预期低约 200 亿美元

    据《金融时报》报道,OpenAI 已告知投资者其年化收入“接近 500 亿美元”,比此前流传的接近 700 亿美元低约 200 亿美元。此前 700 亿美元的数字来自 OpenAI 投资者为与 Anthropic 年化收入做直接对比而进行的推算,两家公司计算年化收入的方式不同,Anthropic 会计入云合作伙伴的销售额,OpenAI 则不计入。

  6. TechCrunch · AI30

    Ben Affleck 谈 AI:从卷积神经网络到微调开源视频模型,好莱坞演员的技术素养走红网络

    Ben Affleck 本周因多段采访视频展示其对 AI 技术的理解而走红,他谈及卷积神经网络、Transformer、张量、GPU 和推理等概念,并称自己会写 Python。他透露曾拜访 OpenAI,创立了 16 人的 AI 影视初创公司 InterPositive,通过解冻权重微调开源视频模型,仅训练最后一层电影化层以达制作标准,该技术已用于其电影《Animals》的后期制作。

  7. TechCrunch · AI60

    Goodfire 推出 inside-out 监控器,以更低成本拦截失控 AI 智能体

    Goodfire 发布了一种新的 AI 智能体监控方案,通过探针读取模型内部激活信号而非重新阅读模型输出,并已在 Baseten 客户中上线。在 Kimi K3 上约 1500 次会话的测试中,监控成本约 51 美元,而用较便宜的 AI 模型逐步检查需 233 美元、顶级模型约 10000 美元;探针捕获了 94% 的恶意黑客会话,并将 8.7% 的无害会话送交二次检查。

10月8日周四
  1. Hugging Face Blog42

    TII 推出 Falcon-ASR:1.6B 参数阿拉伯语语音识别模型

    阿布扎比技术创新研究院(TII)发布 Falcon-ASR,一款 1.6B 参数的语音识别模型,重点覆盖阿联酋方言,同时支持英语、法语、西班牙语和葡萄牙语。在六个阿拉伯语测试集上平均 WER 为 20.92%,优于其参考榜单快照中最佳公开结果 23.17%;内部阿联酋方言评测中 WER 22.73%、CER 10.19%,比次优的 Qwen3-Omni 低 4.07 个百分点。

  2. The Decoder80

    Zenity Labs:一个公开 AI 智能体可接管 AWS 账户内全部 AgentCore 智能体

    安全公司 Zenity Labs 发现 Amazon Bedrock AgentCore 存在一串被其称为 AgentCorruption 的漏洞:攻击者只需对一个公开智能体拥有聊天权限,用一条提示词就能接管同一 AWS 账户和区域内所有 AgentCore 智能体,读取私密对话、源代码和存储的凭证。

    推荐理由:Zenity Labs 披露 AWS AgentCore 默认权限可让单个公开智能体接管同区域全部智能体,并给出 AWS 的修复动作。

  3. TechCrunch · AI62

    Manus 与 Meta 拆分后首轮融资超 5 亿美元

    Manus 母公司 Butterfly Effect 在微信公告中称已完成超 5 亿美元融资,这是 Meta 被迫取消 20 亿美元收购后该公司的首轮融资,由博裕资本和 IDG 资本领投,腾讯、HSG、真格基金等现有股东参投。

  4. Ars Technica · AI58

    Nvidia 押注物理 AI,推出 Halos for Robotics 安全系统

    Nvidia 在物理 AI 领域投入数十亿美元,其 Halos 安全系统于 2025 年推出,为自动驾驶汽车等自主车辆提供硬件和软件护栏工具。2026 年 6 月,Nvidia 将该安全架构扩展到更多物理 AI 技术,发布 Nvidia Halos for Robotics,目标是让仓库自主移动机器人、工厂内人形机器人乃至手术机器人实现安全部署。

  5. The Decoder80

    AI 黑客工具助单一攻击者入侵多家韩国银行

    CrowdStrike 报告称,一名疑似中文使用者于 2026 年 9 月底至 10 月初攻击多家韩国金融机构并窃取大量数据,仅新韩银行就有超过 25000 条含姓名、联系方式、收入和信用额度的记录被窃。

    推荐理由:CrowdStrike 披露的攻击案例显示 AI 渗透工具已能支撑单人完成多起银行入侵,可据此观察自动化攻击的现实门槛。