跳到正文
今天10月10日周六6 条
  1. TechCrunch · AI28

    Amazon 放弃数据中心 NDA,AI 智能体想要你的信用卡

    Amazon 宣布在与地方政府谈判数据中心交易时不再使用 NDA,此前 Microsoft 今年早些时候已采取类似举措。保密做法引发的社区反对已导致从纽约到旧金山数百项拟议和已生效的禁令。与此同时,一批初创公司押注消费者愿意让 AI 智能体访问自己的收件箱、文件和信用卡,前提是能让网站放行。

  2. TechCrunch · AI38

    Amazon 效仿 Microsoft 停止在数据中心交易中使用 NDA,能否重建社区信任?

    Amazon 宣布在与地方政府谈判数据中心交易时将不再使用保密协议(NDA),此前 Microsoft 今年早些时候已采取类似举措。保密做法此前加剧了社区对 AI 基础设施的反对,从纽约到旧金山已出现数百项拟议和已颁布的禁令。TechCrunch Equity 播客本期还讨论了个人 AI 初创公司为何把信任当作真正的产品。

10月9日周五
  1. The Verge · AI40

    Instinct 如何对抗 Muse 和 Dots:一款没有 App 的 AI 智能体

    Instinct 是一款仅靠 iMessage、WhatsApp 或邮件交互的 AI 智能体,无 App、无月费,需邀请或等待名单批准,9 月底公司估值达 100 亿美元。面对 OpenAI 的 Muse 和 Dots 竞争,创始人 Noah Shinn 称其专注日常个人助理场景,测试中能完成预约、邮件跟进和 Ikea 退货等任务,但也会漏掉网页弹窗中的关键信息。

  2. Hugging Face Blog74

    作者用 ML Intern 两天训练六个模型,总花费约 103 美元

    作者借助 HuggingChat 中的 ML Intern,在几天内做出六个模型,包括 0.8B 的 Pocket Rewriter、柑橘病害 VLM、Huggy LoRA、相机视角 LoRA、Doodle-in LoRA 和 Agate 4-step 蒸馏模型,总计算成本约 103 美元。

    推荐理由:作者用 ML Intern 在两天内做出六个模型,并公开全部提示词与成本明细,可迁移到自己的训练流程。

  3. TechCrunch · AI60

    Goodfire 推出 inside-out 监控器,以更低成本拦截失控 AI 智能体

    Goodfire 发布了一种新的 AI 智能体监控方案,通过探针读取模型内部激活信号而非重新阅读模型输出,并已在 Baseten 客户中上线。在 Kimi K3 上约 1500 次会话的测试中,监控成本约 51 美元,而用较便宜的 AI 模型逐步检查需 233 美元、顶级模型约 10000 美元;探针捕获了 94% 的恶意黑客会话,并将 8.7% 的无害会话送交二次检查。

10月8日周四
  1. The Decoder80

    Zenity Labs:一个公开 AI 智能体可接管 AWS 账户内全部 AgentCore 智能体

    安全公司 Zenity Labs 发现 Amazon Bedrock AgentCore 存在一串被其称为 AgentCorruption 的漏洞:攻击者只需对一个公开智能体拥有聊天权限,用一条提示词就能接管同一 AWS 账户和区域内所有 AgentCore 智能体,读取私密对话、源代码和存储的凭证。

    推荐理由:Zenity Labs 披露 AWS AgentCore 默认权限可让单个公开智能体接管同区域全部智能体,并给出 AWS 的修复动作。

  2. The Decoder80

    AI 黑客工具助单一攻击者入侵多家韩国银行

    CrowdStrike 报告称,一名疑似中文使用者于 2026 年 9 月底至 10 月初攻击多家韩国金融机构并窃取大量数据,仅新韩银行就有超过 25000 条含姓名、联系方式、收入和信用额度的记录被窃。

    推荐理由:CrowdStrike 披露的攻击案例显示 AI 渗透工具已能支撑单人完成多起银行入侵,可据此观察自动化攻击的现实门槛。

  3. Google Research66

    Google Research 三个月实验:AI 辅助提升专利撰写产出,但初级律师无辅助判断力未同步提升

    Google Research 在 NBER 发布三个月实地实验,将 133 名专利律师随机分为两组,一组提前使用当时未发布的 Google Labs AI 专利撰写工具(现属 Gemini Notebook)。

    推荐理由:三个月专利撰写实验区分了AI带来的即时产出提升与无辅助判断力的变化,为评估AI对专业能力的影响提供了可迁移的实验设计。

  4. The Decoder82

    Anthropic 发布 Claude Haiku 5.5,价格最高下调 90%

    Anthropic 发布 Claude Haiku 5.5,这是其迄今最快、最便宜的小模型,平均价格比 Haiku 4.5 低约 75%,10 万 token 以内提示词的价格降幅最高达 90%,超过 10 万 token 则贵 5 倍。

    推荐理由:对比 Haiku 4.5 与 GPT-6 Luna 的基准和分档定价,可看清小模型在成本敏感任务上的取舍。

  5. NVIDIA Blog78

    NVIDIA 与 Microsoft 发布 RTX Spark 及 Windows 智能体基础设施

    在旧金山 Microsoft 活动上,NVIDIA 与 Microsoft 宣布为 Windows PC 上的 AI 智能体共同设计软硬件,Microsoft 宣布 OS 级基础设施 Microsoft Execution Containers(MXC)正式可用,让智能体在系统控制下安全持久地在后台运行。

    推荐理由:NVIDIA 与 Microsoft 把智能体运行所需的系统级容器和本地算力硬件一并给出,读者可据此判断 Windows 端侧智能体的落地路径。

  6. The Verge · AI32

    Meta 的 AI 智能体 Muse 登陆 iPad

    Meta 的 AI 智能体 Muse 通过最新 iOS 版本更新加入对 iPad 的原生支持,可更好利用大屏与 iPadOS 多任务能力。此次更新还让 Muse 接入 Canva、Dropbox、Figma、GitHub、Zoom、Notion 等工具,并面向小企业主提供设定业务目标后自主规划营销与客户提案的能力。

  7. Microsoft Research71

    微软研究院开源 Agent Lightning v1.0:约 3500 行的轻量智能体 RL 框架

    微软研究院开源 Agent Lightning v1.0,一个约 3500 行代码的轻量智能体强化学习框架,围绕 Harnessed Agentic RL 范式重建,让部署时使用的同一套 agent harness 直接参与训练,无需在训练框架内重新实现智能体。

    推荐理由:微软研究院开源了约 3500 行的智能体 RL 框架,并给出 6000 样本提升 14.6 个百分点的完整训练管线。

  8. AWS Machine Learning Blog38

    Cornerstone OnDemand 如何用 Amazon Bedrock 将数据库诊断时间缩短 78%

    Cornerstone OnDemand 基于 Amazon Bedrock 和 Strands Agents 构建多智能体系统 Orion AI,将数据库诊断时间从 45 分钟降至 10 分钟,减少 78%。该系统还使手动生命周期步骤减少 70%、SRE 与数据团队报告延迟从 15 分钟降至实时、冗余告警中位数减少 65%,由三人团队在六个月内交付。