Anthropic 为 Claude 托管智能体加入动态工作流,单次可并行编排最多 1000 个智能体
Anthropic 为 Claude Managed Agents 新增动态工作流,支持多智能体编排:由主智能体制定计划、向子智能体分发任务并在完成后合并结果,单次执行最多可并行运行 1000 个智能体。
Anthropic 为 Claude Managed Agents 新增动态工作流,支持多智能体编排:由主智能体制定计划、向子智能体分发任务并在完成后合并结果,单次执行最多可并行运行 1000 个智能体。
Ai2 用 GPU 时间预算、分层公平分配和时间切片合约替换了原有的优先级调度器,以提升高价值研究获得 GPU 资源的概率。其集群管理数千块 NVIDIA H100、B200 和 B300,规模从 88 到 1024 块 GPU,约 150 名内部研究者的需求长期是可用算力的 2-3 倍。
Postman 披露其 Agent Mode 在 Amazon Bedrock 上的生产架构:通过向量数据库将 170 多个工具按任务动态收窄至约 15 个,避免工具集超过约 40 个后选择错误率上升。
Amazon Bedrock 9 月新增 OpenAI 的 GPT-6 Astra、Sol、Luna 系列模型,其中 GPT-6 Astra 支持最高 100 万输入 token,Ultrafast 版本推理速度最高提升 6 倍、达 300 tokens/秒。
Alexa Plus 是目前最好的智能家居语音助手,能理解"我冷了"这类模糊指令,天气、计时等响应从 2025 年的 10-15 秒缩短到 3-5 秒,还能上传食谱照片边做饭边对话。但它的私人助理功能仍不成熟,Echo Show 上的全屏广告严重破坏体验,作者建议想避开广告可选 Echo Dot Max。
LegalOn 将 Codex 每日预估成本降低 65%,同时保持开发速度。其做法是按任务匹配 Astra、Sol 和 Luna,并对预算进行策略性管理。
作者借助 HuggingChat 中的 ML Intern,在几天内做出六个模型,包括 0.8B 的 Pocket Rewriter、柑橘病害 VLM、Huggy LoRA、相机视角 LoRA、Doodle-in LoRA 和 Agate 4-step 蒸馏模型,总计算成本约 103 美元。
推荐理由:作者用 ML Intern 在两天内做出六个模型,并公开全部提示词与成本明细,可迁移到自己的训练流程。
NVIDIA 开发者用 GPT-6 Astra、Claude Fable 5 等前沿 AI 模型配合 Omniverse 库,通过自然语言指令构建仿真应用。
Incarna 借助 Amazon Bedrock AgentCore payments,让智能体通过 x402 按次向 BlockRun 支付模型推理费用,把接入 x402 支付支持的工作量从数月缩短到数天,并已上线端到端按次付费推理流程。
Goodfire 发布了一种新的 AI 智能体监控方案,通过探针读取模型内部激活信号而非重新阅读模型输出,并已在 Baseten 客户中上线。在 Kimi K3 上约 1500 次会话的测试中,监控成本约 51 美元,而用较便宜的 AI 模型逐步检查需 233 美元、顶级模型约 10000 美元;探针捕获了 94% 的恶意黑客会话,并将 8.7% 的无害会话送交二次检查。
AWS 发布基于 Amazon SageMaker HyperPod 与 EKS 的多租户参考架构,让多个团队共享同一 GPU 集群。
安全公司 Zenity Labs 发现 Amazon Bedrock AgentCore 存在一串被其称为 AgentCorruption 的漏洞:攻击者只需对一个公开智能体拥有聊天权限,用一条提示词就能接管同一 AWS 账户和区域内所有 AgentCore 智能体,读取私密对话、源代码和存储的凭证。
推荐理由:Zenity Labs 披露 AWS AgentCore 默认权限可让单个公开智能体接管同区域全部智能体,并给出 AWS 的修复动作。
《Gears of War: E-Day》已于 10 月 6 日全球发售后登陆 GeForce NOW,Ultimate 会员可以 GeForce RTX 5080 级性能在云端体验,并支持 NVIDIA DLSS 和 NVIDIA Reflex。
Nvidia 在物理 AI 领域投入数十亿美元,其 Halos 安全系统于 2025 年推出,为自动驾驶汽车等自主车辆提供硬件和软件护栏工具。2026 年 6 月,Nvidia 将该安全架构扩展到更多物理 AI 技术,发布 Nvidia Halos for Robotics,目标是让仓库自主移动机器人、工厂内人形机器人乃至手术机器人实现安全部署。
AVEVA 首席技术官 Arti Garg 提出,工业 AI 正从预测分析转向基础模型、物理 AI 与智能体 AI,但因其直接作用于物理系统,必须把安全与可靠性放在部署核心。
微软在两年来的首场线下活动中发布新款 Surface Laptop Ultra,并公布 Windows 11 的一系列改动,同时展示本地 AI 与智能体工作流如何改变个人计算。
微软在旧金山 Tech Week 活动上公布 Surface Laptop Ultra 的规格与价格,两款基础机型分别 2600 美元和 3700 美元起,选配更高内存与存储后最高 5900 美元,微软称最高配机型已售罄。
Amazon Quick 与 Amazon Bedrock Knowledge Bases 新增实时 ACL 校验层,在查询时直接向 Google Drive 等权威源核实权限,与原有的预检索过滤组成两阶段方案。该方案针对复制-过滤模式的三大缺陷:AI 系统并非权限权威源、同步间隔导致权限过期、数据源权限模型持续变化。未授权文档会被排除在检索结果之外,只有通过校验的片段才送入 LLM 生成回答。
AWS 宣布 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上可用。
推荐理由:AWS 官方给出 Haiku 5.5 的定位、成本降幅与在 Bedrock 上的接入方式,便于判断它在多智能体分层中的位置。
在旧金山 Microsoft 活动上,NVIDIA 与 Microsoft 宣布为 Windows PC 上的 AI 智能体共同设计软硬件,Microsoft 宣布 OS 级基础设施 Microsoft Execution Containers(MXC)正式可用,让智能体在系统控制下安全持久地在后台运行。
推荐理由:NVIDIA 与 Microsoft 把智能体运行所需的系统级容器和本地算力硬件一并给出,读者可据此判断 Windows 端侧智能体的落地路径。
微软面向开发者的高端 AI 迷你主机 Surface RTX Spark Dev Box 现已开启预售,售价约 6000 美元,预计 11 月发货。该机采用 Nvidia Arm 架构的 RTX Spark 平台和 128GB 统一内存,官方称可运行超过 120B 参数的模型,用于测试 AI 模型、原型化 AI 智能体或在本地运行 AI 编码工具。
在 Windows 与 Surface 活动上,微软展示了 Copilot 的升级:可访问 PC 本地文件,并在操作系统内执行操作,这属于微软称为 Hybrid Intelligence 的思路,即应用和工具混合使用本地与云端 AI 模型完成任务。
GitHub 发布与 Microsoft Applied Sciences 联合微调的 ModernBERT 分类器,用上下文判断非结构化密钥,可在 2 毫秒内评估一批候选密钥,据称能把可拦截的密钥数量提升一倍以上。
推荐理由:GitHub 用九个季度数据说明密钥泄露与人工修复的失衡,并给出把检测前移到 push 环节的模型方案。
OpenAI 宣布 API 平台两项更新,其中新的 Decisions API 可评估文本、图像或两者,运行速度约为 Responses API 的十倍,目前处于公开测试阶段,即将正式可用。
微软研究院开源 Agent Lightning v1.0,一个约 3500 行代码的轻量智能体强化学习框架,围绕 Harnessed Agentic RL 范式重建,让部署时使用的同一套 agent harness 直接参与训练,无需在训练框架内重新实现智能体。
推荐理由:微软研究院开源了约 3500 行的智能体 RL 框架,并给出 6000 样本提升 14.6 个百分点的完整训练管线。
Cornerstone OnDemand 基于 Amazon Bedrock 和 Strands Agents 构建多智能体系统 Orion AI,将数据库诊断时间从 45 分钟降至 10 分钟,减少 78%。该系统还使手动生命周期步骤减少 70%、SRE 与数据团队报告延迟从 15 分钟降至实时、冗余告警中位数减少 65%,由三人团队在六个月内交付。
AWS 设计了一个为期六周、每周约四小时的结构化项目,让非工程背景的业务人员用 Amazon Bedrock AgentCore、Strands Agents SDK 等生产级工具构建可用的 AI 原型。
针对 AWS DevOps Agent 只诊断不改动生产资源的问题,该方案用 Amazon EventBridge 接收调查完成事件,触发 AWS Lambda Durable Functions 调用 Amazon Bedrock 分析根因并从预批准工具白名单中提出修复动作。
Qlik 基于 Amazon Bedrock 打造 Qlik Answers,为全球超 4 万名客户提供有来源、可验证的自然语言问答。其 Discovery Agent 上线以来已为客户发现超 10 万条异常与离群点,多数启用智能体工具的 Qlik Cloud 账户已在日常使用。
AWS 提出 Agentic Value Model,用于替代按“节省工时×人力成本−建设成本”计算的 RPA 时代 ROI 模型,从时间节省、异常处理、决策质量、变更韧性与维护经济性四个维度衡量 agentic automation 的价值。该框架强调价值实现需有明确机制和责任人,并以理赔分流流程为例说明释放工时并不等于节省成本。
Latent Space 采访了 Kubernetes 创始人 Craig McLuckie 和 Joe Beda,他们创办的 Stacklok 正把编码 Agent 的 harness 从桌面搬到云端。
Simon Willison 发布 llm-openai-decisions 0.1a0 插件,用于接入 OpenAI 在 DevDay 后推出的 Decisions API。
Simon Willison 发布 llm-mistral 0.16,这是 llm 命令行工具接入 Mistral 模型的插件更新。该版本于 2026 年 10 月 6 日发布,具体更新内容原文未披露。
创业公司 Hark 正式发布 AI 个人助理 Hark Pro,用户可免费使用,重度用户可订阅付费档。该产品基于专门为电脑操作训练的模型,可接入邮箱、日历、硬盘和信用卡等,代替用户完成数字任务,并在小窗口中展示智能体浏览网页的过程以建立信任。
Parseable 是一款全新的可观测性工具,兼容 OpenTelemetry,用于存储和查询可观测性数据,提供 AGPL 协议的 Rust 开源实现(单个约 180MB 二进制文件)、带额外功能的企业版以及云托管选项。
EmbeddingGemma 2 采用 Apache 2.0 许可证,Simon Willison 认为嵌入模型不应使用闭源、专有、仅托管的形式。嵌入模型应用通常需计算并存储数千甚至数百万个嵌入向量,若模型专有,厂商一旦停供,用户需付费重新计算已存储的向量。他更愿付费使用托管版本,同时保留自行运行开放权重版本或另寻供应商的余地。
基于 Amazon Bedrock AgentCore 运行时与开源智能体系统 OpenClaw,可构建具备持久记忆的上下文感知 AI 助手。AgentCore memory 将一次性对话转为长期知识,并支持结构化元数据标签检索;文本与图像分别路由至 Claude Haiku 4.5 和 Claude Sonnet 4.5。
Google Research 展示 Google Earth AI 的 Population Dynamics Foundation Model(PDFM)作为公共卫生概念验证:它把匿名搜索趋势、人口流动、建成环境密度和环境因素压缩为按月更新的位置嵌入向量,无需任务微调即可直接接入现有流行病学模型。
基于 Amazon Bedrock AgentCore、Amazon Nova 2.5 Sonic 和 Amazon Bedrock Knowledge Bases,可构建航空应用中的语音旅行助手,支持改座位、查延误、更新餐食偏好、回答政策问题并转接人工客服。
Amazon SageMaker Studio 新增 HyperPod Spaces 管理界面,数据科学家无需 CLI 或 kubectl,即可在浏览器中创建、配置、启停并打开 HyperPod EKS 集群上的 JupyterLab 和 Code Editor 环境。