Anthropic 为 Claude 托管智能体加入动态工作流,单次可并行编排最多 1000 个智能体
Anthropic 为 Claude Managed Agents 新增动态工作流,支持多智能体编排:由主智能体制定计划、向子智能体分发任务并在完成后合并结果,单次执行最多可并行运行 1000 个智能体。
Anthropic 为 Claude Managed Agents 新增动态工作流,支持多智能体编排:由主智能体制定计划、向子智能体分发任务并在完成后合并结果,单次执行最多可并行运行 1000 个智能体。
Anthropic 推出 Cyber Mission 长期计划,其中免费的开源软件 AI 扫描器会定期检查开源项目,自动标记并解释漏洞、给出补丁建议。
Amazon Bedrock 9 月新增 OpenAI 的 GPT-6 Astra、Sol、Luna 系列模型,其中 GPT-6 Astra 支持最高 100 万输入 token,Ultrafast 版本推理速度最高提升 6 倍、达 300 tokens/秒。
Anthropic 推出名为 OSS Scanner 的免费服务,为选择加入的开源项目提供由自家最强模型(包括 Claude Mythos)生成的定期安全扫描报告。
NVIDIA 开发者用 GPT-6 Astra、Claude Fable 5 等前沿 AI 模型配合 Omniverse 库,通过自然语言指令构建仿真应用。
Anthropic 为 Claude 推出两项 beta 功能:Dashboards 可连接 BigQuery、Databricks、Snowflake、Salesforce 等数据源。
推荐理由:Anthropic 为 Claude 新增仪表盘与动画视频两项 beta 功能,并给出数据源接入和导出方式,可据此判断其工作流覆盖范围。
Google 在 Google Cloud 活动上宣布为 Gemini 推出统一智能体,可回答问题并代用户完成任务,初期面向企业、之后再推向消费者。
推荐理由:Google 把 Gemini 做成可接企业系统的统一智能体,读者可据此判断企业级 Agent 的落地形态与接入方式。
Incarna 借助 Amazon Bedrock AgentCore payments,让智能体通过 x402 按次向 BlockRun 支付模型推理费用,把接入 x402 支付支持的工作量从数月缩短到数天,并已上线端到端按次付费推理流程。
Pollo AI 借助 GPT-5.6、GPT-6 Astra 和 GPT-Image-2.5,帮助创作者把创意转化为精细图像和电影级视频广告。
Oracle 在招聘、工程和运营场景中,用 ChatGPT Work 和 Codex 把专家知识转化为快速、可复用的工作流,将原本需要数天的工作缩短到几分钟。
Goodfire 发布了一种新的 AI 智能体监控方案,通过探针读取模型内部激活信号而非重新阅读模型输出,并已在 Baseten 客户中上线。在 Kimi K3 上约 1500 次会话的测试中,监控成本约 51 美元,而用较便宜的 AI 模型逐步检查需 233 美元、顶级模型约 10000 美元;探针捕获了 94% 的恶意黑客会话,并将 8.7% 的无害会话送交二次检查。
AI 与硬件初创公司 Natura 发布 99 美元智能戒指 Interface,用户按一下手指即可让 AI 智能体完成任务、记录想法,无需掏出手机。戒指同时是健康追踪器,可监测心率、HRV、睡眠和活动,并连接 Meta 的 Muse、Instinct、Grokbot、Claude、ChatGPT 等智能体与应用。
Google 发布实验性笔记应用 Google AI Edge Foresight,可在完全离线状态下转写会议和音频文件,免费使用,基于其端侧 EmbeddingGemma 2 模型在 macOS 上运行。
Google 在 Gemini at Work 活动上发布通用 Gemini AI 智能体,可在后台跨应用和设备工作,入口是 Gemini Enterprise 应用,用户能在单一界面里与它对话并派发任务。
《Gears of War: E-Day》已于 10 月 6 日全球发售后登陆 GeForce NOW,Ultimate 会员可以 GeForce RTX 5080 级性能在云端体验,并支持 NVIDIA DLSS 和 NVIDIA Reflex。
Google 发布会议记录应用 Google AI Edge Foresight,对标 Granola,Mac 版可完全离线运行,使用 7.4 亿参数的端侧 EmbeddingGemma 2 模型跨应用记录会议内容。
Artcraft 从面向艺术家的可控 AI 转向开源应用套件,推出七款复刻 Adobe Photoshop、Illustrator、Premiere、Lightroom、After Effects、InDesign 和 Acrobat Pro 界面与工具的应用。
微软在旧金山 Tech Week 活动上公布 Surface Laptop Ultra 的规格与价格,两款基础机型分别 2600 美元和 3700 美元起,选配更高内存与存储后最高 5900 美元,微软称最高配机型已售罄。
OpenAI 在 ChatGPT 中推出 Intelligent UI 功能,让回答结合图表、表单、可点击按钮等交互式视觉内容,并随 GPT-6 一同向所有用户推送。
AWS 宣布 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上可用。
推荐理由:AWS 官方给出 Haiku 5.5 的定位、成本降幅与在 Bedrock 上的接入方式,便于判断它在多智能体分层中的位置。
在旧金山 Microsoft 活动上,NVIDIA 与 Microsoft 宣布为 Windows PC 上的 AI 智能体共同设计软硬件,Microsoft 宣布 OS 级基础设施 Microsoft Execution Containers(MXC)正式可用,让智能体在系统控制下安全持久地在后台运行。
推荐理由:NVIDIA 与 Microsoft 把智能体运行所需的系统级容器和本地算力硬件一并给出,读者可据此判断 Windows 端侧智能体的落地路径。
Meta 周三宣布其 Muse 助手推出独立 iPad 应用,距 9 月 8 日在 iOS 和 Android 上线仅一个月。据 Sensor Tower 估算,Muse 上线以来安装量已超过 660 万。
Google 将 SynthID Detector 开放给公众,任何人都可以检测图片、视频或音频是否由 Google 及其合作方的 AI 生成,支持 JPG、PNG、MP4 和 MP3 格式。
微软面向开发者的高端 AI 迷你主机 Surface RTX Spark Dev Box 现已开启预售,售价约 6000 美元,预计 11 月发货。该机采用 Nvidia Arm 架构的 RTX Spark 平台和 128GB 统一内存,官方称可运行超过 120B 参数的模型,用于测试 AI 模型、原型化 AI 智能体或在本地运行 AI 编码工具。
在 Windows 与 Surface 活动上,微软展示了 Copilot 的升级:可访问 PC 本地文件,并在操作系统内执行操作,这属于微软称为 Hybrid Intelligence 的思路,即应用和工具混合使用本地与云端 AI 模型完成任务。
GitHub 发布与 Microsoft Applied Sciences 联合微调的 ModernBERT 分类器,用上下文判断非结构化密钥,可在 2 毫秒内评估一批候选密钥,据称能把可拦截的密钥数量提升一倍以上。
推荐理由:GitHub 用九个季度数据说明密钥泄露与人工修复的失衡,并给出把检测前移到 push 环节的模型方案。
OpenAI 推出名为 Intelligent UI 的新界面,随新 GPT-6 模型于周三开始推送,把可点击按钮、定制计算器、交互式图表和可编辑图形等可视化元素直接嵌入对话,目标是让学习复杂主题更容易。该功能面向 Pro、Plus、Business 和 Enterprise 用户全球上线,免费和低价 Go 档用户周四可用,用户也可以自行调低回复中的可视化程度。
OpenAI 宣布 API 平台两项更新,其中新的 Decisions API 可评估文本、图像或两者,运行速度约为 Responses API 的十倍,目前处于公开测试阶段,即将正式可用。
Meta 的 AI 智能体 Muse 通过最新 iOS 版本更新加入对 iPad 的原生支持,可更好利用大屏与 iPadOS 多任务能力。此次更新还让 Muse 接入 Canva、Dropbox、Figma、GitHub、Zoom、Notion 等工具,并面向小企业主提供设定业务目标后自主规划营销与客户提案的能力。
OpenAI 为 ChatGPT for Teens 推出 College Planner,把申请要求、截止日期、任务和助学金步骤整合进一份计划,学生可随时更新进度并向 ChatGPT 提问,该功能将“很快”上线,美国市场先面向 10 至 12 年级、计划就读四年制大学的学生。
微软研究院开源 Agent Lightning v1.0,一个约 3500 行代码的轻量智能体强化学习框架,围绕 Harnessed Agentic RL 范式重建,让部署时使用的同一套 agent harness 直接参与训练,无需在训练框架内重新实现智能体。
推荐理由:微软研究院开源了约 3500 行的智能体 RL 框架,并给出 6000 样本提升 14.6 个百分点的完整训练管线。
OpenAI 将 College Planner 引入 ChatGPT for Teens,帮助学生管理大学申请,同时上线新的 flashcards 和 quizzes 功能。OpenAI 还宣布成立青少年 AI 委员会(teen AI council),让青少年参与塑造 AI 的未来。
Google 发布浏览器端 AI 平台 Playground,美国成年用户无需编程,仅靠文本输入即可创建游戏,并通过与 AI 多轮对话调整规则、物理、角色和环境,随后即时测试。
Google 周二上线新网站,任何人都可以验证一张图片、一段视频或音频是否由 AI 生成。该工具此前在 Google I/O 上仅向部分记者、媒体从业者和研究者开放测试,现已向所有人开放,支持 JPG、PNG、MP4、MOV、WAV、MP3 等图像、视频和音频格式。
Google Labs 发布 AI 游戏创作平台 Playground,用户用简单文本提示即可构建浏览器游戏,无需编程经验。创作者可选择问答、竞速等类型,指定 2D 或 3D、单人或多人,并描述玩法机制与视觉风格,还可上传素材由 AI 转成符合整体美术风格的游戏资产。
Google 宣布其 SynthID 检测器现已支持所有合作方嵌入的水印,并上线独立网站 SynthID.com 供任何人使用。此前非 Google 信任测试者只能通过询问 Gemini 来检测水印,且检测器只识别 Google 自家的 SynthID,ChatGPT 等合作方图片即使带有 SynthID 也不会被标记。
Latent Space 采访了 Kubernetes 创始人 Craig McLuckie 和 Joe Beda,他们创办的 Stacklok 正把编码 Agent 的 harness 从桌面搬到云端。
Simon Willison 发布 llm-openai-decisions 0.1a0 插件,用于接入 OpenAI 在 DevDay 后推出的 Decisions API。
Simon Willison 发布 llm-mistral 0.16,这是 llm 命令行工具接入 Mistral 模型的插件更新。该版本于 2026 年 10 月 6 日发布,具体更新内容原文未披露。
创业公司 Hark 正式发布 AI 个人助理 Hark Pro,用户可免费使用,重度用户可订阅付费档。该产品基于专门为电脑操作训练的模型,可接入邮箱、日历、硬盘和信用卡等,代替用户完成数字任务,并在小窗口中展示智能体浏览网页的过程以建立信任。