斯坦福 HomeBody 让 GPT-6 Astra 接上宇树 G1 收拾厨房
斯坦福团队在 HomeBody 项目中让 GPT-6 Astra 控制宇树 G1 进入陌生厨房,先探索建图,再按语言指令收拾物品、丢弃纸盒,甚至从视野外的抽屉取药递给人。
斯坦福团队在 HomeBody 项目中让 GPT-6 Astra 控制宇树 G1 进入陌生厨房,先探索建图,再按语言指令收拾物品、丢弃纸盒,甚至从视野外的抽屉取药递给人。
阿里云瓴羊在2026云栖大会推出「AI员工7日上场计划」,企业出真实业务题,瓴羊FDE带AI员工进场,7天内完成场景诊断、方案设计和POC验证,并交付上岗前后效果对比,发布当天27家企业签署意向书。其AgentOne上的营销、销售、客服、运营四类AI员工已于7月底上岗,公式为Data+Agent+FDE=AI员工,验收标准是能干、能信、能打。
H 公司发布 Holo4 系列智能体模型,包含 27B 稠密版和 35B-A3B MoE 版,两者均已在 H Models API 上线,权重以 BF16、FP8、NVFP4 和 4-bit GGUF 格式开源在 Hugging Face。
推荐理由:Holo4 同时覆盖 GUI、代码、MCP 与 API 四种接口,并公开全部评测轨迹,读者可据此判断通用计算机操作智能体的成本与能力边界。
GitHub Copilot 应用中的 canvas 是一种可自定义的双向界面,用户只需在 agent 会话中输入 /create-canvas 并用自然语言描述需求,即可生成看板、发布清单或仪表盘等界面,无需编写代码。canvas 会保存为扩展,可随项目共享或作为个人扩展复用,社区已在 Awesome Copilot 分享现成模板。
GitHub Copilot 应用推出 canvas,一种运行在应用内、无浏览器外壳的全栈小应用,可与 Copilot 智能体双向通信,并能在本地执行代码、调用第三方 API。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会自动识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分诊并生成漏洞报告。
推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃分诊交给 LLM 智能体,并公开了可复用的开源流水线。
Simon Willison 发布 LLM 插件 llm-typesafe 0.1a0,为 TypeSafe AI 的新模型 Jev 提供支持,可通过 `llm install llm-typesafe` 安装并设置 API key 使用。该插件支持三类提问:返回 0.99 这类置信度的 yes/no "noul" 问题、choice 选项分类问题,以及 score 评分问题。
Simon Willison 反驳“MCP 一直是坏主意”的观点,认为在 Claude Code、Codex、Meta Muse、OpenClaw 等拥有无限制互联网访问的终端智能体之外,MCP 仍能提供对可访问外部服务的精确控制、不让智能体直接接触 API key 的认证方式、供用户连接并认证更多服务的合理 UI,以及强审计日志。
Simon Willison 发布 llm-keys-ui 0.1 插件,用于在不向 ChatGPT 应用或智能体会话粘贴 API key 的情况下,把密钥配置到远程机器上。
Latent Space 的 AINews 汇总了 Jev 发布两天内出现的 6 个复现或克隆方案,包括基于 ModernBERT 与扩散模型的猜测、Bespoke Nimble 的 Qwen3.5-9B LoRA 微调、SemIf 的 4B 与 35B Qwen3.5 骨干加三分类 NLI 分类器、Jevlike 的 40K byte 嵌入方案以及 Kev-0.5B 等。
GitHub Podcast 最新一期拆解了五个 AI 热门观点:AI 生成的代码仍需阅读和负责,只是审查力度应按风险分级;Skills 与 MCP 解决不同问题,前者是打包的团队经验,后者是智能体连接工具与数据的标准,二者可组合使用;RAG 并未消亡,它让模型基于训练数据外的文档、内部知识或代码库上下文作答,能减少 token 浪费并降低答案不完整的概率。
Latent Space 的 AINews 汇总了 9/16-9/17 的 AI 动态:Anthropic 在 Claude Code 中推出 Projects,一次对话可派生多个云端并行会话、在线程间传递上下文并在用户离开后继续运行,本地工作流后续支持。
GitHub 日本和韩国营销负责人把活动运营流程交给 GitHub Copilot,从单个 GitHub Issue 出发自动完成落地页复制、UTM 链接生成、报名名单清洗和会后 CRM 整理。
Google Research 提出 ToolGrad,一种“先答案后问题”的工具调用数据生成范式:先生成真实工具调用链,再反推用户提示词,替代 ToolBench、ToolACE 等基于 DFS 试错搜索的查询优先方案。
OpenAI 发布 Agents API,用于构建和上线云端智能体。该服务为托管式,由 Codex harness 提供编排、长时间运行会话和工具调用支持。
推荐理由:OpenAI 官方发布托管式 Agents API,读者可了解其编排、长会话与工具调用能力。
Hugging Face 团队用 Gradio Workflow 重建了 AUTOMATIC1111 的大部分功能,做成名为 Workflow1111 的画布,由 11 条媒体流水线和 73 个节点组成,覆盖文生图、高清修复、图生图、提示词矩阵、VLM 反推、检测生成 inpaint 掩码、ControlNet 风格标注器、背景移除、PNG Info 存储和图生视频。
推荐理由:原文用 73 个节点复刻 A1111 的十一条图像流水线,并说明输出如何变成 REST 端点和 MCP 工具。
Hugging Face 发布 funes,一个面向编码智能体的持久记忆层,支持 Claude Code、Codex、pi 和 Hermes,通过一条 add 命令把本机已有会话索引为可检索记忆。
推荐理由:funes 把编码智能体的会话轨迹变成可检索的本地记忆,并给出跨机器、跨智能体共享的用法与成本对比。
Mistral 发布 Agentic Search,一个让模型在多步检索循环中查找、检查和验证信息的检索层,通过 Mistral Search Toolkit 提供,并内置于 Studio 和 Vibe 的 Libraries 中。
推荐理由:原文给出多步检索循环的工具设计与两组基准数字,可据此判断传统一次性 RAG 在长文档场景的边界。
Mistral Studio 即日起为 Prompts 和 Skills 提供集中式系统记录,支持版本管理、归属追踪和审计日志。每个版本不可篡改,可对比回滚,资产有明确负责人和分类标签,并可通过 MCP 服务器直接调用。该功能面向 Mistral Studio 客户开放,数据保留在用户自有边界内。
Mistral AI 为 Connectors 推出多项新能力:按工作区或组织设置连接器访问权限、按工具粒度开关,以及带连接器作用域的 API key,用于防止自动化 AI 工作负载冒充用户。
Mistral 将 Le Chat 升级为统一 AI 智能体 Vibe,同时覆盖办公与编码场景,原有对话、设置和订阅方案全部保留。
推荐理由:Mistral 把 Le Chat 升级为统一智能体 Vibe,同时覆盖办公长任务与编码流程,读者可据此判断其与现有 Agent 产品的差异。
Mistral AI 发布 Search Toolkit 公开预览版,一个用于构建 AI 应用生产级搜索管线的可组合框架,将数据摄取、检索与评测整合到共享接口下,开源并支持云端、本地和边缘部署。
推荐理由:Mistral 把检索、索引与评测收进同一框架,读者可据此判断自建 RAG 管线的整合成本是否被压缩。
Mistral AI 在 Studio 发布 Connectors,内置连接器和自定义 MCP 均可通过 API/SDK 用于所有模型与 Agent 调用,目前处于 Public Preview。
推荐理由:原文给出连接器注册、直接工具调用与人工审批三段能力,读者可据此判断企业级 Agent 集成层的落地方式。
Mistral AI 发布企业 AI 编排层 Workflows 公开预览版,提供持久化执行、可观测性和人工介入能力,ASML、ABANCA、CMA-CGM、France Travail、La Banque Postale、Moeve 等客户已用它自动化关键流程。
推荐理由:Mistral 把企业级 AI 编排的持久化执行、可观测与人工审批打包进 Studio,读者可据此判断生产化落地的门槛变化。
Mistral AI 发布 CLI 工具 Spaces,同时面向人类开发者与编码智能体。它通过 `spaces init`、`spaces dev` 等命令完成项目脚手架、开发环境与部署,并为每个交互式提示提供等价的 flag 或配置文件,使智能体可自主操作。每次 init 还会生成 context.json 与 AGENTS.md,帮助智能体理解项目结构、端口与命令。
Mistral 发布 Leanstral,称其为首个面向 Lean 4 的开源代码智能体,采用 6B 激活参数的稀疏架构,权重以 Apache 2.0 许可开放,并接入 Mistral Vibe 与免费 API 端点 labs-leanstral-2603。
推荐理由:官方给出 Leanstral 在 FLTEval 上的分数与成本对比,可据此判断形式化证明智能体的性价比路线。
Mistral 发布终端原生编码智能体 Mistral Vibe 2.0,由 Devstral 2 模型家族驱动,新增自定义子智能体、多选项澄清、斜杠命令技能、统一智能体模式和自动更新。
推荐理由:官方给出 Vibe 2.0 的自定义子智能体、斜杠命令技能等能力与订阅入口,可据此判断终端编码智能体的工作流变化。
Mistral 在 Le Chat 中发布 20+ 个基于 MCP 的安全连接器目录(beta),覆盖数据、生产力、开发、自动化与商务等类别,可连接 Databricks、Snowflake、GitHub、Atlassian、Asana、Outlook、Box、Stripe、Zapier 等工具,并支持添加自定义 MCP 连接器及连接任意远程 MCP 服务器。
推荐理由:官方给出连接器目录、自定义 MCP 与记忆功能的开放范围,读者可据此判断企业工作流接入方式。
Mistral AI 发布 Agents API,将自家语言模型与代码执行、图像生成、文档库、网页搜索等内置连接器以及 MCP 工具结合,并提供跨对话的持久记忆和智能体编排能力。
推荐理由:官方给出 Agents API 的连接器、记忆与编排能力,读者可据此判断企业级智能体平台的搭建方式。
Mistral AI 发布 Le Chat Enterprise,一款由全新 Mistral Medium 3 模型驱动的企业级 AI 助手,包含企业搜索、Agent 构建器、自定义数据与工具连接器、文档库、自定义模型和混合部署等功能,全部功能将在未来两周内逐步上线。
推荐理由:官方给出 Le Chat Enterprise 的功能清单与部署方式,可据此判断企业级 AI 助手的落地路径。
Mistral AI 推出 TranscriptToPRDTicket 智能体工作流,由 Mistral Large 2 驱动的 PRDAgent 和 TicketCreationAgent 组成,可将会议转录自动生成 PRD 并转化为结构化开发工单,自动在 Linear / Jira 中创建。