Postman 如何在 Amazon Bedrock 上为 4000 万开发者运行 Agent Mode
Postman 披露其 Agent Mode 在 Amazon Bedrock 上的生产架构:通过向量数据库将 170 多个工具按任务动态收窄至约 15 个,避免工具集超过约 40 个后选择错误率上升。
Postman 披露其 Agent Mode 在 Amazon Bedrock 上的生产架构:通过向量数据库将 170 多个工具按任务动态收窄至约 15 个,避免工具集超过约 40 个后选择错误率上升。
Incarna 借助 Amazon Bedrock AgentCore payments,让智能体通过 x402 按次向 BlockRun 支付模型推理费用,把接入 x402 支付支持的工作量从数月缩短到数天,并已上线端到端按次付费推理流程。
Cornerstone OnDemand 基于 Amazon Bedrock 和 Strands Agents 构建多智能体系统 Orion AI,将数据库诊断时间从 45 分钟降至 10 分钟,减少 78%。该系统还使手动生命周期步骤减少 70%、SRE 与数据团队报告延迟从 15 分钟降至实时、冗余告警中位数减少 65%,由三人团队在六个月内交付。
针对 AWS DevOps Agent 只诊断不改动生产资源的问题,该方案用 Amazon EventBridge 接收调查完成事件,触发 AWS Lambda Durable Functions 调用 Amazon Bedrock 分析根因并从预批准工具白名单中提出修复动作。
Qlik 基于 Amazon Bedrock 打造 Qlik Answers,为全球超 4 万名客户提供有来源、可验证的自然语言问答。其 Discovery Agent 上线以来已为客户发现超 10 万条异常与离群点,多数启用智能体工具的 Qlik Cloud 账户已在日常使用。
基于 Amazon Bedrock AgentCore 运行时与开源智能体系统 OpenClaw,可构建具备持久记忆的上下文感知 AI 助手。AgentCore memory 将一次性对话转为长期知识,并支持结构化元数据标签检索;文本与图像分别路由至 Claude Haiku 4.5 和 Claude Sonnet 4.5。
基于 Amazon Bedrock AgentCore、Amazon Nova 2.5 Sonic 和 Amazon Bedrock Knowledge Bases,可构建航空应用中的语音旅行助手,支持改座位、查延误、更新餐食偏好、回答政策问题并转接人工客服。
基于 Amazon Bedrock AgentCore 的 Quick Resource Migrator 示例 MCP 服务器,可在单次工具调用中把 Amazon Quick 的 chat agent、action connector、知识库、flow 和 space 从开发账户迁移到生产账户。
Amazon SageMaker AI 推出 aws-ai-ml 技能,通过 Agent Toolkit for AWS 为 Kiro、Claude Code、Codex 等支持 MCP 的编码智能体提供推理优化与基准测试能力。
微软 Copilot Studio 团队与 Hugging Face 联合发布 ThinkingBox,通过隔离的 MCP 工具会话运行智能体,按终端后端状态和副作用而非生成文本判分,覆盖 507 个有状态业务流程、每个任务重复 20 次。
推荐理由:微软与 Hugging Face 联合发布的智能体评测基准,用后端状态而非生成文本判分,并给出可复现的 OpenEnv 运行方式。
OpenAI 发布 GPT-6 家族模型指南,面向初创公司说明如何选择 GPT-6 模型、调整推理强度、改进提示词与技能、协调工具,并为生产环境准备工作流。
推荐理由:OpenAI 官方给出 GPT-6 家族的选型与调优路径,可帮助团队把模型能力落到生产工作流。
AWS 提出 Adjudicated Query 设计模式,让业务用户在 Amazon Quick 聊天界面提问合规问题,实际判定交由确定性规则引擎完成,模型只负责把自然语言转为固定类型操作调用并复述结果。
通过 Amazon Bedrock AgentCore 的 AgentCore Gateway,可将 Claude Desktop 接入由 Amazon 网页索引支持的 Web Search,覆盖数万亿文档,查询流量全程留在 AWS 内、无需外部 API key。
AWS Professional Services 用四个 AI 智能体在 Amazon Bedrock AgentCore 上构建云迁移方案,将每个应用的基础设施即代码(IaC)开发时间从 3 到 4 周缩短至几分钟,该数据来自内部项目跟踪。
NVIDIA NeMo Agent Toolkit(NAT)可将 Amazon S3 Vectors 作为自定义记忆后端,为多智能体系统提供持久化记忆。
Amazon Bedrock AgentCore 支持构建"环境智能体"(ambient agent):它监听 Amazon S3 事件通知、EventBridge 规则等事件流并自动触发任务,在需要时通过单个 ask_human 工具暂停等待人工审批,再从中断处恢复执行。
AWS 官方博客演示在 Amazon Bedrock AgentCore Runtime Instances 上部署三智能体音乐制作流水线:作曲智能体用 Claude Sonnet 4.6 生成音乐简报并在实例的 NVIDIA L4 上运行 ACE-Step 渲染音频,交付智能体读取共享文件做 DSP 处理,合规智能体独立复测并比对曲库。
推荐理由:AWS 官方给出三智能体共享 GPU 实例的完整代码与实测数据,可迁移到其他长时多智能体工作流。
亚马逊云科技介绍用 Amazon Nova Act 与 Amazon Bedrock AgentCore 构建智能体驱动的合成监控方案,以自然语言动作替代 Selenium、Playwright 的 DOM 选择器脚本。
OpenAI 在旧金山 DevDay 2026 上公布 25 项更新,覆盖 ChatGPT、Codex、GPT-6 模型和 API,官方称这是历届规模最大的一次 DevDay。
推荐理由:梳理了 DevDay 25 项更新中 Dots、GPT-6.1 Sol、Codex 与 Agents API 的定位,可看清 OpenAI 把 Agent 从单次任务推向长期运行的产品线。
Amazon Quick 的提示词工程决定其 AI 功能对自然语言请求的响应质量,涵盖自定义智能体、自动化流程和对话式分析等场景。文章给出通用原则与可复用框架:以具体性实现清晰、用业务上下文提升相关性、用示例代替描述,并介绍 CRISPE 框架,从上下文与约束、角色与职责、意图与输入、步骤与范围等维度组织复杂提示词。
AWS 详解 Amazon Quick 各组件的提示词工程实践:Quick Research 需明确目标、受众与时间范围,并可从 Quick Index、200+ 家新闻媒体及 S&P Global。
DeepSeek Harness 更新 v0.2 预览版并推出桌面版,Mac 和 Windows 用户可从官网直接下载安装,不再需要先装 Node.js 再用命令行启动。
Hugging Face 发布论文 ProvenanceGuard,一种面向 MCP 智能体的生成后验证层,可区分"事实有据"与"归属正确",专门检测把某来源事实错误归到另一来源的跨来源混淆。在医疗智能体 281 条真实 trace 上,专家判定应拦截的 139 条声明中它拦下 138 条,来源识别准确率约 86%,并在与四种支持性检查器的对比中得分最高。
腾讯元宝APP的AI录音笔新增边录边拍功能,拍照不中断录音,拍下的PPT会插入到当时那段实时转写里,会后可点图片定位回对应语句。录音结束后可生成纪要、待办和知识总结,支持导出DOCX、PDF、TXT、Markdown,并一键传到WorkBuddy、腾讯文档继续处理。该功能还支持录制手机内置音频并做中英双语转写与实时翻译,作者称全部免费。
Manus 发布恢复独立运营后的首个大版本 Manus 2.0,包含新的 Agent 底座、创作工作台和全新个人 Agent 应用 Cue。Cue 中每个 Agent 拥有独立邮箱、电话号码、钱包和电脑,可对外发消息、在预算内付款、执行任务并代接电话,多个助手还能拉进同一群聊分工协作,目前处于凭邀请码的抢先体验阶段。
斯坦福团队在 HomeBody 项目中让 GPT-6 Astra 控制宇树 G1 进入陌生厨房,先探索建图,再按语言指令收拾物品、丢弃纸盒,甚至从视野外的抽屉取药递给人。
阿里云瓴羊在2026云栖大会推出「AI员工7日上场计划」,企业出真实业务题,瓴羊FDE带AI员工进场,7天内完成场景诊断、方案设计和POC验证,并交付上岗前后效果对比,发布当天27家企业签署意向书。其AgentOne上的营销、销售、客服、运营四类AI员工已于7月底上岗,公式为Data+Agent+FDE=AI员工,验收标准是能干、能信、能打。
H 公司发布 Holo4 系列智能体模型,包含 27B 稠密版和 35B-A3B MoE 版,两者均已在 H Models API 上线,权重以 BF16、FP8、NVFP4 和 4-bit GGUF 格式开源在 Hugging Face。
推荐理由:Holo4 同时覆盖 GUI、代码、MCP 与 API 四种接口,并公开全部评测轨迹,读者可据此判断通用计算机操作智能体的成本与能力边界。
GitHub Copilot 应用中的 canvas 是一种可自定义的双向界面,用户只需在 agent 会话中输入 /create-canvas 并用自然语言描述需求,即可生成看板、发布清单或仪表盘等界面,无需编写代码。canvas 会保存为扩展,可随项目共享或作为个人扩展复用,社区已在 Awesome Copilot 分享现成模板。
GitHub Copilot 应用推出 canvas,一种运行在应用内、无浏览器外壳的全栈小应用,可与 Copilot 智能体双向通信,并能在本地执行代码、调用第三方 API。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会自动识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分诊并生成漏洞报告。
推荐理由:GitHub Security Lab 把模糊测试的 harness 编写、覆盖率追踪与崩溃分诊交给 LLM 智能体,并公开了可复用的开源流水线。
GitHub Podcast 最新一期拆解了五个 AI 热门观点:AI 生成的代码仍需阅读和负责,只是审查力度应按风险分级;Skills 与 MCP 解决不同问题,前者是打包的团队经验,后者是智能体连接工具与数据的标准,二者可组合使用;RAG 并未消亡,它让模型基于训练数据外的文档、内部知识或代码库上下文作答,能减少 token 浪费并降低答案不完整的概率。
GitHub 日本和韩国营销负责人把活动运营流程交给 GitHub Copilot,从单个 GitHub Issue 出发自动完成落地页复制、UTM 链接生成、报名名单清洗和会后 CRM 整理。
Google Research 提出 ToolGrad,一种“先答案后问题”的工具调用数据生成范式:先生成真实工具调用链,再反推用户提示词,替代 ToolBench、ToolACE 等基于 DFS 试错搜索的查询优先方案。
OpenAI 发布 Agents API,用于构建和上线云端智能体。该服务为托管式,由 Codex harness 提供编排、长时间运行会话和工具调用支持。
推荐理由:OpenAI 官方发布托管式 Agents API,读者可了解其编排、长会话与工具调用能力。
Hugging Face 团队用 Gradio Workflow 重建了 AUTOMATIC1111 的大部分功能,做成名为 Workflow1111 的画布,由 11 条媒体流水线和 73 个节点组成,覆盖文生图、高清修复、图生图、提示词矩阵、VLM 反推、检测生成 inpaint 掩码、ControlNet 风格标注器、背景移除、PNG Info 存储和图生视频。
推荐理由:原文用 73 个节点复刻 A1111 的十一条图像流水线,并说明输出如何变成 REST 端点和 MCP 工具。
Hugging Face 发布 funes,一个面向编码智能体的持久记忆层,支持 Claude Code、Codex、pi 和 Hermes,通过一条 add 命令把本机已有会话索引为可检索记忆。
推荐理由:funes 把编码智能体的会话轨迹变成可检索的本地记忆,并给出跨机器、跨智能体共享的用法与成本对比。
Mistral 发布 Agentic Search,一个让模型在多步检索循环中查找、检查和验证信息的检索层,通过 Mistral Search Toolkit 提供,并内置于 Studio 和 Vibe 的 Libraries 中。
推荐理由:原文给出多步检索循环的工具设计与两组基准数字,可据此判断传统一次性 RAG 在长文档场景的边界。
Mistral Studio 即日起为 Prompts 和 Skills 提供集中式系统记录,支持版本管理、归属追踪和审计日志。每个版本不可篡改,可对比回滚,资产有明确负责人和分类标签,并可通过 MCP 服务器直接调用。该功能面向 Mistral Studio 客户开放,数据保留在用户自有边界内。
Mistral AI 为 Connectors 推出多项新能力:按工作区或组织设置连接器访问权限、按工具粒度开关,以及带连接器作用域的 API key,用于防止自动化 AI 工作负载冒充用户。