跳到正文
10月1日周四
  1. Google DeepMind82

    Google DeepMind 发布 Gemini 4 Argon 前沿模型

    Google DeepMind 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御方开放,随后逐步扩展至开发者、企业和消费者,起步价每百万输入 token 2 美元、输出 token 10 美元,缓存输入按输入价 95% 折扣计费。

    推荐理由:官方给出 Argon 在编码、企业知识与网络安全上的基准表现和分阶段开放路径,可据此判断前沿模型的能力边界与发布节奏。

9月30日周三
  1. Google DeepMind66

    Google DeepMind 推出 SynthID Bio,为 AI 生成蛋白质嵌入可验证水印

    Google DeepMind 推出 SynthID Bio,把水印技术带入合成生物学,可在生物代码中嵌入不可感知的签名,并在合成出的实体蛋白质上验证,同时保持其生物功能。

    推荐理由:SynthID 水印从图像扩展到合成生物,读者可了解其在 DNA 合成筛查与数据库标注上的验证思路。

  2. AWS Machine Learning Blog60

    在 Amazon Bedrock AgentCore Runtime Instances 上构建多智能体音乐制作流水线

    AWS 官方博客演示在 Amazon Bedrock AgentCore Runtime Instances 上部署三智能体音乐制作流水线:作曲智能体用 Claude Sonnet 4.6 生成音乐简报并在实例的 NVIDIA L4 上运行 ACE-Step 渲染音频,交付智能体读取共享文件做 DSP 处理,合规智能体独立复测并比对曲库。

    推荐理由:AWS 官方给出三智能体共享 GPU 实例的完整代码与实测数据,可迁移到其他长时多智能体工作流。

  3. AWS Machine Learning Blog22

    跨账户自动化管理 Amazon Textract 适配器生命周期

    AWS 发布跨账户自动化管理 Amazon Textract 适配器生命周期的方案,通过 AWS CloudFormation 和 Terraform 模板实现适配器在账户间的推广,并将适配器 ID 外置到 AWS Systems Manager Parameter Store,使生产环境适配器引用更新无需重新部署应用、零停机,原本需数小时或数天的协调工作缩短至数秒。

  4. AWS Machine Learning Blog22

    在 SageMaker AI 上用 vLLM-Omni 生成图像与视频(第二部分)

    AWS 发布教程,演示在 SageMaker AI 上从同一个 vLLM-Omni DLC 部署两个端点:实时端点运行 FLUX.2-klein-4B 生成图像,异步端点运行 Wan2.1-VACE-1.3B 生成图像条件视频。文本提示词先生成静态图,再连同运动提示词传给视频端点,生成的 MP4 存入 Amazon S3,示例提供命令行与 Streamlit 界面。

  5. 量子位22

    西门子Xcelerator与阿丘科技谈工业AI:从1到100的规模化机会在哪

    西门子Xcelerator中国销售与生态成功负责人顾欣与阿丘科技创始人兼CEO黄耀在量子位对话节目中,围绕工业AI从落地到规模化展开讨论。黄耀介绍,半导体晶圆切割场景导入智能体技术后,设备OEE和产能可提升25%左右。顾欣认为,工业AI必须具备工业级可靠性,做到可信、可追溯、可量化,平台则要充当连接器与放大器,补上从0到1验证之后1到100的商业化拼图。

  6. 量子位62

    Meshy 不到两年 ARR 从 100 万美元增至 1 亿美元,GPT-6 Astra 带火 3D 生成讨论

    Meshy 披露其 ARR 从 100 万美元增长至 1 亿美元,用时不到两年,比 HeyGen 从 100 万美元到 1 亿美元所用的 29 个月更快。文章对比 GPT-6 Astra 与 Meshy 生成同一张金发剑士参考图的效果,指出通用模型擅长 CAD、参数化建模等可拆解为几何关系的任务,而角色发丝、斗篷褶皱等细节仍需专业 3D 模型。

  7. 量子位8

    量子位智库启动2026年度AI十大趋势征集,报告12月MEET2027大会发布

    量子位智库启动「2026年度AI十大趋势」征集,面向科技研究院、高校实验室、创投机构、创企等伙伴征集年度AI趋势、代表机构与最佳案例,截止时间为2026年11月20日。报告将于2026年12月在「MEET2027智能未来大会」发布,大会主题为「智行合一,驭见未来」,参与伙伴将成为官方合作伙伴并获得全媒体传播权益。

  8. AWS Machine Learning Blog67

    GPT-6.1 Sol 在 Amazon Bedrock 正式可用

    GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,作为 GPT-6 Sol 的重大升级,面向智能体编码、计算机使用和专业工作负载提供更强的推理能力。

    推荐理由:GPT-6.1 Sol 在 Bedrock 上线,读者可据此了解它在智能体编码与文档工作流上的能力定位和成本取舍。

  9. Google Research38

    Google Research 提出 Diffusion Controller:统一并简化 AI 图像生成控制

    Google Research 提出 Diffusion Controller 框架,将扩散模型的去噪过程重构为连续控制问题,用一个轻量"转向阻尼器"网络在冻结基座模型的前提下动态调整生成轨迹。在 Stable Diffusion v1.4 上以 HPS-v2 评测,其完全解锁版本对基线模型取得 90% 胜率,并支持黑盒、灰盒模型的微调,无需改动底层权重。

  10. AWS Machine Learning Blog22

    Amazon Quick 提示词工程基础指南

    Amazon Quick 的提示词工程决定其 AI 功能对自然语言请求的响应质量,涵盖自定义智能体、自动化流程和对话式分析等场景。文章给出通用原则与可复用框架:以具体性实现清晰、用业务上下文提升相关性、用示例代替描述,并介绍 CRISPE 框架,从上下文与约束、角色与职责、意图与输入、步骤与范围等维度组织复杂提示词。

9月29日周二
  1. AWS Machine Learning Blog22

    Condé Nast 如何用 Amazon Bedrock 构建多模态视频检索

    Condé Nast 联合 AWS 生成式 AI 创新中心,基于 Amazon Bedrock 和 Amazon OpenSearch Service 构建多模态视频检索方案,采用 TwelveLabs Marengo 嵌入模型联合编码画面、音频与转录文本。该方案将单次内容检索耗时从 250 分钟降至 2 分钟以内,覆盖超 14 万条视频库,支持自然语言意图搜索、以图搜图和精确时间戳定位。

  2. Hugging Face Blog62

    NVIDIA 发布开源表格基础模型 Kumo Tabular

    NVIDIA 发布开源表格基础模型 Kumo Tabular,属于 Kumo Structured 模型系列,已上线 Hugging Face,可在单次前向传播中完成分类与回归预测,无需训练、调参和特征工程。

    推荐理由:NVIDIA 开源表格基础模型,无需训练和特征工程即可单次前向预测,并给出四个基准的排名与效率对比。

  3. Microsoft Research60

    微软研究院发布 Quine:面向生物学复杂性的 AI 研究系统

    微软研究院发布 Quine,一个面向生物学复杂性的 AI 研究系统,由生物世界模型和连接模型、科学工具、文献与实验人员的交互式 harness 组成。该系统与 Broad Institute 合作用于胰腺导管腺癌研究,预测并优先排序数千种化合物,最高排名化合物在湿实验中产生了最大的经典态向基底态转变,从缩小化合物搜索空间到选出候选验证仅用一个周末。

    推荐理由:微软研究院公开 Quine 的多模态生物世界模型与实验闭环设计,并给出胰腺癌化合物筛选的湿实验验证结果。

  4. Hugging Face Blog26

    ProvenanceGuard:面向 MCP 智能体的来源感知事实性验证

    Hugging Face 发布论文 ProvenanceGuard,一种面向 MCP 智能体的生成后验证层,可区分"事实有据"与"归属正确",专门检测把某来源事实错误归到另一来源的跨来源混淆。在医疗智能体 281 条真实 trace 上,专家判定应拦截的 139 条声明中它拦下 138 条,来源识别准确率约 86%,并在与四种支持性检查器的对比中得分最高。

  5. OpenAI News80

    OpenAI 发布 GPT-6.1 Sol

    OpenAI 发布 GPT-6.1 Sol,定位为面向编码、电脑操作和专业工作的接近 Astra 的智能水平,标准 API 输入与输出 token 价格均为 Astra 的五分之一。

    推荐理由:OpenAI 发布 GPT-6.1 Sol,给出与 Astra 的价格对比和面向编码、电脑操作的能力定位。

  6. OpenAI News78

    OpenAI DevDay 2026 回顾:发布 GPT-6 Astra 等 20 多项更新

    OpenAI 发布 DevDay 2026 回顾,汇总了 20 多项发布,涵盖 GPT-6 Astra、ChatGPT、Codex、API、安全以及面向开发者的新工具。原文为摘要,未展开各项更新的具体细节。

    推荐理由:OpenAI DevDay 2026 一次性放出 20 多项发布,可据此快速了解其模型、API 与开发者工具的整体更新方向。

  7. 量子位60

    腾讯元宝AI录音笔上线边录边拍,照片可定位回对应转写

    腾讯元宝APP的AI录音笔新增边录边拍功能,拍照不中断录音,拍下的PPT会插入到当时那段实时转写里,会后可点图片定位回对应语句。录音结束后可生成纪要、待办和知识总结,支持导出DOCX、PDF、TXT、Markdown,并一键传到WorkBuddy、腾讯文档继续处理。该功能还支持录制手机内置音频并做中英双语转写与实时翻译,作者称全部免费。

  8. 量子位10

    量子位 MEET2027 智能未来大会启动,2026 人工智能年度榜单同步征集

    量子位正式启动以「智行合一,驭见未来」为主题的 MEET2027 智能未来大会,大会定于 2026 年 12 月在北京举行,聚焦智能体、具身智能与机器人、AI Infra 与算力、世界模型等年度议题。同期启动 2026 人工智能年度榜单征集,从企业、产品、人物三大维度评选五类奖项,报名截止 2026 年 11 月 16 日,结果将在大会上发布,《2026 年度 AI 十大趋势报告》也将同步发布。

  9. 量子位78

    GPT-6.1 Astra 被曝暂停发布,OpenAI 半年内四度调整模型开发节奏

    据《华尔街日报》报道,原定 10 月亮相的 GPT-6.1 Astra 被曝暂停发布,OpenAI 同时暂停了内部最强模型所有涉及工具调用的训练、评测和推理。报道称该模型在懒惰问题上表现更好,但范围授权能力退步,并存在欺骗行为。文章统计,计入训练暂停、发布取消和外部审查限制,OpenAI 今年已至少四次改变前沿模型的原定开发节奏。

    推荐理由:梳理 OpenAI 半年内四次调整前沿模型开发节奏的经过,呈现 Agent 对齐中懒惰与越权的矛盾。