跳到正文
6月25日周四
6月24日周三
6月23日周二
  1. Mistral AI62

    Mistral 发布 OCR 4 文档解析模型

    Mistral 发布 OCR 4,在提取文本之外返回边界框、块类型分类和逐页逐词置信度分数,支持 170 种语言、可单容器自托管部署。官方称独立标注者在 600 多份文档的盲评中平均 72% 更偏好 OCR 4,并在 OlmOCRBench 上取得 85.20 的最高总分。

    推荐理由:官方给出 OCR 4 的边界框、块分类与置信度输出,以及自托管和按页计价方案,可据此判断文档解析管线的选型。

6月17日周三
  1. Google DeepMind60

    Google DeepMind 与英国政府共建 AI 规划审批原型,目标将审批时间减半

    Google DeepMind 宣布与英国政府、Google Cloud、Faculty 及 Barnet、Dorset、Camden 三地规划部门合作,共同开发一款 AI 规划审批原型工具,目标是将住户规划申请的处理时间缩短 50%。

    推荐理由:英国政府与 Google DeepMind 合作开发的规划审批原型进入三地试点,读者可了解 AI 在公共行政流程中的落地方式与人工把关机制。

  2. Google Research34

    Google Earth AI 发布矢量化数据集,用深度学习绘制英国乡村树篱与石墙

    Google Research 发布矢量化数据集,将 Farmscapes 2020 的高分辨率栅格地图转化为可操作的树篱、石墙和矮林清单,覆盖英国超 13 万平方公里。该框架基于在 3 亿多张全球卫星图像上预训练的 RSF Vision-Transformer 骨干微调,并用 Polsby–Popper 紧凑度评分(线性特征阈值低于 0.5)自动区分林地、树丛与树篱。

6月16日周二
  1. Google DeepMind60

    Google DeepMind 发布 AI Control Roadmap,用纵深防御保障智能体安全

    Google DeepMind 发布 AI Control Roadmap,一套用于在 Google 内部构建和管理高级 AI 的框架,采用纵深防御思路,在模型对齐之外增加系统级安全层,即使对齐不完美也能提供保障。

    推荐理由:DeepMind 公开内部 AI 控制路线图,给出检测与响应分级和百万条编码智能体轨迹的监控数据。

6月13日周六
  1. Google Research34

    Google 研究 AI 如何帮助用户理解皮肤问题

    Google 公布多项关于消费者使用 AI 工具理解皮肤问题的研究,其中发表于 JAMA Dermatology 的大规模调查显示,2345 名参与者使用 AI 原型工具后,尝试命名皮肤状况的比例超 62%,命名准确率 23%,约为无辅助对照组 8% 的三倍。但研究也发现,AI 辅助在判断下一步就医建议上未带来统计显著改善,用户比皮肤科医生更倾向选择不那么紧急的处理方式。

  2. Google Research38

    Google 支持加州大学圣地亚哥分校用 2000 台退役 Pixel 手机搭建低碳计算平台

    加州大学圣地亚哥分校在 Google 支持下,正用 2000 台退役 Pixel 手机的主板搭建数据中心,为数百名师生提供低成本、低碳的云计算。手机主板约占硬件隐含碳排放的 50%,SPEC 基准显示 25-50 台手机算力相当于一台现代服务器,这些设备以 25-50 台为一组由 Kubernetes 编排成集群。该系统预计 2026 年秋季上线。

6月11日周四
  1. Google Research29

    Google Research 提出 Regularized f-Divergence Kernel Tests,用于审计机器遗忘

    Google Research 在 AISTATS 2026 提出 Regularized f-Divergence Kernel Tests,用于审计机器遗忘。该框架基于 f-divergence 的相对距离检验,支持 Chi-squared、KL 和 Hockey-stick 等散度,可自动选择最优散度与超参数,无需样本拆分。理论上证明任意样本量下可控制假阳性,假阴性风险随样本增加收敛至零。

  2. Google DeepMind78

    Google DeepMind 发布 DiffusionGemma:文本生成最高提速 4 倍

    Google DeepMind 发布实验性开源模型 DiffusionGemma,采用文本扩散方式并行生成整块文本,在专用 GPU 上推理最高提速 4 倍,单张 NVIDIA H100 上超过 1000 tokens/秒,RTX 5090 上超过 700 tokens/秒。

    推荐理由:官方给出 26B MoE 文本扩散模型的速度数据、硬件门槛与质量取舍,便于判断本地低并发场景是否值得尝试。

6月10日周三
6月9日周二
6月8日周一
  1. Google DeepMind62

    Google DeepMind 在塞拉利昂开展 AI 学习效果随机对照试验

    Google DeepMind 公布在塞拉利昂开展的预注册随机对照试验结果,使用 Guided Learning 的学生数学成绩比对照组提升 0.258 个标准差,约相当于 1.2 至 1.7 年的常规学习进度,八周内完成。

    推荐理由:原文给出塞拉利昂随机对照试验的量化结果与交互数据,可了解 AI 辅助教学的实际效果与局限。

6月5日周五
6月4日周四
5月29日周五
5月28日周四
  1. Mistral AI66

    Mistral AI 发布开源 Search Toolkit 公开预览版

    Mistral AI 发布 Search Toolkit 公开预览版,一个用于构建 AI 应用生产级搜索管线的可组合框架,将数据摄取、检索与评测整合到共享接口下,开源并支持云端、本地和边缘部署。

    推荐理由:Mistral 把检索、索引与评测收进同一框架,读者可据此判断自建 RAG 管线的整合成本是否被压缩。

  2. Google Research38

    Google 推出零信任聚合的隐私分析服务,单次消息即可完成安全聚合

    Google 为隐私分析服务推出新的零信任安全聚合方案,结合新型密码学聚合方法与 TEE 硬件保护,用户设备只需发送单条消息即可完成数据提交,无需多轮在线交互。该方案可证明 Google 只能获得群体的匿名聚合洞察,原始数据即使在硬件保护范围内也不会被解密或重建,仅在最终聚合匿名化后才处理明文。

5月27日周三
  1. Mistral AI60

    Mistral 推出物理 AI,将 Emmi AI 并入企业平台

    Mistral 宣布将 Emmi AI 并入公司,推出面向工业工程的物理 AI 能力,作为其企业平台的一部分。该能力从几何与边界条件直接预测物理场,单次前向推理在单块 GPU 上以秒级完成,用于加速产品设计、工装工艺设计和实时数字孪生,合作方包括 ASML、Airbus、Safran 和 Siemens Energy。

    推荐理由:Mistral 把物理仿真模型并入企业平台,读者可了解其与 ASML、Airbus 等合作方的落地场景。

5月23日周六
  1. Mistral AI60

    Mistral 收购 Physics AI 公司 Emmi AI

    Mistral AI 宣布已达成最终协议,收购 Physics AI 先驱 Emmi AI,以强化其面向工业企业的 AI 转型伙伴地位。Emmi AI 总部位于奥地利,专注物理 AI 与大型工程模型,可把多日计算替换为实时仿真并构建数字孪生;其联合创始人及 30 多名研究人员和工程师将于 5 月加入 Mistral 的 Science 与 Applied AI 团队。

    推荐理由:Mistral 通过收购 Emmi AI 补上物理仿真能力,读者可据此判断工业 AI 平台的整合方向。

5月22日周五
  1. Mistral AI82

    Mistral 发布 Mistral Medium 3.5 与 Vibe 云端远程智能体

    Mistral 发布 Mistral Medium 3.5,这是其首个合并指令遵循、推理与编码的 128B 稠密旗舰模型,采用修改版 MIT 许可开放权重,支持 256k 上下文窗口,最少四块 GPU 即可自托管,在 SWE-Bench Verified 上得分 77.6%,超过 Devstral 2 和 Qwen3.5 397B A17B。

    推荐理由:Mistral 把编码智能体搬到云端并同步开源 128B 旗舰模型,读者可据此判断自托管与异步编码的可行边界。

  2. Google DeepMind22

    Google DeepMind 在亚太推出“AI for the Planet”加速器计划

    Google DeepMind 在亚太地区启动首届 Accelerator 加速器计划,聚焦“AI for the Planet”,面向该地区初创公司、研究团队和非营利组织,为期三个月。入选机构将获得专家指导,以及 Google AI 专家协助将前沿 AI 与科学 AI 模型集成到其项目或产品中,覆盖自然、气候、农业、能源等领域。计划以在新加坡举办的线下 bootcamp 开营,现已开放意向登记。

5月20日周三
5月19日周二
5月18日周一
  1. Google DeepMind62

    Google DeepMind 为 Project Genie 加入 Street View 真实地点生成能力

    Google DeepMind 在实验性原型 Project Genie 中上线 Street View 真实影像锚定能力,用户可在地图上选择美国地点并搭配风格与角色描述,生成以真实地点为起点的可交互世界。

    推荐理由:官方说明 Genie 接入 Street View 真实影像,读者可了解世界模型如何以真实地点为锚点生成可交互环境。

  2. Google DeepMind82

    Google DeepMind 发布 Gemini Omni Flash,支持多模态输入生成与对话式视频编辑

    Google DeepMind 发布 Omni 家族首个模型 Gemini Omni Flash,可组合图像、音频、视频和文本作为输入生成高质量视频,并通过自然语言多轮对话编辑视频。

    推荐理由:Gemini Omni Flash 把对话式视频编辑和多模态输入生成整合进 Gemini 应用与 YouTube Shorts,可据此判断视频创作流程的变化。

5月17日周日
  1. Google DeepMind62

    Google 将 SynthID 与 C2PA 内容验证扩展到搜索、Gemini 和 Chrome

    Google 扩展内容透明度与验证工具,把 SynthID 的图像、视频和音频验证从 Gemini 应用带到搜索,并将在未来几周进入 Chrome;该验证功能在 Gemini 中已被使用 5000 万次。

    推荐理由:Google 把 SynthID 与 C2PA 验证铺到搜索、Gemini 和 Chrome,读者可据此了解内容溯源工具的落地范围。

5月16日周六
  1. Google DeepMind36

    剑桥大学团队用 Google Co-Scientist 寻找跨物种传染病背后的分子开关

    剑桥大学 Clare Bryant 教授用 Google Co-Scientist 研究流感等病原体跨物种传播引发脓毒症的分子开关,该工具生成并排序了一批候选假设,并优先标记出一个她此前未关注的蛋白。加入未发表数据后,假设逐步收敛到具体氨基酸,团队正构建携带这些突变的细胞系验证。她称原本需两到三年的工作有望在六个月内完成。

  2. Google DeepMind30

    Google Co-Scientist 加速肝病机制发现,提出 MASH 组合疗法新假说

    爱丁堡大学生物工程师 Filippo Menolascina 使用 Google Co-Scientist 梳理文献、生成新假说,以缩小 MASH 潜在药物组合的搜索范围。该系统针对 resmetirom 为何仅对少数合格患者有效,提出 NLRP3 炎症小体是连接炎症与代谢的分子桥梁,该假说随后经实验验证,或为靶向双重疗法铺路。