为什么 AlphaFold 没有解决蛋白质折叠问题——对话 Google DeepMind 的 Pushmeet Kohli 与 Biohub 的 Sal Candido
Google DeepMind 的 Pushmeet Kohli 与 Biohub 的 Sal Candido 在 Latent Space 的一场对谈中指出,AlphaFold 的突破只是开始,蛋白质结构预测远未解决,蛋白质动态、无序等问题仍待攻克。
Google DeepMind 的 Pushmeet Kohli 与 Biohub 的 Sal Candido 在 Latent Space 的一场对谈中指出,AlphaFold 的突破只是开始,蛋白质结构预测远未解决,蛋白质动态、无序等问题仍待攻克。
Alexa Plus 是目前最好的智能家居语音助手,能理解"我冷了"这类模糊指令,天气、计时等响应从 2025 年的 10-15 秒缩短到 3-5 秒,还能上传食谱照片边做饭边对话。但它的私人助理功能仍不成熟,Echo Show 上的全屏广告严重破坏体验,作者建议想避开广告可选 Echo Dot Max。
MIT Technology Review 指出,AI 的拒绝机制已成为 AI 安全的核心,但这一机制并不可靠。Anthropic 2021 年提出模型应 helpful、honest、harmless,如今模型经大量拒绝训练后仍可能被绕过,部分用户正试图用最先进 AI 研发生物病原体和自主无人机蜂群。
Google 在 Google Cloud 活动上宣布为 Gemini 推出统一智能体,可回答问题并代用户完成任务,初期面向企业、之后再推向消费者。
推荐理由:Google 把 Gemini 做成可接企业系统的统一智能体,读者可据此判断企业级 Agent 的落地形态与接入方式。
Google 发布实验性笔记应用 Google AI Edge Foresight,可在完全离线状态下转写会议和音频文件,免费使用,基于其端侧 EmbeddingGemma 2 模型在 macOS 上运行。
Google 在 Gemini at Work 活动上发布通用 Gemini AI 智能体,可在后台跨应用和设备工作,入口是 Gemini Enterprise 应用,用户能在单一界面里与它对话并派发任务。
ICANN 公布新一轮顶级域名申请名单,共收到 481 家申请方的 1615 份申请,Meta 和 OpenAI 等 10 家公司申请了 .agent,7 家申请了 .agi,OpenAI 还申请了 .chatgpt、.codex、.gpt 等,共 15 个 TLD,Meta 则申请了 21 个。
Google 发布会议记录应用 Google AI Edge Foresight,对标 Granola,Mac 版可完全离线运行,使用 7.4 亿参数的端侧 EmbeddingGemma 2 模型跨应用记录会议内容。
MIT Technology Review 与 Aventine 合作的文章指出,尽管 Elon Musk 称 Tesla 的 Optimus 人形机器人未来能以每台低至 2 万美元自动化几乎所有人类劳动,并预测 2027 年底前向公众发售,但许多机器人研究者对此持怀疑态度。
Google Research 在 NBER 发布三个月实地实验,将 133 名专利律师随机分为两组,一组提前使用当时未发布的 Google Labs AI 专利撰写工具(现属 Gemini Notebook)。
推荐理由:三个月专利撰写实验区分了AI带来的即时产出提升与无辅助判断力的变化,为评估AI对专业能力的影响提供了可迁移的实验设计。
Google 将 SynthID Detector 开放给公众,任何人都可以检测图片、视频或音频是否由 Google 及其合作方的 AI 生成,支持 JPG、PNG、MP4 和 MP3 格式。
扎克伯格与 Priscilla Chan 支持的 nonprofit Biohub 正协调一项 18 亿美元的计划,用于构建预测细胞行为的 AI 模型,以加速药物研发。
Google DeepMind、Meta 和 AI 药物发现初创公司 Isomorphic Labs 联合向扎克伯格夫妇创立的非营利生物医学研究机构 Biohub 投资 3 亿美元,用于构建 AI 数据集,帮助研究人员以数字化方式提出、预测和回答生物学问题。
Google 发布浏览器端 AI 平台 Playground,美国成年用户无需编程,仅靠文本输入即可创建游戏,并通过与 AI 多轮对话调整规则、物理、角色和环境,随后即时测试。
Google 周二上线新网站,任何人都可以验证一张图片、一段视频或音频是否由 AI 生成。该工具此前在 Google I/O 上仅向部分记者、媒体从业者和研究者开放测试,现已向所有人开放,支持 JPG、PNG、MP4、MOV、WAV、MP3 等图像、视频和音频格式。
Google Labs 发布 AI 游戏创作平台 Playground,用户用简单文本提示即可构建浏览器游戏,无需编程经验。创作者可选择问答、竞速等类型,指定 2D 或 3D、单人或多人,并描述玩法机制与视觉风格,还可上传素材由 AI 转成符合整体美术风格的游戏资产。
Google 宣布其 SynthID 检测器现已支持所有合作方嵌入的水印,并上线独立网站 SynthID.com 供任何人使用。此前非 Google 信任测试者只能通过询问 Gemini 来检测水印,且检测器只识别 Google 自家的 SynthID,ChatGPT 等合作方图片即使带有 SynthID 也不会被标记。
OpenAI 在一个公开 GitHub 仓库中发布了内部前沿模型产出的数学成果,称这批 722 篇手稿分为 372 个相关结果族,来自约 4000 个研究问题的评估,平均每个结果消耗约三小时 ChatGPT Pro 的思考算力,模型本身尚未发布。
推荐理由:OpenAI 用内部数学模型的 722 篇论文给出算力与验证方式,读者可据此判断 AI 做数学的当前边界。
Simon Willison 用同一提示词测试 Mistral Large 4 生成 SVG 的能力,与 Claude Opus 5.5、GPT-6.1-sol、Gemini 3.8 Flash 对比,提示词为"穿渔网袜的犰狳在火星乱穿马路"。各模型均使用默认推理等级。
Google DeepMind 发布 EmbeddingGemma 2,一个基于 Gemma 4 架构、740M 参数的开源多模态嵌入模型,采用 Apache 2.0 许可,可把文本、图像、音频和视频映射到统一嵌入空间。
推荐理由:官方给出 740M 参数、模块化编码器与端侧内存占用,可据此判断本地多模态检索的落地成本。
Google 发布图像生成与编辑模型 Nano Banana 2.1,取代 2026 年 2 月发布的 Nano Banana 2,官方称其在各方面均有提升。价格约为上一代一半,1K 图像从 6.70 美分降至 3.36 美分,4K 从 15.10 美分降至 7.56 美分。
Google 发布开源模型 EmbeddingGemma 2,可将文本、图像、视频、音频和代码转换为数值向量,参数量 740M,Google 称其在多模态嵌入基准上超越规模达其两倍的竞品。
苹果正研发一款不保存视频的智能家居摄像头,改用 AI 将画面转成文字描述,并支持人脸识别;Google 可穿戴设备负责人 Sandeep Waraich 也提出智能眼镜摄像头可只做图像传感器、不存任何影像。
Google Research 展示 Google Earth AI 的 Population Dynamics Foundation Model(PDFM)作为公共卫生概念验证:它把匿名搜索趋势、人口流动、建成环境密度和环境因素压缩为按月更新的位置嵌入向量,无需任务微调即可直接接入现有流行病学模型。
Toby Ord 分析指出 AI 群体(swarm)是一种新的推理扩展形式,4 智能体群体完成同一任务所需 token 总量约为单智能体的两倍,但因并行运行理论上可将耗时减半,不过随智能体数量增加会出现类似经济学"踩脚"参数的收益递减。
MIT Technology Review 的 EmTech Future 2026 活动探讨 AI 与生物学、基础设施、制造业和科学的交叉融合。
Google 发布《Open and Emergent Problems in Agentic Privacy and Security: A Contextual Angle》 workshop 报告,由 50 多位学界与业界人士在 2025 年底纽约 Google CAPS Workshop 上共同完成。
Google 因自动化提交大幅增加、其中绝大多数无效,已暂停其开源软件漏洞奖励计划,并承诺在 2027 年第一季度给出更新。该计划自 10 月 1 日起暂停,Google 工程师和开源维护者被无效或含幻觉的报告淹没,参与者被建议转向 Google 其他漏洞赏金项目。
Google 的 Gemini“Call for Me”AI 功能可能从商务通话扩展到亲友通话。Android Authority 在 APK 拆解中发现“Gemini Calling”引导页,示例包括“打电话给妈妈,告诉她我会晚到 15 分钟”。该功能预计仍限于类似短信的基础通话,并可能配套按应用细分的权限设置,允许用户选择是否接收 Gemini 自动来电;但这些功能未必会公开发布。
Google 将从 10 月 9 日起把免费版 Gemini 用户限制为只能使用 Flash Lite 模型,此前免费用户可选 Flash Lite、Flash 和 Pro。
独立研究者 Syed Anas Mohiuddin 测试了 Google、JP Morgan Chase、Weviate、Rapid7、法国政府部际数字事务局和美国联邦政府等机构的智能体,发现 MCP(Model Context Protocol)存在信任缺口,可被利用实施一种特殊形式的提示注入。
Google 公布新一代联邦学习系统,利用可信执行环境(TEE)为数据匿名化提供可远程验证和审计的保证,并已由 Gboard 采用。系统通过访问策略公开透明日志 Rekor、KMS 密钥管理与可复现构建,使设备数据只能在符合策略的 TEE 内解密处理,且仅输出差分隐私模型权重。
推荐理由:Google 公布基于 TEE 的新一代联邦学习系统设计,并给出 Gboard 已上线的落地情况,可了解隐私可验证训练的实现路径。
前 Google DeepMind 研究员指出,LLM 的思维链仍由同一套下一 token 预测生成,并非独立推理机制。他列举三大缺陷:缺乏可检视的持久认知状态、知识与操作无法分离、思维链常是事后编造。他主张借鉴 AlphaGo 的搜索架构,为模型建立可更新的认知状态。
美国联邦法官 Amit Mehta 驳回 Chegg 和 Penske Media 对 Google 提起的反垄断诉讼,两起诉讼均于 2025 年提起,指控 Google 的 AI overviews 等产品导致网站流量下降。
Google DeepMind 发布 Gemini 4 Argon,面向编码、企业知识工作和网络防御,首批开放给政府用户与 Fairwind 计划中的可信网络防御者,开发者、企业和消费者访问时间未定。
推荐理由:汇总 Gemini 4 Argon 的基准、定价与内部部署数据,并列出外界对公布数字的质疑。
Google 宣布推出 Gemini 4 Argon AI 模型,但目前用户还无法使用。此前外界预期的 Gemini 3.5 Pro 并未出现。
Google DeepMind 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御方开放,随后逐步扩展至开发者、企业和消费者,起步价每百万输入 token 2 美元、输出 token 10 美元,缓存输入按输入价 95% 折扣计费。
推荐理由:官方给出 Argon 在编码、企业知识与网络安全上的基准表现和分阶段开放路径,可据此判断前沿模型的能力边界与发布节奏。
Google 已允许约 100 家出版商加入 AI 内容贡献试点,当网站内容对 Gemini 驱动的 AI Overview 等搜索结果有实质贡献时可获得付费。据 The Information 报道,多家中小出版商反映这笔收入仅约为其广告收入的千分之一,部分大型出版商因此拒绝参与,希望以此争取更优厚的条件。
Google 找到为 AI 设计的蛋白质添加水印的方法,可用于生物安全用途,并已适配一款流行的 AI 蛋白质设计工具。
据 The Information 报道,Google 已启动一项试点项目,为其 AI 搜索功能中使用的出版商内容付费,约 100 家出版商参与。参与测试的出版商按其内容对 AI Overviews、AI Mode 以及 Gemini 聊天机器人的贡献获得报酬,其中一家最早加入的出版商一年收入超过 100 万美元,另一家几个月前加入的出版商收入约 5 万至 6 万美元。