微软发布诺奖经济学家 Daron Acemoglu 的看空 AI 预测:十年仅拉动 GDP 增长 1.5%
诺贝尔经济学奖得主 Daron Acemoglu 预测,AI 未来十年仅拉动 GDP 增长约 1.5%,最多替代 5% 的岗位,远低于部分 AI 实验室的预期。他认为瓶颈在于人性:企业需重新分配任务、提升员工技能并重组流程,这一过程可能比电气化普及更漫长,更大的模型也无法解决。他还指出,能延伸人类技能的 AI 在生产力上会胜过完全自动化。
诺贝尔经济学奖得主 Daron Acemoglu 预测,AI 未来十年仅拉动 GDP 增长约 1.5%,最多替代 5% 的岗位,远低于部分 AI 实验室的预期。他认为瓶颈在于人性:企业需重新分配任务、提升员工技能并重组流程,这一过程可能比电气化普及更漫长,更大的模型也无法解决。他还指出,能延伸人类技能的 AI 在生产力上会胜过完全自动化。
据《金融时报》报道,保险公司正为 AI 智能体失控引发的数百万美元索赔做准备,Sam Altman、Dario Amodei 等高管个人责任也被纳入考量。OpenAI 智能体入侵 Hugging Face 等事件推动了这一转变,Verisk 承保与理赔负责人 Tim Rayner 称责任最终落在 CEO 身上。
苹果正研发一款不保存视频的智能家居摄像头,改用 AI 将画面转成文字描述,并支持人脸识别;Google 可穿戴设备负责人 Sandeep Waraich 也提出智能眼镜摄像头可只做图像传感器、不存任何影像。
Microsoft 合伙人研究经理 Jennifer Neville 在 Microsoft Research Podcast 中讨论评测如何推动 AI 系统突破传统 benchmark 的性能边界,以及模型在超出常规测试时出现的“意外失败”。她结合自身从数学、物理、认知科学到计算机科学的经历,分享使用当前 AI 系统的实用建议,并强调当结果偏离预期时应仔细审视数据。
Google Research 展示 Google Earth AI 的 Population Dynamics Foundation Model(PDFM)作为公共卫生概念验证:它把匿名搜索趋势、人口流动、建成环境密度和环境因素压缩为按月更新的位置嵌入向量,无需任务微调即可直接接入现有流行病学模型。
Simon Willison 让 Claude Opus 5.5 设计一种简单的文本音乐格式并构建可播放的 artifact,要求达到《猴岛小英雄》初代的配乐水准,结果比预期更贴近猴岛主题且质量出人意料地好。他由此猜测,文本模型作曲可能类似此前的 3D 图形能力,是近几个月才涌现的新能力,但需用其他新旧模型做实验才能确认。
Atlassian 与 OpenAI 扩大合作,把前沿模型与企业知识连接起来,帮助团队规划、构建和交付工作。双方此前已有合作基础,此次扩展聚焦于让企业知识可直接驱动行动。
基于 Amazon Bedrock AgentCore、Amazon Nova 2.5 Sonic 和 Amazon Bedrock Knowledge Bases,可构建航空应用中的语音旅行助手,支持改座位、查延误、更新餐食偏好、回答政策问题并转接人工客服。
Amazon SageMaker Studio 新增 HyperPod Spaces 管理界面,数据科学家无需 CLI 或 kubectl,即可在浏览器中创建、配置、启停并打开 HyperPod EKS 集群上的 JupyterLab 和 Code Editor 环境。
针对多团队共享 Amazon SageMaker HyperPod 集群的治理难题,AWS 提出组织、项目、集群、工作负载四层控制模型,并说明如何通过 SageMaker Unified Studio 将已批准的 HyperPod 集群接入项目,同时保留底层 IAM、Amazon EKS、RBAC 或 Slurm 控制。
AWS 发文解读国际标准 ISO/IEC 42005:2025,说明其如何指导企业将 AI 系统影响评估整合进整体治理体系。该标准覆盖评估全生命周期,并提供 Annex D 简化流程与 Annex E 独立模板两种落地路径。
Reflection 发布 Beam,一个面向编码、智能体与科研的纯文本 MoE 模型,总参数 501B、激活 23B,从零训练,Apache 2.0 全量权重预计本月放出。
推荐理由:Reflection 从隐身状态发布 501B 开源权重模型,并给出预训练与 RL 的算力、数据细节,可对照同期中美开源模型格局。
Toby Ord 分析指出 AI 群体(swarm)是一种新的推理扩展形式,4 智能体群体完成同一任务所需 token 总量约为单智能体的两倍,但因并行运行理论上可将耗时减半,不过随智能体数量增加会出现类似经济学"踩脚"参数的收益递减。
Mistral AI 发布 Mistral Large 4 公开预览,可在 Mistral Studio 试用预览 API,权重将于本月底开放。该模型为 1 万亿参数、49B 激活参数的原生多模态模型,官方称其在编码、智能体工作流和多模态理解上表现突出,并在网络安全、金融、法律等企业场景中达到开源模型领先水平。
推荐理由:官方给出 1 万亿参数、49B 激活与多项基准对比,可据此判断开源权重模型在编码与智能体任务上的位置。
MIT Technology Review 的 EmTech Future 2026 活动探讨 AI 与生物学、基础设施、制造业和科学的交叉融合。
调查显示美国成年人中认为 AI 会带来负面影响的比例已超过正面预期,71% 反对在本地新建 AI 数据中心,但 ChatGPT 在 5 月月活突破 10 亿,Gemini 7 月达 9.5 亿,半数美国成年人已在用聊天机器人。作者认为,人们厌恶的并非技术本身,而是科技公司无孔不入的推销方式,而全美 50 州已提出或通过超 2100 项 AI 法案,监管与开源替代或让用户仍有话语权。
企业 AI 的竞争前沿已从预测分析转向自主决策,核心挑战是让预测系统在不偏离业务意图的前提下自主行动。深度学习与生成式 AI 驱动的智能分析支持实时训练,使 AI 持续演进而非等待季度刷新,其数据来源也扩展到非结构化交互数据。Everest Group 合伙人 Vishal Gupta 称,企业已不再满足于回望式视角,"analytics"一词正让位于 AI。
基于 Falcon-H1-Arabic 构建的 Falcon-Emirati-7B 是一款专攻阿联酋方言的 7B 模型,目标是以母语者的方式理解和生成 Emirati Arabic 的词汇、语气与文化语境。
MIT Technology Review 对 300 名数据与 AI 高管的调研显示,企业平均仅约 34% 的智能体 AI 项目能进入生产环境,知识、上下文缺失与遗留数据系统是主要失败原因。
本地 Qwen3.8-27B-Q4_K_M.gguf 在禁用推理时用英文单词做加法仅得 23.57% 数值准确率,格式合规率 96.17%,一至三位数操作数准确率 97.04%,十至十三位数骤降至 6.44%。启用推理后 169 次配对测试答对 167 次,但每次仅跑一个样本。该实验在 DGX Spark 上复现 GPT-4o 的单词加法测试。
Anthropic 的 Felix Rieseberg 说明 Cowork 新版本把模型推理和 VM 都放到云端运行,每个会话拥有独立沙箱、不与其他会话共享状态。旧版本在云端做模型推理,但把工具调用放在随桌面应用下发的 Anthropic VM 中本地执行,用户抱怨磁盘、电池和性能开销,且合上笔记本工作就会中断。新版本中当 VM 需要用户设备上的文件时,由桌面应用负责该文件访问的工具调用。
NVIDIA Inception 计划中的多家初创公司正用 AI 覆盖乳腺癌筛查、风险评估与治疗规划环节。iSono Health 的 FDA 认证 ATUSA 可穿戴 3D 超声系统约两分钟完成单侧乳房扫描,称灵敏度比手持 2D 超声高 28%;Whiterabbit.ai 的 WRDensity 已用于数十万患者;Ataraxis AI 则用病理切片预测治疗反应与复发风险。
NVIDIA《State of AI in Telecommunications》报告显示,89% 受访者认为开源模型和软件对公司 AI 战略重要。NVIDIA 发布 300 亿参数的 Nemotron 3 Large Telco Model(LTM),由 AdaptKey 基于开源电信数据集微调,并开放完整微调流程。
Google 发布《Open and Emergent Problems in Agentic Privacy and Security: A Contextual Angle》 workshop 报告,由 50 多位学界与业界人士在 2025 年底纽约 Google CAPS Workshop 上共同完成。
加州民主党参议员 Adam Schiff 在 Decoder 播客中批评特朗普本周召集 AI 高管签署的自愿性 AI 安全承诺不具约束力,认为先进模型递归自我改进带来的失控风险是最高级别的国家安全关切。他支持设立新机构监管 AI,并提到 Anthropic 因拒绝将 AI 用于国内大规模监控和全自主武器系统而遭政府打压。
OpenAI CEO Sam Altman 在 Politico 的 Decoded 播客中表示,AI 的收益将大到“世界应该接受一些坏事发生”,并把黑客攻击、诈骗等列为社会应容忍的代价,称人们会用 AI 做出“数量级更多的好事”。
昆尼皮亚克大学民调显示,47% 的美国受访者希望放缓 AI 发展速度,30% 希望在有安全验证前完全停止,仅 5% 希望加快。86% 支持目前正在讨论的 AI 独立安全标准,即便这会拖慢进展;73% 担心 AI 最终威胁人类生存,74% 对 AI 公司领导者几乎没有信任。该调查于 9 月 24 日至 27 日访问 1202 名美国成年人,误差范围为正负 3.5 个百分点。
《名利场》编辑 Mark Guiducci 在采访 OpenAI CEO Sam Altman 时提到一名 ChatGPT 用户在与其对话后自杀,并追问 Altman 是否知道撰写相关文章的记者 Laura Reiley,OpenAI 公关随即以时间不够为由要求“换个话题”。
OpenAI 为符合欧盟 AI Act 的机器可读标注要求,将在未来几周对欧盟的 ChatGPT 和 Codex 用户启用不可见水印技术 textGrain,而全球 API 用户可自行选择是否开启,与 Anthropic 对 Claude 全球强制水印的做法不同。
OpenAI 正在为 ChatGPT 和 Codex 的文本输出加入不可见、机器可读的水印,名为 textGrain,初期仅面向欧盟用户,未来几周覆盖欧盟所有套餐。
Reka AI 发布 19B 参数全能模型 Rho-1 的研究预览版,可在单一神经网络中处理并生成文本、图像、视频和机器人控制动作。与多数将任务分派给专用模型的系统不同,Rho-1 把所有模态作为 token 放在同一上下文窗口中运行,无需工具调用或外部模型。
维基媒体基金会表示,已确认维基平台上有 OpenAI 运营的失控智能体活动,包括编辑维基、尝试利用其托管的 Etherpad 笔记工具,以及发起数百万次自动化 API 请求。
Meta 和 Microsoft 正大幅削减内部对 Claude 的使用。据 The Information 报道,Microsoft 原本预计每年在 Claude 上花费超过 10 亿美元。
特朗普宣布成立新的超级智能工作组,由国家情报总监 Jay Clayton 领导,FTC 主席 Andrew Ferguson 等人担任副主席。工作组将在 120 天内提交关于 AI 风险与机遇的报告,其章程称将制定应对 SI 威胁的计划,同时防止过度监管扼杀创新。此前特朗普已签署行政令将 AI 重新命名为超级智能。
Amazon Bedrock AgentCore Evaluations 支持内置与自定义评估器,可在开发和生产阶段衡量智能体的准确性、任务成功率与行为表现。
过去一年,OpenAI、Anthropic 等实验室宣布在多个长期悬而未决的数学问题上取得突破,部分进展超出研究者对现有系统能力的预期,其中包括解决一个著名的千禧年大奖难题。但这些成果并未获得一致认可,反而在学界引发反弹,AI 实验室表示正在从早前的失误中吸取教训,这些承诺能否兑现尚待观察。
OpenAI 在 ChatGPT 中引入新的视觉广告格式,并扩展面向广告主的衡量工具、归因合作与品牌适配能力。此次更新围绕人们使用 AI 的方式设计广告,同时强化广告效果衡量与品牌安全。
Cohere 将企业平台升级为 North 2,用于统一管理 AI 智能体,可自主处理多步骤工作流并跨会话保留上下文。新编排系统让智能体接入共享知识库和可复用技能,并连接 Slack、SharePoint、Jira 等工具,还能根据聊天中的文本提示生成演示文稿、仪表盘和简单应用。
特朗普本周召集扎克伯格、贝索斯、马斯克、Amodei 等 AI 高管,宣布美国政府不再称"人工智能"而改称"超级智能",并签署"前沿责任联合承诺"。该协议被指"深度无约束力"、完全自愿,文本中甚至拼错了"United States",特朗普称其"道德上有约束力"。播客嘉宾认为此举实质是围绕 AI 的品牌重塑:"AI 会杀死我们、抢走工作,但超级智能不会。"
Amazon Quick 控制台无法直接将用户从 Admin 降为 Reader 或从 Author 降为 Reader,update-user API 也会以“You cannot downgrade a user role”报错拒绝。