Nous Research 确认 15 亿美元估值,推出面向企业的 AI 智能体
Nous Research 完成 9000 万美元 B 轮融资,估值 15 亿美元,由 Robot Ventures 领投,Nvidia、Union Square Ventures、Menlo Ventures、Samsung 和 1789 Capital 等参投,公司累计融资达 1.58 亿美元。
Nous Research 完成 9000 万美元 B 轮融资,估值 15 亿美元,由 Robot Ventures 领投,Nvidia、Union Square Ventures、Menlo Ventures、Samsung 和 1789 Capital 等参投,公司累计融资达 1.58 亿美元。
Google Research 在 NBER 发布三个月实地实验,将 133 名专利律师随机分为两组,一组提前使用当时未发布的 Google Labs AI 专利撰写工具(现属 Gemini Notebook)。
推荐理由:三个月专利撰写实验区分了AI带来的即时产出提升与无辅助判断力的变化,为评估AI对专业能力的影响提供了可迁移的实验设计。
微软在旧金山 Tech Week 活动上公布 Surface Laptop Ultra 的规格与价格,两款基础机型分别 2600 美元和 3700 美元起,选配更高内存与存储后最高 5900 美元,微软称最高配机型已售罄。
Anthropic 发布 Claude Haiku 5.5,这是其迄今最快、最便宜的小模型,平均价格比 Haiku 4.5 低约 75%,10 万 token 以内提示词的价格降幅最高达 90%,超过 10 万 token 则贵 5 倍。
推荐理由:对比 Haiku 4.5 与 GPT-6 Luna 的基准和分档定价,可看清小模型在成本敏感任务上的取舍。
OpenAI 面向所有 ChatGPT 用户推出 GPT-6,并带来名为 Intelligent UI 的新功能,模型以图形、按钮、图表和表单等交互界面呈现答案,而非纯文本,格式会随问题自动调整。
微软在旧金山 Windows 与 Surface 发布会上公布 Surface Laptop Ultra 的上市信息,搭载 Nvidia RTX Spark Arm 架构芯片,8 核 CPU、24GB 内存、512GB 存储版本起售价 2599 美元,10 月 16 日发售,并改用内置磁吸 USB-C 充电取代 Surface Connect 接口。
OpenAI 在 ChatGPT 中推出 Intelligent UI 功能,让回答结合图表、表单、可点击按钮等交互式视觉内容,并随 GPT-6 一同向所有用户推送。
OpenAI 宣布 GPT-6 正在 ChatGPT 中面向全球上线,并同步引入 Intelligent UI。官方称新版本响应更快,提供可视化内容与可直接探索和使用的交互体验。
推荐理由:OpenAI 官方公布 GPT-6 在 ChatGPT 全球上线,并同步带来 Intelligent UI 的视觉与交互体验。
Amazon Quick 与 Amazon Bedrock Knowledge Bases 新增实时 ACL 校验层,在查询时直接向 Google Drive 等权威源核实权限,与原有的预检索过滤组成两阶段方案。该方案针对复制-过滤模式的三大缺陷:AI 系统并非权限权威源、同步间隔导致权限过期、数据源权限模型持续变化。未授权文档会被排除在检索结果之外,只有通过校验的片段才送入 LLM 生成回答。
AWS 宣布 Claude Haiku 5.5 在 Amazon Bedrock 和 Claude Platform on AWS 上可用。
推荐理由:AWS 官方给出 Haiku 5.5 的定位、成本降幅与在 Bedrock 上的接入方式,便于判断它在多智能体分层中的位置。
在旧金山 Microsoft 活动上,NVIDIA 与 Microsoft 宣布为 Windows PC 上的 AI 智能体共同设计软硬件,Microsoft 宣布 OS 级基础设施 Microsoft Execution Containers(MXC)正式可用,让智能体在系统控制下安全持久地在后台运行。
推荐理由:NVIDIA 与 Microsoft 把智能体运行所需的系统级容器和本地算力硬件一并给出,读者可据此判断 Windows 端侧智能体的落地路径。
Meta 周三宣布其 Muse 助手推出独立 iPad 应用,距 9 月 8 日在 iOS 和 Android 上线仅一个月。据 Sensor Tower 估算,Muse 上线以来安装量已超过 660 万。
一名男子因利用 1 万个机器人账号和 AI 生成的歌曲刷流媒体播放量、骗取 800 万美元音乐版税,被判处 18 个月监禁。该骗局通过虚增播放量冒充 Taylor Swift 等艺人以套取版税。
Google 将 SynthID Detector 开放给公众,任何人都可以检测图片、视频或音频是否由 Google 及其合作方的 AI 生成,支持 JPG、PNG、MP4 和 MP3 格式。
扎克伯格与 Priscilla Chan 支持的 nonprofit Biohub 正协调一项 18 亿美元的计划,用于构建预测细胞行为的 AI 模型,以加速药物研发。
微软面向开发者的高端 AI 迷你主机 Surface RTX Spark Dev Box 现已开启预售,售价约 6000 美元,预计 11 月发货。该机采用 Nvidia Arm 架构的 RTX Spark 平台和 128GB 统一内存,官方称可运行超过 120B 参数的模型,用于测试 AI 模型、原型化 AI 智能体或在本地运行 AI 编码工具。
在 Windows 与 Surface 活动上,微软展示了 Copilot 的升级:可访问 PC 本地文件,并在操作系统内执行操作,这属于微软称为 Hybrid Intelligence 的思路,即应用和工具混合使用本地与云端 AI 模型完成任务。
Radisson Hotel Group 与 Accenture 合作,基于 OpenAI 技术打造了一款 ChatGPT 插件,帮助旅行者在规划行程时查找、比较和预订酒店。
GitHub 发布与 Microsoft Applied Sciences 联合微调的 ModernBERT 分类器,用上下文判断非结构化密钥,可在 2 毫秒内评估一批候选密钥,据称能把可拦截的密钥数量提升一倍以上。
推荐理由:GitHub 用九个季度数据说明密钥泄露与人工修复的失衡,并给出把检测前移到 push 环节的模型方案。
OpenAI 推出名为 Intelligent UI 的新界面,随新 GPT-6 模型于周三开始推送,把可点击按钮、定制计算器、交互式图表和可编辑图形等可视化元素直接嵌入对话,目标是让学习复杂主题更容易。该功能面向 Pro、Plus、Business 和 Enterprise 用户全球上线,免费和低价 Go 档用户周四可用,用户也可以自行调低回复中的可视化程度。
Common Sense Media 发布对 ChatGPT for Teens 的评测,将其评为“不可接受的风险”,认为其设计仍在鼓励用户保持互动,即使处于心理危机情境。
Liquid AI 开源 d1 决策模型家族的两个模型 d1-3B 和 d1-omni-600M(实验性),二者不生成 token,而是在单次前向传播中给出答案。
推荐理由:Liquid AI 公开两个决策模型,给出端侧延迟与七项基准对比,可据此判断小模型做结构化决策的可行性。
Meta 宣布推出新的 AI 工具,用于识别那些看似正常、实则将用户导向站外非法儿童性虐待内容的广告和账号。其中一套新的大语言模型系统专门检测所谓 signposting,即广告本身不含非法内容但充当跳转入口,Meta 因此开始审查广告的跳转目的地而不只是广告内容,并可据此封禁违规网站和账号。
OpenAI 宣布 API 平台两项更新,其中新的 Decisions API 可评估文本、图像或两者,运行速度约为 Responses API 的十倍,目前处于公开测试阶段,即将正式可用。
Meta 的 AI 智能体 Muse 通过最新 iOS 版本更新加入对 iPad 的原生支持,可更好利用大屏与 iPadOS 多任务能力。此次更新还让 Muse 接入 Canva、Dropbox、Figma、GitHub、Zoom、Notion 等工具,并面向小企业主提供设定业务目标后自主规划营销与客户提案的能力。
OpenAI 为 ChatGPT for Teens 推出 College Planner,把申请要求、截止日期、任务和助学金步骤整合进一份计划,学生可随时更新进度并向 ChatGPT 提问,该功能将“很快”上线,美国市场先面向 10 至 12 年级、计划就读四年制大学的学生。
微软研究院开源 Agent Lightning v1.0,一个约 3500 行代码的轻量智能体强化学习框架,围绕 Harnessed Agentic RL 范式重建,让部署时使用的同一套 agent harness 直接参与训练,无需在训练框架内重新实现智能体。
推荐理由:微软研究院开源了约 3500 行的智能体 RL 框架,并给出 6000 样本提升 14.6 个百分点的完整训练管线。
OpenAI 将 College Planner 引入 ChatGPT for Teens,帮助学生管理大学申请,同时上线新的 flashcards 和 quizzes 功能。OpenAI 还宣布成立青少年 AI 委员会(teen AI council),让青少年参与塑造 AI 的未来。
Cornerstone OnDemand 基于 Amazon Bedrock 和 Strands Agents 构建多智能体系统 Orion AI,将数据库诊断时间从 45 分钟降至 10 分钟,减少 78%。该系统还使手动生命周期步骤减少 70%、SRE 与数据团队报告延迟从 15 分钟降至实时、冗余告警中位数减少 65%,由三人团队在六个月内交付。
AWS 设计了一个为期六周、每周约四小时的结构化项目,让非工程背景的业务人员用 Amazon Bedrock AgentCore、Strands Agents SDK 等生产级工具构建可用的 AI 原型。
针对 AWS DevOps Agent 只诊断不改动生产资源的问题,该方案用 Amazon EventBridge 接收调查完成事件,触发 AWS Lambda Durable Functions 调用 Amazon Bedrock 分析根因并从预批准工具白名单中提出修复动作。
Qlik 基于 Amazon Bedrock 打造 Qlik Answers,为全球超 4 万名客户提供有来源、可验证的自然语言问答。其 Discovery Agent 上线以来已为客户发现超 10 万条异常与离群点,多数启用智能体工具的 Qlik Cloud 账户已在日常使用。
AWS 提出 Agentic Value Model,用于替代按“节省工时×人力成本−建设成本”计算的 RPA 时代 ROI 模型,从时间节省、异常处理、决策质量、变更韧性与维护经济性四个维度衡量 agentic automation 的价值。该框架强调价值实现需有明确机制和责任人,并以理赔分流流程为例说明释放工时并不等于节省成本。
Google DeepMind、Meta 和 AI 药物发现初创公司 Isomorphic Labs 联合向扎克伯格夫妇创立的非营利生物医学研究机构 Biohub 投资 3 亿美元,用于构建 AI 数据集,帮助研究人员以数字化方式提出、预测和回答生物学问题。
Google 发布浏览器端 AI 平台 Playground,美国成年用户无需编程,仅靠文本输入即可创建游戏,并通过与 AI 多轮对话调整规则、物理、角色和环境,随后即时测试。
Michael Lynch 撰文列举软件博客写作的常见反模式,包括冗长铺垫、误判读者已有知识、假设读者读过旧文、过度正式,以及用链接代替术语解释。他强调要用自己的口吻写作,别写得僵硬刻板。Simon Willison 补充称,随着大量开发者把写作交给 AI,软件博客正变得千篇一律,读者更渴望有个性的文字。
英伟达团队基于 Nemotron 3 通过 SFT、RL 和生成-验证-精炼推理流程,在 IOI 2026 和 IMO 2026 双双达到金牌水平。IOI 2026 中 Nemotron-3-Ultra-CC 得 535.4/600,高于 361.12 的金牌线;IMO 2026 系统得 30/42,高于 29 的官方金牌线。
推荐理由:原文公开了从 Nemotron 3 微调到 IOI、IMO 金牌级成绩的完整配方与数据集,可据此复现领域专家模型。
Google 周二上线新网站,任何人都可以验证一张图片、一段视频或音频是否由 AI 生成。该工具此前在 Google I/O 上仅向部分记者、媒体从业者和研究者开放测试,现已向所有人开放,支持 JPG、PNG、MP4、MOV、WAV、MP3 等图像、视频和音频格式。
TechCrunch Disrupt 2026 将于 10 月 13-15 日在旧金山 Moscone West 举行,预计吸引 10,000+ 创始人、投资者和科技领袖,并公布全部互动圆桌议程。
OpenAI 产品负责人 Alexander Embiricos 将在 TechCrunch Disrupt 2026 的 AI Stage 发表演讲,主题为“What Comes After the Chatbot?