Anthropic 推出面向开源项目的免费 AI 漏洞扫描器
Anthropic 推出 Cyber Mission 长期计划,其中免费的开源软件 AI 扫描器会定期检查开源项目,自动标记并解释漏洞、给出补丁建议。
Anthropic 推出 Cyber Mission 长期计划,其中免费的开源软件 AI 扫描器会定期检查开源项目,自动标记并解释漏洞、给出补丁建议。
Anthropic 推出名为 OSS Scanner 的免费服务,为选择加入的开源项目提供由自家最强模型(包括 Claude Mythos)生成的定期安全扫描报告。
SpaceXAI 宣布以创始企业赞助方身份加入监管 Omarchy 的 Omacom Foundation,并向 David Heinemeier Hansson 的 Linux 项目捐赠价值 150 万美元的 Grok tokens,主要用于加速开发、审查代码和修复 bug。
Ben Affleck 本周因多段采访视频展示其对 AI 技术的理解而走红,他谈及卷积神经网络、Transformer、张量、GPU 和推理等概念,并称自己会写 Python。他透露曾拜访 OpenAI,创立了 16 人的 AI 影视初创公司 InterPositive,通过解冻权重微调开源视频模型,仅训练最后一层电影化层以达制作标准,该技术已用于其电影《Animals》的后期制作。
Periodic Labs 联合创始人 Liam Fedus 与 Ekin Dogus Cubuk 在 Latent Space 播客中提出“合成超级智能”(synthesis superintelligence),主张 AI 科学发现需以物理实验为强化学习环境,而非仅靠更多互联网数据训练。
Nous Research 完成 9000 万美元 B 轮融资,估值 15 亿美元,由 Robot Ventures 领投,Nvidia、Union Square Ventures、Menlo Ventures、Samsung 和 1789 Capital 等参投,公司累计融资达 1.58 亿美元。
Liquid AI 开源 d1 决策模型家族的两个模型 d1-3B 和 d1-omni-600M(实验性),二者不生成 token,而是在单次前向传播中给出答案。
推荐理由:Liquid AI 公开两个决策模型,给出端侧延迟与七项基准对比,可据此判断小模型做结构化决策的可行性。
Mistral 表示其新模型 Le Chonk 能够与顶级闭源模型竞争,同时保持开放权重。
Latent Space 采访了 Kubernetes 创始人 Craig McLuckie 和 Joe Beda,他们创办的 Stacklok 正把编码 Agent 的 harness 从桌面搬到云端。
OpenAI 在一个公开 GitHub 仓库中发布了内部前沿模型产出的数学成果,称这批 722 篇手稿分为 372 个相关结果族,来自约 4000 个研究问题的评估,平均每个结果消耗约三小时 ChatGPT Pro 的思考算力,模型本身尚未发布。
推荐理由:OpenAI 用内部数学模型的 722 篇论文给出算力与验证方式,读者可据此判断 AI 做数学的当前边界。
LibreOffice 背后的 The Document Foundation 表示,在可预见的未来“不会添加”AI,其默认安装将不含任何 AI 功能。该组织称这是“刻意的设计立场”,以确保用户文档不被上传到服务器处理、软件无需网络连接即可运行,用户仍可通过安装扩展接入本地 AI 模型。
EmbeddingGemma 2 采用 Apache 2.0 许可证,Simon Willison 认为嵌入模型不应使用闭源、专有、仅托管的形式。嵌入模型应用通常需计算并存储数千甚至数百万个嵌入向量,若模型专有,厂商一旦停供,用户需付费重新计算已存储的向量。他更愿付费使用托管版本,同时保留自行运行开放权重版本或另寻供应商的余地。
Google DeepMind 发布 EmbeddingGemma 2,一个基于 Gemma 4 架构、740M 参数的开源多模态嵌入模型,采用 Apache 2.0 许可,可把文本、图像、音频和视频映射到统一嵌入空间。
推荐理由:官方给出 740M 参数、模块化编码器与端侧内存占用,可据此判断本地多模态检索的落地成本。
Reflection 发布 Beam,一个面向编码、智能体与科研的纯文本 MoE 模型,总参数 501B、激活 23B,从零训练,Apache 2.0 全量权重预计本月放出。
推荐理由:Reflection 从隐身状态发布 501B 开源权重模型,并给出预训练与 RL 的算力、数据细节,可对照同期中美开源模型格局。
Mistral AI 发布 Mistral Large 4 公开预览,可在 Mistral Studio 试用预览 API,权重将于本月底开放。该模型为 1 万亿参数、49B 激活参数的原生多模态模型,官方称其在编码、智能体工作流和多模态理解上表现突出,并在网络安全、金融、法律等企业场景中达到开源模型领先水平。
推荐理由:官方给出 1 万亿参数、49B 激活与多项基准对比,可据此判断开源权重模型在编码与智能体任务上的位置。
NVIDIA《State of AI in Telecommunications》报告显示,89% 受访者认为开源模型和软件对公司 AI 战略重要。NVIDIA 发布 300 亿参数的 Nemotron 3 Large Telco Model(LTM),由 AdaptKey 基于开源电信数据集微调,并开放完整微调流程。
Google 因自动化提交大幅增加、其中绝大多数无效,已暂停其开源软件漏洞奖励计划,并承诺在 2027 年第一季度给出更新。该计划自 10 月 1 日起暂停,Google 工程师和开源维护者被无效或含幻觉的报告淹没,参与者被建议转向 Google 其他漏洞赏金项目。
PhAI Labs 联合斯坦福、牛津、普林斯顿的研究者提出 JEPA-Anything,把标准 JEPA 的单一预测拆成四个正交因子、各由独立预测模块处理,再重组为完整世界状态,在物理、机器人、天气等十个测试任务上优于同架构同数据的基线。
AI 公司 Reflection 发布首个免费开放模型 Beam,面向编码、逻辑推理和智能体任务,采用 MoE 架构,每 token 激活 5010 亿总参数中的 230 亿。
韩国计划通过政府股权投资 4.7 万亿韩元(约 34.9 亿美元)开发本土前沿模型,资金列入 2027 年预算草案,尚待国会批准。另一条资金线将支持韩国自研模型在全国经济中的采用,且 LG AI Research、SK Telecom 与 Upstage 竞赛的两家决赛入围者不会自动获得额外资金,政府改为启动创业公司也可参与的公开竞赛。
Mistral 发布迄今最大模型 Mistral Large 4(ML4),总参数 1 万亿、激活 49B,原生多模态,已在 Mistral Studio 开放 API 预览,权重预计 10 月底发布。
Z.ai 的 GLM 5.3 现已在 Amazon Bedrock 上线,这是一个 753B 参数的 MoE 模型,面向编码和长周期智能体任务,通过全托管 API 提供跨区域推理、提示词缓存和服务层级,目前面向符合条件的企业客户开放。
推荐理由:GLM 5.3 在 Bedrock 上线,文中给出提示词缓存与 Strix 安全测试的完整调用示例,可据此评估迁移成本。
TechCrunch Disrupt 2026 将于 10 月 13-15 日在旧金山 Moscone West 举行,多场议程聚焦 AI 创始人在开源与闭源模型间的选择。Together AI、Pathway、Oumi、Nvidia 等公司高管将分别探讨多模型策略、自建与定制模型的取舍,以及 AI 设计芯片对基础设施的影响。
Reflection AI 正式发布其首个前沿开源权重模型 Beam,称在高级推理基准上匹配领先中国开源模型的性能,且推理成本大幅更低。Beam 是文本 MoE 模型,总参数 5010 亿、激活 230 亿,预训练使用 23.8 万亿 token,上下文窗口 100 万 token;公司称其得分与 Z.ai 的 GLM-5.2 持平,并使用少 3-4 倍的推理算力。
法国 AI 实验室 Mistral AI 发布大型多模态模型 Mistral Large 4,参数规模达 1 万亿,绰号 Le Chonk,目前仅通过公开的 guardrail 端点访问,计划在安全测试完成后三周内开放权重。
Earendil 旗下 Pi 发布 1.0 版本并推出 Pi Durable,两者同时登上 Hacker News 首页。Pi 1.0 带来 Codemode(原生支持 MCP、Jev 和图像模型)、虚拟模型扩展、延迟工具加载、Anthropic 模型缓存预热、对话中途系统消息、新 TUI 主题和默认全屏模式。
MIT 研究者 Alex Zhang 在 Latent Space 播客中介绍了递归语言模型(RLM)等工作,基于 RLM 的 harness 是首个接近解决 ARC-AGI-3 的系统,早于 OpenAI 的 Astra。
DeepSeek 与华为合作为昇腾芯片打造编程工具并全部开源,核心是源自北京大学研究的 TileLang 语言,DeepSeek 称其编程模型比 CUDA 更简单,已使用约一年并作为其 AGI 工作的主要工具。
Google DeepMind 推出 SynthID Bio,把水印技术带入合成生物学,可在生物代码中嵌入不可感知的签名,并在合成出的实体蛋白质上验证,同时保持其生物功能。
推荐理由:SynthID 水印从图像扩展到合成生物,读者可了解其在 DNA 合成筛查与数据库标注上的验证思路。
AWS 发布教程,演示在 SageMaker AI 上从同一个 vLLM-Omni DLC 部署两个端点:实时端点运行 FLUX.2-klein-4B 生成图像,异步端点运行 Wan2.1-VACE-1.3B 生成图像条件视频。文本提示词先生成静态图,再连同运动提示词传给视频端点,生成的 MP4 存入 Amazon S3,示例提供命令行与 Streamlit 界面。
AWS 发布教程,演示如何用 vLLM-Omni DLC 在 Amazon SageMaker AI 上部署 Qwen3-TTS,通过 SageMaker 双向流式连接实现文本流入、24 kHz PCM 音频分块流出,并配套 Gradio 应用。
Anthropic 发布分析称,智谱开源权重模型 GLM-5.3 在漏洞利用能力上接近其 Claude Mythos Preview。
推荐理由:Anthropic 与 CAISI 的评测给出开源模型网络攻击能力逼近前沿的具体数字,也呈现了发布方立场与结论重合的部分。
Anthropic 发布报告警告智谱 GLM-5.3 具备较强的漏洞发现与攻击能力,并称其防滥用限制容易被绕过。
Hugging Face 发布 Open TTS Leaderboard,用客观指标评测开源多语言 TTS 与声音克隆模型,单模型评测耗时从数周投票缩短到数小时。
NVIDIA 发布开源表格基础模型 Kumo Tabular,属于 Kumo Structured 模型系列,已上线 Hugging Face,可在单次前向传播中完成分类与回归预测,无需训练、调参和特征工程。
推荐理由:NVIDIA 开源表格基础模型,无需训练和特征工程即可单次前向预测,并给出四个基准的排名与效率对比。
至知创新研究院 IQuest Research 发布 IQuest-Q1 模型,采用 decoder-only Transformer 主干与稀疏 MoE 架构,总参数约 320B、激活参数约 15B。
AINews 汇总 9/24-9/25 的 AI 动态,指出 Opus 5.5 本周发布后社区反馈积极,尤其在用代码生成解说视频上表现突出。Opus 5.5 在 SimpleBench 上以 88.4% 领先,Terminal-Bench-Science 上从低推理档的 24% 升至 xhigh 档的 62%,但 max 档回落到 59%。
推荐理由:汇总 Opus 5.5 在视频生成与 Agent 任务上的社区反馈,并给出 Jev、Photon 等基础设施的实测数字。
Mistral 在慕尼黑开设德国中心,组建专注 Physics AI 与工业 AI 的研究团队,并计划到 2030 年建成 1 吉瓦欧洲算力。该中心将与 BMW 合作碰撞仿真、与 Siemens Energy 合作工业 AI 应用,并与慕尼黑工业大学(TUM)共建汽车空气动力学数字孪生研究。Mistral 强调其开放权重架构让模型在客户自有基础设施上运行,数据不出组织。
截至2026年8月,西门子Xcelerator在中国已积累超66万注册用户、600余家生态伙伴和900余项数字化与低碳化解决方案。平台通过共享、共创、共赢机制推动伙伴协作,例如阿丘科技联合推出AI数智化方案已在西门子成都数字化工厂上线,设序科技累计获得1000多条有效线索、成单超百单。
上海人工智能实验室团队开源 Intern-Decision 系列多模态决策模型,包含 0.8B、2B 和 4B 三款,权重已在 Hugging Face 发布,代码和样例托管在 GitHub。