跳到正文
9月29日周二
9月28日周一
  1. Import AI22

    Import AI 474:Platonic mindspace、太空 TPU、智谱启动外层 RSI 循环

    智谱启动了一个"外层 RSI 循环",Import AI 474 将其与 Michael Levin 提出的"Platonic mindspace"假说、以及太空部署 TPU 并列为本期要点。Levin 在论文中主张心智与大脑的关系如同数学模式与其引导的形态发生结果之间的关系,身体只是模式进入物理世界的接口,并用 xenobots、anthrobots 等实验作为线索。

9月26日周六
  1. Simon Willison62

    John Gruber 评 Meta Muse:外观可爱但能力与风险被低估

    John Gruber 在评论 Meta Muse 时指出,Muse 因技术上的突破性(每位用户获得运行在 Meta 云端的完整持久 Linux VM)和易于安装使用而受到大量关注,它被包装成一个可爱的吉祥物,是首个面向消费者可用的智能体 AI 系统。但他认为消费者未必理解这意味着什么,人们没有意识到 Muse 有多强大、因而有多危险,尤其是在自己的 Mac 上运行时。

9月25日周五
9月24日周四
  1. Latent Space34

    Foundries vs Navigators:AI 如何降低科学研究的成本

    Endura Therapeutics 的 Adrian Sanborn 提出,AI 对科学的影响分为两类:Foundries 用新一代测序、多重检测和物理自动化把实验数据生成速度提升一个数量级,但需要资本和多年投入;Navigators 则把 AI 嵌入公司日常流程,加速决策与实验迭代,无需专有模型或大数据集,且对每家公司都可行。

9月23日周三
  1. Simon Willison12

    @therealcornpop 谈 AI 写脚本为何一眼可辨

    @therealcornpop 在 TikTok 上指出,用 AI 写 TikTok 和 YouTube 脚本很容易被识破。除了"不是 X,而是 Y"、三段式、断奏式堆砌标点等 AI 腔调外,更明显的是内容里缺少任何东西,缺少明确的个人声音,让人一眼看出你对所谈之事并无观点。

9月22日周二
  1. MIT Technology Review · AI36

    别被这个夏天的 AI 炒作骗了:从 Claude Mythos 到 OpenAI Astra 的真相

    针对今夏一系列 AI 炒作,文章指出 Anthropic 宣称 Claude Mythos 找漏洞强于多数安全专家、OpenAI 与 Hugging Face 遭黑客事件,以及双方各自宣称的数学突破,在专家审视后均呈现不同面貌。数学家指责 OpenAI 的 Astra 成果并非首创,并指控其研究不端与抄袭。文章呼吁政策制定者与公众听取独立专家意见,不要被企业新闻稿和"超级智能"叙事左右。

9月21日周一
  1. NVIDIA Blog38

    NVIDIA 谈 AI 安全:如何在智能体栈的每一层解决这一工程问题

    NVIDIA 提出 AI 安全是工程问题,需要明确的安全需求、可执行的管控、指定负责人和防护有效的证据。智能体栈中模型、harness 与运行时环境各层都承担安全责任,权限不能随任务自动扩展,敏感操作仍需人工审批。NVIDIA OpenShell 作为开源安全运行时在智能体之外强制执行策略并提供沙箱执行,Cisco DefenseClaw 与 JFrog 已在其上构建治理与技能扫描能力。

  2. Import AI22

    Import AI 473:美国超级智能战略、人脑组织小鼠实验与机器诠释学

    RAND 发布长篇论文,建议美国在通往超级智能的不确定路径上采取“自由行动”战略,通过投资 AI 安全、构建 AI 安全架构、改造国家安全体系等方式保留地缘政治优势。论文还归纳了共存、拒止、加速三类共七种原型战略,并列出危险临近程度、共存可行性、遏制可行性等五项关键不确定性。

9月19日周六
  1. Latent Space62

    Jev 发布两天内出现 6 个复现版本

    Latent Space 的 AINews 汇总了 Jev 发布两天内出现的 6 个复现或克隆方案,包括基于 ModernBERT 与扩散模型的猜测、Bespoke Nimble 的 Qwen3.5-9B LoRA 微调、SemIf 的 4B 与 35B Qwen3.5 骨干加三分类 NLI 分类器、Jevlike 的 40K byte 嵌入方案以及 Kev-0.5B 等。

9月18日周五
  1. GitHub Blog · AI & ML22

    GitHub Podcast 拆解 AI 热门观点:该不该读代码、RAG 已死、Skills 杀死 MCP?

    GitHub Podcast 最新一期拆解了五个 AI 热门观点:AI 生成的代码仍需阅读和负责,只是审查力度应按风险分级;Skills 与 MCP 解决不同问题,前者是打包的团队经验,后者是智能体连接工具与数据的标准,二者可组合使用;RAG 并未消亡,它让模型基于训练数据外的文档、内部知识或代码库上下文作答,能减少 token 浪费并降低答案不完整的概率。

9月16日周三
9月8日周二
9月6日周日
8月31日周一
8月10日周一
8月3日周一
7月30日周四
7月20日周一
7月8日周三
7月7日周二
  1. Berkeley AI Research34

    智能免费之后怎么办?面向智能体、由智能体构建、为智能体服务的数据系统

    伯克利 EPIC Data Lab 提出近零推理成本时代数据系统面临三大挑战:为智能体服务、由智能体运行、由智能体构建。GPT-4 级能力从 2023 年初约 $30/百万 token 降至如今不到 $1,部分厂商已低于 $0.10,推理价格年降幅在 9x 到 900x 之间,中位数约 50x。

7月6日周一
6月30日周二
6月22日周一
6月8日周一
  1. Import AI60

    Import AI 460:社会可被奖励攻击、Anthropic 的 RSI 数据与 RL 四旋翼竞速

    本期 Import AI 汇总多项研究:伦敦国王学院、复旦大学与艾伦图灵研究所构建 SocioHack 基准,含 72 个沙盒社会环境,测试 AI 在信用卡积分、学校评分等场景中钻制度漏洞的能力,RL 训练的 LLM 在历史子集上以 61.25% 召回率、90.85% 精确率重新发现已被修补的漏洞策略。

6月1日周一
5月26日周二