跳到正文
今天10月10日周六3 条
  1. TechCrunch · AI36

    a16z 合伙人 Olivia Moore 谈消费级 AI 现状:ChatGPT 仍遥遥领先,六大品类仍是空白

    a16z 合伙人 Olivia Moore 发布消费级 AI 应用 Top 100 报告,ChatGPT 仍是最大玩家,Suno、ElevenLabs 等小玩家展现出持久生命力。报告指出社交、约会、市场、零售、旅行、金融、健康等品类在榜单中完全没有 AI 应用入围。Moore 认为消费级 AI 仍处早期,机会在于跳出订阅和 API 收费,探索广告等更多变现方式。

10月9日周五
  1. The Verge · AI38

    特朗普试图把 AI 改名为 "Super Intelligence",OpenAI、Meta 等高管纷纷附和

    特朗普签署行政令,要求尽可能停用 "AI" 一词,改称 "Super Intelligence",并将继续使用 "Artificial Intelligence" 的人称为 "THE ENEMY"。美国 CAISI 已更名为 CAISSI,司法部新闻稿也改用该说法。Musk 承诺将 SpaceXAI 改名为 SpaceXSI,Altman 表示赞赏但 OpenAI 不会改名。

  2. MIT Technology Review · AI32

    我们过于相信 AI 说“不”的能力

    MIT Technology Review 指出,AI 的拒绝机制已成为 AI 安全的核心,但这一机制并不可靠。Anthropic 2021 年提出模型应 helpful、honest、harmless,如今模型经大量拒绝训练后仍可能被绕过,部分用户正试图用最先进 AI 研发生物病原体和自主无人机蜂群。

10月8日周四
10月7日周三
  1. Simon Willison8

    Michael Lynch 谈软件博客写作的反模式

    Michael Lynch 撰文列举软件博客写作的常见反模式,包括冗长铺垫、误判读者已有知识、假设读者读过旧文、过度正式,以及用链接代替术语解释。他强调要用自己的口吻写作,别写得僵硬刻板。Simon Willison 补充称,随着大量开发者把写作交给 AI,软件博客正变得千篇一律,读者更渴望有个性的文字。

  2. Simon Willison30

    EmbeddingGemma 2 采用 Apache 2.0 许可证

    EmbeddingGemma 2 采用 Apache 2.0 许可证,Simon Willison 认为嵌入模型不应使用闭源、专有、仅托管的形式。嵌入模型应用通常需计算并存储数千甚至数百万个嵌入向量,若模型专有,厂商一旦停供,用户需付费重新计算已存储的向量。他更愿付费使用托管版本,同时保留自行运行开放权重版本或另寻供应商的余地。

  3. The Decoder38

    微软发布诺奖经济学家 Daron Acemoglu 的看空 AI 预测:十年仅拉动 GDP 增长 1.5%

    诺贝尔经济学奖得主 Daron Acemoglu 预测,AI 未来十年仅拉动 GDP 增长约 1.5%,最多替代 5% 的岗位,远低于部分 AI 实验室的预期。他认为瓶颈在于人性:企业需重新分配任务、提升员工技能并重组流程,这一过程可能比电气化普及更漫长,更大的模型也无法解决。他还指出,能延伸人类技能的 AI 在生产力上会胜过完全自动化。

  4. Microsoft Research22

    Microsoft 研究员 Jennifer Neville:AI 评测如何暴露模型的“意外失败”

    Microsoft 合伙人研究经理 Jennifer Neville 在 Microsoft Research Podcast 中讨论评测如何推动 AI 系统突破传统 benchmark 的性能边界,以及模型在超出常规测试时出现的“意外失败”。她结合自身从数学、物理、认知科学到计算机科学的经历,分享使用当前 AI 系统的实用建议,并强调当结果偏离预期时应仔细审视数据。

10月6日周二
10月2日周五
  1. MIT Technology Review · AI44

    别被迷惑:LLM 并不会真正推理

    前 Google DeepMind 研究员指出,LLM 的思维链仍由同一套下一 token 预测生成,并非独立推理机制。他列举三大缺陷:缺乏可检视的持久认知状态、知识与操作无法分离、思维链常是事后编造。他主张借鉴 AlphaGo 的搜索架构,为模型建立可更新的认知状态。

10月1日周四
9月29日周二
9月26日周六
  1. Simon Willison62

    John Gruber 评 Meta Muse:外观可爱但能力与风险被低估

    John Gruber 在评论 Meta Muse 时指出,Muse 因技术上的突破性(每位用户获得运行在 Meta 云端的完整持久 Linux VM)和易于安装使用而受到大量关注,它被包装成一个可爱的吉祥物,是首个面向消费者可用的智能体 AI 系统。但他认为消费者未必理解这意味着什么,人们没有意识到 Muse 有多强大、因而有多危险,尤其是在自己的 Mac 上运行时。

9月25日周五
9月23日周三
9月22日周二
  1. MIT Technology Review · AI36

    别被这个夏天的 AI 炒作骗了:从 Claude Mythos 到 OpenAI Astra 的真相

    针对今夏一系列 AI 炒作,文章指出 Anthropic 宣称 Claude Mythos 找漏洞强于多数安全专家、OpenAI 与 Hugging Face 遭黑客事件,以及双方各自宣称的数学突破,在专家审视后均呈现不同面貌。数学家指责 OpenAI 的 Astra 成果并非首创,并指控其研究不端与抄袭。文章呼吁政策制定者与公众听取独立专家意见,不要被企业新闻稿和"超级智能"叙事左右。

9月21日周一
  1. Simon Willison30

    Simon Willison 回应“MCP 一直是坏主意”:终端智能体之外 MCP 仍有价值

    Simon Willison 反驳“MCP 一直是坏主意”的观点,认为在 Claude Code、Codex、Meta Muse、OpenClaw 等拥有无限制互联网访问的终端智能体之外,MCP 仍能提供对可访问外部服务的精确控制、不让智能体直接接触 API key 的认证方式、供用户连接并认证更多服务的合理 UI,以及强审计日志。

9月9日周三
9月6日周日
5月26日周二