跳到正文
3月17日周二
  1. Mistral AI60

    Mistral 发布 Leanstral:面向 Lean 4 的开源代码智能体

    Mistral 发布 Leanstral,称其为首个面向 Lean 4 的开源代码智能体,采用 6B 激活参数的稀疏架构,权重以 Apache 2.0 许可开放,并接入 Mistral Vibe 与免费 API 端点 labs-leanstral-2603。

    推荐理由:官方给出 Leanstral 在 FLTEval 上的分数与成本对比,可据此判断形式化证明智能体的性价比路线。

3月11日周三
2月5日周四
1月22日周四
  1. Mistral AI34

    Heaps do lie:排查 vLLM 内存泄漏

    Mistral AI 团队在 vLLM 上排查一起内存泄漏:在 Mistral Medium 3.1、开启 graph compilation 的 Prefill/Decode 分离部署中,系统内存以每分钟 400 MB 线性增长,数小时后触发 out of memory。Heaptrack 显示堆内存稳定,泄漏发生在堆外,问题仅出现在经 NIXL 传输 KVCache 的 decode 侧。

12月9日周二
  1. Mistral AI82

    Mistral 发布 Devstral 2 编码模型与 Mistral Vibe CLI

    Mistral 发布下一代编码模型家族 Devstral 2,含 123B 的 Devstral 2 和 24B 的 Devstral Small 2,两者均为开源许可,Devstral 2 采用修改版 MIT、Small 2 采用 Apache 2.0。

    推荐理由:原文给出 Devstral 2 的 SWE-bench 成绩、开源许可与部署门槛,读者可据此判断开源编码模型与闭源模型的差距。

12月3日周三
  1. Mistral AI82

    Mistral 发布 Mistral 3 系列模型,含 675B 参数 Mistral Large 3

    Mistral 发布 Mistral 3 系列,包括 14B、8B、3B 三个小尺寸稠密模型和迄今最强的 Mistral Large 3,后者为稀疏 MoE 架构,41B 激活参数、675B 总参数,全部以 Apache 2.0 许可开源。

    推荐理由:Mistral 3 系列以 Apache 2.0 开源并给出参数与部署路径,读者可据此判断开源前沿模型的可用边界。

11月19日周三
7月15日周二
  1. Mistral AI80

    Mistral 发布 Voxtral 语音理解模型,24B 与 3B 双版本开源

    Mistral AI 发布 Voxtral 语音理解模型,提供 24B 和 3B 两个版本,均以 Apache 2.0 许可开源并上线 API。模型支持 32k token 上下文,可处理最长 30 分钟音频转写或 40 分钟音频理解,具备内置问答与摘要、多语言自动检测和语音直接触发函数调用等能力。

    推荐理由:Mistral 开源两款语音理解模型,给出与 Whisper、GPT-4o mini、ElevenLabs 的对比和 API 定价,便于评估落地成本。

7月11日周五
7月3日周四
  1. Mistral AI40

    Mistral AI 推出 AI for Citizens 计划,助各国政府掌控 AI 未来

    Mistral AI 推出 AI for Citizens 协作计划,帮助各国政府和公共机构战略性地应用 AI,改造公共服务并推动创新。该计划已在法国、卢森堡、新加坡、荷兰、英国、瑞士等国落地,提供开源模型、自托管部署、数据主权保障及定制研发等选项,以替代封闭供应商的“一刀切”方案。

6月11日周三
6月10日周二
5月21日周三
  1. Mistral AI78

    Mistral AI 与 All Hands AI 发布编码智能体模型 Devstral

    Mistral AI 与 All Hands AI 合作发布面向软件工程任务的智能体模型 Devstral,在 SWE-Bench Verified 上取得 46.8%,比此前开源 SoTA 高出 6 个百分点以上,并以 Apache 2.0 许可开源。

    推荐理由:官方给出 Devstral 在 SWE-Bench Verified 上的分数与开源许可,读者可据此判断开源编码智能体的当前水位。

3月17日周一