Mistral 发布 Mistral Small 4,统一推理、多模态与编码智能体能力
Mistral AI 发布 Mistral Small 4,这是 Mistral Small 系列的下一个重大版本,也是首个把 Magistral 的推理、Pixtral 的多模态和 Devstral 的智能体编码能力统一到单一模型的 Mistral 模型,采用 Apache 2.0 许可。
推荐理由:Mistral 把推理、多模态与编码智能体能力合并进单一开源模型,并给出可调推理强度与部署门槛。
技术方向
文本之外的能力:视觉理解、图文混合、音视频输入输出的模型与产品进展。
47 条精选近 30 天 9 条共收录 84 条
Mistral AI 发布 Mistral Small 4,这是 Mistral Small 系列的下一个重大版本,也是首个把 Magistral 的推理、Pixtral 的多模态和 Devstral 的智能体编码能力统一到单一模型的 Mistral 模型,采用 Apache 2.0 许可。
推荐理由:Mistral 把推理、多模态与编码智能体能力合并进单一开源模型,并给出可调推理强度与部署门槛。
Mistral AI 发布 Mistral OCR 3,在表单、扫描文档、复杂表格和手写内容上相对 Mistral OCR 2 的整体胜率为 74%,官方称其准确率超过企业级文档处理方案和 AI 原生 OCR 方案。
推荐理由:官方给出与上一代在表单、手写和复杂表格上的胜率对比,以及每千页定价,可据此判断文档解析成本与适用场景。
Mistral 发布 Mistral 3 系列,包括 14B、8B、3B 三个小尺寸稠密模型和迄今最强的 Mistral Large 3,后者为稀疏 MoE 架构,41B 激活参数、675B 总参数,全部以 Apache 2.0 许可开源。
推荐理由:Mistral 3 系列以 Apache 2.0 开源并给出参数与部署路径,读者可据此判断开源前沿模型的可用边界。
Mistral 为 Le Chat 上线一批新功能,包括预览版 Deep Research 模式、由新语音模型 Voxtral 驱动的语音模式、由推理模型 Magistral 支持的多语言推理、用于整理对话的 Projects,以及与 Black Forest Labs 合作的图像编辑。
推荐理由:Mistral 一次性为 Le Chat 补齐深度研究、语音、推理与图像编辑,读者可据此判断其产品线布局。
Mistral AI 发布 Mistral Medium 3,称其在各项基准上达到或超过 Claude Sonnet 3.7 的 90%,成本为每百万 token 输入 0.4 美元、输出 2 美元。
推荐理由:官方给出 Mistral Medium 3 的定价、对标基准与部署门槛,可据此判断企业自部署的成本与可行性。
Mistral AI 发布 Mistral Small 3.1,在 Mistral Small 3 基础上提升文本性能、多模态理解,并将上下文窗口扩展至 128k tokens,以 Apache 2.0 许可开源。
推荐理由:官方给出 Mistral Small 3.1 的多模态与长上下文能力及开源许可,读者可据此判断小模型在端侧与私有部署中的可用性。
Mistral AI 发布光学字符识别 API Mistral OCR,可把图片和 PDF 解析为有序交错的文本与图像,并已作为 Le Chat 的默认文档理解模型。
推荐理由:官方给出 Mistral OCR 的定价、基准对比和自托管选项,可据此判断它在文档解析与 RAG 流程中的位置。