Mistral 发布 Mistral Small 4,统一推理、多模态与智能体编码能力
Mistral AI 发布 Mistral Small 4,是首个将 Magistral 推理、Pixtral 多模态、Devstral 智能体编码能力统一到单一模型的小型模型,采用 Apache 2.0 许可开源。
推荐理由:官方发布正文给出了完整的架构参数、基准对比和部署要求,读者可据此评估其替代多模型组合的可行性。
新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。
Mistral AI 发布 Mistral Small 4,是首个将 Magistral 推理、Pixtral 多模态、Devstral 智能体编码能力统一到单一模型的小型模型,采用 Apache 2.0 许可开源。
推荐理由:官方发布正文给出了完整的架构参数、基准对比和部署要求,读者可据此评估其替代多模型组合的可行性。
Mistral AI 发布 Voxtral Transcribe 2,含 Voxtral Mini Transcribe V2 与 Voxtral Realtime 两款语音转写模型,支持 13 种语言、说话人分离和词级时间戳。
推荐理由:官方给出两款转录模型的延迟、错误率和价格数据,并开放 Realtime 权重,读者可据此对比现有语音方案。
Mistral AI 发布开源编码模型家族 Devstral 2,包含 123B 的 Devstral 2(modified MIT 许可)和 24B 的 Devstral Small 2(Apache 2.0),两者均支持 256K 上下文窗口,分别在 SWE-bench Verified 上取得 72.2% 和 68.0%。
推荐理由:官方公布了两个尺寸编码模型的开源协议、SWE-bench Verified 成绩、API 定价和硬件要求,可据此评估本地或端侧部署的可行性。
Mistral 发布新一代模型系列 Mistral 3,包括 MoE 架构的 Mistral Large 3(41B 激活、675B 总参数)以及 3B、8B、14B 三个尺寸的 Ministral 3 模型,全部以 Apache 2.0 协议开源。
推荐理由:官方公告完整列出了模型规格、开源协议、部署方式与可用平台,读者可据此评估在自有环境落地的可行性。
Mistral 发布开源语音理解模型 Voxtral,含 24B 的 Voxtral Small 和 3B 的 Voxtral Mini,均采用 Apache 2.0 许可证并可通过其 API 调用,价格低至每分钟 $0.001。
推荐理由:官方公布了两个尺寸的开源语音理解模型、基准成绩和 API 价格,读者可据此评估其替代现有 ASR 方案的可行性。
Mistral AI 与 All Hands AI 合作发布 Devstral Medium,并升级 Devstral Small 1.1。
推荐理由:官方给出了两个新模型的 SWE-Bench Verified 成绩、定价和许可方式,开发者可以据此评估代码智能体选型。
Mistral AI 发布其首个推理模型 Magistral,分开源的 Magistral Small(24B,Apache 2.0)与企业版 Magistral Medium 两个版本。
推荐理由:官方同时开源与商用双版本,给出 AIME2024 分数、开源许可和部署渠道,读者可据此评估选型。
Mistral AI 与 All Hands AI 合作推出面向软件工程任务的智能体大语言模型 Devstral,以 Apache 2.0 许可开源发布。
推荐理由:官方发布了模型权重和 API 定价,并给出 SWE-Bench Verified 的具体成绩与部署门槛,读者可以据此评估本地或企业编码场景的适配性。
Mistral AI 发布 Mistral Medium 3,定位 SOTA 性能、成本降低 8 倍的新级别模型。基准上达到或超过 Claude Sonnet 3.7 的 90%,定价为 $0.4 输入 / $2 输出每 M token,超越 Llama 4 Maverick 和 Cohere Command A,可在 4 张 GPU 以上环境自部署。
推荐理由:官方给出与 Claude Sonnet 3.7 的基准对比、定价和部署门槛,读者可据此评估企业落地的性价比。
Mistral AI 发布 Mistral Small 3.1,在 Mistral Small 3 基础上改进文本性能、增加多模态理解,上下文窗口扩至 128k tokens,推理速度达 150 tokens 每秒。
推荐理由:原文来自官方发布,给出基准对比、开源协议和硬件要求,读者可以据此评估它在轻量部署场景的可用性。