跳到正文

#模型发布

今日 3 条
6月30日周二
  1. Google Research61

    Google Research 发布表格数据零样本基础模型 TabFM

    Google Research 推出面向表格数据分类与回归的基础模型 TabFM,将表格预测建模为上下文学习(ICL)问题,无需手动训练、超参数调优和特征工程即可在单次前向传播中生成预测。

    推荐理由:原文说明了 TabFM 的架构设计、合成数据训练方式和 TabArena 基准结果,读者可据此评估其相对传统调参流程的取舍。

6月23日周二
  1. Mistral AI70

    Mistral 发布 OCR 4:支持边界框、块分类与置信度分数

    Mistral 发布 OCR 4 文档解析模型,在提取文本之外返回边界框、类型化块分类和逐词置信度分数,支持 170 种语言、10 个语言组,可通过单个容器完全自托管。

    推荐理由:原文来自 Mistral 官方,给出 OCR 4 的结构化输出、多语言支持和自托管选项,还披露了基准评分局限,可作选型参考。

6月11日周四
  1. Google DeepMind70

    Google DeepMind 发布开源实验模型 DiffusionGemma,GPU 文本生成提速至 4x

    Google DeepMind 发布开源实验模型 DiffusionGemma,基于文本扩散方法生成整块文本,在专用 GPU 上推理速度最高达 4x(单张 NVIDIA H100 超 1000 tokens/秒,RTX 5090 超 700 tokens/秒)。

    推荐理由:官方明确了 4x 提速的具体硬件数字和输出质量取舍,读者可以据此判断它适不适合本地低并发场景。

6月9日周二
5月22日周五
  1. Mistral AI70

    Mistral 发布 Mistral Medium 3.5 开源权重模型,并在 Vibe 和 Le Chat 推出云端远程 Agent

    Mistral 发布 128B 开源权重旗舰模型 Mistral Medium 3.5(公开预览),融合指令跟随、推理与编码,256k 上下文窗口,SWE-Bench Verified 得分 77.6%,API 定价为每百万输入 token $1.5、输出 token $7.5。

    推荐理由:原文给出模型规格、评测分数、定价和开放权重入口,可据此评估它在自托管和异步编码场景的适用性。

5月18日周一
5月16日周六
  1. Google DeepMind84

    Google DeepMind 发布 Gemini 3.5,率先推出 3.5 Flash

    Google DeepMind 发布 Gemini 3.5 模型系列,首先推出 3.5 Flash,定位智能体与编码,在 Terminal-Bench 2.1(76.2%)、GDPval-AA(1656 Elo)、MCP Atlas(83.6%)和 CharXiv Reasoning(84.2%)上超过 Gemini 3.1 Pro,输出速度为其他前沿模型的 4 倍。

    推荐理由:官方公布了 3.5 Flash 的基准成绩、开放渠道和 Pro 后续计划,读者可以据此评估它在智能体与编码场景的取舍。

4月16日周四
4月13日周一
3月24日周二
  1. Mistral AI65

    Mistral AI 发布 4B 文本转语音模型 Voxtral TTS

    Mistral AI 发布首个文本转语音模型 Voxtral TTS,参数量 4B,支持英语、法语、德语等 9 种语言,定位低延迟语音生成。模型在人工评测中自然度超过 ElevenLabs Flash v2.5,与 ElevenLabs v3 质量相当;10 秒样本加 500 字符的模型延迟为 70ms,RTF 约 9.7x。

    推荐理由:原文给出延迟、价格、人评对比和开源许可等关键细节,方便读者评估它在语音 Agent 场景中的可用性。

3月17日周二
2月5日周四
12月9日周二
  1. Mistral AI72

    Mistral AI 发布 Devstral 2(123B)与 Devstral Small 2(24B)编码模型及 Mistral Vibe CLI

    Mistral AI 发布开源编码模型家族 Devstral 2,包含 123B 的 Devstral 2(modified MIT 许可)和 24B 的 Devstral Small 2(Apache 2.0),两者均支持 256K 上下文窗口,分别在 SWE-bench Verified 上取得 72.2% 和 68.0%。

    推荐理由:官方公布了两个尺寸编码模型的开源协议、SWE-bench Verified 成绩、API 定价和硬件要求,可据此评估本地或端侧部署的可行性。

12月3日周三
  1. Mistral AI78

    Mistral 发布 Mistral 3 系列模型,含 Mistral Large 3 与 Ministral 3,均采用 Apache 2.0 开源

    Mistral 发布新一代模型系列 Mistral 3,包括 MoE 架构的 Mistral Large 3(41B 激活、675B 总参数)以及 3B、8B、14B 三个尺寸的 Ministral 3 模型,全部以 Apache 2.0 协议开源。

    推荐理由:官方公告完整列出了模型规格、开源协议、部署方式与可用平台,读者可据此评估在自有环境落地的可行性。

7月30日周三
7月15日周二
  1. Mistral AI70

    Mistral 发布开源语音理解模型 Voxtral,提供 24B 与 3B 两个版本

    Mistral 发布开源语音理解模型 Voxtral,含 24B 的 Voxtral Small 和 3B 的 Voxtral Mini,均采用 Apache 2.0 许可证并可通过其 API 调用,价格低至每分钟 $0.001。

    推荐理由:官方公布了两个尺寸的开源语音理解模型、基准成绩和 API 价格,读者可据此评估其替代现有 ASR 方案的可行性。

7月11日周五
6月10日周二
5月28日周三
5月21日周三
5月7日周三
  1. Mistral AI64

    Mistral AI 发布 Mistral Medium 3,以约八分之一成本逼近 Claude Sonnet 3.7

    Mistral AI 发布 Mistral Medium 3,定位 SOTA 性能、成本降低 8 倍的新级别模型。基准上达到或超过 Claude Sonnet 3.7 的 90%,定价为 $0.4 输入 / $2 输出每 M token,超越 Llama 4 Maverick 和 Cohere Command A,可在 4 张 GPU 以上环境自部署。

    推荐理由:官方给出与 Claude Sonnet 3.7 的基准对比、定价和部署门槛,读者可据此评估企业落地的性价比。

3月17日周一