跳到正文

全部动态

今日 29 条
3月25日周三
3月24日周二
  1. Mistral AI65

    Mistral AI 发布 4B 文本转语音模型 Voxtral TTS

    Mistral AI 发布首个文本转语音模型 Voxtral TTS,参数量 4B,支持英语、法语、德语等 9 种语言,定位低延迟语音生成。模型在人工评测中自然度超过 ElevenLabs Flash v2.5,与 ElevenLabs v3 质量相当;10 秒样本加 500 字符的模型延迟为 70ms,RTF 约 9.7x。

    推荐理由:原文给出延迟、价格、人评对比和开源许可等关键细节,方便读者评估它在语音 Agent 场景中的可用性。

3月18日周三
  1. Mistral AI43

    Mistral AI 推出 Forge:帮企业用专有数据训练前沿级模型

    Mistral AI 发布 Forge,供企业基于内部文档、代码库和业务数据训练前沿级模型,使模型理解内部术语、工作流程与合规要求。Forge 支持预训练、后训练和强化学习,兼容 dense 与 MoE 架构及多模态输入,并内置数据管道与 Mistral AI 训练方法,支持持续评估与迭代。ASML、Ericsson、欧洲航天局等机构已与 Mistral AI 合作训练专有模型。

3月17日周二
3月13日周五
3月12日周四
  1. Google Research62

    Google Flood Hub 推出 AI 城市山洪预报,可提前 24 小时预测风险

    Google 宣布在 Flood Hub 上推出城市山洪预报,可提前 24 小时预测城市山洪风险。模型基于 LSTM 架构,用 Gemini 从新闻报告中提取历史山洪事件的 Groundsource 数据集进行训练,仅依赖全球气象产品,以 20x20 公里分辨率覆盖人口密度大于每平方公里 100 人的城市地区。

    推荐理由:原文给出模型方法、覆盖范围和与 NWS 对比的精度数据,读者可以据此了解城市山洪预报的可行路径。

  2. Google Research62

    Google 发布 Groundsource:用 Gemini 将新闻报道转化为 260 万条洪水历史数据

    Google Research 推出 Groundsource,利用 Gemini 从 80 种语言的新闻报道中提取结构化灾害记录,构建覆盖 150 多个国家、2000 年至今的 260 万条城市山洪事件开放数据集。

    推荐理由:原文给出了用 Gemini 从新闻中提取灾害数据的完整方法和验证数字,读者可以据此评估其研究价值。

  3. Google Research72

    Google AMIE 完成真实门诊前瞻性可行性研究,与 BIDMC 合作验证对话式诊断 AI 安全性

    Google Research 与 Beth Israel Deaconess Medical Center 合作开展前瞻性单中心可行性研究,让 AMIE 在 100 名成人患者的初级诊疗就诊前采集病史,由医生通过视频实时监督。

    推荐理由:原文公布了 AMIE 在真实初级诊疗环境中的前瞻性可行性研究数据和安全性结果,读者可据此了解医疗对话 AI 走向临床的证据现状。

3月11日周三
2月5日周四
1月28日周三
  1. Mistral AI64

    Mistral 发布 Mistral Vibe 2.0 终端编码智能体,Devstral 2 转为付费 API

    Mistral 发布 Mistral Vibe 2.0,升级其终端原生编码智能体,由 Devstral 2 模型家族驱动。新功能包括自定义 subagents、执行前多选项澄清、斜杠命令加载技能、统一 Agent 模式和自动更新。

    推荐理由:原文给出 Vibe 2.0 的功能明细、订阅方案和 Devstral 2 API 定价,读者可以据此评估是否切换自己的编码工作流。

1月22日周四
1月10日周六
  1. Berkeley AI Research45

    以信息量驱动成像系统设计:Berkeley AI Research 提出基于互信息的评估与优化框架(NeurIPS 2025)

    Berkeley AI Research 在 NeurIPS 2025 论文中提出直接基于信息内容评估和优化成像系统的框架,用互信息指标统一分辨率、噪声等因素。该方法仅需噪声测量数据和噪声模型即可估计信息量,并提供真实信息的上界。在彩色摄影、射电天文、无透镜成像和显微成像四个领域,该指标能预测解码器性能,优化结果匹配 SOTA 端到端方法,同时内存、计算量更低且无需任务专用解码器。

12月17日周三
12月9日周二
  1. Mistral AI72

    Mistral AI 发布 Devstral 2(123B)与 Devstral Small 2(24B)编码模型及 Mistral Vibe CLI

    Mistral AI 发布开源编码模型家族 Devstral 2,包含 123B 的 Devstral 2(modified MIT 许可)和 24B 的 Devstral Small 2(Apache 2.0),两者均支持 256K 上下文窗口,分别在 SWE-bench Verified 上取得 72.2% 和 68.0%。

    推荐理由:官方公布了两个尺寸编码模型的开源协议、SWE-bench Verified 成绩、API 定价和硬件要求,可据此评估本地或端侧部署的可行性。

12月3日周三
  1. Mistral AI78

    Mistral 发布 Mistral 3 系列模型,含 Mistral Large 3 与 Ministral 3,均采用 Apache 2.0 开源

    Mistral 发布新一代模型系列 Mistral 3,包括 MoE 架构的 Mistral Large 3(41B 激活、675B 总参数)以及 3B、8B、14B 三个尺寸的 Ministral 3 模型,全部以 Apache 2.0 协议开源。

    推荐理由:官方公告完整列出了模型规格、开源协议、部署方式与可用平台,读者可据此评估在自有环境落地的可行性。

11月19日周三
11月1日周六
10月24日周五
9月9日周二
9月2日周二
  1. Mistral AI53

    Mistral AI 为 Le Chat 推出 Memories(beta)记忆功能

    Mistral AI 在 Le Chat 中推出 Memories(beta)记忆功能,采用自动保存与可见召回相结合的混合方案,召回时显示记忆来源链接。功能围绕透明、可控和主权三个原则设计:用户可随时关闭记忆、开启无记忆的 incognito 聊天、编辑或删除单条记忆,并支持导出导入。

9月1日周一
8月1日周五
7月30日周三
7月23日周三
7月17日周四
7月15日周二
  1. Mistral AI70

    Mistral 发布开源语音理解模型 Voxtral,提供 24B 与 3B 两个版本

    Mistral 发布开源语音理解模型 Voxtral,含 24B 的 Voxtral Small 和 3B 的 Voxtral Mini,均采用 Apache 2.0 许可证并可通过其 API 调用,价格低至每分钟 $0.001。

    推荐理由:官方公布了两个尺寸的开源语音理解模型、基准成绩和 API 价格,读者可据此评估其替代现有 ASR 方案的可行性。

7月11日周五
7月3日周四
  1. Mistral AI39

    Mistral AI 宣布推出 AI for Citizens 计划,助力各国政府掌控 AI 未来

    Mistral AI 宣布推出 AI for Citizens 协作计划,帮助各国政府和公共机构战略性应用 AI、改造公共服务并保障数据主权。该计划基于开放、协作、选择与自主原则,提供从顶级模型到聊天和编程助手的产品组合,支持自托管、Mistral AI 及本地伙伴运营的 AI 数据中心或 SaaS/API 部署,并可定制模型联合训练与垂直化。

6月11日周三
6月10日周二
6月4日周三