Google DeepMind 发布 AI co-clinician 医疗协作智能体研究计划
Google DeepMind 宣布 AI co-clinician 研究计划,探索在医生监督下辅助医患双方的医疗 AI。
推荐理由:官方给出多组临床评测数字和双智能体安全架构,读者可以据此了解 AI 协诊助手的能力边界与实际定位。
文本之外的能力:视觉理解、图文混合、音视频输入输出的模型与产品进展。
Google DeepMind 宣布 AI co-clinician 研究计划,探索在医生监督下辅助医患双方的医疗 AI。
推荐理由:官方给出多组临床评测数字和双智能体安全架构,读者可以据此了解 AI 协诊助手的能力边界与实际定位。
Mistral AI 发布 Mistral Small 4,是首个将 Magistral 推理、Pixtral 多模态、Devstral 智能体编码能力统一到单一模型的小型模型,采用 Apache 2.0 许可开源。
推荐理由:官方发布正文给出了完整的架构参数、基准对比和部署要求,读者可据此评估其替代多模型组合的可行性。
Google 宣布在 Flood Hub 上推出城市山洪预报,可提前 24 小时预测城市山洪风险。模型基于 LSTM 架构,用 Gemini 从新闻报告中提取历史山洪事件的 Groundsource 数据集进行训练,仅依赖全球气象产品,以 20x20 公里分辨率覆盖人口密度大于每平方公里 100 人的城市地区。
推荐理由:原文给出模型方法、覆盖范围和与 NWS 对比的精度数据,读者可以据此了解城市山洪预报的可行路径。
Mistral AI 发布 Mistral OCR 3,在表单、扫描件、复杂表格和手写内容上对 Mistral OCR 2 的整体胜率为 74%。
推荐理由:原文给出了与 Mistral OCR 2 的对比胜率、定价和接入方式,读者可以据此评估文档解析方案的替换成本。
Mistral 发布新一代模型系列 Mistral 3,包括 MoE 架构的 Mistral Large 3(41B 激活、675B 总参数)以及 3B、8B、14B 三个尺寸的 Ministral 3 模型,全部以 Apache 2.0 协议开源。
推荐理由:官方公告完整列出了模型规格、开源协议、部署方式与可用平台,读者可据此评估在自有环境落地的可行性。
Mistral 发布开源语音理解模型 Voxtral,含 24B 的 Voxtral Small 和 3B 的 Voxtral Mini,均采用 Apache 2.0 许可证并可通过其 API 调用,价格低至每分钟 $0.001。
推荐理由:官方公布了两个尺寸的开源语音理解模型、基准成绩和 API 价格,读者可据此评估其替代现有 ASR 方案的可行性。
Mistral AI 发布 Mistral Medium 3,定位 SOTA 性能、成本降低 8 倍的新级别模型。基准上达到或超过 Claude Sonnet 3.7 的 90%,定价为 $0.4 输入 / $2 输出每 M token,超越 Llama 4 Maverick 和 Cohere Command A,可在 4 张 GPU 以上环境自部署。
推荐理由:官方给出与 Claude Sonnet 3.7 的基准对比、定价和部署门槛,读者可据此评估企业落地的性价比。
Mistral AI 发布 Mistral Small 3.1,在 Mistral Small 3 基础上改进文本性能、增加多模态理解,上下文窗口扩至 128k tokens,推理速度达 150 tokens 每秒。
推荐理由:原文来自官方发布,给出基准对比、开源协议和硬件要求,读者可以据此评估它在轻量部署场景的可用性。
Mistral 发布光学字符识别 API Mistral OCR,接受图片和 PDF 输入,按顺序提取文本与图像,可配合 RAG 系统处理幻灯片、复杂 PDF 等多模态文档。
推荐理由:官方给出内部基准对比、定价和自部署选项,读者可据此评估它在多模态文档理解和 RAG 流程中的可用性。