Baseten 接入 Hugging Face Inference Providers
Baseten 正式成为 Hugging Face Hub 支持的 Inference Provider,首发支持对话与文本生成任务,可通过 Baseten 调用 Kimi K3、DeepSeek V4 Flash、GLM-5.2 等开源权重 LLM。
Baseten 正式成为 Hugging Face Hub 支持的 Inference Provider,首发支持对话与文本生成任务,可通过 Baseten 调用 Kimi K3、DeepSeek V4 Flash、GLM-5.2 等开源权重 LLM。
Google DeepMind 推出最新音乐生成模型 Lyria 3.5,即日起在 Google Flow Music 中可用。模型在音乐性、歌词和人声质量上均有提升:可生成更自然复杂的旋律结构,歌词更贴合提示词并具结构感知,人声更具表现力且发音更准确。此外用户可更方便地控制输出音乐的节奏与时长。
NVIDIA 发布 Cosmos-H-Dreams,一个实时、动作条件驱动的手术机器人生成式仿真器,将 Cosmos-H-Surgical-Simulator 蒸馏为因果、少步数的学生模型,并通过 FlashDreams 流式推理库在单张 NVIDIA RTX PRO 6000 上达到约 160 帧每秒的交互速度,支持人或策略以闭环方式控制。
Hugging Face 宣布 Diffusers 原生支持 Nunchaku 的 SVDQuant 4-bit 扩散模型推理,通过新的 Nunchaku Lite 路径即可用 from_pretrained() 加载预量化 checkpoint,无需本地 CUDA 编译。
推荐理由:原文给出 W4A4 量化在 Diffusers 中原生加载后的实测延迟与显存数据,读者可据此评估消费级 GPU 跑大模型的可行路径。
Pollen Robotics 在 Hugging Face 发布开源手持数据采集系统 Grabette,用手持夹爪加相机录制操作演示并自动转成 LeRobot 数据集,无需机器人或遥操作设备。
Google DeepMind 与 Atal Innovation Mission 合作推出 Gemini 驱动的网页应用 ATL Saathi 的试点,为 Tinkering Lab 教师提供 24/7 规划与培训助手,首期覆盖 100 所试点学校。
Mistral 推出 Studio,为企业 Prompt 和 Skills 提供统一的系统记录,实现版本化、明确归属与可追溯。
Hugging Face 宣布 vLLM 的 transformers modeling backend 现在对多种 LLM 架构达到与 vLLM 手写原生实现相同或更快的吞吐。
推荐理由:官方实测显示 transformers 后端在三种 Qwen3 配置上达到或超过 vLLM 原生吞吐,模型作者无需再写定制移植。
Hugging Face 与 Amazon SageMaker AI 推出深度链接集成,开发者在受支持的模型页点击 "Customize on SageMaker AI" 或 "Deploy on SageMaker AI" 即可直接进入 SageMaker Studio,模型已预加载、环境自动配置。
Microsoft 在 Build 2026 宣布 Foundry Managed Compute 与 Hugging Face models on Foundry,提供每周更新、覆盖文本、视觉、音频与多模态的开源模型精选目录,可一键部署到 Managed Compute。
SkyPilot 与 Hugging Face 联合发布 store: hf 存储后端,通过 hf:// URL 将 Hub 仓库或 Bucket 挂载进任意 SkyPilot 任务,只需现有 HF_TOKEN 即可在 20+ 云、Kubernetes 和本地集群读取数据。
推荐理由:原文给出免出口费存储与 SkyPilot 跨云挂载的具体配置和实测速度,读者可以据此评估跨云 GPU 训练的存储方案。
Hugging Face 官方博客宣布 LeRobot v0.6.0,核心是闭合机器人学习环路。新版本引入三个世界模型策略(VLA-JEPA、LingBot-VA、FastWAM)、一批新 VLA(GR00T N1.7、MolmoAct2、EO-1、EVO1、Multitask DiT),以及统一奖励模型 API(Robometer、TOPReward)。
推荐理由:官方发布说明完整列出模型、基准和工具链变化,读者可以据此评估新版本对机器人学习工作流的实际影响。
Hugging Face 官方博客总结 🤗 Kernels 项目过去几个月的重大更新。Hub 新增 kernel 仓库类型,可查看 kernel 支持的加速器。
Hugging Face 与 Cerebras 联合展示了一套实时语音到语音架构:语音输入经 Nvidia 的 Parakeet 做语音识别,由 Cerebras 上运行的 Google DeepMind Gemma 4 31B 完成推理,再用 Alibaba 的 Qwen3TTS 合成语音输出。
推荐理由:原文给出完整的开源语音到语音技术栈和各层组件,开发者可以据此搭建或替换自己的实时语音 AI 流水线。
Google Research 发布覆盖 50+ 城市、9 个国家的建筑级屋顶反照率数据集,通过新的 Heat Resilience Earth Engine App 开放访问,帮助城市规划者实施冷屋顶方案。
Every Eval Ever(EEE)与 Hugging Face Community Evals 现已互通,支持交叉发布评测结果并回链完整 EEE 记录。
Google DeepMind 宣布 computer use 成为 Gemini 3.5 Flash 的内置工具,此前该能力仅以独立的 Gemini 2.5 computer use 模型形式提供。
推荐理由:原文说明 computer use 从独立模型转为内置进 Gemini 3.5 Flash,并给出 API 入口和企业级防护选项,便于评估自动化场景。
Mistral AI 为 Connectors 推出多项新能力:增强版管理员控制(GA)可按 workspace 或 org 设置连接器访问并逐个开关工具;带 connector 范围的 API 密钥(GA)防止自动化负载中的身份冒用。
Google DeepMind 与英国政府合作,基于 Gemini 开发一款 AI 规划原型工具,目标是帮助规划官员将住宅规划申请的决策时间缩短 50%。该工具正与 Barnet、Camden 和 Dorset 等地方规划部门共同开发,可整合数据、识别相关政策、总结反馈意见并起草评估报告,但官员仍是最终决策者。
Google 发布基于 Farmscapes 2020 的矢量化数据集,将英格兰超过 130,000 km² 高分辨率栅格地图转化为可操作的树篱、石墙与树丛清单,帮助土地所有者在不妨碍粮食安全的情况下扩展森林栖息地。
Google DeepMind 发布音频模型 Gemini 3.5 Live Translate,支持 70+ 语言自动检测的近实时语音转语音翻译,连续生成保留说话者语调、节奏和音高的译文,全程仅落后说话者几秒。
推荐理由:官方公告给出了模型能力、开放入口和各产品落地细节,读者可以据此判断它对实时语音翻译工作流的改变。
Google 在 Gemini Enterprise Agent Platform 推出由 Agentic RAG 驱动的 Cross-Corpus Retrieval,现已提供公共预览。
Google Research 在 I/O 2026 上宣布 Gemini for Science,一套与 Google Cloud、Google DeepMind 和 Google Labs 合作打造的实验性科学工具集。
Mistral 在 AI Now Summit 2026 上推出面向工业工程的 AI 全栈方案,并与 Airbus、BMW、ASML 达成合作,覆盖设计、仿真与生产,同时保障数据主权。其智能体产品 Vibe 升级为统一 Agent,可处理长时程多步骤工作,包括深度研究、编码到合并 PR。位于法国 Les Ulis 的 10 MW 推理数据中心计划于 2026 年第三季度启用。
Mistral 发布统一 AI 智能体 Vibe,Le Chat 全面升级为 Vibe,原有计划、历史和设置自动迁移。Work Mode 面向长程多步任务,覆盖企业知识搜索、数据分析、文档草稿和定时任务;Code Mode 支持远程编码会话、并行运行和沙箱隔离,并推出 VS Code 扩展和更新版 CLI。
推荐理由:官方完整公布 Vibe 的 Work 与 Code 双模式、定价和入口,读者可据此评估它对日常工作流和编码流程的影响。
Mistral AI 发布开源框架 Search Toolkit 公共预览版,用于为 AI 应用搭建生产级搜索管线,将摄取、检索和评估统一到一个共享接口的框架中。
推荐理由:原文给出模块构成、评估指标和企业案例细节,可以判断它是否适合替换现有检索基础设施。
Google 发布了一套用于隐私分析的零信任安全设计,将新的密码学聚合协议与可信执行环境(TEE)硬件保护相结合,可证明地保证 Google 只能获得匿名化的群体聚合洞察。
Mistral 将 Emmi AI 收入麾下,推出面向工程领域的 physics AI 基础模型。传统 CFD/FEM 仿真每个设计变体需数小时到数周,physics AI 可在单 GPU 上秒级前向推理预测物理场,但不取代第一性原理求解器。该能力已用于 ASML、Airbus、Safran、Siemens Energy 等合作伙伴,覆盖产品设计、工装工艺设计加速与实时数字孪生。
Mistral 发布 Studio 的 Connectors 公开预览,内置连接器与自定义 MCP 均可通过 API/SDK 用于所有模型和 agent 调用。新功能包括直接工具调用、human-in-the-loop 审批流和连接器的程序化管理,连接器集中注册后可在 LeChat 和 AI Studio 中复用,便于对接 CRM、知识库等企业系统。
Google DeepMind 在亚太地区推出首期 Accelerator 加速器计划,主题为“AI for the Planet”。该计划为期三个月,面向区域内的初创公司、研究团队和非营利组织,帮助其利用前沿 AI 解决自然、气候、农业和能源等领域的环境问题。入选机构将获得专家指导和将前沿 AI 与科学 AI 模型集成到项目中的支持,计划以新加坡的线下 bootcamp 启动,现已开放报名。
Arista Networks 宣布入选 2026 Gartner Magic Quadrant for Enterprise Wired and Wireless LAN 领导者象限。
Google 开发的 ERA 研究工具使用 Gemini 编写和优化科学代码,相关论文于今日发表于 Nature。ERA 通过树搜索考虑数千种方案,在基因组学、公共卫生、卫星图像、神经科学、时间序列预测和数学等基准上达到专家级表现。
推荐理由:原文给出 ERA 在多个学科基准上的表现和八个应用案例,读者可据此了解 AI 辅助科学计算的实际落地方式。
生物学家 Omar Abudayyeh 和 Jonathan Gootenberg 的实验室正使用 Google DeepMind 的 Co-Scientist 加速衰老研究。该系统扫描数万篇论文后提出 20 多个新型候选遗传因子,其中部分经实验验证能驱动细胞进入更年轻、功能更好的状态。分析大规模筛选数据原本最多需 6 个月,借助 Co-Scientism 可缩短到几天。
Google DeepMind 在 Project Genie 中推出 Street View grounding 新能力,可基于美国真实地点结合“Ocean World”“B&W film”等风格生成可交互世界,技术来自 Maps Imagery Grounding。
Google DeepMind 发布 Gemini for Science,在 Google Labs 推出三个实验原型:基于 Co-Scientist 的 Hypothesis Generation。
Google 于 5 月 19 日宣布扩展内容透明与验证工具,覆盖 Search、Gemini、Chrome、Pixel 和 Cloud。
推荐理由:原文梳理了 SynthID 水印、C2PA Content Credentials 验证在 Search、Gemini、Chrome、Pixel 的扩展路径和落地节奏,可据此了解内容溯源工具的现状。
Calico Life Sciences 的 AI/ML 负责人 Matt Onsum 和首席科学家 Katherine Labbé 用 Google DeepMind 的 Co-Scientist 连接衰老生物学领域分散的研究发现,生成值得验证的假设。
爱丁堡大学 bioengineer Filippo Menolascina 用 Co-Scientist 研究代谢功能障碍相关脂肪性肝炎(MASH),从海量文献中筛选候选联合疗法。针对药物 resmetirom 为何只对部分 MASH 患者有效这一问题,系统提出 NLRP3 炎性小体是连接炎症与代谢的分子桥梁的假设,该假设后来经实验验证,有望推动双重靶向疗法。
Google DeepMind 的 Co-Scientist 正在连接 MIT 机械工程师 Ritu Raman 与 Boston Children's Hospital 化学生物学家 Ryan Flynn 的实验室,共同研究 ALS。
Google DeepMind 的 AI 气象模型 WeatherNext 提前 5 天、以 80% 置信度预测出飓风 Melissa 将以 Category 5 强度登陆牙买加,3 天前置信度升至接近 100%。