跳到正文

全部动态

今日 29 条
8月31日周一
  1. AMD 芯片与算力35

    AMD 与沙特 MCIT、DCO 启动开放开发者生态计划,推进 AI 创新

    AMD 与沙特阿拉伯通信和信息技术部(MCIT)及数字合作组织(DCO)宣布启动一项生态计划,为开发者、初创公司提供开放软件工具、培训和社区项目。双方于 LEAP 2026 举办首场研讨会,介绍 AMD AI Developer Program、AMD ROCm 开放软件生态及 DCO 的 AI 伦理与负责任治理培训课程。后续 DCO 将与 AMD 及成员国探索扩展 AI 能力建设与知识共享。

8月28日周五
  1. Marvell 光互连与官方公告69

    Marvell 2027 财年 Q2 营收 27.39 亿美元创纪录,数据中心增长 46%

    Marvell 公布 2027 财年第二季度业绩,净营收 27.39 亿美元创纪录,同比增长 37%,高于 5 月 27 日指引中值 3900 万美元。数据中心收入 21.715 亿美元,同比增长 46%,占营收 79%;GAAP 毛利率 53.1%,非 GAAP 毛利率 58.9%,经营现金流 6.055 亿美元。

    推荐理由:财报给出数据中心收入增速加快和上调展望的指引,读者可以据此了解 AI 需求对 Marvell 业务的实际拉动。

  2. Google DeepMind60

    Google DeepMind 发布 Gemini Omni 1.1 Flash,强化生成视频创作控制

    Google DeepMind 于 8 月 27 日发布 Gemini Omni 1.1 Flash,带来面向开发者的生成视频创意控制套件,可通过 Gemini API 在 Google AI Studio 中使用。

    推荐理由:官方发布给出了场景延展、关键帧插值、4K 放大等新能力的具体参数和开放渠道,开发者可据此评估是否接入生成视频工作流。

8月27日周四
  1. Google DeepMind54

    Google DeepMind 试点首个面向前沿模型的 double-blind AI 评估

    Google DeepMind 推出据称全球首个针对专有前沿模型的双盲评估,将外部评测限制在密码学安全的隔离环境中,防止模型提前看到测试题造成基准污染。此次与 Singapore AI Safety Institute、OpenMined、AVERI 和 MLCommons 合作,用机密基准测试一个 Gemini Flash Lite 模型,以提升评估的可信度和完整性。

  2. Google Research47

    Google 发布 GlucoFM:面向连续血糖监测的基础模型

    Google 推出自监督基础模型 GlucoFM,采用双流设计将缓慢血糖基线趋势与短期偏离分开处理。在四个队列、七项临床预测任务共 14 项评估中,其平均 PR-AUC 比最强基线 CGM 基线从 54.7 提升至 58.8,在全部糖尿病风险和 beta 细胞功能障碍评估中领先,并在餐后血糖响应预测上取得最低 MAE。

  3. Google DeepMind64

    Google DeepMind 发布 Gemini 3.5 Transcribe 语音转写模型

    Google DeepMind 发布 Gemini 3.5 Transcribe,定位为更精准、支持智能交互的实时语音转写模型。模型可将原始音频直接转为格式化文本,自动清除口头语和自我纠正,支持自定义词表、超过 85 种语言、最多三名说话人区分,并可通过 function calling 调用其他 Gemini 模型。

    推荐理由:官方公布了模型在噪声环境、自定义词表和多说话人场景的能力细节与 API 入口,读者可据此评估语音转写工作流能否迁移。

8月26日周三
8月25日周二
  1. Hugging Face Blog61

    IBM 发布 Granite 4.2 推理模型家族,详解 15T token 预训练与多阶段 RL 训练管线

    IBM 发布 Granite 4.2 推理模型家族,含 3B、8B、30B 三个稠密解码器模型,基于 Granite 4.1 基座(从头在约 15T token 上预训练,五阶段策略将上下文扩展至 512K),经 SFT 与多阶段 GRPO 强化学习后训练,全部以 Apache 2.0 许可开源。

    推荐理由:官方完整披露从预训练、SFT 到多阶段 GRPO 和智能体 RL 的训练细节,可迁移到类似模型的构建流程。

  2. Hugging Face Blog66

    Gradio 发布 gr.Workflow:用类型化节点图搭建可部署的 AI 流水线

    Hugging Face 在 Gradio 中推出 gr.Workflow,把 AI 应用流水线直接做成界面:用类型化节点描述步骤,提供拖拽画布,每个节点可运行、每个中间结果可见。

    推荐理由:原文给出 gr.Workflow 的节点类型、REST API 与部署方式,并附多个可打开复制的 Space 示例,便于直接上手搭建 AI 流水线。

  3. Mistral AI53

    Mistral 与 HUMAIN 达成数亿欧元级战略合作,推进沙特及中东主权 AI

    Mistral 与 HUMAIN 宣布战略合作,覆盖 AI 基础设施、先进模型开发与解决方案部署,规模达数亿欧元。双方将本地化先进 AI 模型,初期聚焦网络安全和语音,并计划开发阿拉伯语表现强劲的前沿模型;Mistral 将探索使用 HUMAIN 数据中心基础设施,双方还计划在沙特针对受监管行业制定联合市场策略。

8月24日周一
  1. AMD 芯片与算力16

    AMD Learning Labs 如何赋能下一代学习者

    AMD 通过 Learning Labs 项目为学生提供动手学习技术的机会,包括编程、数字媒体、组装 PC 和 3D 打印。2020 年至 2025 年,AMD 向超过 800 所大学、科研机构和非营利组织捐赠技术,惠及约 1.048 亿人,并于 2025 年承诺投入 1.5 亿美元扩展美国 AI 教育。

8月22日周六
  1. Google Research50

    Google Research 推出 Biomarker Discovery Framework:从可穿戴设备数据中优先排序候选生物标志物

    Google Research 推出 Biomarker Discovery Framework,一个多智能体系统,将候选生物标志物优先排序结构化为人类监督下的迭代研究流程,结合假设生成、统计分析、模型训练与对抗性验证。在三个队列共 9,279 人次观测中,该系统自主识别出 41 个心理健康候选数字生物标志物和 25 个代谢类候选标志物,并构建了睡眠时长变异性等新型复合特征。

8月21日周五
  1. Hugging Face Blog62

    Hugging Face 研究量化语音识别模型的基准优化行为,高分模型会复现错误基准文本

    Hugging Face 发布研究,用一致性分歧探针、数字静默检索和拼写切换三类测试,评估 11 个开源 ASR 模型的基准优化(benchmaxxing)行为。

    推荐理由:原文用三类探针量化语音识别中的基准优化现象,并给出模型名单、比例数据与可复用的检测脚本,读来能帮助避开仅看 WER 的选型误区。

  2. Hugging Face Blog66

    LiquidAI 发布 LFM2.5-DSpark 草稿模型,推理最高提速 3.18x

    LiquidAI 为 LFM2.5 系列的 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 发布 DSpark 草稿模型检查点,通过投机解码在不改变输出质量的前提下加速推理,H100 上吞吐最高提升 3.18x,端侧最高 2.87x。

    推荐理由:官方给出 DSpark 投机解码草稿模型的实测加速数据和 llama.cpp、SGLang 用法,端侧部署者可对照判断收益。

8月20日周四
  1. Mistral AI65

    Mistral 发布 Agentic Search,多步检索在 FinanceBench 上将准确率从 26.7% 提至 86%

    Mistral 发布 Agentic Search,一个让模型在复杂文档中搜索、导航、读取并验证信息的多步检索层,通过 Mistral Search Toolkit 及 Studio 和 Vibe 中的 Libraries 提供。

    推荐理由:官方给出了在 FinanceBench 和 OfficeQA Pro 上的具体提升数字与工具设计,读者可据此评估其对企业文档检索工作流的适用性。

8月19日周三
  1. AMD 芯片与算力24

    Secihti 与 AMD 签署谅解备忘录,在墨西哥培养 AI 与超级计算人才

    墨西哥科学、人文、技术与创新部(Secihti)与 AMD 签署谅解备忘录,旨在建立覆盖人工智能、高性能计算和半导体等领域的国家创新生态。双方将协调学术活动、研讨会和培训项目,培养专业人才。合作还将支持 Coatlicue 超级计算机和国家级高性能计算与 AI 集群等项目,助力墨西哥科研基础设施建设与技术主权。

8月18日周二
  1. AMD 芯片与算力27

    AMD 发布 2025-26 企业责任报告:以负责任的方式扩大影响力

    AMD 发布 2025-26 企业责任报告,回顾 2020-2025 目标进展并展望 2030。2020 至 2025 年,可再生能源用电占比从 22% 升至 58%,运营温室气体排放减少 30%,AI 训练和高性能计算节点能效提升 38x,Green500 榜单上的 AMD 系统从 11 台增至 194 台;新目标为 2024-2030 年将机架级 AI 能效提升 20x。

  2. Hugging Face Blog71

    Sentence Transformers v6.0 新增 MultiVectorEncoder 支持 ColBERT 式 late interaction 检索

    Hugging Face 官方博客宣布 Sentence Transformers v6.0 新增第四种模型类型 MultiVectorEncoder,支持 ColBERT 式 late interaction 检索,任何 PyLate 和 Stanford-NLP ColBERT checkpoint 可直接加载,colpali-engine 模型也可用于视觉文档检索。

    推荐理由:官方教程覆盖加载、评分、索引与压缩的完整链路,读者可以据此判断多向量检索是否值得引入自己的搜索栈。