跳到正文

#产品更新

今日 22 条
10月1日周四
  1. TechCrunch · AI48

    听力科技初创公司 Legato 发布 AI 听力眼镜 Legato Frames

    听力科技初创公司 Legato 周四宣布,其 AI 听力眼镜 Legato Frames 开售,售价 999 美元起,面向轻中度听损成人。产品通过 AI 区分人声与背景噪声并放大语音,双扬声器系统可在耳旁几英寸处将漏音降低 99%,全部处理在眼镜本地完成,无摄像头或录音。

  2. The Verge · AI30

    Grokipedia 推出 v0.3 更新:新 logo 与界面焕新

    SpaceXAI 的 Grokipedia 发布 v0.3 更新,带来新 logo 以及首页、实时编辑页面的重新设计。新版首页新增精选文章、最多阅读榜单和最新编辑追踪,精选列表采用可旋转的书籍化设计;文章页面也优化了顶部关键信息表格样式并缩小行距。此前该网站曾一度停止更新超过三个月。

  3. TechCrunch · AI48

    OpenAI 推出 Decisions API,被指是 TypeSafe AI 的 Jev 仿品

    OpenAI 在 Dev Day 上发布 Decisions API 的有限预览版,让 Luna 模型从预定义选项中快速低成本地做出分类或智能体行为选择,功能与 TypeSafe AI 本月发布的 Jev 类似。Jev 这类"System One"决策模型可为每次智能体操作做审查,监控同类 Hugging Face 事件,用 Jev 成本约 $2.94,而前沿 LLM 需 $372。

  4. TechCrunch · AI52

    DoorDash 推出可发短信点餐的 AI 智能体

    DoorDash 于周三宣布推出可通过 Apple Messages 发短信下单的 AI 智能体,支持“order my usual”等指令、指定菜品、本地推荐,并能处理混合饮食偏好和不同份数的团体订单。美国用户可加入 waitlist 试用,同时 DoorDash 将在北加州与部分餐厅测试配送无人机,以对抗 Uber Eats 和 Grubhub。

9月30日周三
  1. The Verge · AI60

    Meta 发布 Muse AI 智能体并持续扩展相关产品与功能

    Meta 推出 Muse AI 智能体,宣称可帮忙发邮件和在线购物,实际效果取决于用户愿把数据和信用卡交给 Meta。此后 Meta 还宣布了类似 Tamagotchi 的 Muse Charm 配件、面向中小企业的 Muse Enterprise Platform、Mac 应用、智能眼镜支持,并修复了一个可让攻击者控制该智能体的漏洞,而 Amazon 已屏蔽 Muse AI 智能体。

  2. The Verge · AI54

    Instagram 在 Edits 应用中加入 AI 创意助手,为创作者提供发布建议

    Instagram 宣布其独立 Edits 应用新增 AI 创意助手,可结合账号的点赞、观看、留存和分享等数据,回答趋势、内容表现和选题、脚本、字幕、音频等开放性问题。该功能对创作者免费,重度用户需购买 Meta One 订阅获得更多用量;作者指出 YouTube 也刚更新了类似的 AI 创作者数据面板,并提问当所有人都在优化内容时,平台生态会走向何方。

  3. AMD 芯片与算力43

    AMD 发布 Ross™ 智能体 AI 助手,加速嵌入式设计开发全流程

    AMD 推出面向嵌入式开发全流程的智能体 AI 助手 AMD Ross™,覆盖架构设计、优化、调试、PCB 设计、原理图审查、软件与部署。它通过 MCP 服务器连接 AMD Embedded 工具,并内置 AMD Knowledge Base、专家编写的 agent skills 和可运行设计示例,支持自然语言查询文档、执行命令和自动化工作流。

  4. Hugging Face Blog63

    Hugging Face 发布 Open TTS Leaderboard:用客观指标评测多语言 TTS 与声音克隆

    Hugging Face 推出 Open TTS Leaderboard,用 Qwen3 ASR 的 WER/CER、H200 上的 RTFx 和 TTFA 以及 WavLM 说话人相似度等客观指标评估开源 TTS 模型,把单模型评测时间从约两周缩短到数小时。

    推荐理由:原文说明了用客观指标将 TTS 评测从数周缩到数小时的做法,以及主流竞技场对开源模型覆盖不足的结构性原因。

  5. AWS Machine Learning Blog69

    OpenAI GPT-6.1 Sol 在 Amazon Bedrock 正式上线

    GPT-6.1 Sol 在 Amazon Bedrock 正式可用,聚焦智能体编码、计算机操作和专业工作负载的更强推理能力。据 OpenAI 称,其 DeepSWE v1.1 成绩与 GPT-6 Astra 相当且每任务成本约为五分之一,超过 GPT-6 Sol 最佳成绩 6.4 个百分点;在透明度、用户意图和显式限制评估中也优于 GPT-6 Sol。

    推荐理由:官方公告给出了与 GPT-6 Sol 和 GPT-6 Astra 的具体对比数据,可帮助读者评估其智能体工作场景的性价比。

9月29日周二
  1. Microsoft Research62

    Microsoft Research 发布面向生物学的 AI 研究系统 Quine

    Microsoft Research 推出 Quine,一个包含生物学多模态世界模型和连接科学工具、文献与科研人员的交互框架的研究系统。它与 Broad Institute 合作将其用于胰腺导管腺癌(PDAC)研究,预测并排序可驱动肿瘤细胞状态转变的化合物,湿实验验证了排名靠前的候选化合物,从缩小化合物范围到确定待验证候选只需一个周末。

    推荐理由:微软官方介绍 Quine 的架构与 PDAC 癌症研究实测结果,读者可以了解 AI 世界模型如何压缩湿实验迭代周期。

9月28日周一
9月25日周五
9月24日周四
  1. Hugging Face Blog60

    Liquid AI 发布 LFM2.5-VL-3B 的 DSpark 草稿模型,加速视觉语言推理

    Liquid AI 发布面向视觉语言模型 LFM2.5-VL-3B 的实验性 DSpark 草稿模型,通过投机解码在不改变输出质量的前提下换取更快推理,解码在设备端最高加速 3.13x、H100 上最高 2.66x,端到端分别为最高 2.62x 和 2.27x。

    推荐理由:原文给出视觉语言模型的投机解码加速方案、具体倍数与内存开销,并覆盖 llama.cpp、MLX-VLM、SGLang 的接入方法。

9月23日周三
  1. Google DeepMind64

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型

    Google DeepMind 于 9 月 23 日发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示词在超过 100 种语言中自定义角色声音、从 30 秒音频样本复刻声音、逐行指导表演节奏与方言变化,并原生支持双说话人场景生成。

    推荐理由:官方公告给出了两款 TTS 模型的能力细节、基准成绩和开放渠道,读者可以据此判断语音创作工作流的变化。