跳到正文

#Anthropic

今日 11 条
9月29日周二
  1. MIT Technology Review · AI64

    MIT Technology Review 分析何时才能说 AI 做出了科学发现

    Anthropic 宣布其由 950 个 Claude 智能体组成、运行 21 小时的分子生物学实验室取得首个发现,即围绕一种已知酶标记出此前未被记录的重复模式;这一说法遭到部分生物学家质疑,哥本哈根大学的 Mario Rodríguez Mestre 称其团队早已发现该模式,Anthropic 否认从其与 Claude 的对话中学习。

9月28日周一
9月27日周日
9月26日周六
  1. Ars Technica · AI82

    法院裁定五角大楼可将 Anthropic 列入黑名单

    美国哥伦比亚特区巡回上诉法院以 2-1 裁定,批准国防部将 Anthropic 技术列入黑名单,认定即使 Anthropic 无恶意,政府也有权因该公司拒绝向军方开放部分 Claude 功能而实施管制。判决书称需权衡受限模型可能导致军事行动中断与不受限模型可能幻觉生成错误打击目标两类风险,并认定防长未越权,驳回 Anthropic 的复审请求。该法院此前已在 4 月驳回其紧急暂缓申请。

    推荐理由:报道给出法院裁定的核心理由和 2-1 票数,读者可以了解军方供应链管制对 AI 公司的约束边界。

9月25日周五
9月24日周四
9月23日周三
  1. Latent Space84

    Anthropic 发布 Claude Opus 5.5,OpenAI 同日跟进降价 50% 的 GPT-6 Sol 和 Luna

    Anthropic 发布 Claude 5.5 家族首个模型 Claude Opus 5.5,称多数任务达到 Fable 5.1 水平、比 Opus 5 快约 30% 且每任务便宜 40%,token 定价从 $5/$25 降至 $4/$20,并成为 Claude Code 与 Claude 应用的默认模型。

    推荐理由:原文汇总了 Opus 5.5 的定价、评测与争议细节,包括第三方拆解显示 40% 降价在 max effort 下并不成立。

9月22日周二
9月21日周一
9月18日周五
9月17日周四
  1. Latent Space48

    AI 新闻的现实检验:Steve Yegge 关停 Gas Town,Databricks 使用 Astra 成本增加 60%

    Steve Yegge 在每月花费数千美元订阅编码智能体后,宣布关停 Gas Town,承认其是唯一的产出成果。Databricks 向约 3500 名工程师推出 GPT-6 Astra,其在复杂长程任务上明确优于 Opus 5 / Sol 5.6,但使编码总支出增加约 60%,为此设立了专项子预算。OpenAI 发布了模型 misalignment 事件披露框架及六份近半年案例报告。

9月9日周三
9月5日周六
  1. GitHub Blog · AI & ML70

    GitHub 发布 Project HydraFusion 研究预览,用多模型编排降低 Copilot 编码成本

    GitHub 在 GitHub Copilot CLI 推出 Project HydraFusion 研究预览,通过运行时多模型编排,按任务在 Single、Cascade、Critique 三种执行模式中选择,并调用跨供应商模型完成起草、审查、修订或升级。

    推荐理由:原文给出三套执行模式、具体基准对比和开放步骤,读者可以据此评估多模型编排对自己编码工作流的成本与质量影响。

8月19日周三
8月17日周一
8月3日周一
7月27日周一
7月16日周四
7月6日周一
6月22日周一
  1. Import AI62

    Import AI 462:AI 说服力超越人类专家、自维持 AI 时间线与 DeepMind 探讨通往 ASI 的路径

    Import AI 第 462 期汇总多项内容:牛津大学、英国 AISI、斯坦福等机构的研究通过 4 项实验、6923 人的 18978 段对话,发现 AI(最强的为 Opus 4.1 和 Opus 4.6)在文本说服上稳定超越专家人类,募集真实捐款时比职业募捐者高 10.8 个百分点;当限制 AI 以人类速度和篇幅输出时,优势降至不显著。

6月8日周一
5月26日周二
5月4日周一