跳到正文

AI 编码

AI 写代码的一切:编码助手、Vibe Coding、代码模型评测与开发工作流变革。

30条精选相关主题Agent 智能体Cursor教程实践

最新精选

第 21–30 条 · 共 30 条
5月28日周四
  1. Mistral AI69

    Mistral 将 Le Chat 升级为统一智能体 Vibe,覆盖工作与编码

    Mistral 发布统一 AI 智能体 Vibe,Le Chat 全面升级为 Vibe,原有计划、历史和设置自动迁移。Work Mode 面向长程多步任务,覆盖企业知识搜索、数据分析、文档草稿和定时任务;Code Mode 支持远程编码会话、并行运行和沙箱隔离,并推出 VS Code 扩展和更新版 CLI。

    推荐理由:官方完整公布 Vibe 的 Work 与 Code 双模式、定价和入口,读者可据此评估它对日常工作流和编码流程的影响。

5月22日周五
  1. Mistral AI70

    Mistral 发布 Mistral Medium 3.5 开源权重模型,并在 Vibe 和 Le Chat 推出云端远程 Agent

    Mistral 发布 128B 开源权重旗舰模型 Mistral Medium 3.5(公开预览),融合指令跟随、推理与编码,256k 上下文窗口,SWE-Bench Verified 得分 77.6%,API 定价为每百万输入 token $1.5、输出 token $7.5。

    推荐理由:原文给出模型规格、评测分数、定价和开放权重入口,可据此评估它在自托管和异步编码场景的适用性。

5月20日周三
  1. Google Research62

    Google 发布 ERA 并通过 Gemini for Science 逐步开放 Computational Discovery

    Google 开发的 ERA 研究工具使用 Gemini 编写和优化科学代码,相关论文于今日发表于 Nature。ERA 通过树搜索考虑数千种方案,在基因组学、公共卫生、卫星图像、神经科学、时间序列预测和数学等基准上达到专家级表现。

    推荐理由:原文给出 ERA 在多个学科基准上的表现和八个应用案例,读者可据此了解 AI 辅助科学计算的实际落地方式。

5月16日周六
  1. Google DeepMind84

    Google DeepMind 发布 Gemini 3.5,率先推出 3.5 Flash

    Google DeepMind 发布 Gemini 3.5 模型系列,首先推出 3.5 Flash,定位智能体与编码,在 Terminal-Bench 2.1(76.2%)、GDPval-AA(1656 Elo)、MCP Atlas(83.6%)和 CharXiv Reasoning(84.2%)上超过 Gemini 3.1 Pro,输出速度为其他前沿模型的 4 倍。

    推荐理由:官方公布了 3.5 Flash 的基准成绩、开放渠道和 Pro 后续计划,读者可以据此评估它在智能体与编码场景的取舍。

5月6日周三
1月28日周三
  1. Mistral AI64

    Mistral 发布 Mistral Vibe 2.0 终端编码智能体,Devstral 2 转为付费 API

    Mistral 发布 Mistral Vibe 2.0,升级其终端原生编码智能体,由 Devstral 2 模型家族驱动。新功能包括自定义 subagents、执行前多选项澄清、斜杠命令加载技能、统一 Agent 模式和自动更新。

    推荐理由:原文给出 Vibe 2.0 的功能明细、订阅方案和 Devstral 2 API 定价,读者可以据此评估是否切换自己的编码工作流。

12月9日周二
  1. Mistral AI72

    Mistral AI 发布 Devstral 2(123B)与 Devstral Small 2(24B)编码模型及 Mistral Vibe CLI

    Mistral AI 发布开源编码模型家族 Devstral 2,包含 123B 的 Devstral 2(modified MIT 许可)和 24B 的 Devstral Small 2(Apache 2.0),两者均支持 256K 上下文窗口,分别在 SWE-bench Verified 上取得 72.2% 和 68.0%。

    推荐理由:官方公布了两个尺寸编码模型的开源协议、SWE-bench Verified 成绩、API 定价和硬件要求,可据此评估本地或端侧部署的可行性。

7月11日周五
5月21日周三
5月7日周三
  1. Mistral AI64

    Mistral AI 发布 Mistral Medium 3,以约八分之一成本逼近 Claude Sonnet 3.7

    Mistral AI 发布 Mistral Medium 3,定位 SOTA 性能、成本降低 8 倍的新级别模型。基准上达到或超过 Claude Sonnet 3.7 的 90%,定价为 $0.4 输入 / $2 输出每 M token,超越 Llama 4 Maverick 和 Cohere Command A,可在 4 张 GPU 以上环境自部署。

    推荐理由:官方给出与 Claude Sonnet 3.7 的基准对比、定价和部署门槛,读者可据此评估企业落地的性价比。