Newsroom
AIEII

AI 周刊 #27:Claude Code 默认开 Auto Mode,编程 Agent 进入自动挡

本周 (8/9-8/16) 最值得记的一件事: Anthropic 把 Claude Code 的 Auto Mode 从可选功能改成默认打开。同期 Gemini 3.7 Flash 半价发布、GLM-5.3 开源模型登场、Lovable 拿到 4 亿美元融资。这五件事一起说清楚。

TL;DR
  • Anthropic 于 8 月 9 日把 Claude Code 的 Auto Mode 从手动开启改为默认打开, 意味着更多操作不再需要人工逐条确认。
  • Gemini 3.7 Flash 于 8 月 13 日发布, 输入 0.75 美元/输出 3.75 美元每百万 token, 是上一代价格的一半, 到 2026 年底有效。
  • GLM-5.3 于 8 月 14 日登场, 号称目前最强开源编程模型, 但权重要两周后才放出, 现在只能通过 GLM Coding Plan 订阅使用。
AI 周刊 #27:Claude Code 默认开 Auto Mode,编程 Agent 进入自动挡

本周 (8 月 9 日到 8 月 16 日) 最该记住的不是哪个模型跑分又涨了几分, 是 Claude Code 把 Auto Mode 从「你选择打开」变成了「默认给你打开」。

这个开关背后是编程 Agent 从「辅助」滑向「代劳」的一次实质性跨步。同一周里, 模型价格战和开源阵营也都各自动了一步。


本期 3 件事

一, Claude Code 的 Auto Mode 从可选变默认 (8 月 9 日)

Anthropic 在 8 月 9 日把 Claude Code 的 Auto Mode 从需要手动开启的功能改成了默认开启。Auto Mode 是一个安全分类器, 用来判断某个操作是不是「足够安全可以不用你确认」, 打开之后减少了大量逐条审批弹窗。

对开发者和小团队意味着什么: 写代码的摩擦确实变少了, 但这也意味着更多决策权交给了模型自己的判断。升级后建议先跑一遍 /status 和权限配置检查, 确认哪些目录和命令你仍然想手动把关, 不要等出了问题才想起这茬。

二, Gemini 3.7 Flash 发布, 价格砍半 (8 月 13 日)

Google 在 8 月 13 日发布 Gemini 3.7 Flash, 距上一代 3.6 Flash 只隔了三周, 一发布就是稳定版没有预览标签。官方给出的引入价是输入每百万 token 0.75 美元、输出 3.75 美元, 是上一代同期价格的一半, 优惠持续到 2026 年底, 2027 年 1 月 1 日起涨回 1.50 美元和 7.50 美元。上下文窗口是 1,048,576 token。官方数据显示它在调试和问题修复类基准上提升明显, DeepSWE v1.1 从 49.0% 涨到 65.3%。

对开发者和小团队意味着什么: 如果你的 agent 流水线里有大量重复的调试 / 修复子任务, 现在换成 3.7 Flash 大概率是「跑分更高还更便宜」的直接置换, 值得优先测。

三, GLM-5.3 登场, 号称最强开源编程模型 (8 月 14 日)

Zhipu (Z.ai) 在 8 月 14 日通过自家 GLM Coding Plan 发布 GLM-5.3, 号称是目前最强的开源权重编程模型。这次没有换新的预训练底座, 沿用 GLM-5.2 的基座, 靠加长后训练把编程能力拉高了官方口径的 50%。上下文窗口 1M token, 最大输出 128K token。但权重要两周后才开放下载, 目前只能通过订阅或等待中的 API 使用, 现在网上任何标着具体单价的 GLM-5.3 报价都是拿 5.2 的价格 (输入 0.630 美元/输出 1.98 美元每百万 token) 推算的, 不是官方数字。

对开发者和小团队意味着什么: 想自托管的团队现在还用不上, 先记下发布节奏, 两周后权重放出再评估值不值得替换现有开源模型。

四, Lovable 拿到 4 亿美元 C 轮, 估值 133 亿美元

瑞典的 AI 建站/软件平台 Lovable 完成 4 亿美元 C 轮融资, 由 Menlo Ventures 和 Scaleup Europe Fund 领投, 估值来到 133 亿美元。同一批融资新闻里, Databricks 也在 8 月 13 日拿到 50 亿美元新融资, 估值 1900 亿美元。

对开发者和小团队意味着什么: vibe coding / 无代码建站赛道的资本还在加码, 意味着这类工具的迭代速度短期内不会慢下来, 如果你的产品和它们功能重叠, 该盯紧竞对动态了。

五, 研究机构公开首例近乎自主的 AI 攻击政府案例取证 (8 月 12 日)

以色列网络安全公司 Dream 在 8 月 12 日公开了一份取证报告, 记录了目前已知第一起「近乎自主」的 AI 参与攻击政府系统的案例。

对开发者和小团队意味着什么: 如果你的 agent 有权限访问生产环境或外部系统, 这是提醒自己再检查一遍权限最小化和审计日志的好时机, 不是等出事才补。


我的判断

这周没有哪条单独拿出来算「爆炸新闻」, 但连在一起看, 方向很清楚: 编程 Agent 在往「更少确认、更快执行」走, 模型价格在往下砸, 开源阵营在追赶但权重开放总是慢半拍。对小团队来说, 现在最实际的动作是先审一遍自己 agent 的权限配置, 再评估要不要把重复子任务换成更便宜的新模型, 不用急着追每一个新发布。

相关阅读

上一期回顾: Agent 产品周报: Cursor 秘密造「Sand」, Claude Code 学会自己开模拟器。下期继续追 GLM-5.3 权重开放和 Gemini 3.5 Pro 迟迟未到的进展。

参考

常见问题

Claude Code 的 Auto Mode 默认打开后, 之前设的权限规则还有效吗?
有效。Auto Mode 是在你已有权限规则基础上减少确认弹窗的分类器, 不会绕开你在 settings.json 里明确写死的拒绝规则, 但会让更多灰色地带的操作自动通过, 建议升级后检查一遍权限配置。
Gemini 3.7 Flash 和上一代 3.6 Flash 比, 主要提升在哪?
官方给出的 DeepSWE v1.1 基准从 49.0% 提到 65.3%, FrontierCode 1.1 Main 从 34.4% 提到 43.6%, 提升集中在调试和问题修复类任务, 价格却降了一半。
GLM-5.3 现在能下载权重自己部署吗?
还不能。8 月 14 日发布时官方明确权重要两周后才开放, 现阶段只能通过 Z.ai 的 GLM Coding Plan 订阅或 API 等待开放来用, 自托管团队要再等等。
广告合作联系
立即联系 →
加入会员申请
了解详情 →
← 用 Dify 从零搭一条能上线的 RAG + Agentic … Ollama 报 CUDA out of memory 怎么 … →
💬 Comments
4 min read