Gemini 3.8 Flash 出了,Google Pro 现在真有点接近白嫖了,顺便推荐一下 /boost 烧额度

tf2026 2026-09-03 10:05 1

昨天 Gemini 3.8 Flash 正式出了。


最近 Google 这更新速度是真的离谱,3.7 Flash 才出来没多久,3.8 又来了。


我自己主要还是拿 AI 做项目和编程,所以比较关注 Agent 这块。现在 Google 这一套其实已经越来越完整了:



  • Antigravity 直接干项目

  • Antigravity CLI 可以在终端里跑

  • Agent 可以调子 Agent 协作

  • 能跑终端、编译、测试、浏览器验证

  • Gemini 3.8 Flash 直接作为主力 coding / agent 模型


Google AI Pro 的额度对正常写代码来说已经挺夸张了,官方现在也是 5 小时刷新一轮额度,另外还有周限额。


所以对我这种喜欢让 Agent 自己跑项目的人来说,感觉已经有点接近白嫖了。


问题甚至变成:


额度太多怎么烧。


然后这次发现一个很适合烧额度的东西:


/boost


这个我一开始以为只是类似:


Gemini 3.8 Flash High → 再加大一点 Thinking


后来查了官方文档才发现不是这么简单。


/boost 本质上是直接启动一套 多 Agent 深度推理模式


大概流程是:


第一层:Orchestrator


先读项目、理解问题、拆任务,决定这个问题应该从哪些方向调查。



第二层:多个子 Agent 并行干活


有的负责:



  • 找 Bug 根因

  • 跟调用链

  • 看依赖

  • 写候选实现

  • 重构代码

  • 补单元测试


而且这些 Agent 会尽量在隔离的环境里处理自己的任务,不是一群 Agent 全往同一个上下文里面塞东西。



第三层:验证


这个我觉得才是 /boost 最有意思的地方。


不是几个 Agent 干完以后主 Agent 总结一下就结束。


它还会:



  • 跑 build

  • 跑 test

  • 检查 edge case

  • 做 regression

  • 汇总不同 Agent 的结论

  • 验证失败再把错误扔回去继续修


也就是说更接近:


一个 Agent 当项目经理 + 几个 Agent 分头调查/实现 + 最后再安排 Agent 验收。


而不是普通模式的:


看代码 → 想一下 → 改代码 → 跑一下 → 完事。


官方给 /boost 的定位也是复杂 Bug、并发问题、算法优化、复杂多文件重构这种东西。


例如直接:


/boost 排查这个偶发 Bug,找到根因,修复并补测试,最后跑完整回归。


这种任务应该就很合适。


反而“改个按钮颜色”“加个字段”这种小活开 /boost 就纯属拿大炮打蚊子。




更有意思的是 3.8 Flash 本身就比 3.7 更愿意烧


Google 对 3.8 Flash 有个描述我觉得挺形象:


works harder。


遇到复杂任务它会主动:



  • 多走几步 reasoning

  • 多调几次工具

  • 多做一些检查

  • Agent loop 跑得更深


所以虽然 3.8 Flash 和 3.7 Flash 目前 API 单 token 价格一样,但是实际完成一个复杂任务,3.8 往往会主动消耗更多计算量。


也就是说:


3.8 Flash + High + /boost


属于:


本来模型就挺能烧,再叫一群 Agent 出来一起烧。🤣


具体是不是固定 3 倍、5 倍我暂时不敢说,官方没给固定倍数,而且每个任务差异应该很大。


但从机制上看,/boost 要同时做任务拆解、并行调查、实现、测试、独立验证,再来几轮纠错,额度掉得比普通 Agent 快完全正常。


对额度少的人可能是缺点。


对 Google Pro 这种:


月底发现额度根本用不完的人


那反而是优点。🤣




而且我感觉 3.8 Flash 这代方向已经很明显了。


Google 不一定非要让 Flash 在单次问答里面跟最大的 Pro/Opus 拼极限智力,而是:


Flash 够聪明 + 速度快 + 成本低 + Agent 多跑几轮 + 工具多调用几次。


最后实际把事情做出来。


官方现在也直接把 3.8 Flash 定位成 coding 和 agents 的 workhorse model,专门强化 long-horizon software engineering 和 autonomous agents。


我觉得这个方向挺适合真干项目。


以前用 Flash 最大的问题就是:


便宜、快,但是复杂项目容易干着干着跑偏。


现在如果 3.8 本身能力再提高一点,再配 /boost 多 Agent 调查 + 独立验收,可能比单纯换一个更贵的大模型更实用。


最近有 Google Pro 的可以去 Antigravity 或 CLI 里试试:


/boost 你的任务


尤其是拿一个自己以前 Agent 怎么都修不好的 Bug 去测,应该最能看出来区别。


我准备拿 Unity 项目这种多文件、需要编译验证的任务烧一下看看。


Google:给你这么多额度。


我:终于找到一个能把它烧完的按钮了。

最新回复 (10)
  • vikim 09-03 10:12
    1

    你的內容不會是 gemini 整理的把?

  • NOOOOOODE 09-03 10:15
    2

    gemini真的能写代码吗

  • XJEtmRllWnGX 09-03 10:24
    3

    煞笔再多思考也只是煞笔的思考,看看文档总结下代码还行,不敢用来写生产代码

  • tf2026 楼主 09-03 10:27
    4

    @XJEtmRllWnGX #3 我 用的 是ultra 20x 刚刚玩了下 5% 额度没了。相当于一个pro 的额度 ,。1x 烧光,能烧还是很快乐。

  • tf2026 楼主 09-03 10:28
    5

    @vikim #1 GPT 啊 。 我有几个team 跟他们开车了 菲律宾 20X 网页GPT 20x 的都没登录。

  • tf2026 楼主 09-03 10:29
    6

    @NOOOOOODE #2 没问题。 3.8 跑分很强,你舍得流量直接开/boost 我感觉 跟GPT 差距不大,但他肯定更快。

  • SkyLightVPS 09-03 10:32
    7

    3.7还没用热乎 3.8又来了 谷歌这更新速度跟不要钱似的

  • Thompson 09-03 11:45
    8

    额度部分好像是每天下午三点更新吧

  • tf2026 楼主 09-03 11:52
    9

    @Thompson #8 这个也是五小时,你问个问题 就开始计时 跟GPT 有点像,

  • Thompson 09-03 11:58
    10

    @tf2026 #9


    谢谢

* 帖子来源NodeSeek
返回