跳转到内容

海外三巨头同周上新:Fable 5.1、Gemini 3.8 Flash、GPT-6 Astra 跟你有什么关系

📍 认识 AI · 本周时事 · 相关:现在 AI 圈在卷什么 · Claude 5 速查 · 大厂 AI 大合并周(国内篇)

三个可爱的白色小机器人站在三级领奖台上,分别举着蓝色、绿色、橙色的小旗子

上周国内三巨头「拆墙合并」(那篇在这),这周轮到海外三巨头发新模型,而且排得像商量好的:

  • 9 月 1 日(周二):Anthropic 发布 Claude Fable 5.1,同时发布一个带更少「锁」的兄弟版本 Claude Mythos 5.1
  • 9 月 2 日(周三):Google 发布 Gemini 3.8 Flash,六周内第三个 Flash
  • 9 月 3 日(周四):OpenAI 发布 GPT-6 Astra,号称「一代人的跨越」

同一天国内也有一条小新闻:智谱把大模型套餐搬上了天猫,在淘宝就能下单。放在文末一起说。

这篇还是按「跟你有多大关系」的顺序讲:先讲大趋势,再逐家拆,最后按人群说该做什么。

先看懂:这一轮卷的不是「更聪明」

Section titled “先看懂:这一轮卷的不是「更聪明」”

三家发布会的 PPT 里都有一堆跑分,但把细节放一起看,真正的变化在三个词上:

卷什么三家各自的动作
更便宜Anthropic 把「缓存读取」降价 75%;Google 新模型促销价打五折到年底
更能干活三家都在强调「长任务」「自己操作电脑」——也就是本站一直讲的 Agent(智能体)
带锁出厂Anthropic 的 Mythos 只给审核过的机构;OpenAI 把 Astra 定为最高一级网络安全风险、分批放;Google 的 Flash Cyber 只给受信测试者和政府

打个比方:同一台发动机,出厂时装了不同的限速器。 普通人买到的是限速版,专业机构经过审核才能拿到解限版。这是 2026 年 AI 发布的新常态——模型太强,厂商开始用「谁能用」来管风险,而不只是「能不能做」。

第一家:Anthropic 的 Claude Fable 5.1

Section titled “第一家:Anthropic 的 Claude Fable 5.1”

一句话:同样的价格,更强的能力,外加一个大幅降价的角落。

  • 价格不变:每百万 token 输入 $10、输出 $50,跟 Fable 5 一样
  • 缓存读取降 75%:从 $1 降到 $0.25。官方估算,典型任务整体便宜约 25%,让 AI 自己跑长任务的场景最多省约 45%(这是厂商口径,实际看你的用法)
  • 能力:官方说是「目前最强的编程和知识工作模型」,而且开中低档「努力程度」时,效果就能追平上一代 Fable 5,但花的钱少得多

「缓存读取」是什么?你反复让 AI 看同一份资料(比如一个大项目的代码、一份长合同),它第二次起「重读旧资料」的那部分叫缓存读取。类比:复印件打 2.5 折,原件价格不变。Claude Code 这种一直在同一个项目里干活的工具,绝大部分 token 都是「重读」,所以省得最多。

按本站惯例,先说事实(来源:Anthropic 帮助中心,2026-09):

你的套餐能不能用 Fable 5.1
免费版不能
Pro($20 / 月)不含在套餐里,要另外买「用量额度」按量付费
Max含在套餐里,但最多用掉你每周额度的一半,而且它消耗额度比其他模型快
Team / Enterprise高级席位同 Max,标准席位同 Pro
API(程序接口)按上面的单价计费

两个细节值得知道:

  1. Claude Code 里默认开「High」档努力程度,网页版默认「Medium」——网页版更省,但也更「省着想」。想调,在发送按钮旁边的模型菜单里改
  2. Claude Code 要升到 2.1.255 以上才能选它。终端里敲 claude update 就行(出错怎么办那篇有升级排雷)

跟 Fable 5.1 是同一个模型,只是「锁」更少。 面向网络安全防御和生命科学研究,目前只对经过审核的美国机构开放。普通人不用惦记,知道这个名字就行——以后新闻里出现「Mythos」,指的就是这个解限版。

顺带一提,Anthropic 这次把误判也收紧了:安全类的「误拒绝」少了 60%,模型现在可以用来找软件漏洞(但不能写攻击代码)。

这两件跟新模型无关,但正好撞在同一周,本站读者里用 Claude 的人不少,一起说了。

① 9 月 14 日起,Claude Code 的周额度会变。 5 月到 9 月 13 日一直有个「周额度 +50%」的促销;9 月 14 日促销结束,官方同时把标准周额度永久提高 25%。算一笔账:原来 100,促销期 150,14 日起变 125——比原来多,但比你现在用的少 17%。适用 Pro / Max / Team 和老的按席位企业版;5 小时额度不受影响;只影响 Claude Code,网页版聊天不变。习惯了促销期用量的人,下周开始把轻活挪去便宜模型(怎么省钱那篇的方法都适用)。

② 有人的 Claude 账号被「偷用」了,做一次检查。 9 月 1 日前后,Anthropic 给一批用户发了邮件:有人用常见的「信息窃取」木马,从受害者电脑里偷走浏览器的登录状态,然后用他们的账号消耗额度、甚至触发自动充值。注意,这不是猜密码,也不是绕过验证码——是你已经登录的那个「会话」被整个复制走了,所以改密码和开二次验证都拦不住。官方的处理是强制下线、删掉绑定的卡。如果你发现「额度刚恢复就莫名其妙用光了」,八成就是这个。

自查四步(来自官方建议):

  1. 先给电脑做一次杀毒,清干净再登录
  2. 改你注册 Claude 用的邮箱密码,把其他设备都登出,开二次验证
  3. 浏览器里存过的银行、公司、云服务密码,一起换掉;存过卡的看一眼账单
  4. 以上做完,再把付款方式加回去

这条的原则本站早写过:什么能发给 AI,什么不能——账号本身也是要保护的东西。

一句话:轻量款一直更新,旗舰款迟迟不出。

  • 这是 Google 六周内的第三个 Flash(上一个是 8 月的 3.7 Flash),官方称是「目前最强的推理和编程模型」,编程能力提升最明显;而上一代旗舰 Pro 从年初到现在没有更新
  • API 促销价:每百万 token 输入 $0.75、输出 $3.75,到年底;原价是 $1.50 / $7.50
  • 免费路径:在 Google AI Studio 里可以免费聊,API 也有免费额度(有限流);但 Gemini 手机 / 网页应用里要 Pro 或 Ultra 订阅才能选到它
  • 同时发布的 Gemini 3.8 Flash Cyber 专做漏洞发现和修补,只给受信测试者和政府

对普通人的意义:Flash 这个档位已经卷到「便宜 + 够用」了,如果你是开发者、想找一个便宜的模型接进自己的小工具,它是这周最值得试的一个。给 Agent 配工具那篇讲过怎么接。

一句话:最响的名字,最难用上的模型。

  • OpenAI 总裁的原话是「一代人的跨越」,把 AI 「完全带进 AGI 时代」——听听就好
  • 官方跑分:电脑操作、浏览网页、软件工程、网络安全、科研全部第一;几个数学和推理基准直接「刷满」。全是厂商口径,第三方独立评测还没出来
  • 实际能感觉到的:ChatGPT 操作电脑的速度快了近一倍,能自己做文档、表格、PPT;配套的 Codex(OpenAI 的编程工具)同步升级
  • 怎么用:这是 OpenAI 第一个被自己定为「最高一级网络安全风险」的模型,所以分批放——9 月 3 日先给部分企业客户,9 月 4 日给 ChatGPT Pro($100 / $200 每月)用户,$20 的 Plus 要再等,免费版还没说法
  • 背景数字:用了超过 10 万块 GPU 训练,「史上最大规模」;而且是第一个大量由上一代模型参与训练的模型

国内读者的现实:ChatGPT 的门槛没变,该翻的还得翻,该付的海外账单还得付。它对你的意义更多是「知道天花板在哪」,真要用,Claude Code / 豆包 / ChatGPT 怎么选那篇的结论没变。

9 月 2 日,智谱在天猫开了官方旗舰店,卖的是 GLM Coding Plan 订阅套餐(基于 GLM-5.3),个人版 Lite 每月 118 元起,支持月付 / 季付 / 年付,也有团队席位。套餐适配 20 多款主流 Agent 工具——包括 Claude Code 和 Codex

这条新闻的意思是:大模型正在从「技术产品」变成「话费套餐」——不用找官网、不用研究 API,淘宝搜店名下单。对本站走国内路线的读者,这是继 DeepSeek 之后又一个能接进 Claude Code 的国产选项,价格按月算,比按 token 算更好预算。(据智东西报道,Kimi、MiniMax 也在往电商平台走。)

三家 API 价格一览(截至 2026-09)

Section titled “三家 API 价格一览(截至 2026-09)”

给开发者和记账党的一张表,单位:美元 / 每百万 token。

模型输入输出备注
Claude Fable 5.1$10$50缓存读取 $0.25(降 75%)
Claude Opus 5$5$25主力旗舰
Claude Sonnet 5$3$15介绍价已于 8 月底到期
Gemini 3.8 Flash$0.75$3.75促销价到年底,原价 $1.50 / $7.50
GPT-6 Astra分批开放中,价格以官网为准
DeepSeek V4 Pro分时分时高峰 / 低谷两档,见涨价那篇
  • 只用手机、只用免费版的:三家新模型你一个都用不上,也不用急——豆包、DeepSeek 照旧,等它们下放到免费档再说
  • Claude Pro 用户:Fable 5.1 不在你套餐里,别被「New」标签骗了;记住 9 月 14 日的额度变化;做一次账号安全自查
  • Claude Max 用户:可以选 Fable 5.1,但它吃额度快、最多用掉一半,重活再上;Claude Code 记得 claude update
  • 用 Claude Code + 国产模型的:多了智谱天猫套餐这个选项,按月付、接法一样
  • 开发者:Gemini 3.8 Flash 的促销价是这周最便宜的旗舰级选项;Fable 5.1 只在「反复读同一批资料」的场景才真便宜
  • 想尝鲜 GPT-6 的:没有 $100 以上的 ChatGPT 套餐就先别惦记,等 Plus 档开放再看第三方评测

本站一贯的提醒放最后:「一代人的跨越」「目前最强」「刷满」全是厂商口径。 新模型先拿来省钱、拿来玩,正经生产的活,多留一手。