都说 Fable 5 贵,我把一次干到两毛钱

Fable 5 今天发布上线,我的时间线上几乎全是夸它的:推理强、代码强、推背感回来了。可每条帖子点进评论区,大家关心的全是另一件事。

大家好,我是超级峰,一个看到新模型就忍不住先上手测一轮的 AI 独立开发者。我翻了几十条帖子,发现不管开头吹得多猛,聊到最后都落在同一个字上。

贵。

卡兹克的评论区里,有人留言说"感觉是在与 10T 级别的模型在对话"。他自己回了一句更狠的:4.7 和 4.8 是真的拉,这个模型真的让我回到了 4.5 和 4.6 那种兴奋感推背的峥嵘岁月。

图片[1]-都说 Fable 5 贵,我把一次干到两毛钱-环球搭子

那种久违的推背感回来了,这是共识。但价格也实打实地立在那里。

贵到什么程度

先把数字摆出来。这部分不是我自己测的,来自官方说明和当晚几家媒体的报道。

Fable 5 的 API 定价是每百万输入 token 10 美元,每百万输出 token 50 美元。正好是 Claude Opus 4.8 的两倍。对比正在打价格战的 DeepSeek V4-Pro,输入贵约 23 倍,输出贵约 57 倍。

订阅用户有个免费窗口:6 月 22 日之前,Pro、Max 这些套餐可以免费用。6 月 23 日起,它就不再默认包含在套餐里,用一次扣一次额度。官方说等容量充足会恢复,但什么时候充足,没人知道。

图片[2]-都说 Fable 5 贵,我把一次干到两毛钱-环球搭子

卡兹克在文章里叹了口气,说 AI 这东西真的要变成贵族的游戏了,你的经济因素会直接决定你能用什么级别的 AI。APPSO 的实测标题更直白:普通人慎用。

图片[3]-都说 Fable 5 贵,我把一次干到两毛钱-环球搭子

我本来也准备认了。反正每次新模型发布都是这个剧本:先惊艳,再看账单,然后默默切回便宜的。

转折发生在第二天

第二天我在 Cursor 里点开模型下拉框,Fable 5 已经上线了,默认配置就是 High。

图片[4]-都说 Fable 5 贵,我把一次干到两毛钱-环球搭子

选模型的那一瞬间我突然意识到一件事:我手上这个旧的 Cursor 付费方案,是按次数计费的。20 美元一个月,500 次 included requests。

按次数。不是按 token。

这两个口径的差别,平时感觉不出来。但 Fable 5 这种"思考十分钟、吞吐几十万 token"的模型一来,差别就被放到最大了。API 口径下它是天价,按次口径下,它和别的模型一样,一次就是一次。

我当时的判断是:如果一次正常调用真的只扣 1 次,那这就是全网都在喊贵的当口,藏在旧方案里的一个洞。

得验证一下。

实测:它到底扣几次

我发了一条很日常的指令:"今天的 AI 热文是什么"。

图片[5]-都说 Fable 5 贵,我把一次干到两毛钱-环球搭子

Fable 5 接到指令后开始干活:探索了 2 个文件,做了 5 次搜索,最后吐出一整页结构化的 AI 日报,大模型发布、研究论文、产品动态、融资新闻,分门别类全列出来了。

Fable 5 完整执行结果

这是关键时刻。我打开 cursor.com/dashboard/usage,盯着那个数字看。

192 / 500。

上一次任务结束是 191。也就是说,这一整套搜索、阅读、整理、输出,模型在背后干了那么多活,面板上就跳了一个数。

Cursor 用量面板:一次任务只扣 1 次

点开用量明细,每一行写得清清楚楚:claude-fable-5-thinking-high,有一条吃掉了 47.8 万 token,Requests 那一栏照样只有 1。

用量明细:47.8 万 token 也只扣 1 次

算一笔账

20 美元,按现在的汇率大概 145 块钱,500 次。

一次,两毛九。我视频里说两毛钱,是抹了零头的说法,真实口径是不到三毛。

同样的任务直接调 API 什么价?这种带多轮搜索和长输出的调研任务,按 10 美元输入、50 美元输出的单价,几块钱到十几块钱一次很正常。中间差了一到两个数量级。

成本对比

两毛九,用的还是全网公认的当前最强模型。这个性价比我觉得已经不是高了,是有点离谱了。

会不会是 Cursor 还没来得及为 Fable 5 改计费规则?有可能。所以这个用法的保质期,谁也别高估。但至少在我写这篇文章的当下,它是真实成立的,截图都在上面。

关键前提:什么时候只扣一次

先别急着去开任务,真正容易翻车的地方在这里。

只扣 1 次的前提是:它是一次单独的调用。你提一个需求,让它完整地干完一件事,这算一次。下面三种姿势会让次数飞快烧掉:

第一种,循环跑。在同一个任务里不停追加指令让它反复重试,每一轮都是新的一次。

第二种,并行多开。同时开三个窗口跑三个任务,就是 3 次。这个账是线性的,没有任何折扣。

第三种最隐蔽:Subagents。Cursor 在做复杂调研时,有时候会自己拆出好几个子代理并行去查,每一路都单独计次。你以为发了一次指令,账上可能是好几次。

这个可以关。路径是 Settings,进 Agents,找到 Subagents,把它改成 disable。

Cursor 设置里的 Agents 与 Subagents 区域

关掉之后,每次指令就锁死成唯一的一次调用。代价也得说清楚:复杂任务少了并行探索,速度和广度会打折。我自己的用法是日常开发任务关着,确实需要大规模调研的时候再打开,用一次贵的换一次值的。

把这套用法收成一张清单,照着配就行:

  • • 付费方案:保留旧版按次计费,20 美元一个月 500 次
  • • 模型选择:Fable 5,默认 High 就行
  • • Subagents:Settings 进 Agents 找到 Subagents,改成 disable
  • • 任务习惯:一个任务一个窗口,发出去让它一次干完

判断要不要换姿势的阈值也很简单:一旦你发现同一个任务里追加指令超过 3 轮,或者屏幕上同时开着超过 2 个窗口在跑,这个月的 500 次就开始失控了。

加码玩法:一次次数,榨出一整个工作流

到这里其实还没完。我后来又发现了一层:次数的计量单位是"对话",不是"轮次"。

什么意思?同一个对话窗口里,任务跑完之后你接着补充、追问、让它继续改,这些续接是不重新扣次数的。扣次发生在你新开一次任务的时候。

于是就有了一个很顺手的玩法,我叫它 ask-loop:让 Agent 在每轮干完活之后,主动用 AskQuestion 这类提问工具停下来,把下一步的选项摆给你选。你点一个选项,它接着干,再停下来再问。整个过程在同一次对话里滚动,一次次数,跑完一整串任务。

具体做法也不复杂,在你的提示词或者规则文件里加一条约定就行。下面这段就是我自己在用的版本,直接复制过去就能生效:

代码块
Plain Text
复制
每轮工作完成后,不要直接结束对话。
调用 AskQuestion(或环境里等价的结构化提问工具),

配图这件事也一样。Cursor 里内置的 GenerateImage 工具,调用的是 Gemini 2 的生图模型,目前是免费的,不计入次数。我这篇文章里的封面图和示意图,就是在同一次对话里让它顺手生成的。

一次次数的工作流

把这三件事叠起来:按次方案打底,Subagents 锁住单次,ask-loop 把一次次数滚成一串任务,生图走免费通道。最强模型的单任务成本,就被压到了一个很不体面的水平。

最后说清楚边界

这套玩法的每一层都有保质期。

免费窗口到 6 月 22 日。旧版按次方案是历史残留,Cursor 随时可能调整计费规则。Subagents 关掉会牺牲复杂任务的能力。这些我都不替你打包票。

但反过来说,如果你手上还保留着旧的按次付费方案,先别急着切换,这就是隐藏福利。趁窗口还开着,把你积压的那些硬任务,重构、调研、长文档,扔给 Fable 5 跑一轮,两毛九一次,亏不到哪里去。

我自己已经把日常开发全部切过去了。各位创造者,先去翻翻你的订阅页面,看看那个旧方案还在不在。

© 版权声明
THE END
喜欢就支持一下吧
点赞12 分享
chaojifeng的头像-环球搭子
评论 抢沙发

请登录后发表评论

    暂无评论内容