锐意创新 · 敏锐洞察 · 锐不可当

最强旗舰只吃掉6%Token,Anthropic紧急补牌“棉花糖”和“甜瓜”

两款神秘模型ID突然出现在第三方开发者和Discord社区中,分别叫claude-mashmallow-eap和claude-melon-eap。早期实测显示,Marshmallow对话自然度反超Opus 5,Melon表现稍逊,但均未达到Fable级别的综合能力,最快下周上线。就在全网围观之际,成立于2021年的AI大模型基础层开发商Anthropic内部却炸出一颗雷——旗舰模型Fable 5上线两个多月,遭遇了一场近乎集体的冷落。

希鸥网观察到,支付平台Ramp追踪了美国超70000万家企业的Token消费数据,发现Fable 5上线一个月仅吃掉企业在Anthropic上6%的Token调用量,支出占比11.4%;两个多月过去,支出份额仍徘徊在11%左右。而OpenAI同期旗舰GPT-5.6 Sol拿走了25%的Token和23%的支出份额。同一赛场,Anthropic顶配模型的份额只有竞品的四分之一,总营收贡献约为后者的75%。

贵是原罪。Fable 5的单价是自家Opus 4.8的2倍,是Haiku 4.5的10倍。企业日常的代码补全、文档摘要、客服推理,根本用不到那个参数级别。成本翻倍,体验增益却微乎其微,财务决策者自然不会为“参数虚荣”买单。旗舰存在的意义被重新定义:它可以是能力上限的证明,但不该是唯一被推向市场的牌。

更致命的打击来自自家阵营。7月底登场的Opus 5定价仅为Fable 5的一半,但在编程、知识工作评测中跑出几乎持平的分数。CursorBench 3.2测试里,Opus 5在最大算力下得分70%,每任务成本8.23美元;Fable 5得分70.5%,仅高出0.5个百分点,每任务却要17.32美元。企业用脚投票,Opus 5上线后支出迅速反超Fable 5。

外部开源模型的挤压同样凶猛。Vercel AI Gateway统计显示,4月开源模型Token份额只有11%,6月涨到29%,8月直接冲到62%,而它们花掉的钱不到企业总支出的4%。往内看,Opus 5半价追平旗舰;往外看,开源模型一轮轮把价格打穿。Fable 5的位置越来越尴尬——它只能是展示柜,但市场凭什么为一座展示柜给出2万亿美元的估值低估?

希鸥网认为,Marshmallow与Melon的紧急曝光,本质上是Anthropic对产品矩阵的一次纠偏。它不再试图用单一最贵模型通吃市场,而是用“够强加够便宜”的组合覆盖真实需求。Opus级别的迭代负责守住性能天花板,Sonnet级别负责放量。这场博弈的胜负手,从来不是谁的参数最高,而是谁能让企业愿意长期批量调用。

创业者面对技术采购时,最容易犯的错误是“以参数论英雄”。Fable 5被冷落给了一个清晰的信号:决定采用率的不是评测榜单,而是单位成本换来的有效产出。企业决策者应该花时间了解分歧,而不是急着证明自己选的模型是对的。真正的成本优势,往往藏在那些“便宜且够用”的选项里,就像Opus 5用一半价格追平了旗舰99%的体验。

多听几个可信者的观点,物有所值。一位连续创业者曾把模型选型比作就医——常规方案是切除食管,但未必适合每个人的病情。企业算账也一样:预算有限,与其押注最贵的顶配,不如定期检查、按需替换。那些在48小时内听取三位专家意见后选择替代方案的人,最终活了下来。技术采购的生存法则同样如此,备选方案不是妥协,而是对冲。

头脑封闭的人更关心自己被证明正确,头脑开放的人更想了解为什么出现分歧。开源份额四个月从11%冲到62%,这个事实已经说明,性价比的迁移速度远超任何品牌的护城河。创业者若想不被淘汰,就要敢把自己钉在数据上反复审视,承认“我可能选错了”并不丢人;丢人的是,数据已经翻脸,你还抱着参数榜单当护身符。

金鸥品牌榜·2026年度创新案例库开放申报了。免费提报,独立评估,入榜品牌将获得电子版《入榜证明》及年度专题公示,优秀案例可获得深度专访+全平台分发。 如需修改或发布文章,请加微信号:sheisceo

阅读量:1298
阅读时间:4分钟