立足娱乐圈·争做八卦帝!

徽声在线

顶级AI模型遇冷,Fable 5增长停滞!企业转向性价比更高模型,控制Anthropic和OpenAI支出

来源:未知 作者:佚名 发布时间:2026-08-26 19:47:34

每经特约记者:陈思宇 编辑:李晓雯

最新一代的顶级AI大模型,似乎正在失去企业客户的青睐,不再被视为首选解决方案。

据徽声在线8月23日消息,企业支付平台Ramp的最新数据显示,Anthropic公司推出的能力最强、价格最高的旗舰模型Fable 5,在发布两个多月后,企业客户支出占比仅为约11%,且增长势头已经停滞。相比之下,Anthropic在7月底推出的价格更为亲民的Opus 5模型,企业支出已经悄然超越了Fable 5。


图片来源:Anthropic官网截图

有企业高管坦言,企业交给AI处理的任务中,绝大多数都可以由更基础、价格更低的模型来完成,这一比例甚至可能高达95%。美国电信业巨头AT&T更是计划将开源或开放权重模型在员工AI需求中的占比,从目前的约40%提升至60%至70%,以进一步降低成本。

美国AI基础设施服务商Featherless AI的CEO尤金·切赫(Eugene Cheah)在接受《每日经济新闻》记者采访时透露,目前在其公有云业务中,约75%的推理流量来自中国AI企业开发的大模型,或是基于这些大模型进一步微调的模型,显示出中国AI模型的强大竞争力。

Anthropic顶级模型遇冷,企业支出占比低迷

不仅在企业支出上未能占据主导地位,Anthropic的最大、最贵模型Fable 5在实际Token使用量上的占比也极低。过去一个月内,Fable 5仅占企业从Anthropic购买Token数量的6%,对应支出占比为11.4%。相比之下,OpenAI的旗舰模型GPT-5.6 Sol则占据了企业购买OpenAI Token数量的25%,相关支出占比为23%,显示出明显的优势。

Ramp的数据还显示,Fable 5每百万Token的价格约为10美元,几乎是GPT-5.6 Sol价格的两倍。高昂的价格成为了阻碍其广泛应用的重要因素。



有分析指出,这一现象打破了企业用户倾向于采用能力最强模型的惯例。多名Anthropic的投资者和分析师认为,Fable 5增长缓慢的主要原因在于其价格较高,以及市场上其他模型已经能够满足大部分企业的需求。

Anthropic的投资方Accel合伙人迈尔斯·克莱门茨(Miles Clements)表示,“大多数人并不需要始终处于技术前沿。”他认为,客户倾向于只选择前沿模型的阶段不会持续太久。虽然模型能力的持续突破对于疾病治疗等高难度目标以及吸引顶尖研究人员仍然至关重要,但最前沿的模型将更多地承担探索能力边界的角色。

尤金·切赫向记者表示,每当有新模型发布,流量就会出现波动。

他举例说,Qwen 3发布后,其基础模型及微调版本的流量迅速上升,一度占Featherless AI公有云总流量的四分之一。但随着Gemma模型的上线,一部分流量从Qwen 3转向了Gemma。而随着更多新模型的陆续发布,目前Gemma的流量也在缓慢回落,显示出市场竞争的激烈。


AI成本攀升,企业开始限制使用频率,转向性价比更高的模型

企业对最前沿模型需求的降温,背后是AI使用成本成为越来越多公司的现实考量。

据徽声在线报道,在经历数年鼓励员工广泛使用AI后,一些企业开始限制AI工具的使用频率,并培训员工根据任务需求选择更小、更便宜的模型,以降低运营成本。

Gartner今年6月发布的报告警告称,随着Token使用量的增长以及AI服务向按使用量收费模式的转变,到2028年,AI编程成本可能超过开发者的平均工资。这一预测引发了业界的广泛关注。

一些企业已经开始采取措施压缩不必要的Token消耗。电子签名软件公司Docusign发现,AI编程智能体在执行任务前会读取整个代码库以获取上下文,从而消耗大量Token。公司随后调整了默认设置,仅提取完成具体任务所需的相关上下文,使得Token使用量下降了近50%,有效降低了成本。

企业也开始根据任务的复杂程度选择不同的模型。肯德基和塔可钟的母公司Yum Brands首席数字与技术官吉姆·道施(Jim Dausch)表示,公司已经注意到AI Token使用量和相关支出的上升。在他看来,企业交给AI处理的任务中,绝大多数都可以由更基础、价格更低的模型完成,这一比例甚至可能高达95%。

美国医疗保险公司Cigna则在内部批准了超过70种AI模型,对于不需要大量推理能力的任务,允许员工使用小语言模型或更早、更便宜的模型。尽管公司的算力和Token使用量均在增加,但通过组合使用不同模型,其AI总支出并未以相同速度增长,实现了成本的有效控制。

一些企业甚至进一步将模型选择交给系统自动完成。美国电信巨头AT&T负责员工AI业务的副总裁马克·奥斯汀(Mark Austin)近日接受采访时表示,AT&T正在使用LiteLLM模型路由器,根据任务复杂程度自动判断是否可以将请求交给成本更低的模型。在部分编码及其他高级AI任务中,这一方式最高将成本降低了56%,而AI输出质量仅下降了2%,实现了成本与质量的平衡。

机构:75%公有云推理流量青睐中国大模型

图片来源:每经媒资库

随着企业开始在不同任务之间选择不同模型,开源模型也迎来了需求的增长。

马克·奥斯汀表示,根据AT&T的使用经验,开源模型的能力通常比最前沿模型落后6至10个月,但这一差距正在逐渐缩小。一些开源模型的表现已经完全不输甚至超越了Anthropic和OpenAI等大厂此前推出的模型,成为了企业的新选择。

目前,AT&T约40%的员工AI请求由开源或开放权重模型处理,公司计划未来将这一比例提高至60%至70%,以进一步控制员工使用Anthropic和OpenAI模型的支出。公司目前使用的此类模型包括英伟达Nemotron、Meta Llama和Google Gemma等,展现了开源模型的强大潜力。

这一趋势在Featherless AI的数据中也得到了验证。

以欧洲市场的大模型调用情况为例,尤金·切赫向记者表示,越来越多企业希望在自有基础设施或位于欧洲本土的服务器上运行开源模型。开放权重让他们能够完全按照自身需求,在任意环境下部署运行所选定的模型。并且,这些模型在实际生产环境中的表现完全立得住——针对特定场景微调、参数规模适中的开放权重模型,在成本和准确率两项指标上甚至可以超越参数规模更大的通用大模型,为企业带来了更大的价值。

而中国大模型也在成为企业的热门选择。

尤金·切赫进一步提到,目前,Featherless AI公有云业务中,约75%的推理流量来自中国AI企业开发的大模型,或基于中国企业大模型进一步微调的模型。从具体场景看,在代码开发方面,平台用户几乎都选择智谱GLM、Kimi以及DeepSeek系列模型,显示了中国AI模型的强大实力和广泛认可。

他解释称,“中国开源模型与海外模型之间的技术差距已经大幅收窄。”企业选择中国模型,其中最主要的驱动力是成本。“这种趋势短期内不会改变。”他说,预示着中国AI模型在国际市场上的广阔前景。

免责声明:本文内容与数据仅供参考,不构成投资建议,使用前请核实。据此操作,风险自担。

    责任编辑:
    19岁弗拉格两战狂砍96分!球风酷似詹皇,他比布朗尼更得老詹真传?

    2026-04-06

    今日这场对决着实令人瞠目结舌,紫金军团拼尽全力鏖战至最后一刻,却意外被一位年仅19岁的新秀给好好上了一课。独行侠的状元郎库珀·弗拉格,全场犹如猛虎下山般狂轰45分,同时摘下 ... [详细]

    国安不敌辽宁铁人!蒙哥马利赛后剖析败因,阵容调整引期待

    2026-04-05

    国安队在中超客场1比2不敌辽宁铁人,主帅蒙哥马利赛后分析输球原因并决定调整阵容,杨立瑜等球员的回归备受期待。 ... [详细]

    头号詹黑彻底崩溃!41岁詹姆斯再夺周最佳,全联盟被打得措手不及

    2026-04-28

    41岁105天的勒布朗·詹姆斯再夺周最佳,打破历史纪录,用实力回击质疑。头号詹黑Skip Bayless陷入精神内耗,詹姆斯用数据证明自己仍是联盟顶级巨星。 ... [详细]

    20+23+22+30!活塞队豪掷5200万美金大合同的背后逻辑

    2026-05-07

    活塞队托哈季后赛表现惊艳,连续砍下20+,成为球队二当家,或因此获2年5200万美金大合同。 ... [详细]

    于和伟怒扇鬼子耳光!王阳万茜乱世守家国;李昀锐冰湖重生归来!黄杨钿甜接棒赵丽颖饰演复仇大女主

    2026-04-10

    剧荒?不存在的!本周两部重磅新剧已经开播!一部是乱世里小人物在血火中坚守信仰、保家卫国的硬核抗战剧,一部是冰湖虐恋、死而复生的古装复仇爽剧。风格完全不同,但每一部都让人追 ... [详细]

    图酷

    图说天下

    资讯排行

    首页 - 娱乐圈事 - 体育圈事 - 两性情感 - 星座命运 - 奇闻怪事 - 历史故事 - 科技资讯 - 图说天下 - 知识百科 - 图酷 - 娱乐八卦 - 开云体育登录_官网入口_安全便捷 - 乐鱼体育_乐鱼APP_体育赛事_在线娱乐平台
    电脑版 | 移动端
    Copyright © 2002-2019 徽声在线 版权所有
    删帖请联系邮箱:[email protected]