2026-04-06
今日这场对决着实令人瞠目结舌,紫金军团拼尽全力鏖战至最后一刻,却意外被一位年仅19岁的新秀给好好上了一课。独行侠的状元郎库珀·弗拉格,全场犹如猛虎下山般狂轰45分,同时摘下 ... [详细]
|
每经特约记者:陈思宇 编辑:李晓雯 最新一代的顶级AI大模型,似乎正在失去企业客户的青睐,不再被视为首选解决方案。 据徽声在线8月23日消息,企业支付平台Ramp的最新数据显示,Anthropic公司推出的能力最强、价格最高的旗舰模型Fable 5,在发布两个多月后,企业客户支出占比仅为约11%,且增长势头已经停滞。相比之下,Anthropic在7月底推出的价格更为亲民的Opus 5模型,企业支出已经悄然超越了Fable 5。 图片来源:Anthropic官网截图 有企业高管坦言,企业交给AI处理的任务中,绝大多数都可以由更基础、价格更低的模型来完成,这一比例甚至可能高达95%。美国电信业巨头AT&T更是计划将开源或开放权重模型在员工AI需求中的占比,从目前的约40%提升至60%至70%,以进一步降低成本。 美国AI基础设施服务商Featherless AI的CEO尤金·切赫(Eugene Cheah)在接受《每日经济新闻》记者采访时透露,目前在其公有云业务中,约75%的推理流量来自中国AI企业开发的大模型,或是基于这些大模型进一步微调的模型,显示出中国AI模型的强大竞争力。 Anthropic顶级模型遇冷,企业支出占比低迷 不仅在企业支出上未能占据主导地位,Anthropic的最大、最贵模型Fable 5在实际Token使用量上的占比也极低。过去一个月内,Fable 5仅占企业从Anthropic购买Token数量的6%,对应支出占比为11.4%。相比之下,OpenAI的旗舰模型GPT-5.6 Sol则占据了企业购买OpenAI Token数量的25%,相关支出占比为23%,显示出明显的优势。 Ramp的数据还显示,Fable 5每百万Token的价格约为10美元,几乎是GPT-5.6 Sol价格的两倍。高昂的价格成为了阻碍其广泛应用的重要因素。 有分析指出,这一现象打破了企业用户倾向于采用能力最强模型的惯例。多名Anthropic的投资者和分析师认为,Fable 5增长缓慢的主要原因在于其价格较高,以及市场上其他模型已经能够满足大部分企业的需求。 Anthropic的投资方Accel合伙人迈尔斯·克莱门茨(Miles Clements)表示,“大多数人并不需要始终处于技术前沿。”他认为,客户倾向于只选择前沿模型的阶段不会持续太久。虽然模型能力的持续突破对于疾病治疗等高难度目标以及吸引顶尖研究人员仍然至关重要,但最前沿的模型将更多地承担探索能力边界的角色。 尤金·切赫向记者表示,每当有新模型发布,流量就会出现波动。 他举例说,Qwen 3发布后,其基础模型及微调版本的流量迅速上升,一度占Featherless AI公有云总流量的四分之一。但随着Gemma模型的上线,一部分流量从Qwen 3转向了Gemma。而随着更多新模型的陆续发布,目前Gemma的流量也在缓慢回落,显示出市场竞争的激烈。
企业对最前沿模型需求的降温,背后是AI使用成本成为越来越多公司的现实考量。 据徽声在线报道,在经历数年鼓励员工广泛使用AI后,一些企业开始限制AI工具的使用频率,并培训员工根据任务需求选择更小、更便宜的模型,以降低运营成本。 Gartner今年6月发布的报告警告称,随着Token使用量的增长以及AI服务向按使用量收费模式的转变,到2028年,AI编程成本可能超过开发者的平均工资。这一预测引发了业界的广泛关注。 一些企业已经开始采取措施压缩不必要的Token消耗。电子签名软件公司Docusign发现,AI编程智能体在执行任务前会读取整个代码库以获取上下文,从而消耗大量Token。公司随后调整了默认设置,仅提取完成具体任务所需的相关上下文,使得Token使用量下降了近50%,有效降低了成本。 企业也开始根据任务的复杂程度选择不同的模型。肯德基和塔可钟的母公司Yum Brands首席数字与技术官吉姆·道施(Jim Dausch)表示,公司已经注意到AI Token使用量和相关支出的上升。在他看来,企业交给AI处理的任务中,绝大多数都可以由更基础、价格更低的模型完成,这一比例甚至可能高达95%。 美国医疗保险公司Cigna则在内部批准了超过70种AI模型,对于不需要大量推理能力的任务,允许员工使用小语言模型或更早、更便宜的模型。尽管公司的算力和Token使用量均在增加,但通过组合使用不同模型,其AI总支出并未以相同速度增长,实现了成本的有效控制。 一些企业甚至进一步将模型选择交给系统自动完成。美国电信巨头AT&T负责员工AI业务的副总裁马克·奥斯汀(Mark Austin)近日接受采访时表示,AT&T正在使用LiteLLM模型路由器,根据任务复杂程度自动判断是否可以将请求交给成本更低的模型。在部分编码及其他高级AI任务中,这一方式最高将成本降低了56%,而AI输出质量仅下降了2%,实现了成本与质量的平衡。 机构:75%公有云推理流量青睐中国大模型 图片来源:每经媒资库 随着企业开始在不同任务之间选择不同模型,开源模型也迎来了需求的增长。 马克·奥斯汀表示,根据AT&T的使用经验,开源模型的能力通常比最前沿模型落后6至10个月,但这一差距正在逐渐缩小。一些开源模型的表现已经完全不输甚至超越了Anthropic和OpenAI等大厂此前推出的模型,成为了企业的新选择。 目前,AT&T约40%的员工AI请求由开源或开放权重模型处理,公司计划未来将这一比例提高至60%至70%,以进一步控制员工使用Anthropic和OpenAI模型的支出。公司目前使用的此类模型包括英伟达Nemotron、Meta Llama和Google Gemma等,展现了开源模型的强大潜力。 这一趋势在Featherless AI的数据中也得到了验证。 以欧洲市场的大模型调用情况为例,尤金·切赫向记者表示,越来越多企业希望在自有基础设施或位于欧洲本土的服务器上运行开源模型。开放权重让他们能够完全按照自身需求,在任意环境下部署运行所选定的模型。并且,这些模型在实际生产环境中的表现完全立得住——针对特定场景微调、参数规模适中的开放权重模型,在成本和准确率两项指标上甚至可以超越参数规模更大的通用大模型,为企业带来了更大的价值。 而中国大模型也在成为企业的热门选择。 尤金·切赫进一步提到,目前,Featherless AI公有云业务中,约75%的推理流量来自中国AI企业开发的大模型,或基于中国企业大模型进一步微调的模型。从具体场景看,在代码开发方面,平台用户几乎都选择智谱GLM、Kimi以及DeepSeek系列模型,显示了中国AI模型的强大实力和广泛认可。 他解释称,“中国开源模型与海外模型之间的技术差距已经大幅收窄。”企业选择中国模型,其中最主要的驱动力是成本。“这种趋势短期内不会改变。”他说,预示着中国AI模型在国际市场上的广阔前景。 免责声明:本文内容与数据仅供参考,不构成投资建议,使用前请核实。据此操作,风险自担。 |
iPhone凌晨突发价格调整 17 Pro跌入6000元区间!内存成本飙升,苹果此举背后有何玄机?
我国航天新突破:高精度温室气体探测卫星成功发射
微信撤回消息后灰色提示字能否删除?官方最新回应来了
波音回应徽声在线:喜获200架中国意向订单初步承诺
颜宁自谦:我仅算人才,王虹才是科研天才
蓝思科技具身智能机器人业务突破10亿营收大关
特斯拉Cybercab量产:无方向盘、脚踏板、后视镜,引领自动驾驶新潮流 2026-04-06
今日这场对决着实令人瞠目结舌,紫金军团拼尽全力鏖战至最后一刻,却意外被一位年仅19岁的新秀给好好上了一课。独行侠的状元郎库珀·弗拉格,全场犹如猛虎下山般狂轰45分,同时摘下 ... [详细]
2026-04-05
国安队在中超客场1比2不敌辽宁铁人,主帅蒙哥马利赛后分析输球原因并决定调整阵容,杨立瑜等球员的回归备受期待。 ... [详细]
2026-04-28
41岁105天的勒布朗·詹姆斯再夺周最佳,打破历史纪录,用实力回击质疑。头号詹黑Skip Bayless陷入精神内耗,詹姆斯用数据证明自己仍是联盟顶级巨星。 ... [详细]
2026-04-10
剧荒?不存在的!本周两部重磅新剧已经开播!一部是乱世里小人物在血火中坚守信仰、保家卫国的硬核抗战剧,一部是冰湖虐恋、死而复生的古装复仇爽剧。风格完全不同,但每一部都让人追 ... [详细]
啥病人看了这个都得好啊! 副标题 这胸是真的! 副标题 你赢了! 副标题 我是关心这是在哪里
乞丐装的最新境界! 副标题 买家你确定你不是阿宝?? 副标题 这裤子不敢坐下啊! 副标题 颜值
这鼠标垫你看到了什么?邪恶了吧! 副标题 毫无违和感! 副标题 小卖部的这女孩真会选呀! 副
女人真的不容易,怀孕后,内脏被挤压的严重,挺着大肚子干啥都不方便!近日,刘嘉姵和闺蜜集体拍
锤哥的替身也是辣么的帅气! 副标题 锤哥的替身好多啊! 副标题 你杀了你的替身,你可就没替
芭蕾舞这种舞蹈艺术形式,往往能够给观看者带来很大的感触,芭蕾舞演员们轻盈飘逸,舞裙飘飘
香港有一段特殊的历史时期,这段时间打家劫舍是常态,黑社会古惑仔遍街跑,后面社会发展号好
作为是国内高空挑战第一人的吴永宁,很多人应该都不会陌生,很多人都看过他的户外极限挑战