立足娱乐圈·争做八卦帝!

徽声在线

梁文锋、马斯克同日推新:DeepSeek暂未涨价,Grok 4.6单任务成本与Kimi K3相当,中美大模型价差持续收窄

来源:未知 作者:佚名 发布时间:2026-08-13 19:03:45

8月12日,人工智能领域迎来重要时刻,DeepSeek与马斯克旗下的SpaceXAI在同一天分别发布了新模型DeepSeek-V4-Pro和Grok 4.6,这无疑为新一轮的大模型竞争添了一把火,使得整个行业的热度再次攀升。

从最新的评测数据来看,这两款新模型都展现出了强劲的实力,进一步向全球头部水平逼近。其中,DeepSeek-V4-Pro在多项智能体相关的测试中表现出色,成功超越了Anthropic的Claude Opus 4.8;而Grok 4.6则在Artificial Analysis智能指数上取得了优异成绩,追平了OpenAI的旗舰模型GPT-5.6 Sol。

在大模型能力差距逐渐缩小的同时,中美两国大模型之间原本悬殊的价格差距也正在发生显著变化。徽声在线从摩根士丹利发布的最新研报中了解到,在过去一年里,中国大模型API的平均价格呈现出明显的上涨趋势,而美国闭源模型的价格近期却在持续下降,这一升一降之间,中美大模型的价格差距正在不断收窄。

摩根士丹利在研报中特别指出,中国大模型市场的竞争重点正在悄然发生转变,从以往激烈的价格战逐渐转向了更为注重模型能力的智力战。

DeepSeek-V4-Pro正式版:Agent性能飞跃,大幅涨价暂未成真

8月12日晚,DeepSeek对官方API文档进行了更新,正式上线了旗舰模型DeepSeek-V4-Pro-0813,同时API及Chat端也完成了同步更新。

这是继7月31日DeepSeek-V4-Flash-0731正式上线之后,DeepSeek V4系列迎来的又一次重要更新。

从DeepSeek公布的评测结果来看,此次V4-Pro正式版在性能上有了显著提升,主要集中体现在Agent能力方面。

与DeepSeek今年4月发布的V4-Pro预览版相比,正式版在多项Agent相关测试中的成绩有了大幅提升。在考察软件工程能力的DeepSWE测试中,得分从12.8大幅升至62.7;在高难度数据科学任务测试DSBench-Hard中,得分从31.1提高到了67.2;在终端操作能力测试Terminal Bench 2.1中,得分从72.1跃升至87.9;在网络安全测试Cybergym中,得分从52.7提升至83.3;在HLE带工具测试中,得分也从48.2上升到了60.0。

DeepSeek还将V4-Pro与Anthropic旗下的Claude Opus 4.8和Fable 5进行了对比评测。根据官方公布的评测数据,V4-Pro在多项测试中表现优异,超过了Claude Opus 4.8,而与Fable 5则是各有胜负。具体来看,在Terminal Bench 2.1测试中,V4-Pro得分87.9,与Fable 5的88.0基本持平;在Cybergym测试中,V4-Pro以83.3的得分略高于Fable 5的83.1;不过在DSBench-FullStack测试中,V4-Pro得分71.1,低于Fable 5的77.2。


8月13日,半导体与AI研究机构SemiAnalysis在社交平台上发布文章称,DeepSeek-V4-Pro在Agent任务上的表现远远超过了英伟达的Nemotron 3 Ultra。该机构引用的Terminal Bench 2.1数据显示,Nemotron 3 Ultra得分仅为53.9,而V4-Pro则高达87.9。

除了性能上的升级,V4-Pro还具备诸多强大的功能特性。它支持100万Token的上下文窗口和最高38.4万Token的输出,并且同时支持思考与非思考模式,其中思考模式为默认开启状态。根据DeepSeek官方API文档显示,新模型还支持工具调用等功能,并且能够同时兼容OpenAI和Anthropic两套API格式,这无疑为用户提供了更多的便利和选择。

然而,令人意外的是,在模型性能得到明显提升的同时,DeepSeek此前预告的API大幅涨价并未随着V4-Pro正式版的上线而一同实施。

截至8月13日,徽声在线查看DeepSeek官方API价格页面发现,V4-Pro每百万Token缓存命中输入价格为0.025元,缓存未命中输入为3元,输出为6元,这一价格与此前V4-Pro预览版的定价保持一致。而V4-Flash对应的价格分别为0.02元、1元和2元。


目前,DeepSeek仍在官方价格页面明确提示,计划在近期整体上调DeepSeek API服务的定价,并且预计涨幅较大,具体的调价方案将以正式通知为准。也就是说,截至8月13日V4-Pro正式版上线时,DeepSeek此前预告的这轮API调价尚未真正落地。

Grok 4.6:性能比肩OpenAI旗舰,单任务成本与Kimi K3相当

当地时间8月12日,SpaceXAI发布了新一代大模型Grok 4.6,值得一提的是,这距离上一代Grok 4.5的发布仅仅过去了一个多月的时间。Grok 4.6主要面向长时间运行的AI智能体,以及更复杂的交互和视觉任务,旨在为用户提供更加智能和高效的服务。

从AI模型评测机构Artificial Analysis公布的最新评测结果来看,Grok 4.6的综合得分已经成功追平了OpenAI的旗舰模型。

Artificial Analysis在8月12日公布的数据显示,在最新版本的Artificial Analysis Intelligence Index(智能指数)中,Grok 4.6获得了61分,与OpenAI的GPT-5.6 Sol并列。不过,与Claude Opus 5的63分和Claude Fable 5的62分相比,Grok 4.6还有一定的差距,但高于Kimi K3的60分和DeepSeek-V4-Pro的53分。

Artificial Analysis将这一智能指数用于综合衡量不同模型的能力表现,并且明确标注分数越高代表模型能力越强。该指数综合了9项评测,包括用于测试高经济价值职场任务的GDPval-AA v2、终端操作测试Terminal-Bench v2.1,以及Humanity's Last Exam、GPQA Diamond等,全面评估了模型在不同场景下的表现。


在性能得到提升的同时,Grok 4.6并未像一些用户担忧的那样同步涨价。SpaceXAI公布的价格显示,新模型每百万Token输入和输出价格分别为2美元和6美元,与上一代Grok 4.5的价格保持一致。相比之下,Claude Opus 5的每百万Token输入和输出价格分别为5美元和25美元,GPT-5.6 Sol分别为5美元和30美元,Grok 4.6在价格上具有明显的优势。


Artificial Analysis从完成一项智能指数测试任务所产生的实际Token消耗出发,对不同模型的单任务成本进行了详细的测算。结果显示,Grok 4.6完成一项测试任务的平均成本为0.84美元,与Kimi K3持平。这意味着用户在使用Grok 4.6时,可以在获得高性能的同时,有效控制成本。


马斯克在新模型发布后也积极进行宣传。据媒体8月13日报道,模型上线后约两小时内,马斯克转发了约10条相关推文,并且称赞Grok 4.6智能、快速且性价比超高,在同时考虑智能水平、速度和成本的情况下,Grok 4.6客观上是第1。


中美大模型价差逐渐缩小,中国市场从价格战转向智力战

虽然DeepSeek此次暂未兑现此前预告的大幅涨价,但如果从更长的时间维度来看,中国大模型的价格正在呈现整体上行的趋势。

摩根士丹利在8月9日发布的研报《告别价格战,打响智力战》(Intelligence War Over Price War)中显示,该机构统计了字节跳动、阿里巴巴、百度、腾讯、MiniMax、智谱、月之暗面和DeepSeek等厂商的官方报价后发现,到了2026年第二季度,中国大模型平均API输入价格已经升至每百万Token 4.9元,输出价格升至21.9元。与2025年第一季度的3.3元和12.2元相比,输入价格分别上涨了约48%,输出价格上涨了约80%。


摩根士丹利认为,中国大模型行业正在逐步建立更加健康的商业化环境,竞争重点也在从单纯的价格竞争转向了模型能力的竞争。8月8日,DeepSeek曾预告将大幅上调API价格。摩根士丹利分析认为,这一变化可能与多个因素有关。一方面,V4系列需求的增强使得DeepSeek的定价能力得到提升;另一方面,为了维持合理的毛利以支持前沿模型的持续投入,以及考虑到推理成本等因素,上调价格也是必然的选择。随着模型能力和规模继续提升,中国新一代大模型的定价可能还会进一步上升,行业竞争将更多地聚焦在模型能力和算力供给上。

研报进一步指出,在大模型的长期竞争中,模型智能水平才是关键的决定因素,而非价格。这是因为头部模型厂商可以推出价格更低、能力稍弱的模型进入大众市场,以满足不同用户的需求。然而,对于普通模型厂商来说,要反过来追赶至最前沿水平则面临着巨大的困难。持续提升前沿模型能力需要大量的训练和算力投入,如果单纯依靠低价来争夺市场,可能会压低毛利,进而进一步限制下一代模型研发所需的资金,不利于行业的长期发展。

在中国模型价格上涨的同时,美国头部模型的价格却在下降,这使得中美之间原本悬殊的模型价格差距正在逐渐缩小。

摩根士丹利在8月12日发布的另一份研报中指出,在2025年一季度,中国大模型输入、输出API均价仅分别占到美国同行的6%、5%。但到了2026年二季度,这两个指标的占比已经上涨至19%与14%。随着中国模型价格的继续上涨,以及美国厂商继续下调模型价格,这一差距预计还将进一步收窄。研报认为,中国模型已经不再像过去那样便宜,与此同时,美国厂商特别是中低端模型仍存在进一步降价的空间。


从Silicon Data的LLM Token价格指数也可以清晰地看到这一变化趋势。截至2026年8月,闭源模型Token价格指数已从此前超过4美元的高位快速降至3.07美元;同期,开源模型Token价格指数约为0.66美元。摩根士丹利指出,开源模型使用比例的上升与闭源模型的降价正在共同推动整体Token价格的下降。


免责声明:文章内容和数据仅供参考,不构成投资建议。投资者据此操作,风险自担。

    责任编辑:
    法国队世界杯不败神话终结,半决赛首尝落后滋味&淘汰赛首丢球

    2026-07-22

    北京时间7月15日世界杯半决赛,法国队对阵西班牙队,法国队后防失误送点,西班牙队奥亚萨瓦尔罚进,法国队本届世界杯首次落后且淘汰赛首丢球。 ... [详细]

    海牛队保级形势严峻,邝兆雷成新星,林创益逆袭成关键

    2026-04-03

    青岛海牛队本赛季保级形势不容乐观,邝兆雷成球队新星,林创益逆袭成关键球员,助力海牛队保级。 ... [详细]

    海牛未战先礼!球迷开放日引爆期待,邝兆镭能否追赶郑龙传奇?

    2026-06-25

    青岛海牛队即将举办球迷开放日,邝兆镭表现受期待,能否追赶郑龙传奇成焦点。 ... [详细]

    郑丽文力挽狂澜?赖清德闹剧落幕,国民党三人自毁形象

    2026-05-15

    在世界外交的舞台上,这般离奇的出访方式着实少见。2026年5月伊始,台当局领导人赖清德开启了一场备受争议的外访之旅,这场外访竟如同一场荒诞的“潜伏”闹剧。他没有采用常规的 ... [详细]

    徽声在线:美加墨世界杯首轮,C罗表现平淡难与梅西比肩

    2026-06-18

    美加墨世界杯首轮,葡萄牙队与民主刚果队战平,C罗表现平平,与梅西首秀惊艳形成鲜明对比,目前难与梅西平起平坐。 ... [详细]

    图酷

    图说天下

    资讯排行

    首页 - 娱乐圈事 - 体育圈事 - 两性情感 - 星座命运 - 奇闻怪事 - 历史故事 - 科技资讯 - 图说天下 - 知识百科 - 图酷 - 娱乐八卦 - 开云体育登录_官网入口_安全便捷 - 乐鱼体育_乐鱼APP_体育赛事_在线娱乐平台
    电脑版 | 移动端
    Copyright © 2002-2019 徽声在线 版权所有
    删帖请联系邮箱:[email protected]