每经记者:宋欣悦 每经编辑:兰素英
《每日经济新闻》根据OpenRouter最新数据测算,上周(8月10日至8月16日)全球AI大模型总调用量为75.3万亿Token,环比增长9.13%。
其中,上榜的AI大模型中,中国AI大模型周调用量达36.84万亿Token,环比增长7.56%;同期美国AI大模型周调用量为10.26万亿Token,环比增长11.89%。中国大模型周调用量连续十六周超过美国,稳居全球首位。
《每日经济新闻》注意到,上周,全球调用量排名前二均为中国AI大模型。其中,DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash正式版)连续两周位居第一,周调用量达11.2万亿Token,环比增长27%;腾讯Hy3连续两周位居第二,周调用量达9.95万亿Token,环比增长24%。
与此同时,DeepSeek-V4-Flash-0423(即DeepSeek-V4-Flash预览版)排名第四,周调用量达4.83万亿Token,环比下滑18%。值得注意的是,8月17日0时起,DeepSeek正式执行更新调整后的API价格,采用峰谷定价,空闲时段价格为高峰时段价格的一半。其中,V4-Pro高峰时间段涨幅最高达1100%。
OpenAI旗下GPT-5.6 Luna首次进入前三,周调用量达5.31万亿Token,环比增长20%,实现连续三周增长。
7月10日,OpenAI正式公开发布GPT-5.6系列模型,而GPT-5.6 Luna是该系列中速度最快、成本最低的模型,适用于大规模、高频率任务处理,可支持工具调用和多步骤工作流程。该系列模型上线不到三周之际,OpenAI宣布优化GPT-5.6系列模型定价和性能,以提升企业用户AI应用的性价比。其中,GPT-5.6 Luna模型价格下调80%。
据Artificial Analysis测算,GPT-5.6 Luna正式版完成单项测试任务的平均成本约为0.05美元,只有Anthropic旗舰模型Claude Fable 5的1/60。
一端是中国头部模型随着能力和调用量提升逐渐提高价格,另一端是美国厂商继续通过降低中低端模型价格争夺开发者,中美大模型此前悬殊的价格差正在收窄。摩根士丹利数据显示,2025年第一季度,中国大模型平均输入、输出API价格分别只有美国同行的6%和5%;到2026年第二季度,这两个比例已经上升至19%和14%。
月之暗面企业业务负责人黄震昕此前也曾表示,“开源模型、中国大模型不该被贴上低价标签,我们做出了SOTA级模型,也能匹配合理商业定价。”
此外,Claude Opus 5首次进入榜单,排名第八,周调用量达2.67万亿Token,环比增长102%。
Claude Opus 5于7月25日发布。Anthropic表示,Opus 5在编程、Agent任务及复杂推理等能力上进一步提升,整体性能接近更高端的Claude Fable 5,但API价格仍维持上一代Opus 4.8水平。该模型更适合企业办公、软件开发等日常高频场景,并进一步增强了安全性和抗滥用能力。
值得注意的是,此前一周排名第八的英伟达Nemotron 3 Ultra (free)跌出榜单。
免责声明:本文内容与数据仅供参考,不构成投资建议,使用前请核实。据此操作,风险自担。
每日经济新闻