国产大模型改写全球AI调用版图

2026-08-10 09:41:33来源:科技日报

近日,全球模型聚合平台OpenRouter最新周度Token(词元)调用榜单出现历史性变化:前五名全部为国产大模型,DeepSeek V4 Flash位居榜首,小米MiMo V2.5、腾讯Hy3、DeepSeek V4 Pro、智谱GLM5.2依次位列第二至第五名。DeepSeek V4 Flash正式版上线后,单日使用量和合作平台新订阅用户均实现约30%的增长,凭借突出的性价比优势,扭转全球AI开发者的使用格局。

DeepSeek为何登顶全球调用榜?这体现了我国大模型产业怎样的竞争优势?科技日报记者就此采访了有关专家。

第一问:DeepSeek为何登顶全球调用榜?

对于“登顶”原因,中国电子信息产业发展研究院未来产业研究中心人工智能研究室主任钟新龙表示,直接原因是DeepSeek V4 Flash正式版的上线。

他介绍,该正式版将此前发布的预览版的能力验证转化为稳定的商用服务,上线过程中,DeepSeek与合作平台同步推进旧有版本用户的迁移以及旧接口停用,使用户调用在短期内集中到该正式版。

同时,极致性价比叠加智能体需求放大了该正式版的用户需求。数据显示,该版本官方价格为每百万Token输入1元、输出2元,且智能体应用场景Token消耗量大,市场需求水涨船高。据报道,该版本上线后,单日使用量和合作平台新订阅用户均增长30%,说明它的发布既提高了存量用户的使用频次,也带来了新增客户的入场。“可以理解为,正式版上线触发了需求,成本性能比和智能体生态又将需求持续放大。”钟新龙说。

第二问:国产模型在技术层面有哪些优势?

在国产模型包揽榜单前五的背景下,我国大模型在技术层面的优势值得关注。“国产大模型的突出优势,已经扩展到全链路工程能力。”钟新龙表示。

以DeepSeek V4 Flash为例,通过混合专家、稀疏注意力和长上下文压缩等技术路径,在百万级上下文、推理能力、工具调用和低价格之间形成平衡;小米MiMo V2.5、腾讯Hy3、DeepSeek V4 Pro及智谱GLM 5.2,则分别在多模态、代码生成、长程规划和复杂推理等方向上形成互补。

“更为关键的是,国内企业能够快速完成灰度测试、正式发布、接口迁移和多平台分发,从而将技术进步迅速转化为全球开发者的实际调用。”钟新龙说。

第三问:将给国内AI企业带来哪些机遇与挑战?

从更长周期看,国产模型在海外推理成本上的优势,正在为产业发展打开新空间。

我国大模型普遍采用MoE(混合专家)架构,这一架构可以通过降低参数激活比来压缩推理成本。通俗来讲,一个公司有几十个专家,处理一个任务时,MoE架构下只需要“激活”几个最擅长的专家来完成,而不需要动用所有专家,从而实现有效“降本”。

在钟新龙看来,国内AI企业可以利用该正式版发布的窗口吸引全球开发者,并由低价API(应用程序接口)服务逐步延伸至推理工具链、行业解决方案等高附加值环节,扩大发展空间。同时,调用量增长还将拉动国产推理芯片、服务器、存储等基础设施需求,为软硬件协同优化提供真实场景。

不过,挑战同样不容忽视。钟新龙表示,高调用未必带来高利润,正式版发布形成的流量峰值会考验企业的算力供给、服务稳定性、故障恢复能力等,持续低价还可能压缩利润空间。此外,海外市场对版权合规、网络安全及审计等方面的要求日益严格,持续抬高合规门槛。“对国内企业而言,要进一步把价格优势转化为稳定服务能力、合规交付能力、开发者生态以及高价值应用。”钟新龙建议。



本网站转载的所有的文章、图片、音频视频文件等资料的版权归版权所有人所有。如因无法联系到作者侵犯到您的权益,请与本网站联系,我们将在第一时间删除内容!

联系邮箱:infochinatousu@126.com

中国信息界

中国信息界官方微信公众号

全域数字化新视界公众号

版权所有 © 《中国信息界》杂志社

京ICP备2025140127号

行政电话:010-63691340转8016
战略合作:010-63691340转8018
投诉邮箱:zgxxj@ciia.org.cn

地 址:北京市西城区广安大街
315号信息大厦B座4层

投稿邮箱:zgxxjzz@163.com

数字经济决策参考公众号

数字文明进化论公众号