模型战争,正在从“谁更强”转向“谁真的被用”。

如果只看参数、跑分和发布会,AI 模型竞争像是一场能力竞赛;但一旦把视角切到生产环境,座次就会发生变化。基于 Vercel AI Gateway 2026年7月1日至7月31日的公开榜单,我们可以看到三个更接近真实采用的信号:谁被频繁调用,谁承担最多token负载,谁真正拿走预算。

🏅1、GPT-5 nano 正在成为高频入口。

7月全周期看,GPT-5 nano已经拿下requests第一。这说明轻量模型的价值正在被重新定义:它不一定承担最重、最复杂的任务,但足够高频、足够便宜、足够适合作为开发者日常调用入口。

🏅2、DeepSeek V4 Flash仍是综合采用榜首。

虽然requests第一发生变化,但综合requests、tokens、spend后,DeepSeek V4 Flash仍排在第一。原因在于它不仅有调用量,也承担了最重的token负载,是典型的“生产主力型模型”。

🏅3、Claude系列继续掌握高端预算。

Claude Opus 4.8仍是周期spend第一,Claude Opus 5在后半段快速拉升,并在单日预算份额中表现突出。这说明高端模型的竞争不靠调用频次取胜,而靠复杂任务、关键链路和高价值场景里的定价权。

所以,这张榜单真正揭示的是:AI模型商业竞争已经分层。高频入口、负载主力、高端溢价,未必属于同一个模型。未来判断一家模型公司的竞争力,也不能只看跑分,而要看它能否持续进入真实生产流量。

#大模型 #调用 #token #spend #AI生产

内容中包含的图片若涉及版权问题,请及时与我们联系删除