首页
看点啥
插画图片
首页 看点啥 DeepSeek-V4-Flash正式版上线后,OpenAI等头部模型厂商纷纷降价

DeepSeek-V4-Flash正式版上线后,OpenAI等头部模型厂商纷纷降价

2026-08-05 0

【快讯】近日,“DeepSeek 一天消耗 8 万亿”冲上热搜,这并非指烧掉 8 万亿资金,而是 DeepSeek-V4-Flash 模型在海外平台单日处理的 Token 量。DeepSeek 仅凭单一模型、单一入口的单日消耗,便超越了海外数百款模型加起来的日均总和。据每日经济新闻报道,根据 OpenRouter 最新数据测算,上周 ( 7 月 27 日至 8 月 2 日) 全球调用量排名中,DeepSeek-V4-Flash 升至第一。

OpenRouter 数据显示,全球 AI 大模型总调用量为 56.8 万亿 Token。其中,上榜的 AI 大模型中,中国 AI 大模型周调用量达 28.13 万亿 Token,美国 AI 大模型周调用量为 4.38 万亿 Token。中国大模型周调用量连续 14 周超过美国,稳居全球首位。

榜单前五席位全部由国产模型占据:DeepSeek-V4-Flash 以 7.22 万亿 Token 登顶榜首;小米 MiMo-V2.5 位列第二,调用量 6.3 万亿 Token;腾讯 HY3 排名第三,4.82 万亿 Token;DeepSeek-V4-Pro、智谱 GLM-5.2 分列四五位,周调用量分别为 3.28 万亿、2.89 万亿 Token。

7 月 31 日 DeepSeek 上线 V4-Flash 正式版 API,定价较 V4-Pro 进一步下调,缓存命中每百万 Token 仅 0.02 元,缓存未命中输入 1 元 / 百万 Token,输出 2 元 / 百万 Token。外网网友频出“法拉利性能、脚踏车价格”等神级调侃。

据科创板日报,此前海外巨头长期侧重模型性能比拼,较少参与低价竞争。伴随 AI 编程商业化市场空间逐步清晰,AI 赛道迎来大规模调价,海内外头部厂商同步下调 API 调用定价。

OpenAI 也在 GPT-5.6 发布三周后大幅降价,入门级 Luna 降幅达 80%,输入单价由 1 美元 / 百万 Token 降至 0.2 美元;Terra 同步下调 20% 调用费用。Anthropic 的 Claude Opus 5 降价,Google 则推出低价的 Gemini Flash 系列模型应对冲击。

相关专业人士表示,AI 编程工具正从早期试用产品,转型为普惠型生产力基础设施。调用成本降低能够加速中小企业、垂直行业落地应用;行业评判标准也随之转变,市场不再单纯看重基准测试分数、模型参数量,转而聚焦真实任务使用成本、运行稳定性、复杂任务完成能力,行业估值逻辑向实际营收、客户留存等经营指标倾斜。

喜欢(0)

上一篇

LibTV免费生成如何用?官网入口与PixPix替代方案

LibTV免费生成如何用?官网入口与PixPix替代方案

下一篇

如何为 AI 智能体构建评估测试套件?

如何为 AI 智能体构建评估测试套件?
猜你喜欢