对大模型涨价这事,我是一直有心理准备的。毕竟滴滴涨价和外卖涨价的历史告诉我们,白菜价不可持续,资本总会收割的,哪怕 DeepSeek 不想挣钱,也不能耽误别的资本挣钱。但我只是没想到,这个美好的夏天如此短暂。
OpenCode 从吹了个大牛到拉了个大胯:在deepseek官方涨价后,在opencode go的套餐里,DeepSeek V4 Flash 每 5 小时的调用量,从 63300 直接掉到 3800,砍了 94%。V4-Pro 从 3450 掉到 1050。月限额从 60 美元缩到 15 美元。有人算了算,波谷只剩原来的 10%,波峰只剩 5%。
6万3,变成3千8。这打脸来得太快,就几天的功夫实在猝不及防。以至于知乎上有个问题,名字就是「DeepSeek 涨价后,OpenCode Go 套餐的 Flash 调用量削减 94%」(知乎[1])。
遗憾的是,最近半年来,我早就把日常重复性的垃圾工作建立在2块钱100万 tokens的价格基础上,这是不符合期望的,但是我并没什么办法。这是不符合经济学原理的,只是我自己习惯了这种特价,这不长久,不对。
所以这时候我发现自建号池搞中转站才是真的香,这才是程序员之光啊。
DeepSeek 是 8 月 13 号的涨价公告,17 号零点生效。
V4-Pro 输出从每百万 token 6 块涨到 27 块,350%。当然 V4 Pro 有点过度思考,整体智力不佳,我是不用的。就是 Flash 从 2 块涨到 9 块,涨了 350%,真的让人震惊。真正的大头是缓存,缓存命中的输入价才叫狠,从两分五厘拉到三毛,12 倍,新闻里那个「最高涨幅 1100%」就是这么来的。
还有个利好欧美人的新算法,峰谷定价。工作日 9 点到 12 点、14 点到 18 点算高峰,价格翻倍,其余时间半价。美国人欧洲人至少可以用半价在工作时间猛蹬,这对中国人太不公平了吧!!!
我以前一个大点的任务,折腾大半天花不到两块钱,这个价格也的确是低,以至于我敢于把AI当基本相当于不要钱的AI员工,也就是一天一瓶饮料的价格;现在涨价以后,我对AI还是礼貌了一点,至少会准确的布置任务了。
但真正让我意识到token经济进入下半场的,是我发现这不是 DeepSeek 一家的事的,而是各家后面都陆续变相涨价。
Kimi K3,7 月 17 号发的,2.8 万亿参数,输出价直接定 100 块一百万 token。上线 48 小时,月之暗面自己先扛不住了,把 C 端新用户订阅停了,理由是算力被打爆。摩根士丹利还专门出了份解读,管这叫「定价回归」,说是正面信号。
腾讯那边更赤裸裸的涨价了。CodeBuddy 和 WorkBuddy 今年已经涨了三回,5 月 15 号那次,企业旗舰版从 78 块一人一月涨到 198,涨了 154%。加量包 2000 个 credit 卖 80 块,你说够干什么?credit 这玩意真的是最恶心的创新,因为他计费模式不透明,官方拥有最终解释权,所以阿里和腾讯都在推自家的credit,这个事情是真坑,官方从不公布折合多少 token,只说消耗因模型和任务复杂度而异,但我实测感觉比买tokens要贵。
有较真的网友实测,CodeBuddy 一个 credit 大约折合 2000 个输出 token(知乎[2]),这么算 2000 个 credit 就是 400 万输出 token,合 20 块一百万,跟glm5.2和deepseek pro这种贵价模型差不多了。
而且虽说在办公版 WorkBuddy 那里,一个credit能顶 3.1 万 token(腾讯云社区[3]),但是80块钱只能顶一下午,这也不合理,只能说计费单位越不透明,隐性涨价越方便。而且让一个程序员一个月花2400买tokens上班,也过于离谱了。
阿里云百炼的 Token Plan 也在改版,个人版 39 块一月起,额度不到一周就刷完了,企业版 198 块一席,尊享席 1398。我们公司买了 40 个企业版席位,一个月烧掉的钱超过 8 万,可生成的 token 平均价格 20 元一百万,这踏马哪里便宜了?
智谱年内提了三次价,一季度涨 83%,调用量还涨了 400%。阿里云、百度智能云的算力产品,也悄悄上调了 5% 到 34%。大洋彼岸,OpenAI 一边把入门模型 Luna 降价 80% 拉人头,一边把旗舰 Sol 的 Fast 模式价格翻倍。但我现在觉得gpt plus的订阅反而成了最有性价比的,特别是用日抛号或者周抛号,用SUB2API转出来猛蹬,奥特曼又眉清目秀了。
到这一步,「涨价」这个说法已经不太准确了。是整条 AI 产业的定价标准,一起上涨,要不然就没法给投入AI的投资者解释了。
回头看年初那股劲儿,就能感知到这轮涨价憋了多久。
当时DeepSeek 把价格打到地板,所有竞品都被迫跟着往下压。那阵子打开任何一家平台的定价页,价格都低得有点不真实,真的是爽的不得了啊。结果一批没能力搭建号池的同学,把便宜的API当成了既定事实,当成了应得的福利,现在中转站的价格倒挂很可能也是不可持续的。
除了deepseek背靠幻方和中国股民这个大爹之外,别的AI企业跟着模型降价,根本不是什么技术进步,而是用投资人的钱占领市场。等你我写代码离不开它、做方案离不开它、连写封邮件都想先丢给它的时候,价格锚悄悄往上一抬,我就发现自己回不去了。
过去一年多,DeepSeek 一直是定价之锚。今年 4 月 V4 刚发布,Pro 输出才 1.1 美元,Flash 只要 0.55 美元。OpenAI 也降过价,Anthropic 把优惠转成过永久,谷歌也跟着降过 17%,全是被deepseek逼得降价的。那时候大家都觉得,AI 就该这么便宜,以后只会更便宜。
无奈的是,这场补贴的最后一声,就发生在三个月前。5 月 22 号,DeepSeek 宣布 V4-Pro 预览版的限时折扣转永久价,降幅 75%。我当时看到有人转这条消息,配文「这才是格局」。永久两个字,从预览到正式版,撑了不到三个月。这个美好的记忆,将永远留在我的脑海里。
我 5 月份写过一篇文章,叫《一封外交电报,遮不住大模型定价权易主的真相》,里面算过一笔账:我一天差不多一千万输出 token,用海外头部模型一个月1500人民币,用 DeepSeek 打折价260块。当时我判断,这不是价格战,这是定价权战争。
现在定价权战争结束了。中美双方握手言和。你看所有中转站上的价格,就是保留了合理利润的真实成本,感觉价格是差不多的。
官方给的理由很官方,「更合理地分配资源、提升服务稳定性」。但看看数据就明白了,Deepseek的确牛逼。
8 月 3 号到 9 号那一周,V4-Flash 单周调用量冲破 8.83 万亿 token,环比暴涨 570%,全球第一。光是 OpenCode 一个平台,8 月 1 号单日就处理了 8 万亿 token,其中 5 万亿是免费额度烧出来的。等于opencode自己在利用deepseek flash给自家平台套餐导流。
这里面有个挺要命的转折。以前我们用 AI 主要是对话,一次上下文撑死两千 token。现在 Agent 一跑起来,多步推理、读文件、写文件、出错重试、来回折腾,一个任务烧掉 50 万甚至 100 万 token 是常态。需求是指数涨的,GPU 集群的扩张速度追不上这个指数。DeepSeek 现有的两万张卡训推共用,也扛不住这么造。
再往深处想一层,这些公司都要上市了。月之暗面在筹备港股 IPO,目标估值 300 亿美元,ARR 从 4 月的 2 亿美元涨到 6 月的 3 亿,DeepSeek 也有未来要上市的传闻。资本市场看的是利润,不会接受「我们价格全球最低」这种口号。
梁文锋我还是佩服的,DS也可能是被迫涨价的,DS 作为定价之锚,它不涨价,别家怎么涨价?怎么卖钱?DeepSeek 不能挡人家财路,再说涨价了正好腾出来算力搞AGI。
涨价那天,社区里的反应比我想象的还热闹,滑动变祖器都蹦出来了,哈哈哈哈。
OpenCode go套餐也直接拉跨了,套餐DeepSeek V4 Flash 每 5 小时的调用量,从 63300 直接掉到 3800,砍了 94%。V4-Pro 从 3450 掉到 1050。月限额从 60 美元缩到 15 美元。有人算了算,波谷只剩原来的 10%,波峰只剩 5%。
V2EX 上有个回复:「先培养使用 AI 的习惯,然后收割,跟培养点外卖没区别,可恶的资本家。」还有人说,60 刀额度变 15 刀,这还不如直接开 GPT Plus 加 Luna。微博上「白菜价时代结束」被刷了屏,有人实测发帖:问了 2 个问题,8 毛钱。
最让我觉得好笑又心酸的是称呼的变化。以前社区里管梁文锋叫「梁圣」,涨价之后,改口叫「牢梁」。从圣到牢,中间只隔着一张定价表。
然后就是一场大逃亡。涨价当天,有人开始自己部署 Qwen3.8-27B,有人转头去试小米 MiMo,有人干脆说,现在最有性价比的模型居然是 ChatGPT。还有人想起 OpenCode 的 CEO 涨价前说过的话,「我们能在租来的 GPU 上复现它现在的价格」,被人翻出来配了三个字:纯小丑。
我自己这几个月,每个月往死里用,平均也就 300 块。
300 块对一个重度用户来说不算多,但它已经悄悄改了我的行为。以前我调模型,主要以国模为主,因为国模服务更稳定,价格更便宜。现在我又重新祭出了中转站,毕竟5块钱/1M 的GTP5.6 Sol还是比9块钱/1M 的DeepSeek V4 flash香。
这大概才是这轮涨价真正的代价:它逼着每一个国内开发者从「用就完了」的状态里醒过来,重新开始算账。公司层面费用消耗更夸张。
用国产 token plan 的订阅,平均价格 20 块钱一百万 token,一个员工一个月用一亿 token 很正常。问题是,你用H20推理GLM5.2的平均成本,按照5年折旧,差不多就是8块钱/1M,然后云厂商能卖到26块钱/1M,很可能也是这轮内存硬盘涨价闹的。
根据我的实测,作为中度使用的程序员一周差不多消耗一亿 token。如果1M tokens卖20 块,一周的成本就是两千块,这个价格太贵了。我觉得 5 块钱一百万tokens左右,再加上本地5090推理Qwen3.8 27B,才是相对合理的价格,要不然哪个公司都烧不起正价 API 的费用。
AI 从「用上就是赚到」,变成了「用之前先算算划不划算」。一天几块钱的模型才叫工具,一天两百块的模型成本,还不如养个员工。
涨价归涨价,但是多亏国产这几家大模型公司在全球继续卷,我们还能有得选。毕竟自己有的选,才有资格说贵了换一家。没有,就只能被唯一一家A/拿捏。
8 月 12 号深夜,DeepSeek V4 Pro 正式版和 Grok 4.6 撞在一起发布,我现在觉得Grok也眉清目秀的了。模型还在变强,只是便宜没了。
我不知道Tokens经济的下半场会打成什么样,也不知道最后谁才是性价比之王。但有一件事我很确定:我再也回不到那个不看 API 账单的状态了。Token 自由,就是这么没的。
这大概就是上半场和下半场的分界线。借给你的东西,迟早要还。
https://mp.weixin.qq.com/s/fWk0du5A5zPmQvkAhQWEMQ?scene=1&click_id=29
本地部署模型,硬件也涨价
两头堵呀
Featured Collection
Popular Events
套餐缩水94%
对大模型涨价这事,我是一直有心理准备的。毕竟滴滴涨价和外卖涨价的历史告诉我们,白菜价不可持续,资本总会收割的,哪怕 DeepSeek 不想挣钱,也不能耽误别的资本挣钱。但我只是没想到,这个美好的夏天如此短暂。
OpenCode 从吹了个大牛到拉了个大胯:在deepseek官方涨价后,在opencode go的套餐里,DeepSeek V4 Flash 每 5 小时的调用量,从 63300 直接掉到 3800,砍了 94%。V4-Pro 从 3450 掉到 1050。月限额从 60 美元缩到 15 美元。有人算了算,波谷只剩原来的 10%,波峰只剩 5%。
6万3,变成3千8。这打脸来得太快,就几天的功夫实在猝不及防。以至于知乎上有个问题,名字就是「DeepSeek 涨价后,OpenCode Go 套餐的 Flash 调用量削减 94%」(知乎[1])。
遗憾的是,最近半年来,我早就把日常重复性的垃圾工作建立在2块钱100万 tokens的价格基础上,这是不符合期望的,但是我并没什么办法。这是不符合经济学原理的,只是我自己习惯了这种特价,这不长久,不对。
所以这时候我发现自建号池搞中转站才是真的香,这才是程序员之光啊。
整条线都在涨
DeepSeek 是 8 月 13 号的涨价公告,17 号零点生效。
V4-Pro 输出从每百万 token 6 块涨到 27 块,350%。当然 V4 Pro 有点过度思考,整体智力不佳,我是不用的。就是 Flash 从 2 块涨到 9 块,涨了 350%,真的让人震惊。真正的大头是缓存,缓存命中的输入价才叫狠,从两分五厘拉到三毛,12 倍,新闻里那个「最高涨幅 1100%」就是这么来的。
还有个利好欧美人的新算法,峰谷定价。工作日 9 点到 12 点、14 点到 18 点算高峰,价格翻倍,其余时间半价。美国人欧洲人至少可以用半价在工作时间猛蹬,这对中国人太不公平了吧!!!
我以前一个大点的任务,折腾大半天花不到两块钱,这个价格也的确是低,以至于我敢于把AI当基本相当于不要钱的AI员工,也就是一天一瓶饮料的价格;现在涨价以后,我对AI还是礼貌了一点,至少会准确的布置任务了。
但真正让我意识到token经济进入下半场的,是我发现这不是 DeepSeek 一家的事的,而是各家后面都陆续变相涨价。
Kimi K3,7 月 17 号发的,2.8 万亿参数,输出价直接定 100 块一百万 token。上线 48 小时,月之暗面自己先扛不住了,把 C 端新用户订阅停了,理由是算力被打爆。摩根士丹利还专门出了份解读,管这叫「定价回归」,说是正面信号。
腾讯那边更赤裸裸的涨价了。CodeBuddy 和 WorkBuddy 今年已经涨了三回,5 月 15 号那次,企业旗舰版从 78 块一人一月涨到 198,涨了 154%。加量包 2000 个 credit 卖 80 块,你说够干什么?credit 这玩意真的是最恶心的创新,因为他计费模式不透明,官方拥有最终解释权,所以阿里和腾讯都在推自家的credit,这个事情是真坑,官方从不公布折合多少 token,只说消耗因模型和任务复杂度而异,但我实测感觉比买tokens要贵。
有较真的网友实测,CodeBuddy 一个 credit 大约折合 2000 个输出 token(知乎[2]),这么算 2000 个 credit 就是 400 万输出 token,合 20 块一百万,跟glm5.2和deepseek pro这种贵价模型差不多了。
而且虽说在办公版 WorkBuddy 那里,一个credit能顶 3.1 万 token(腾讯云社区[3]),但是80块钱只能顶一下午,这也不合理,只能说计费单位越不透明,隐性涨价越方便。而且让一个程序员一个月花2400买tokens上班,也过于离谱了。
阿里云百炼的 Token Plan 也在改版,个人版 39 块一月起,额度不到一周就刷完了,企业版 198 块一席,尊享席 1398。我们公司买了 40 个企业版席位,一个月烧掉的钱超过 8 万,可生成的 token 平均价格 20 元一百万,这踏马哪里便宜了?
智谱年内提了三次价,一季度涨 83%,调用量还涨了 400%。阿里云、百度智能云的算力产品,也悄悄上调了 5% 到 34%。大洋彼岸,OpenAI 一边把入门模型 Luna 降价 80% 拉人头,一边把旗舰 Sol 的 Fast 模式价格翻倍。但我现在觉得gpt plus的订阅反而成了最有性价比的,特别是用日抛号或者周抛号,用SUB2API转出来猛蹬,奥特曼又眉清目秀了。
到这一步,「涨价」这个说法已经不太准确了。是整条 AI 产业的定价标准,一起上涨,要不然就没法给投入AI的投资者解释了。
白菜价是暂时的
回头看年初那股劲儿,就能感知到这轮涨价憋了多久。
当时DeepSeek 把价格打到地板,所有竞品都被迫跟着往下压。那阵子打开任何一家平台的定价页,价格都低得有点不真实,真的是爽的不得了啊。结果一批没能力搭建号池的同学,把便宜的API当成了既定事实,当成了应得的福利,现在中转站的价格倒挂很可能也是不可持续的。
除了deepseek背靠幻方和中国股民这个大爹之外,别的AI企业跟着模型降价,根本不是什么技术进步,而是用投资人的钱占领市场。等你我写代码离不开它、做方案离不开它、连写封邮件都想先丢给它的时候,价格锚悄悄往上一抬,我就发现自己回不去了。
过去一年多,DeepSeek 一直是定价之锚。今年 4 月 V4 刚发布,Pro 输出才 1.1 美元,Flash 只要 0.55 美元。OpenAI 也降过价,Anthropic 把优惠转成过永久,谷歌也跟着降过 17%,全是被deepseek逼得降价的。那时候大家都觉得,AI 就该这么便宜,以后只会更便宜。
无奈的是,这场补贴的最后一声,就发生在三个月前。5 月 22 号,DeepSeek 宣布 V4-Pro 预览版的限时折扣转永久价,降幅 75%。我当时看到有人转这条消息,配文「这才是格局」。永久两个字,从预览到正式版,撑了不到三个月。这个美好的记忆,将永远留在我的脑海里。
我 5 月份写过一篇文章,叫《一封外交电报,遮不住大模型定价权易主的真相》,里面算过一笔账:我一天差不多一千万输出 token,用海外头部模型一个月1500人民币,用 DeepSeek 打折价260块。当时我判断,这不是价格战,这是定价权战争。
现在定价权战争结束了。中美双方握手言和。你看所有中转站上的价格,就是保留了合理利润的真实成本,感觉价格是差不多的。
用户蹬太凶了
官方给的理由很官方,「更合理地分配资源、提升服务稳定性」。但看看数据就明白了,Deepseek的确牛逼。
8 月 3 号到 9 号那一周,V4-Flash 单周调用量冲破 8.83 万亿 token,环比暴涨 570%,全球第一。光是 OpenCode 一个平台,8 月 1 号单日就处理了 8 万亿 token,其中 5 万亿是免费额度烧出来的。等于opencode自己在利用deepseek flash给自家平台套餐导流。
这里面有个挺要命的转折。以前我们用 AI 主要是对话,一次上下文撑死两千 token。现在 Agent 一跑起来,多步推理、读文件、写文件、出错重试、来回折腾,一个任务烧掉 50 万甚至 100 万 token 是常态。需求是指数涨的,GPU 集群的扩张速度追不上这个指数。DeepSeek 现有的两万张卡训推共用,也扛不住这么造。
再往深处想一层,这些公司都要上市了。月之暗面在筹备港股 IPO,目标估值 300 亿美元,ARR 从 4 月的 2 亿美元涨到 6 月的 3 亿,DeepSeek 也有未来要上市的传闻。资本市场看的是利润,不会接受「我们价格全球最低」这种口号。
梁文锋我还是佩服的,DS也可能是被迫涨价的,DS 作为定价之锚,它不涨价,别家怎么涨价?怎么卖钱?DeepSeek 不能挡人家财路,再说涨价了正好腾出来算力搞AGI。
从梁圣到牢梁
涨价那天,社区里的反应比我想象的还热闹,滑动变祖器都蹦出来了,哈哈哈哈。
OpenCode go套餐也直接拉跨了,套餐DeepSeek V4 Flash 每 5 小时的调用量,从 63300 直接掉到 3800,砍了 94%。V4-Pro 从 3450 掉到 1050。月限额从 60 美元缩到 15 美元。有人算了算,波谷只剩原来的 10%,波峰只剩 5%。
V2EX 上有个回复:「先培养使用 AI 的习惯,然后收割,跟培养点外卖没区别,可恶的资本家。」还有人说,60 刀额度变 15 刀,这还不如直接开 GPT Plus 加 Luna。微博上「白菜价时代结束」被刷了屏,有人实测发帖:问了 2 个问题,8 毛钱。
最让我觉得好笑又心酸的是称呼的变化。以前社区里管梁文锋叫「梁圣」,涨价之后,改口叫「牢梁」。从圣到牢,中间只隔着一张定价表。
然后就是一场大逃亡。涨价当天,有人开始自己部署 Qwen3.8-27B,有人转头去试小米 MiMo,有人干脆说,现在最有性价比的模型居然是 ChatGPT。还有人想起 OpenCode 的 CEO 涨价前说过的话,「我们能在租来的 GPU 上复现它现在的价格」,被人翻出来配了三个字:纯小丑。
我又开始算账了
我自己这几个月,每个月往死里用,平均也就 300 块。
300 块对一个重度用户来说不算多,但它已经悄悄改了我的行为。以前我调模型,主要以国模为主,因为国模服务更稳定,价格更便宜。现在我又重新祭出了中转站,毕竟5块钱/1M 的GTP5.6 Sol还是比9块钱/1M 的DeepSeek V4 flash香。
这大概才是这轮涨价真正的代价:它逼着每一个国内开发者从「用就完了」的状态里醒过来,重新开始算账。公司层面费用消耗更夸张。
用国产 token plan 的订阅,平均价格 20 块钱一百万 token,一个员工一个月用一亿 token 很正常。问题是,你用H20推理GLM5.2的平均成本,按照5年折旧,差不多就是8块钱/1M,然后云厂商能卖到26块钱/1M,很可能也是这轮内存硬盘涨价闹的。
根据我的实测,作为中度使用的程序员一周差不多消耗一亿 token。如果1M tokens卖20 块,一周的成本就是两千块,这个价格太贵了。我觉得 5 块钱一百万tokens左右,再加上本地5090推理Qwen3.8 27B,才是相对合理的价格,要不然哪个公司都烧不起正价 API 的费用。
AI 从「用上就是赚到」,变成了「用之前先算算划不划算」。一天几块钱的模型才叫工具,一天两百块的模型成本,还不如养个员工。
回不去了
涨价归涨价,但是多亏国产这几家大模型公司在全球继续卷,我们还能有得选。毕竟自己有的选,才有资格说贵了换一家。没有,就只能被唯一一家A/拿捏。
8 月 12 号深夜,DeepSeek V4 Pro 正式版和 Grok 4.6 撞在一起发布,我现在觉得Grok也眉清目秀的了。模型还在变强,只是便宜没了。
我不知道Tokens经济的下半场会打成什么样,也不知道最后谁才是性价比之王。但有一件事我很确定:我再也回不到那个不看 API 账单的状态了。Token 自由,就是这么没的。
这大概就是上半场和下半场的分界线。借给你的东西,迟早要还。
https://mp.weixin.qq.com/s/fWk0du5A5zPmQvkAhQWEMQ?scene=1&click_id=29