DeepSeek V4 Flash低价斩杀线背后:当梁文锋也卷不动算力账单(含实测)
(本文作者为 大模型之家,钛媒体经授权发布) 文 | 大模型之家 8 月6日,DeepSeek在用户后台突然发布调价预告,宣布计划在近期对全部API接口服务进行整体提价,且预计涨幅较大。 官方在公告中明确建议企业与个人开发者合理规划调用量、控制充值金额,具体调价细则与生效时间以后
本条来自 钛媒体(Business / 科技商业),聚焦 technology、company。 (本文作者为 大模型之家,钛媒体经授权发布) 文 | 大模型之家 8 月6日,DeepSeek在用户后台突然发布调价预告,宣布计划在近期对全部API接口服务进行整体提价,且预计涨幅较大。 官方在公告中明确建议企业与个人开发者合理规划调用量、控制充值金额,具体调价细则与生效时间以后续正式公告为准。 这距离梁文峰上一次给行业带来 价格震荡 ,仅仅过去了七天。 7月31日,DeepSeek在API文档里更新了一条日志,宣布DeepSeek-V4-Flash正式版上线公测。模型的架构与参数规模和4月24日开源的预览版完全一致,2840亿总参数、130亿激活参数的MoE架构,唯一重做的东西是后训练。 然而,正是这唯一的改动,让整个行业惊掉了下巴。在官方公布的9项Agent基准测试中,正式版全面越过自家旗舰V4-Pro预览版,指令遵循能力呈现出跨代际的提升。与此同时,DeepSeek首次原生支持Responses API格式,并直接向OpenAI的Codex亮剑。开发者可以直接在ChatGPT桌面端或是VS Code插件里,将底层引擎无缝切换为DeepSeek。 随后几天,各大榜单和开发者的时间线都被这个模型 血洗 了一遍。 大模型之家也在第一时间对DeepSeek V4 Flash正式版进行了实测,进步确实不小,但它真正的杀伤力不在只跑分上。 实测:修复生产bug,仅需8毛8 实测的机会来得有些偶然。 笔者自己搭建的舆情管理系统正好出了bug:信源匹配数量断崖式下跌,前一天还能匹配出10000多条数据,当天只剩不到2000条。 DeepSeek V4 Flash正式版在遍历遍历 屎山代码 之后,很快定位到匹配历史骤减的根源:每次遍历信源之后的归档写出环节存在错误,导致此后更新的历史库条目大幅下降。 从开始定位bug到给出解决方案,全程不到3分钟,并且一次修复成功 , 匹配数量从1966条恢复到了11020条。 在这个过程中还有一个计划外的收获。DeepSeek V4 Flash正式版甚至在检查代码时顺手揪出了信息条目重复的暗病,并附赠了去重方案。 而在一次修正的成果背后, DeepSeek V4 Flash 正式版的消耗也是可圈可点:整个项目消耗了不到 21.7 万 Token ,缓存命中率高达 99.8% 。按照正式版的定价 (输入1元/百万Token、缓存命中0.02元/百万Token、输出2元/百万Token) 估算,这次在生产环境中debug的总成本,仅需要0.88元人民币 (约0.13美元)。如果抛开后续的去重和项目归档,仅算最初的Bug定位与修复,成本仅为0.27元(约0.04美元),若通过第三方平台的Token Plan调用,价格还能再压一压。 在Agent时代全面到来之前,几毛钱修好一个生产环境的Bug,恐怕是难以想象的。 不过, DeepSeek V4 Flash 正式版也并非没有短板。其 API目前仍不支持多模态图像输入,这使得它在处理前端任务中会表现出 审美 不足,且284B总参数量、13B激活的体量,决定了它在复杂、长流程的任务规划中依然会感到吃力。 单点定位、单次修复是它的绝对主场,可一旦拉长到多步骤、多分支的完整工程,其表现就会不可避免地下滑。 Agent时代难逃 真香定律 凭借着不错的能力与极为出色的性价比,DeepSeek V4 Flash正式版发布后, 斩杀线 一说在AI圈里不胫而走, 干翻Claude 的说法铺天盖地。 根据第三方评测机构Artificial Analysis的综合智能指数显示,DeepSeek V4 Flash正式版得分50,在国内落后于Kimi K3的57分和智谱GLM-5.2的51分,排在第三。 值得注意的是,DeepSeek V4 Flash正式版的输出价格是每百万token 0.28美元(2元人民币),而GLM-5.2的输出定价是4.29美元,是它的15倍;Anthropic旗舰Claude Fable 5的输出定价更是高达50美元,是它的178倍。 Artificial Analysis按综合评测任务口径估算, DeepSeek V4 Flash 正式版完成一项任务的平均成本约0.03美元,Kimi K3约0.86美元,Fable 5约3.15美元,最贵与最便宜之间差了105倍。 也许在单轮闲聊中,几毛与几分的差价毫无体感,但Agent场景会将其指数级放大。 一个真实的软件工程任务,模型需要读仓库、改代码、调终端、查输出、发现错误再重来,动辄触发百次以上的调用。一次0.03美元和一次3.15美元,跑50次,就是一杯咖啡和一台咖啡机的区别。这不是倍数差,而是量级碾压。 这也是为什么,各大厂商立刻闻风而动。DeepSeek V4 Flash正式版上线前一天,OpenAI宣布GPT-5.6系列调价,入门款Luna降价80%;8月1日,智谱重新开放了一度需要抢购的GLM Coding Plan订阅。 虽然在瞬息万变的模型市场,我们很难把所有同行的降价都归因于DeepSeek,但在如此密集的动作背后,整个行业的价格锚点正在被重塑。这也恰恰是 斩杀线 的真正含义:性能比它强的,价格贵出一两个数量级;价格向它看齐的,性能又存在代差。 正因为DeepSeek V4 Flash正式版的出色表现,也让尚未露面的DeepSeek V4 Pro正式版备受行业期待。如果Flash的定义是 够用 ,那么瞄准GPT-5.6 Sol一档的Pro,才会是DeepSeek真正意义上的正面进攻。届时, 国模一哥 的地位,也许会再次发生洗牌。 重启500亿募资,梁文峰的秣马厉兵 与DeepSeek产品侧的 抠门 形成对照的,是梁文峰在资本侧的胃口。 据报道,DeepSeek已重启第二轮融资,计划募资500亿元,投前估值约5000亿元。 而就在两个月前,他们刚刚完成了中国大模型史上规模最大的首轮融资 拿走了包括国家人工智能产业投资基金、腾讯、宁德时代等在内的510亿元,是中国AI大模型史上规模最大的首轮融资。 大模型之家了解到,两轮合计超千亿的募资,将有超过六成资金用于自建智算中心与国产芯片适配,另有一条一年前已秘密启动的自研推理芯片产线,以及核心人才团队的稳定与扩充。这家曾经以 轻资产、重算法 著称的公司,正在被残酷的算力需求逼着变 重 。 梁文锋曾表示:采购一批服务器,大约10个月通过API收入收回设备成本,在DeepSeek内部,这已经算 合理利润 。也就是说,此前的低价不是靠补贴烧出来的战术,而是算法优化带来的成本结构性优势。 同一赛道的另一面是月之暗面。7月16日发布2.8万亿参数的Kimi K3之后,这家公司先以约315亿美元(折合人民币约2100亿元)的估值完成F轮融资,随即以500亿美元估值开启Pre-IPO轮,预计年内递表上市。K3的API定价比上一代K2.6涨了三到四倍,输出达到100元/百万token。一个涨价押注 更聪明 ,一个降价押注 够用就好 。两条路线都拿到了巨额资本背书,市场还没有投出最终答案。 然而,8月6日后台那一纸突如其来的调价预告,无情地戳破了DeepSeek带来的这场低价狂欢的滤镜。它透露出大模型商业化进程中,触碰到了最冰冷的物理现实: 算法的精妙固然可以压缩单位Token的算力成本,但算力集群的硬件天花板与现金流压力,无法被无限平抑。 DeepSeek V4 Flash 正式版上线后,在OpenRouter榜单上创下了单周7.1万亿Token的恐怖消耗量。 极低的价格引发了全网开发者的 报复性 调用,高峰期的并发请求直接让服务器集群不堪重负。在自建智算中心尚未完全交付的当下,通过价格杠杆筛选高价值客户、抑制低效高频消耗,成了防止服务器被彻底挤爆的唯一自救手段。 另一方面,则是重资产基础设施的现实账单。自建超大规模智算中心、深度适配国产芯片乃至自研推理芯片的产线建设 ,无一不是动辄百亿级的现金流黑洞。 即便是手握千亿融资金额,面对硬件周期与供应链成本,DeepSeek也必须重新算账:如果长期维持临界状态的低毛利,硬件扩张与研发投入的血条终究难以为继。 写在最后 8毛8修Bug 的故事固然动听,但8月6日的提价信号终归证明了一件事:即便是技术与成本控制极具天赋的梁文锋,也无法凭一己之力脱离算力硬件的客观物理规律。 当强如DeepSeek都不得不踩下刹车、调头提价时,这场靠 价格战 互相放血的时代,或许真的要画上句号了。 而在另一边,阿里 千问办公 、腾讯WorkBuddy与字节豆包,正为了C端办公场景打得刺刀见红。对比之下,DeepSeek那个功能依然 简陋 的官网,克制得仿佛不属于这个时代。 克制的产品形态,极致的API定价,与千亿级别的重资产基建,构成了DeepSeek最真实的商业底色。DeepSeek踩下的这一脚刹车,与其说是向商业现实低头,不如说是整个行业在一场狂热的价格战后,对客观商业规律的第一次真正敬畏。 更多精彩内容,关注钛媒体微信号(ID:taimeiti),或者下载钛媒体App
(本文作者为 大模型之家,钛媒体经授权发布) 文 | 大模型之家 8 月6日,DeepSeek在用户后台突然发布调价预告,宣布计划在近期对全部API接口服务进行整体提价,且预计涨幅较大
- (本文作者为 大模型之家,钛媒体经授权发布) 文 | 大模型之家 8 月6日,DeepSeek在用户后台突然发布调价预告,宣布计划在近期对全部API接口服务进行整体提价,且预计涨幅较大
(本文作者为 大模型之家,钛媒体经授权发布) 文 | 大模型之家 8 月6日,DeepSeek在用户后台突然发布调价预告,宣布计划在近期对全部API接口服务进行整体提价,且预计涨幅较大
官方在公告中明确建议企业与个人开发者合理规划调用量、控制充值金额,具体调价细则与生效时间以后
(本文作者为 大模型之家,钛媒体经授权发布) 文 | 大模型之家 8 月6日,DeepSeek在用户后台突然发布调价预告,宣布计划在近期对全部API接口服务进行整体提价,且预计涨幅较大。 官方在公告中明确建议企业与个人开发者合理规划调用量、控制充值金额,具体调价细则与生效时间以后续正式公告为准。 这距离梁文峰上一次给行业带来 价格震荡 ,仅仅过去了七天。 7月31日,DeepSeek在API文档里更新了一条日志,宣布DeepSeek-V4-Flash正式版上线公测。模型的架构与参数规模和4月24日开源的预览版完全一致,2840亿总参数、130亿激活参数的MoE架构,唯一重做的东西是后训练。 然而,正是这唯一的改动,让整个行业惊掉了下巴。在官方公布的9项Agent基准测试中,正式版全面越过自家旗舰V4-Pro预览版,指令遵循能力呈现出跨代际的提升。与此同时,DeepSeek首次原生支持Responses API格式,并直接向OpenAI的Codex亮剑。开发者可以直接在ChatGPT桌面端或是VS Code插件里,将底层引擎无缝切换为DeepSeek。 随后几天,各大榜单和开发者的时间线都被这个模型 血洗 了一遍。 大模型之家也在第一时间对DeepSeek V4 Flash正式版进行了实测,进步确实不小,但它真正的杀伤力不在只跑分上。 实测:修复生产bug,仅需8毛8 实测的机会来得有些偶然。 笔者自己搭建的舆情管理系统正好出了bug:信源匹配数量断崖式下跌,前一天还能匹配出10000多条数据,当天只剩不到2000条。 DeepSeek V4 Flash正式版在遍历遍历 屎山代码 之后,很快定位到匹配历史骤减的根源:每次遍历信源之后的归档写出环节存在错误,导致此后更新的历史库条目大幅下降。 从开始定位bug到给出解决方案,全程不到3分钟,并且一次修复成功 , 匹配数量从1966条恢复到了11020条。 在这个过程中还有一个计划外的收获。DeepSeek V4 Flash正式版甚至在检查代码时顺手揪出了信息条目重复的暗病,并附赠了去重方案。 而在一次修正的成果背后, DeepSeek V4 Flash 正式版的消耗也是可圈可点:整个项目消耗了不到 21.7 万 Token ,缓存命中率高达 99.8% 。按照正式版的定价 (输入1元/百万Token、缓存命中0.02元/百万Token、输出2元/百万Token) 估算,这次在生产环境中debug的总成本,仅需要0.88元人民币 (约0.13美元)。如果抛开后续的去重和项目归档,仅算最初的Bug定位与修复,成本仅为0.27元(约0.04美元),若通过第三方平台的Token Plan调用,价格还能再压一压。 在Agent时代全面到来之前,几毛钱修好一个生产环境的Bug,恐怕是难以想象的。 不过, DeepSeek V4 Flash 正式版也并非没有短板。其 API目前仍不支持多模态图像输入,这使得它在处理前端任务中会表现出 审美 不足,且284B总参数量、13B激活的体量,决定了它在复杂、长流程的任务规划中依然会感到吃力。 单点定位、单次修复是它的绝对主场,可一旦拉长到多步骤、多分支的完整工程,其表现就会不可避免地下滑。 Agent时代难逃 真香定律 凭借着不错的能力与极为出色的性价比,DeepSeek V4 Flash正式版发布后, 斩杀线 一说在AI圈里不胫而走, 干翻Claude 的说法铺天盖地。 根据第三方评测机构Artificial Analysis的综合智能指数显示,DeepSeek V4 Flash正式版得分50,在国内落后于Kimi K3的57分和智谱GLM-5.2的51分,排在第三。 值得注意的是,DeepSeek V4 Flash正式版的输出价格是每百万token 0.28美元(2元人民币),而GLM-5.2的输出定价是4.29美元,是它的15倍;Anthropic旗舰Claude Fable 5的输出定价更是高达50美元,是它的178倍。 Artificial Analysis按综合评测任务口径估算, DeepSeek V4 Flash 正式版完成一项任务的平均成本约0.03美元,Kimi K3约0.86美元,Fable 5约3.15美元,最贵与最便宜之间差了105倍。 也许在单轮闲聊中,几毛与几分的差价毫无体感,但Agent场景会将其指数级放大。 一个真实的软件工程任务,模型需要读仓库、改代码、调终端、查输出、发现错误再重来,动辄触发百次以上的调用。一次0.03美元和一次3.15美元,跑50次,就是一杯咖啡和一台咖啡机的区别。这不是倍数差,而是量级碾压。 这也是为什么,各大厂商立刻闻风而动。DeepSeek V4 Flash正式版上线前一天,OpenAI宣布GPT-5.6系列调价,入门款Luna降价80%;8月1日,智谱重新开放了一度需要抢购的GLM Coding Plan订阅。 虽然在瞬息万变的模型市场,我们很难把所有同行的降价都归因于DeepSeek,但在如此密集的动作背后,整个行业的价格锚点正在被重塑。这也恰恰是 斩杀线 的真正含义:性能比它强的,价格贵出一两个数量级;价格向它看齐的,性能又存在代差。 正因为DeepSeek V4 Flash正式版的出色表现,也让尚未露面的DeepSeek V4 Pro正式版备受行业期待。如果Flash的定义是 够用 ,那么瞄准GPT-5.6 Sol一档的Pro,才会是DeepSeek真正意义上的正面进攻。届时, 国模一哥 的地位,也许会再次发生洗牌。 重启500亿募资,梁文峰的秣马厉兵 与DeepSeek产品侧的 抠门 形成对照的,是梁文峰在资本侧的胃口。 据报道,DeepSeek已重启第二轮融资,计划募资500亿元,投前估值约5000亿元。 而就在两个月前,他们刚刚完成了中国大模型史上规模最大的首轮融资 拿走了包括国家人工智能产业投资基金、腾讯、宁德时代等在内的510亿元,是中国AI大模型史上规模最大的首轮融资。 大模型之家了解到,两轮合计超千亿的募资,将有超过六成资金用于自建智算中心与国产芯片适配,另有一条一年前已秘密启动的自研推理芯片产线,以及核心人才团队的稳定与扩充。这家曾经以 轻资产、重算法 著称的公司,正在被残酷的算力需求逼着变 重 。 梁文锋曾表示:采购一批服务器,大约10个月通过API收入收回设备成本,在DeepSeek内部,这已经算 合理利润 。也就是说,此前的低价不是靠补贴烧出来的战术,而是算法优化带来的成本结构性优势。 同一赛道的另一面是月之暗面。7月16日发布2.8万亿参数的Kimi K3之后,这家公司先以约315亿美元(折合人民币约2100亿元)的估值完成F轮融资,随即以500亿美元估值开启Pre-IPO轮,预计年内递表上市。K3的API定价比上一代K2.6涨了三到四倍,输出达到100元/百万token。一个涨价押注 更聪明 ,一个降价押注 够用就好 。两条路线都拿到了巨额资本背书,市场还没有投出最终答案。 然而,8月6日后台那一纸突如其来的调价预告,无情地戳破了DeepSeek带来的这场低价狂欢的滤镜。它透露出大模型商业化进程中,触碰到了最冰冷的物理现实: 算法的精妙固然可以压缩单位Token的算力成本,但算力集群的硬件天花板与现金流压力,无法被无限平抑。 DeepSeek V4 Flash 正式版上线后,在OpenRouter榜单上创下了单周7.1万亿Token的恐怖消耗量。 极低的价格引发了全网开发者的 报复性 调用,高峰期的并发请求直接让服务器集群不堪重负。在自建智算中心尚未完全交付的当下,通过价格杠杆筛选高价值客户、抑制低效高频消耗,成了防止服务器被彻底挤爆的唯一自救手段。 另一方面,则是重资产基础设施的现实账单。自建超大规模智算中心、深度适配国产芯片乃至自研推理芯片的产线建设 ,无一不是动辄百亿级的现金流黑洞。 即便是手握千亿融资金额,面对硬件周期与供应链成本,DeepSeek也必须重新算账:如果长期维持临界状态的低毛利,硬件扩张与研发投入的血条终究难以为继。 写在最后 8毛8修Bug 的故事固然动听,但8月6日的提价信号终归证明了一件事:即便是技术与成本控制极具天赋的梁文锋,也无法凭一己之力脱离算力硬件的客观物理规律。 当强如DeepSeek都不得不踩下刹车、调头提价时,这场靠 价格战 互相放血的时代,或许真的要画上句号了。 而在另一边,阿里 千问办公 、腾讯WorkBuddy与字节豆包,正为了C端办公场景打得刺刀见红。对比之下,DeepSeek那个功能依然 简陋 的官网,克制得仿佛不属于这个时代。 克制的产品形态,极致的API定价,与千亿级别的重资产基建,构成了DeepSeek最真实的商业底色。DeepSeek踩下的这一脚刹车,与其说是向商业现实低头,不如说是整个行业在一场狂热的价格战后,对客观商业规律的第一次真正敬畏。 更多精彩内容,关注钛媒体微信号(ID:taimeiti),或者下载钛媒体App
本条目归入「Technology AI」垂直,涉及真实话题:technology、company。
· 市场:关注 technology、company 对相关品类与竞争格局的潜在影响。
· 消费者:受众行为与偏好变化值得追踪。
· 品牌:本动向对品牌资产建设的启示。
· 渠道:内容分发与触点组合(社媒 / 电商 / 线下)的协同值得复盘。
· 核心话题:technology、company。
· 可思考:如何把「technology」的洞察,转化为可衡量的内容与增长动作?
面试中可引用「DeepSeek V4 Flash低价斩杀线背后:当梁文锋也卷不动算力账单(含实测)」:围绕 technology、company,说明你对行业动向的判断与可落地动作。
本条目相关英文术语可在「商务英语」模块按话题检索,用于外企面试表达训练。
(本文作者为 大模型之家,钛媒体经授权发布) 文 | 大模型之家 8 月6日,DeepSeek在用户后台突然发布调价预告,宣布计划在近期对全部API接口服务进行整体提价,且预计涨幅较大。 官方在公告中明确建议企业与个人开发者合理规划调用量、控制充值金额,具体调价细则与生效时间以后续正式公告为准。 这距离梁文峰上一次给行业带来 价格震荡 ,仅仅过去了七天。 7…
(本文作者为 大模型之家,钛媒体经授权发布) 文 | 大模型之家 8 月6日,DeepSeek在用户后台突然发布调价预告,宣布计划在近期对全部API接口服务进行整体提价,且预计涨幅较大。 官方在公告中明确建议企业与个人开发者合理规划调用量、控制充值金额,具体调价细则与生效时间以后续正式公告为准。 这距离梁文峰上一次给行业带来 价格震荡 ,仅仅过去了七天。 7…