DeepSeek发布第二代MoE模型V2
在刚发布的最新模型因低成本引发大模型斩杀线的讨论后DeepSeek反手宣布要涨价了。8月6日DeepSeek在开发者平台发布通知计划近期整体上调其 API服务的定价预计涨幅较大具体方案以正式通知为准。随后DeepSeek用户陆续收到了涨价邮件。涨价似乎成为了今年国内大模型行业的主旋律。此前智谱、月之暗面等都对老模型或新发模型进行了提价主要云厂商也纷纷上调AI算力服务价格。大模型价格战终于要走到尽头了吗从价格屠夫、斩杀线到突然涨价搜狐科技了解到在DeepSeek官宣涨价后不少用户都陆续收到了DeepSeek团队发出的相关邮件。邮件中除了提到DeepSeek API价格将有较大涨幅外还提醒用户合理使用并对涨价后的用户服务做出安排。“如您在计费调整后继续选择使用我们的服务则代表您已同意调整后的计费方式如不同意接受则可选择退出使用并申请退费。”突然的涨价预告让不少开发者措手不及。要知道自DeepSeek出现在公众视野其显著标签就是低价基本发布的每款模型价格都远低于国内外多数大模型。两年前DeepSeek发布第二代MoE模型V2API定价为输入1元、输出2元单位均为1M Token仅为当时最先进模型GPT-4-Turbo的百分之一是当时已发布模型的最低价。DeepSeek由此打响“价格屠夫”的名号且从最初就坚持开源这也让其在开发者群体里获得了“源神”的美誉。随后DeepSeek发布的模型基本每次都没让人失望无论是性能还是价格尤其是R1创造的DeepSeek时刻更让这家公司彻底出圈成为全球大模型行业备受瞩目的性价比之王。DeepSeek自2024年以来发布的主要模型价格单位元/1M Token从DeepSeek自身来看虽然模型性能在持续提升但其API价格保持快速下降输入价格已从1元降到最新的0.02元输出价格也从此前高点16元降到2元。一周前DeepSeek正式上线的V4-Flash-0731创下其有史以来的模型最低价这也在全球引发了大模型斩杀线的讨论。对比来看DeepSeek-V4-Flash-0731的价格显著低于Kimi K3、Qwen3.8-Max、GLM-5.2、GPT-5.6、Claude Opus 5和Fable 5等国内外头部模型同时性能差距也不是很明显。据独立研究公司Artificial AnalysisDeepSeek-V4-Flash-0731综合性能与GPT-5.6-Luna、Genimi-3.6 Flash并列落后于国产模型Kimi K3、Qwen3.8-Max和GLM-5.2以及OpenAI和Claude最新模型。但是DeepSeek-V4-Flash-0731是全球知名模型中运行成本最低的模型。从完成同等任务的花费来看该模型平均成本为0.03美元不到Kimi K3的4%更不到Claude Fable 5的1%。因此此番DeepSeek罕见宣布涨价则在开发者群体中炸开了锅不少人呼吁不要涨太多。开发者群体还玩起梗来梁文锋的风评如同一只滑动变阻器在“梁圣”、“梁叔”、“梁子”、“牢梁”之间演变如今一夜之间则从“梁圣”变为“梁子”以此来表达连“价格屠夫”也不得不向成本低头的感慨。多位开发者认为DeepSeek此次涨价并非是为了在模型火爆之际赚更多的钱而是调用量的迅速攀升导致算力紧张“梁老板说这钱我这不想挣人家逼着我挣”。其实DeepSeek此前发布V4预览版时就有提到过受限于高端算力Pro的服务吞吐十分有限预计下半年950超节点批量上市后Pro价格会大幅下调。业内认为此次DeepSeek官宣涨价也意味着V4-Pro正式版即将迎来上线。只不过还未等到新的算力补充DeepSeek就先迎来需求高峰。为此DeepSeek此前实行了峰谷定价机制高峰期调用价格翻倍希望以此引导流量错峰降低服务器压力。但有开发者对此吐槽称现在DeepSeek就没有峰谷的问题因为时差都是峰国外那边用得也挺多。海外开发者平台OpenCode披露DeepSeek-V4-Flash单日处理量曾达8万亿Token而模型聚合平台OpenRouter上400多款模型的日均总调用量才6.6万亿。OpenCode高管透漏其平台用户每天在DeepSeek模型上花费13万美元请求过多导致API服务总是宕机流量也因此遭到限制。OpenRouter最新周榜显示DeepSeek-V4-Flash在上周以7.22万亿Token的调用量首次登顶全球第一本周目前仍以5.71万亿Token的调用量蝉联第一且前五依然都是中国模型。这些调用量不仅来自国内用户海外用户也有贡献越来越多的企业转向成本更低的中国开源模型。有美国AI创业公司创始人就表示已切换到DeepSeek V4这将在未来几个月能给公司省下数百万美元。从“价格屠夫”到大模型斩杀线再到突然宣布涨价这并不是梁文锋要加速商业化变现的主动选择而更多像是应对需求爆发而导致算力紧张的应对之举。业内分析称DeepSeek通过涨价希望对目前有限的算力进行再分配。对以技术优先的DeepSeek来说留出更多算力训练更前沿的模型可能更重要尤其是在对手们仍在持续进步的情况下。梁文锋此前在投资交流中也多次强调要克制不追求营收和利润最大化API定价的逻辑是十个月收回设备成本赚取合理的利润要让大家用得起。不少开发者判断虽然DeepSeek预计涨幅较大但最终价格可能仍会低于国内其它头部模型。大模型终于告别价格战DeepSeek不是第一家宣布涨价的大模型公司。今年2月智谱推出新一代旗舰模型GLM-5Coding Plan套餐价格涨幅30%起随后发布的GLM-5-Turbo、GLM-5.1分别提价20%、10%GLM-5.2综合定价则又比前一代高出13%。智谱7月底又更新订阅紧张的GLM Coding Plan国内版套餐Lite/Pro/Max套餐分别从40/149/469元涨至118/538/1078元最低涨幅130%最高则达超260%此前智谱CEO张鹏表示今年一季度API涨价83%但调用量不降反升400%市场仍供不应求。这一定程度成为智谱涨价的底气但持续上涨的算力成本依旧是涨价的关键驱动因素。此前引发关注的Kimi K3的API价格同样迎来上涨100元/1M Token的输出价格相较上代模型K2.7增长2.7倍是目前国内定价最高的模型。这一定程度是中国大模型试图剥离低价标签、通过智能水平掌握模型定价权的尝试但背后都有着算力不够的苦涩。Kimi K3爆火后遭遇算力挑战不得不暂停订阅并进行算力扩容。今年以来阿里云、百度云、腾讯云等主要云厂商都对AI算力、存储等产品进行最低5%到超过30%不等的涨价。从全球来看大模型和云厂商涨价也是趋势。杰富瑞统计今年二季度美国大模型API价格上涨了89%典型如Claude Fable 5的价格相较上代模型翻倍。不过也有少数厂商在降价。今年5月底小米MiMo宣布MiMo-V2.5系列API永久降价新定价最高降幅达99%。这更多是后来者为追赶而采取的措施该模型调用量随后迅速爆发。最新宣布降价的则是OpenAI。上月底OpenAI下调GPT 5.6系列两款新发布模型的价格其中GPT-5.6 Luna下调80%GPT-5.6 Terra下调 20%。仅过一周OpenAI最新又宣布将ChatGPT免费用户的默认模型更新为GPT5.6 Luna。业内普遍认为这是OpenAI为应对外有中国开源模型来袭、内有劲敌Anthropic竞争而采取的应对举措。前者正在吸引越来越多的美国企业和开发者而后者凭借更为强大的模型能力在企业端持续爆发。两年前DeepSeek闯入大模型赛道伊始就开启了轰轰烈烈的价格战如今它自己按下了暂停键。随着需求爆发和定价提高中国头部大模型公司商业化能力有望迎来重新定价。高盛最近就将中国大模型厂商今年底的合计ARR年度经常性收入从100亿美元上调至130亿美元并预测2030年将攀升至1250亿美元实现五年25倍的增长。但高盛也表示今年行业训练总成本40亿美元、推理总成本70亿美元合计将高于当期ARR板块整体仍处于负EBIT状态盈利拐点要到2030年才会出现。不过从长远看DeepSeek可能依旧是一个变量。梁文锋此前表示在当前价格区间用户需求没有太大弹性继续降价并不会带来更多需求价格翻倍也不会导致需求明显下降。但他也强调未来包括模型优化等在内的整体降价空间还是比较大。公开报道显示DeepSeek年化收入已逼近5亿美元V4旗舰API毛利率约70%-80%远高于字节、智谱、MiniMax等公司的MaaS业务反映出DeepSeek强悍的成本优化控制能力。在此次涨价后DeepSeek未来在算力解决后有没有可能再降价仍存变数。毕竟在目前的高毛利支撑下其相较行业对手仍有下降空间。目前DeepSeek依然在广积粮此前已完成首轮500亿元融资。虽然主要输血来源幻方因市场调整今年收益不佳但最新报道称其已开启寻求近80亿美元的第二轮融资。这些资金中的部分计划用于采购算力资源并推进大型数据中心建设加强基础设施投入。算力同样是月之暗面、智谱、MiniMax持续融资中的投入重点。一面是越来越多的用户需求一面是没有尽头的技术竞赛大模型玩家们都需要权衡先后利弊短期长期。暂时停下的风暴未来也可能重来。

相关新闻

字节跳动出了个免费AI编程工具,有点意思。

字节跳动出了个免费AI编程工具,有点意思。

最近有个现象挺有意思的。身边越来越多人跟我吐槽:"想学编程,但光是配环境就劝退了。""有个想法想做个小程序验证一下,结果查资料查到半夜,代码一行没写。"我懂这种感觉。编程这件事,门槛从来不在…

2026/8/20 9:49:34 阅读更多 →
OneRec-V1和V2的架构演进

OneRec-V1和V2的架构演进

一、OneRec-V1为了解决大量资源消耗在通信和存储而非模型计算,GPU 利用率远低于大语言模型;各阶段目标分散,模型结构差异导致建模不一致;级联架构阻碍了 Scaling Law、强化学习对齐等先进技术的应用的问题,快手团队提出…

2026/8/22 23:22:07 阅读更多 →
C语言开发工具选型指南:VS、CLion、VSCode与Dev C++深度横评

C语言开发工具选型指南:VS、CLion、VSCode与Dev C++深度横评

1. 项目概述:为什么C语言开发者需要一个清晰的工具选型指南?干了这么多年C语言开发,从学生时代的Turbo C到后来在工业级项目里摸爬滚打,我最大的感触之一就是:工具选对了,事半功倍;工具选错了&a…

2026/8/22 16:34:57 阅读更多 →

最新新闻

基于STM32的四合一便携仪表设计:从模拟前端到固件实现

基于STM32的四合一便携仪表设计:从模拟前端到固件实现

蹲在机柜前那会儿,我左手举着万用表笔,右手拧着可调电源的旋钮,还得用余光去看信号发生器的频率显示。客户那边设备已经装箱上柜,操作空间窄得可怜,我包里那三台台式仪器倒是一应俱全,可惜一台都放不稳。那…

2026/8/27 4:08:15 阅读更多 →
Microchip PIC32CM PL10:Cortex-M0+ 低功耗 MCU 的安全与实战解析

Microchip PIC32CM PL10:Cortex-M0+ 低功耗 MCU 的安全与实战解析

Microchip 在 Arm Cortex-M0 这条产品线上又补了一块拼图,PIC32CM PL10 系列正式发布。我这些年一直在 MCU 选型和嵌入式开发的一线,看到这个型号的第一反应是:Microchip 终于把安全子系统和低功耗外设塞进了这颗主打性价比的 M0 芯片里。这篇…

2026/8/27 4:08:15 阅读更多 →
AI生成UI工程化实践:基于JSON-Render与Qwen大模型的端到端解决方案

AI生成UI工程化实践:基于JSON-Render与Qwen大模型的端到端解决方案

1. 项目概述:从概念到落地的AI生成UI工程化探索最近在团队内部做技术分享,聊到了一个挺有意思的话题:如何把AI生成UI这件事,从“玩具”变成真正能在生产环境落地的“工程”。大家可能都玩过一些AI画UI的工具,输入一句“…

2026/8/27 4:08:15 阅读更多 →
基于iPad音频口的红外遥控器制作:从硬件电路到协议实现

基于iPad音频口的红外遥控器制作:从硬件电路到协议实现

1. 项目切入点与整体设计选择Part 1 做完,我手里的 iPad 已经能通过音频口输出一段红外载波,把 940nm 的红外发光管点亮。但坦白讲,那时候离“能做日常遥控器”还很远:亮归亮,发送出来的信号接收端不认,家里…

2026/8/27 4:08:15 阅读更多 →
PWM硬件底层真相:从信号变形到负载制约

PWM硬件底层真相:从信号变形到负载制约

1. 这不是“调光调速”的说明书,而是硬件工程师真正用得上的PWM底层认知PWM——脉宽调制,这个词在电子工程师的日常里出现频率高得离谱:调电机转速、控LED亮度、稳电源输出、驱动风扇、甚至给WS2812灯珠发指令……但翻遍各种教程,…

2026/8/27 4:08:14 阅读更多 →
开放式AI耳机实测:韶音OpenFit 2如何用千问大模型重构语音交互

开放式AI耳机实测:韶音OpenFit 2如何用千问大模型重构语音交互

韶音 OpenFit 2 AI 耳机正式开售,这是目前耳机市场里少见的直接把“大模型能力”写进产品名的一批产品之一。从产品定位看,它面向的不是极客玩家,而是普通用户:开放式佩戴适合通勤和运动,AI 问答入口放在耳机里&#x…

2026/8/27 4:07:14 阅读更多 →

日新闻

Go语言构建企业级AI服务网关:统一管理英伟达等AI接口调用

Go语言构建企业级AI服务网关:统一管理英伟达等AI接口调用

1. 项目概述:从零构建一个企业级的AI服务网关 最近在帮一个做内容审核的团队做技术架构升级,他们原来的业务里,每天有几十万张图片和短视频需要过审,最初是接了几个开源的AI模型自己部署,但效果和性能一直不太稳定。后…

2026/8/27 0:00:51 阅读更多 →
网盘直链下载助手5分钟解析八大网盘真实地址

网盘直链下载助手5分钟解析八大网盘真实地址

网盘直链下载助手5分钟解析八大网盘真实地址 【免费下载链接】Online-disk-direct-link-download-assistant 一个基于 JavaScript 的网盘文件下载地址获取工具。基于【网盘直链下载助手】修改 ,支持 百度网盘 / 阿里云盘 / 中国移动云盘 / 天翼云盘 / 迅雷云盘 / 夸…

2026/8/27 1:06:27 阅读更多 →
从零点亮 ESP32:Arduino ESP32 开发环境搭建与首次烧录完整指南

从零点亮 ESP32:Arduino ESP32 开发环境搭建与首次烧录完整指南

从零点亮 ESP32:Arduino ESP32 开发环境搭建与首次烧录完整指南 【免费下载链接】arduino-esp32 Arduino core for the ESP32 family of SoCs 项目地址: https://gitcode.com/GitHub_Trending/ar/arduino-esp32 Arduino ESP32 是乐鑫官方的 ESP32 系列 Ardui…

2026/8/27 1:06:27 阅读更多 →

周新闻

[光学原理与应用-521]:对光的错误理解与纠偏

[光学原理与应用-521]:对光的错误理解与纠偏

首先光是一种能量的载体和形态,宏观上观察到的光是由无数个微观的光量子组成的,每个光子在产生的瞬间,其在真空的空间中以确定不变的速度沿着一个初始的方向一直向前,在微观层面,每个光量子的运动轨迹是以波函数所展现…

2026/8/26 14:45:33 阅读更多 →
SIP通话转接原理与REFER方法实战解析

SIP通话转接原理与REFER方法实战解析

1. 通话转接不是“挂断再拨号”,而是SIP会话的动态重定向你有没有遇到过这样的场景:客服坐席A正在和客户通电话,突然需要把这通对话无缝转给专家坐席B,客户完全感知不到中间的断连——既没听到忙音,也没被要求重新拨号…

2026/8/26 17:46:43 阅读更多 →
Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

Kolla-ansible单节点OpenStack部署实战:从环境准备到排坑指南

1. 为什么选择Kolla-ansible来部署单节点OpenStack?如果你正在寻找一种能把OpenStack从“概念”快速变成“可用的实验环境”的方法,那么Kolla-ansible几乎是当前最主流、最省心的选择。我见过太多人卡在手动编译依赖、配置服务、处理版本冲突的泥潭里&am…

2026/8/26 14:46:37 阅读更多 →

月新闻

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南

免费解锁百度网盘SVIP加速:macOS用户必备的下载提速终极指南 【免费下载链接】BaiduNetdiskPlugin-macOS For macOS.百度网盘 破解SVIP、下载速度限制~ 项目地址: https://gitcode.com/gh_mirrors/ba/BaiduNetdiskPlugin-macOS 还在为百度网盘macOS版的龟速下…

2026/8/26 3:50:20 阅读更多 →
终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换

终极ncmdump指南:3分钟实现网易云NCM音乐解密与格式转换 【免费下载链接】ncmdump 项目地址: https://gitcode.com/gh_mirrors/ncmd/ncmdump 还在为网易云音乐下载的NCM格式文件无法在其他播放器播放而烦恼吗?ncmdump解密工具帮你轻松解决这个困…

2026/8/26 17:46:39 阅读更多 →
HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

HarmonyOS 应用开发《掌上英语》第81篇: 智能体卡片:为英语学习 App 打造桌面级学习助手

AgentCard 智能体卡片:为英语学习 App 打造桌面级学习助手适用平台:HarmonyOS 7.0 (API 26 Beta)一、引言 HarmonyOS 7.0(API 26 Beta)新增了 AgentCard 智能体卡片能力,这是继 HMAF(鸿蒙智能体框架&#x…

2026/8/26 1:24:05 阅读更多 →