
7月31日下昼,DeepSeek在API文档更新日记里低调地挂出一则见告:V4-Flash郑再版(或V4-Flash-0731)上线公测。
随后,成就者社区出现一个反常的事实——V4-Flash郑再版在总参数、激活参数上未在原先V4-Flash预览版基础上进行任何改变,但其代码和智能体才智,竟“突变式”地达到了环球顶尖模子的水平。
2026年以来,头部开源模子竞争参加“万亿参数时间”。更大的算力集群与问心无愧地再次成为模子才智突破的关键。
但这次,DeepSeek似乎再次冲突了这一逻辑惯性——就像2025年春天那样。
DeepSeek时期又来了?
自“GPT时期”以来,“算力即技艺”的领域法例(Scaling Law)被硅谷和环球成本阛阓奉为尺度。
直到2024年末DeepSeek V3上线、2025年1月R1发布——前者以不到600万好意思元检会成本并列GPT-4o,后者以纯强化学习旅途迫临OpenAI o1。“领域法例”第一次碰到正面质疑,英伟达单日市值挥发5000亿好意思元,“DeepSeek时期”由此得名。
然而,“DeepSeek时期”并未拆伙而后各大模子企业的参数竞赛。
参加2026年,“领域法例”卷土重来:4月,DeepSeek V4-Pro预览版以1.6万亿的总参数、490亿激活参数开局;7月阿里Qwen 3.8-Max预览版将总参数推到2.4万亿;同月,月之暗面Kimi K3以2.8万亿参数登顶环球开源模子领域之王座。
“鼎力出古迹”重回舞台中央——直到7月31日,DeepSeek V4-Flash-0731持重发布,堆参数的逻辑惯性才被踩下刹车。
左证DeepSeek官方透露,V4-Flash郑再版在九项智能体与代码基准得分上,一说念零星自家1.6万亿总参数、490亿激活参数的V4-Pro预览版。
其中,在九项基准之中的“DeepSWE”基准上,V4-Flash郑再版与Pro预览版的分差达到惊东说念主的41.6分;而在“ALE”基准上,V4-Flash郑再版致使与环球顶级的Claude Opus 4.8仅差半分。
也就是说,V4-Flash郑再版仅使用了Pro预览版六分之一的总参数,以及不到四分之一的激活参数,便大幅度完成了对Pro预览版的反超。
淌若只将视角停留在V4-Flash郑再版和Pro预览版上,你似乎能猖狂地得出一个论断:“领域法例”在这儿失灵了。
诚然,没东说念主会以为“领域法例”确实失灵。在更新透露中,DeepSeek明确示意,V4-Flash郑再版基准测试接收了自研的类似“Codex”的器具——DeepSeek Harness极简模式来跑分。加上这次DeepSeek接收了重作念后检会的风景,加大了智能体与器具使用标的的大众检会力度,好多AI工程改变的肖似,才在信得过道理上让DeepSeek再次成为算力除外的“X成分”。
AI性价比来到“临界点”
诚然,V4-Flash郑再版也并非完满。
21世纪经济报说念记者疑望到,部分国外成就者社区用户指出,V4-Flash郑再版的输入缓存掷中率偏低、安全分类器时时超时,这在一定经过上反应出,算力和参数储备不及仍将是搁置模子才智上限的瓶颈。
环球成本阛阓层面,在V4-Flash郑再版上线之后,99久久久久成人国英伟达、博通、AMD等公司7月31日股价也并未出现剧烈波动。阛阓也曾风气了DeepSeek改变带来的触动,也并不认为AI工程时间的迭代是算力需求的利空成分。
“领域法例远未到上限,国内模子领域受限仅仅算力不及,不是规章走到很是。”DeepSeek首创东说念主梁文锋此前在一个广为流传的融资会议纪要中提到。但他同期也示意,领域不再是唯独杠杆,念念维链和智能体将会是下一个杠杆。
摩根大通此前也指出,DeepSeek强化了“算力供应推广、订价次第、结构性成本弧线压缩”三大相沿,对行业是顺风,而非零和。
然而,环球追赶顶尖模子的潮水,其实也曾在悄然改变。
近日,左证环球多家媒体报说念,部分泰西公司也曾开动将中国的大模子镶嵌责任流,并欺诈其完成大部分庸碌任务。仅在最复杂的任务中,这些公司才会调用Anthropic Claude Fable等顶尖模子。
以上变化无疑与中国模子使用成本偏低关系。而另一方面,好意思国模子使用权限的弗成控,也让非好意思地区客户不得不接收备用决策。
部分券商的驳斥更值得玩味。
天风证券计较机缪欣君团队在V4-Flash郑再版发布今日,用“大超预期”为之定调,指出其抽象才智已接近Opus 4.8、智能体代码才智接近GPT-5.6 Luna,重申看好下半年国产模子链,认为尤其是“成长性30%+、有基本面”的软件公司会最初受益于AI带来的增量需求。
这一判断反常之处在于,畴昔阛阓多半认为AI模子的合手续逾越将利空“软件即干事”类企业。而今天,DeepSeek的性价比也曾奢靡令软件公司自身使用并提效,更多因Token账单太贵而不敢使用AI的软件公司约略成就更多高性价比AI互联网干事,畴昔无法被情愿的AI智能体使用需求将变为推行。
“站在通盘行业的对立面”
就在几周前,当Kimi K3冲到2.8万亿参数时,头部玩家多半服气,即就是中国模子也要盲从“更大=更强”的法例,走“大激活+高常识容量”阶梯。
V4-Flash郑再版的出现则再次解说,AI发展不单需要鼎力出古迹,还得慢工出细活。
从价钱方面来看,这次V4-Flash郑再版的输入(缓存未掷中)、输入(缓存掷中)、输出每百万Token的价钱分袂为0.14好意思元、0.0028好意思元和0.28好意思元,与“ALE”基准仅半分之差的Claude Opus 4.8比较,三者的价钱分袂是前者的36倍、179倍和89倍。
“梁文锋似乎站在了市面上总共模子玩家的对立面。”一位从事AI初创公司孵化的东说念主士告诉记者。DeepSeek系列模子恒久稳居性价比之王的宝座,导致其余公司必须至少提供比DeepSeek性能更强的模子。
类似的不雅点在V4-Flash郑再版发布之后的AI成就者社区中日出不穷。
“梁文锋的DeepSeek成为了一台永不罢手的收割机。”一些略激进的不雅点认为,“总共的AI大模子公司王人在梁文锋的前边驱驰,无论用什么风景,它们必须跑到DeepSeek的前边才能生涯。”

