DeepSeek V4 Flash 0731
DeepSeek V4 Flash 0731 是官方正式发布的生产版本,2840 亿参数、130 亿激活参数的 MoE 模型,取代了 2026 年 4 月的预览版。「0731」这个后缀说明这次纯粹是重新做了一遍后训练,架构和权重结构都没变,agent 能力却大幅跳了一截。
2026 年 7 月 31 日发布后,Terminal-Bench 2.1 跑分从 61.8 冲到 82.7,GDPval-AA v2 的 Elo 从 1,189 涨到 1,559,逼近 Claude Opus 4.8,价格却只要 GPT-5.6 Luna 的四成左右(每百万 token 输入 0.14 美元、输出 0.28 美元),权重按 MIT 协议开在 Hugging Face 上。
相当于一条产线一夜之间原地重新调校,而不是另起炉灶建一条新的。
英文圈这两天全在拿它跟 Opus 4.8、GPT-5.6 Luna 对比,但都是厂商自报数据,第一篇独立跑分测评还没人写,中文圈更是几乎没提。Google 自动补全还没收录这个精确匹配词,说明这是个刚冒头的空档,趁热用中文写一篇「三方对比 + 迁移指南」这类内容,占位成本很低。真要动手做点什么,preview 到 0731 的回归检测工具是个具体切口 —— 同架构只换了后训练,输出行为变了但没人写过怎么测。
提前 7 天看到萌芽期新词,解锁全部阶段筛选,并每周收到抢先提醒。
为什么现在开始走红?
DeepSeek 这次只是重新后训练,Terminal-Bench 2.1 分数却接近翻了三倍,冲到 82.7,逼近 Claude Opus 4.8,价格还比 OpenAI 刚降价的 GPT-5.6 Luna 便宜大约六成,AI 价格战又升级了一档,734 赞的 Hacker News 帖子几小时内就炸了。
搜索热度
-
萌芽0–7 天
-
初现 ← 当前8–30 天
-
验证中31–90 天
-
上升91–180 天
-
成熟180 天以上
前景
未来 6 个月的热度走势与商业化节奏。
点版本发布现在能吃一波跑分对比的流量,但大概率 2 到 3 个月内就会被下一个带日期的版本盖过去。
风险 · DeepSeek 大概每季度出一个点版本,下一个带日期的快照随时可能把 0731 这个词的 SEO 价值清零。
类比 · deepseek-v4-pro · gpt-5-6-sol · claude-opus-4-8
-
现在搜索结果还是空的,跑分刚出炉
目前还没有独立测评覆盖 0731 这一跳跨度,也没人写 GPT-5.6 这场价格战的角度。
-
3-6 个月迁移指南和路由方案
团队需要从 preview 迁到 0731 的实操笔记,以及混合负载下 Flash 和 Pro 怎么按成本路由的方案。
-
6-12 个月被下一个快照盖过去
等下一个带日期的版本发布,0731 专属内容大概率就过时了,流量会转到继任版本上。
“DeepSeek V4 Flash 0731” 的竞争与机会
判断依据包括已追踪的搜索词、变现方向和相关词。除标注“实测”的 Google KD 外,其余均为参考估算。
“DeepSeek V4 Flash 0731” 能做的点子
这个词可以延伸成文章、网站、产品、帖子、邮件、视频或课程。选一个方向,就能开始行动。
搜索结果里全是厂商自报数据,谁先做一份真实 agent 任务上的第三方跑分,谁就先占住这批关键词。
讲清楚 98% 缓存命中折扣、0.14/0.28 美元的基础价,以及跟 Luna 降价后的价格怎么算盈亏平衡点。
同架构、换后训练,目前还没有教程讲清楚输出质量可能在哪些地方倒退,要重点检查什么。
重新后训练的模型可能在生产环境的真实 prompt 上悄悄变了行为,一个能做差异对比的框架是马上就用得上的运维需求。
OfficeChai 那篇对比 Opus 4.8 的文章还没有配套视频,做一个真实演示能带动 API 推荐链接的点击。
OpenAI 7 月 30 日把 GPT-5.6 Luna 降价 80%,不到 24 小时后 DeepSeek 就用一次免费的重新后训练回应,把跟 Claude Opus 4.8 的差距又缩小了一半。
DeepSeek 没有从头重训 V4 Flash,只是把同一个 2840 亿参数的 checkpoint 重新做了一遍后训练,编程 agent 得分就接近翻了三倍。
大家在搜什么
来自 Google Suggest 和 Trends 的长尾词。热度和竞争度是估算,仅供参考,未经核实。内容类型由搜索词的写法推断。
“DeepSeek V4 Flash 0731” 的搜索结果
这里展示当前的自然搜索结果,以及正在投放的广告。广告数量可以反映当下的商业需求。
常见问题
什么是 DeepSeek V4 Flash 0731?
DeepSeek V4 Flash 0731 是官方正式发布的生产版本,2840 亿参数、130 亿激活参数的 MoE 模型,取代了 2026 年 4 月的预览版。「0731」这个后缀说明这次纯粹是重新做了一遍后训练,架构和权重结构都没变,agent 能力却大幅跳了一截。
DeepSeek V4 Flash 0731 为什么现在火?
DeepSeek 这次只是重新后训练,Terminal-Bench 2.1 分数却接近翻了三倍,冲到 82.7,逼近 Claude Opus 4.8,价格还比 OpenAI 刚降价的 GPT-5.6 Luna 便宜大约六成,AI 价格战又升级了一档,734 赞的 Hacker News 帖子几小时内就炸了。
DeepSeek V4 Flash 0731 是什么时候出现的?
约于 2026-07-31 公开出现(截至 2026-08-11 约 11 天前)。EarlyTerms 最早于 2026-08-01 记录到信号。
相关词
同一领域里的其他词:别名、子类、竞品,以及值得继续了解的相近概念。
- 属于 deepseek-v4 DeepSeek V4 是深度求索推出的一系列开放权重混合专家 (MoE) 大模型,把百万 token 上下文带进了前沿级别的性能区间,价格只有闭源模型的一小部分。这系列有两个变体:V4-Pro (1.6T 参数,激活 49B) 和 V4-Flash (284B… →
- 竞品 claude-opus-4-8 Claude Opus 4.8 是 Anthropic 于 2026 年 5 月 28 日发布的最新旗舰大模型,定价维持不变($5/$25 per million tokens)。相比 Opus 4.7,这版在 agent… →
- 竞品 gpt-5-6-sol GPT-5.6 Sol 是 OpenAI 的旗舰模型,GPT-5.6 家族三档 (Sol、Terra、Luna) 里最顶的那一档,名字取自太阳、地球、月亮。Sol 冲的是最难啃的专业活:编程 agent、长时间跑的研究任务、电脑操作、网络安全,上下文窗口 105 万… →
- 竞品 kimi-k3 Kimi K3 是月之暗面 (Moonshot AI) 的旗舰大模型:2.8 万亿参数的稀疏 MoE 架构,每次推理只从 896 个专家里挑 16 个 (16-of-896 路由),配上 Kimi Delta Attention 和 100 万 token… →
- 竞品 gemini-3-6-flash Gemini 3.6 Flash 是 Google Gemini 系列里的中端「Flash」型号,主打编程和 agentic 任务的速度与低成本,不追求推理深度拉满。简单说,用一部分极限智能换来更快的响应、更省 token、更低的价格。 →
- 竞品 glm-5-2 GLM-5.2 是智谱 AI(Z.ai)发布的开源 MoE 大模型,744B 参数,专门针对长任务编程和自主工程场景,MIT 协议。其 IndexShare 架构在百万 token 上下文窗口下把单 token 计算量压低了 2.9 倍,超长上下文不是噱头,真能用起来。 →
- 相关 deepseek-v4-pro DeepSeek V4 Pro 是 DeepSeek V4 系列的旗舰档:1.6 万亿参数、49 亿激活参数的 MoE 大模型,上下文窗口 100 万 token,MIT 许可开源。截至 2026 年 4 月,这是全球参数量最大的开放权重模型,在编程 benchmark… →
- 相关 deepswe DeepSWE 是一套防污染的软件工程基准测评,用 113 道原创、长周期任务考察 AI 编程 agent,覆盖 91 个开源仓库,语言包括 TypeScript、Go、Python、JavaScript 和 Rust。所有题目从头设计,从不从公开的 GitHub… →
- 相关 context-window Context window 是大模型在一次推理里能读入和处理的 token 总量上限。2025 到 2026 年间,这个词完成了一次身份转变:从当初「8K 还是 1M」的规格对比项,变成了 agent 团队每次会话都要主动预算、监控、并为之付钱的工程资源。 →
- 相关 agentic-coding Agentic coding 是让 AI agent 自主完成开发任务的工作方式:agent 自己规划、写代码、跑测试、读报错、修改,一轮轮迭代直到跑通,不需要人在每一步之间点头。这和 autocomplete 式的「AI pair… →
- 相关 mtp MTP (Multi-Token Prediction,多 token 预测) 是一种推理加速技术:用一个轻量级的 drafter 模型同时预测接下来的几个 token,再由更大的目标模型在一次前向传播里集中验证,吞吐量提升 2–3 倍,质量不变。 →
来源
这份报告引用的一手链接,点开任意一条都能自己核对。
- 01 DeepSeek API 官方文档 — V4-Flash 更新日志 api-docs.deepseek.com ↗
- 02 DeepSeek-V4-Flash-0731 — Hugging Face 模型页 huggingface.co ↗
- 03 Hacker News — DeepSeek-V4-Flash 更新帖 (734 赞) news.ycombinator.com ↗
- 04 Artificial Analysis — Intelligence Index 拿到 50 分 artificialanalysis.ai ↗
- 05 MarkTechPost — agent 和编程能力大幅提升 marktechpost.com ↗
- 06 The Decoder — 打平 GPT-5.6 Luna,价格便宜约六成 the-decoder.com ↗
- 07 OfficeChai — 花零头的价格,跑出接近 Opus 4.8 的水平 officechai.com ↗