【AI】DeepSeek-V4-Flash-0731:更便宜的模型,反超自家旗舰
AI 技术日报 · 2026 年 8 月 3 日
聚焦国内大厂的大模型技术动态,精选近日重点新闻并整理为中文技术速览。本期主题:DeepSeek 掀起新一轮价格与 Agent 能力战、阿里通义千问冲刺 2.4 万亿参数旗舰、字节 Seedance 2.5 把 AI 视频推进「一镜到底」时代。
目录
- 一、DeepSeek-V4-Flash-0731:更便宜的模型,反超自家旗舰
- 二、阿里通义千问 Qwen3.8-Max:2.4 万亿参数冲击第一梯队
- 三、字节 Seedance 2.5:单次生成 30 秒、音画一体的 AI 视频
- 四、国内大模型格局:从「一家独大」到「群雄逐鹿」
- 写在最后
一、DeepSeek-V4-Flash-0731:更便宜的模型,反超自家旗舰
7 月 31 日,DeepSeek 正式发布DeepSeek-V4-Flash-0731并开启 API 公测。这不是一次简单的版本号更新,而是把「低价」和「Agent 能力」两件事同时推到了新高度。
核心看点
- 价格几乎贴地:百万 token 输入
$0.14(cache-miss)、输出$0.28;命中缓存的输入低至$0.0028/百万 token。对于需要反复携带仓库上下文、长时间运行的编码 Agent 来说,缓存复用带来的成本下降尤其明显。 - 小模型反超大模型:经过重新训练(post-training)后,参数更小的 V4-Flash 在9 项 Agent 基准上反超了自家旗舰 V4-Pro-Preview。其中 Terminal Bench 2.1 从 V4-Pro-Preview 的
72.1、Flash-Preview 的61.8提升到82.7;DeepSWE 更是从预览版的7.3直接跳到54.4,这是一次数量级级别的跃升。 - 工程能力对齐主流生态:新版原生支持 Responses API,并完整兼容 Codex 类工具链,意味着开发者可以近乎「无痛」地把现有 Agent 工作流迁移过来。
技术背景
DeepSeek V4 系列采用 MoE(混合专家)架构:旗舰版 V4-Pro 为 1.6 万亿总参数 / 49B 激活参数,V4-Flash 为 284B 总参数 / 13B 激活参数,主打「快、省、够用」。V4-Pro 在 SWE-bench Verified 上的成绩约为80.6%,与顶尖闭源模型仅有零点几个百分点的差距,而输出价格仅为对方的零头。
为什么值得关注:这轮发布进一步坐实了业界所说的「AI 能力向零成本竞速(race to zero)」——最聪明的一批编码模型,正在快速变成随取随用的廉价基础设施。对国内开发者而言,这直接降低了把 Agent、自动化编码接入生产环境的门槛。
二、阿里通义千问 Qwen3.8-Max:2.4 万亿参数冲击第一梯队
7 月 19 日,在上海举行的世界人工智能大会(WAIC)上,阿里通义千问团队预览了新一代旗舰模型Qwen3.8-Max,把国内的「万亿参数竞赛」又推高了一档。
核心看点
- 2.4 万亿参数、原生多模态:Qwen3.8-Max 为稀疏 MoE 架构,声称支持文本、图像、视频、文档等多模态输入,配备100 万 token 上下文窗口。
- 对标第一梯队:阿里官方将其定位为「仅次于 Anthropic Claude Fable 5」的模型,是目前通义系列最激进的一次能力宣示。
- 发布节奏极密:这次预览紧随 Moonshot AI 的 Kimi K3(2.8 万亿参数开放权重)之后仅 3 天推出。同期通义还密集放出了 Qwen-Audio-3.0-TTS、Qwen-Image-3.0 等多个旗舰级模型。
需要冷静看待的地方
值得注意的是,Qwen3.8-Max 目前仍为Preview(预览)状态,发布时并未公开完整的基准测试数据,也未同步开放可下载权重,而是先通过阿里的 Token 订阅计划以 API 形式提供。这与通义早期高举「开放权重」旗帜的路线形成了一定反差,业界普遍将其解读为国内头部厂商在旗舰模型上「向闭源商业化倾斜」的信号。
为什么值得关注:参数规模已经不是唯一看点,真正的悬念在于 2.4 万亿参数能否兑现「第一梯队」的宣传,以及阿里会在多大程度上坚持开放路线。对做应用落地的团队来说,先关注其 API 能力、上下文长度与实际推理成本,比追逐参数数字更有价值。
三、字节 Seedance 2.5:单次生成 30 秒、音画一体的 AI 视频
7 月 31 日,字节跳动 Seed 团队正式发布新一代视频生成模型Seedance 2.5,把 AI 视频从「拼接短片段」推进到了「一镜到底」的阶段。
核心看点
- 单次生成 30 秒:单次生成时长从上一代的 15 秒直接翻倍到30 秒,并支持多次续写延长。这打破了业界普遍卡在 10~15 秒的限制。
- 音画一体(一次生成):视频与音频在同一次推理中联合生成,无需事后配音、对轨,主打「一镜成片(one-take creation)」。
- 多模态编辑与灵活引用:新增更强的多模态编辑能力和灵活的参考(referencing)机制,面向影视、广告等专业创作场景。
产品落地
Seedance 2.5 走的是闭源商用路线,率先在字节的即梦 AI(Jimeng)和豆包专业版(Doubao Pro)上线,API 服务随后通过火山引擎(Volcano Engine)Ark / 方舟平台开放。作为对照,同日 MiniMax 发布的竞品 H3 则选择了开源路线——「开源 vs 闭源」的分野,在 AI 视频赛道上同样清晰。
为什么值得关注:视频时长和音画一体化,是 AI 视频能否真正走进专业生产流程的两个关键卡点。Seedance 2.5 在这两点上的突破,配合字节「豆包 + Seedance + 自研芯片」的全栈布局,正在把 AI 视频从「玩具级 Demo」推向「可用于商业内容生产」的门槛。
四、国内大模型格局:从「一家独大」到「群雄逐鹿」
把上面几条新闻拉远来看,可以清晰感受到 2026 年年中国内大模型格局的一个转变:从「一家独大」变成「群雄逐鹿」的多线战场。
当前活跃在一线的国产模型,至少包括:
| 厂商 | 代表模型 | 主要标签 |
|---|---|---|
| 阿里巴巴 | 通义千问 Qwen3.8-Max | 2.4T 参数、多模态、100 万上下文 |
| DeepSeek | DeepSeek-V4 系列 | MoE、极致性价比、强 Agent 能力 |
| 字节跳动 | 豆包 Doubao / Seedance 2.5 | 全栈布局、AI 视频、自研芯片 |
| 月之暗面 | Kimi K3 | 2.8T 参数、开放权重 |
| 智谱 | GLM 系列 | 通用大模型 |
| 百度 | 文心 ERNIE | 通用大模型 |
| MiniMax | H3 | 开源 AI 视频 |
几个值得关注的行业信号
- 用户规模分化:据外媒援引的数据,截至 2026 年 3 月,字节豆包月活约 3.45 亿,明显领先于通义(约 1.66 亿)和 DeepSeek(约 1.27 亿)。C 端入口的争夺已经进入白热化。
- 价格战常态化:DeepSeek 持续用极低价 API 拉低整个市场的价格锚点,「性价比」正在成为国产模型对外竞争的核心武器之一。
- 开源与闭源的路线分野:同一天里,Seedance 2.5 选择闭源商用、MiniMax H3 选择开源;Qwen 旗舰也从早期的开放权重转向 API 优先。开源与闭源并非谁对谁错,而是不同厂商基于商业化节奏做出的不同取舍。
- 落地生态扩张:苹果 Apple Intelligence 已获批在中国市场落地,并与阿里、百度等本土厂商合作适配——这意味着国产大模型正在从「自家 App」走向更广泛的系统级入口。
⚠️数据说明:文中涉及的月活、估值、部分基准分数来自公开报道整理,可能与官方口径存在差异,请以各厂商官方发布为准。
写在最后
回顾这几天的动态,一句话总结:国内大厂在「更强、更便宜、更全栈」三条线上同时发力。DeepSeek 用价格和 Agent 能力重塑成本曲线,阿里用超大参数冲刺能力上限,字节用 Seedance 打通 AI 视频的生产闭环。对开发者而言,现在是把大模型能力接入实际业务的绝佳窗口期——尤其是编码 Agent 和多模态内容生成两个方向。
如果这篇速览对你有帮助,欢迎点赞、收藏、关注,我会持续跟进国内 AI 技术的重点动态。有想深入了解的具体模型或方向,也可以在评论区告诉我。
参考来源
- DeepSeek’s new bargain model accelerates AI’s race to zero — Axios
- DeepSeek V4 Flash 0731 Launches Public Beta with Price Held at $0.14 — XenoSpectrum
- DeepSeek-V4-Flash-0731: Codex Support, $0.14/$0.28 Pricing — explainX
- DeepSeek V4 Preview Release — DeepSeek 官方 API 文档
- Qwen 3.8 Max review: Alibaba’s 2.4T flagship, tested (2026) — eesel AI
- Alibaba unveils Qwen 3.8 Max days after Kimi K3 — The Indian Express
- Introducing Seedance 2.5 — ByteDance Seed 官方博客
- ByteDance Releases Seedance 2.5 — the-decoder
- ByteDance pushes full-stack AI: Doubao, Seedance, own chips — AI Weekly
- The Rise of Chinese AI Companies — Future Startup
本文由自动化任务于 2026-08-03 整理生成,内容基于公开网络报道,仅供技术交流参考。