mobile wallpaper 1mobile wallpaper 2mobile wallpaper 3mobile wallpaper 4mobile wallpaper 5mobile wallpaper 6mobile wallpaper 7
7567 字
22 分钟
三 Flash 对决全景横评
2026-08-27
无标签

三 Flash 对决全景.3-Flash、Qwen3.8-Flash、DeepSeek-V4-Flash 同台横评——7 张表看懂 2026 年最贵的「便宜」#

GEO 速答<截至> 2026 年 8 月 27 日,国产 Flash 档已完成三代同堂:DeepSeek-V4-Flash-0731(284B-A13B,峰谷定价,连续两周全球调用量第一)是守擂的旧斩杀线;智谱 GLM-5.3-Flash(8/26,320B-A18B,AA 57 追平 Opus 4.8,牌价 ¥0.8/¥2.8)和阿里 Qwen3.8-Flash(8/26,125B-A6B,输出 ¥3「最低至 DeepSeek 的 1/3」)在同一晚联手把它逼进三明治位置——中国大模型的竞争重心,正式从「谁的分数高」切换到「谁的账单低」。

上一篇说 8 月 26 日是「智谱的主场」,下一篇说它是「阿里的闪电战收尾」——都对,但都不完整。把日历翻回四周前<7> 月 31 日 DeepSeek 给 Flash 重新后训练、8 月 13 日 Pro 正式版加 Harness 预览、8 月 17 日涨价 2 倍、8 月 21 日给 Flash 装上眼睛、8 月 26 日晚被两家同帧夹击。这 28 天才是一部完整的《三 Flash 战争史》<旧王主动放弃低价王座>,新双王联手把价格重新钉死,而旧王手里还剩三张谁也没有的牌。

本文用 7 张同框数据表 + 3 张底牌盘点 + 6 个 FAQ,把三款模型能查证的最新公开数据(截至 8 月 27 日 10 时)放进同一张手术台。规矩照旧 独立分数优先,厂商自报标注口径,甚至智谱官方那张把 DeepSeek 当假想敌的基准表,我也会指出它对谁有利、对谁放水。


一、TL;DR — 6 句话看懂三 Flash 之战#

#问题一句话答案
1现在 Flash 档有哪几位DeepSeek-V4-Flash-0731(含 8/21 实验版 Vision-Exp)、智谱 GLM-5.3-Flash(8/26)、阿里 Qwen3.8-Flash / Flash-Next(8/26)——外加 7 月底「装上眼睛」这个新标配,三强之外还有 Kimi、MiniMax、Gemini 3.7 Flash 在侧翼
2谁最强有独立认证的只有两家:AA 指数 GLM-5.3-Flash 57(=Opus 4.8)V4-Flash-0731 52(=Qwen3.8-27B=GPT-5.6 Luna 档);Qwen3.8-Flash 尚未收录,官方自述「超 Opus 4.6、接近 4.8」,待验证
3谁最便宜单看牌价三分天下,看负载结构分胜负 常规 ¥0.8/¥2.8 最低且限时五折;Qwen ¥1/¥3 居中;DeepSeek 高峰 ¥3/¥9 看着最贵,但缓存命中低至 ¥0.05-0.1——约为 GLM 命中价的 1/4、Qwen 未命中输入价的 1/20,高复用 Agent 负载下 DeepSeek 反超
4谁最互补硬指标三家互相拿捏:输出长度——DeepSeek 384K,全场最大(两家新王仅 128K);上下文——智谱原生 1M ≈ DeepSeek 1M > 阿里 262K 外推;并发——DeepSeek 2500 封王
5格局变了什么Flash 从「旗舰的青春版」变成主战场<8>/17 DeepSeek 主动涨价让出低价锚,8/26 两家新王同夜把它和所有旧玩家一起夹在三明治里——同智能带价格下限改由 4.5 美分/任务说了算
6还没解决什么三个未决数:Qwen3.8-Flash 的 AA 分、DeepSeek 下一轮调价与 Harness 正式版、智谱 GLM-5.3 完整权重(8/28)——以及一款模型的「过拟合自家壳」问题没人给你测

一句话立场<这轮> Flash 战争没有输家,只有「先想清楚再用」的人——三家把编程、办公、吞吐量三个方向各钉了一颗价格钉子,选型错误的代价从「贵」变成了「贵且慢且差」;但把三家任何一家的官方跑分直接抄进采购文档,2026 年 8 月的功课你就白抄了


二、时间线 — 28 天闪电战<从>「涨价让位」到「同夜逼宫」#

DeepSeek 是这场战争的「在位者」,先看它四周内的全部动作,再看两位挑战者如何在同一个夜晚进场。

日期玩家动作
2026-04-24DeepSeekV4 预览版发布(V4-Flash 284B-A13B / V4-Pro 1.6T-A49B),Token-wise Compression + DSA 稀疏注意力,1M 上下文,最大输出 384K,权重同步开源
2026-07-31DeepSeekV4-Flash-0731<架构不动>、纯重新后训练,官方九项 Agent 基准全面上涨(Terminal-Bench 2.1 82.7、DeepSWE 54.4、CyberGym 76.7);原生支持 Responses API 并适配 Codex;并发上限 2500
8 月上旬市场V4-Flash-0731 在 OpenRouter 连续两周全球调用量第一(周 11.2 万亿 tokens);中国模型周调用量连续 16 周全球第一,全球前十占六席
2026-08-13DeepSeek一日两文 正式版官宣 + Harness 开发者预览版(「一切皆插件」架构,被招商证券称为「Agent 时代的安卓」);同日确认 8/17 起峰谷定价
2026-08-17DeepSeek涨价生效 空闲 ¥1.5/¥4.5、高峰翻倍至 ¥3/¥9(缓存命中 ¥0.05-0.1);高峰输出价为旧价 4.5 倍,Pro 部分计费项涨幅最高 1100%
2026-08-21DeepSeek首个多模态模型 V4-Flash-Vision-Exp 上线 API<纯文本持平正式版>,视觉 Agent 基准大幅跃升(ApexBench 26.2→36.5),官方称多模态 Agent 能力接近 Opus 4.8;图片按 ≤384 tokens/张计费、Files API 永久免费;单请求最多 600 张图
2026-08-26智谱 × 阿里双 Flash 之夜:20<40> 阿里发 Qwen3.8-Flash(明牌对标:「最低至 DeepSeek-V4-Flash 闲时 2/3、忙时 1/3」);22<12> 智谱官宣 GLM-5.3-Flash(¥0.8/¥2.8 + 两周五折);23<00> Qwen 权重落地 HF/ModelScope
2026-08-26/27生态硅基流动上线高速版 V4-Flash-0731(第 170 款模型);智谱次日股价盘中涨超 8%;阿里、智谱两家通稿互不相让,同框比较帖 24 小时内刷屏

数据来源 官方更新日志/定价页、每日经济新闻(OpenRouter 调用量测算,8/17)、北京商报(8/16、8/26)、百度百科 V4-Flash-Vision-Exp 词条、电子工程专辑(8/27)、搜狐科技(8/22)、威易网(8/26 三 Flash 横评)。

**这意味着:**DeepSeek 在 7/31→8/21 这二十一天里把「能力、生态、变现」三件套全做了——唯独把「最便宜」这把交椅,自己主动让了出去。它让位的当晚,两把新刀同时插进了那个空位。


三、规格对决 — 三匹马,三张完全不同的脸#

维度DeepSeek-V4-Flash(-0731 / Vision-Exp)GLM-5.3-FlashQwen3.8-Flash / Flash-Next
厂商深度求索智谱 Z.ai阿里通义
发布4/24 预览、7/31 正式版、8/21 视觉实验版8/26(官宣,8/20 起匿名公测)8/26
体量284B-A13B(MoE)320B-A18B(MoE)125B + 51B 外挂-A6B(MoE)
注意力路线Token-wise 压缩 + DSA 稀疏线性 × 稀疏混合(34+11 层)+ IndexPoolGDN 线性 + QSA 块级稀疏 + Gated Residual
独家架构件mHC 流形约束超连接N-gram Embedding 可卸载主机内存
模态文本;Vision-Exp 实验版补图片输入(无视频)原生多模态(文本+图像+视频)原生多模态(文本+图像+视频)
上下文1M;输出 384K(全场最大)1M 原生;输出 128K原生 262K,YaRN→1M(Next 默认 1M);输出 128K
思考模式可关(非思考支持 FIM 补全)不可关(thinking 仅 enabled)未披露开关细节(Qwen3.8 系默认强制思考)
AA 智能指数V4-Flash-0731 52;Vision-Exp 未收录57(=Claude Opus 4.8)未收录(发稿时)
API 牌价(¥/MTok)闲 1.5/4.5;高峰 3/9;缓存 0.05/0.1¥0.8/¥2.8;缓存 ¥0.23;两周五折¥1/¥3;缓存价未公布
美元牌价$0.14/$0.28(高峰翻倍)$0.15/$0.50(五折后 0.075/0.25)约 $0.16/$0.47
并发上限2500(全场最高);Pro 500未公布未公布
图片计费≤384 tokens/张;Files API 免费未单项公布未单项公布
权重开源预览版权重已开;0731 新权重未同步放出;许可为 DeepSeek 系协议MIT,发布即开发布即开(HF/ModelScope+FP8),许可未注明(Max 有自定义条款前例)
入口官网 API/网页/App、OpenRouter、聚合平台BigModel/Z.ai、Coding Plan、ZCode千问办公、千问 AI 平台、HF

数据来源 API 官方文档/定价页与更新日志、威易网 8/26 三 Flash 横评、知乎 8/21 专栏(52 分对照)、智谱 8/26 官方公告与 BigModel 文档、阿里 8/26 官方发布与 IT之家/链捕手报道;「并发 2500」「384K 输出」以官网实时文档为准。

三个「人设」用一句话立住:

  • DeepSeek = 长跑者<284b> 体量、13B 激活居中(低于智谱 18B、高于阿里 6B),两年多 MoE+DSA 路线的成熟部署,换来最高并发 2500、最大输出 384K、最狠的缓存价——牌价数字它都不占第一,但「重复前缀」是它的护城河:缓存命中 ¥0.05,在智谱的限时五折退出后,全场再无对手。对 Agent 这种「同一份库 + 工具定义反复带」的负载,错峰 + 缓存能把实付输入成本压到对手的 1/5 以下。
  • 智谱 = 全能重装<18b> 激活 + 320B 体量,买的是**唯一一张独立认证的前沿门票(57=Opus 4.8)**和原生 1M——它是三家里最接近「小号旗舰」的,也最贵一档(体量)。
  • 阿里 = 效率狂魔<6b> 激活把单位算力成本砍到地板,训练成本 1/9;换来的是独立成绩暂时缺位——Qwen3.8-Max 的 AA 58 只证明家族能打,不能替小老弟背书。

**结论:**规格表上没有任何一家全面领先——DeepSeek 守住了「跑得动大任务」的硬指标(384K 输出/2500 并发/缓存价),智谱抢走了「被承认的聪明」,阿里押中了「单位算力的极致」。这场对决从一开始就不是三条同赛道的马,而是三个赛道的冠军互相踩场。


四、跑分对决 — 谁的成绩单值得信#

先把唯一一张「三家同框」的表摆出来——它来自智谱 8/26 官方发布材料,把 DeepSeek-V4-Flash-Vision-Exp 列为对比基线之一(阿里未进该表,Qwen 列分数据 DataLearner/快科技对 Flash-Next 的收录):

基准GLM-5.3-FlashDeepSeek-V4-Flash-Vision-ExpQwen3.8-Flash(-Next)
Terminal-Bench 2.184.383.9未公布绝对值(官方称超 Opus 4.6)
DeepSWE v1.163.459.358.7
NL2Repo56.357.748.1
Toolathlon Verified78.475.9~73.5
AutomationBench v1.0.648.838.8未公布绝对值
Agents’ Last Exam26.327.324.3
GDPval-AA v2(经济产出)1773(全场最高)1675未公布绝对值(JobBench 超 Opus 4.6 近 20 分)
Z.ai Code Bench max29.0未参与

数据来源 与 DS 列出自智谱 8/26 官方公告图(经 CSDN/知乎转录)——由竞争对手评测,结果天然带立场,但三方同条件这点反而珍贵;Qwen 列出自官方发布材料与第三方收录(标注「官方称」);DS 正式版(非 Vision)7/31 九项自报成绩(TB2.1 82.7、DeepSWE 54.4)见其更新日志。

这张表能读出三层信息:

  1. 智谱赢面确实大<六项可比里> GLM 拿四项,且把 V4-Flash-Vision-Exp 的看家项(ALE)只让出 1 分——但别忘了对面是实验版,而 DeepSeek 正式版从 0731 到 Vision-Exp 的跨版增量(NL2Repo、Toolathlon)本来就是其历史上最猛的一次后训练;
  2. DeepSeek 的两个「独赢项」含金量高(整仓生成)、Agents’ Last Exam(开放难题)都是 384K 输出预算撑出来的场景——GLM/Qwen 的 128K 上限在这两项物理上吃亏;
  3. 阿里的表没法直接参与<它公布的绝对值集中在自家生态基准>(JobBench、CoWorkBench、AndroidWorld)和与 Opus 4.6 的分差上,对标口径和另两家错位。错位本身就是话术——锚 4.6 而不是 4.8,是「超」;锚 4.8 就只剩「接近」。

**结论:**截至 8/27,唯一被第三方独立量过的排序是:GLM-5.3-Flash(57)> V4-Flash-0731(52)≥ Qwen3.8-Flash(未测,推断在 52-57 区间)。等 AA 把 Flash-Next 收录进来,这张座次表才算真正开牌。

数据卫生提醒<检索时注意>,聚合平台上流传一批「DeepSeek-V4-Flash-0713 / 16B-A2.8B / 首 token 95ms」的营销软文(如某「DMXAPI」系内容),规格与官方 0731 版本(284B-A13B)完全冲突,疑似编造。三家的公开信息环境里已经掺杂这种噪声,引用前请核对 deepseek.com 更新日志原文。


五、价格对决 — 一元钱的三种命运#

牌价表,先合并同框(每百万 tokens,人民币/美元双牌价——注意,三家的国内价与国际价并不同步)。三条计费规则先记牢<其一>,DeepSeek 峰谷时段为北京时间 9:00-12<00>、14:00-18<00>,段外自动半价——它是三家唯一把「时间」做进价格维度的;其二,智谱限时五折自 8/26 起持续两周,且明确适用于第三方聚合平台;其三,阿里的牌价是发布日快照,既无折扣条款也无峰谷结构。同一份负载,在三家计费系统里会走出三条完全不同的曲线。

计费项(¥/MTok)DeepSeek-V4-FlashGLM-5.3-FlashQwen3.8-Flash
输入·常态空闲 1.5 / 高峰 30.8(五折 0.4)1
输出·常态空闲 4.5 / 高峰 92.8(五折 1.4)3(五折口径无)
输入·缓存命中0.05-0.1(全场最低)0.23未公布
国际价$0.14/$0.28(高峰约翻倍至 $0.28/$0.56)$0.15/$0.50(五折 $0.075/$0.25)约 $0.16/$0.47
折扣机制峰谷<闲时自动五折>发布后两周限时五折未见折扣(首发日)
图片≤384 tokens/张,Files API 永久免费未单列未单列

一个反直觉的细节:国内牌价 GLM 最便宜,美元牌价 DeepSeek 最便宜($0.28 输出 ≈ GLM 的五成六、Qwen 的六成)。同一家公司两副价签,本身就说明牌价是最不该单独看的数字。

真正该看的是任务级。拿两类真实负载算账(设输入 50 万 tokens、输出 1 万 tokens):

负载类型DeepSeek(空闲)DeepSeek(高峰)GLM(常规)GLM(五折)Qwen(无缓存口径)
高缓存 Agent(命中 95%)¥0.11¥0.21¥0.16¥0.08¥0.53
低缓存长文/代码库(命中 0%)¥0.80¥1.59¥0.43¥0.21¥0.53

计算口径<每任务输入> 50 万 tokens、输出 1 万 tokens;输入 = 命中部分×命中价 + 未命中×未命中价;Qwen 因未公布缓存价,按全量未命中计。数字为本文按官方牌价的推演示例,实际以各家计费系统为准。

三张牌价结论:

  1. 高缓存 Agent 长跑的冠军会「换班」 五折窗口内(¥0.08)全场最低;两周后五折退出,同一负载 DeepSeek 空闲价(¥0.11)反超 GLM 常规价(¥0.16)。DeepSeek 把定价权变成了一道时区题——牌价最贵,但「错峰 × 缓存命中 ¥0.05」组合后的真实价最能打;
  2. 低缓存大输入是智谱的绝对主场<啃大代码库>、长文档首问这类一次性负载,¥0.8 未命中输入折前折后都是地板价;但注意隐藏变量——GLM/Qwen 最大输出 128K,DeepSeek 支持 384K,超长产物的拆分、续写与拼接工程成本,价目表上看不见;
  3. Qwen ¥1/¥3 卡在两家中间,真实成本变量在消耗率<家族前科摆着>(Qwen3.8-27B 跑完 AA 全套生成约 1.6 亿输出 tokens,同题 GPT-5.6 Luna 约 1.3 亿),6B 的「快想」架构会把便宜牌价吃回去多少,单价 × 消耗量 × 重试率的乘积没人验证过——这正是它的悬念

**结论:**这场价格战的真相是「牌价趋同、结构分叉」——三家把同一元钱的切分方式彻底拉开了:DeepSeek 赌缓存与错峰,GLM 赌牌价数字本身,Qwen 赌单位算力。采购文档里「每百万 tokens 单价」这一栏,该整体替换成「每成功任务成本(含重试)」。


六、基本盘对决 — 跑量、硬核与云端各守一角#

跑分和价格只是水面上的桅杆,三家的水下载体完全不同。逐个看牌:

**DeepSeek 的牌<流量>、时区与「半瞎」的解法。**它是三家里唯一有「全球调用量第一」实绩的 连续两周登顶、周 11.2 万亿 tokens、中国模型整体连续 16 周压过美国——它的基准测试不是实验室,是真实世界的流量池。8/13 上线的 Harness(一切皆插件的 Agent 框架)+ Responses API 原生适配 Codex,把「换模型」的成本降到改一个 model 名<已在> DS 栈上的团队解锁视觉只需把模型名换成 vision-exp,账单公式不变。但三处暗伤<其一>,多模态是「实验版」,只有图片没有视频,官方自己标注 Exp;其二,权重更新与 API 脱节——0731 重新后训练的权重并未同步开源,自托管用户手里的还是 4 月的旧模型;其三,涨价 4.5 倍(旧 ¥2→新 ¥9 高峰输出)的决策在两周内遭到 GLM/Qwen 同夜夹击证实为窗口期误判——摩根大通说的「定价灵活性」如今成了双刃剑<它随时可以再降回去>,但也证明了它可以不守信用

**智谱的牌<认证>、工程与「孤勇者」处境。**57 分是三家唯一一张独立机构盖章的前沿认证;60T tokens 匿名公测淬炼是唯一一次「先跑全球流量再发布」;MIT + 国产芯片集群承载全部真实负载,是中国公司第一次把「硬件自主 + 开源生态」两张牌同时打给海外市场(股价盘中 +8%、JPM 目标价 1800 港元是资本侧的回声)。但代价同样清晰<智谱没有云帝国>——Coding Plan 与 API 是它的全部渠道,面对阿里的「千问办公 95% 覆盖率 × 阿里云」和 DeepSeek 的「免费网页版 × 流量池」,它站在中间没有生态缓冲。这是一家只有模型公司的模型战争。

**阿里的牌<密度>、肌肉与「生态闭环」。**训练成本 1/9 是三家里唯一的「造模型的成本革命」,意味着它的迭代次数上限是对手的数倍;Qwen4 架构预览身份让 Flash-Next 自带「未来兼容性」——今天微调的架构知识,明天直接平移到旗舰;30 亿次下载、30 万衍生模型的社区纵深,让三家任何部署争议最后都会变成「有人已经踩过坑」。而「千问办公」当晚内置,是 DeepSeek 和智谱都不具备的——自有十亿级办公场景做模型的分发器。它的短板也最直白<没有> AA 分、没做过 1M 原生的公网压测、Max 的自定义许可证先例让「Apache 惯性信任」吃了亏。

“没有绝对的天下第一,只有最适合你的场景。” — 威易网三 Flash 横评(8/26);而粉丝战争版是<头条算法圈>「GLM Flash 稳压 Qwen Flash」vs Qwen 阵营「125B 对阵 320B,这不叫对比,这叫以大欺小」——两边都对,这就是 Flash 战争的本质<用不同的尺寸>、价格与生态,回答同一个问题——每块钱、每瓦特、每一次迭代,装多少智能。

棋局之外的下一步<三家已被公开信息剧透的动作>#

玩家已露头的后续动作对三 Flash 格局的影响
DeepSeekVision-Exp 转正并扩展到 Pro 系列(媒体普遍预期);峰谷规则随时可再调;0731 权重是否补开源仍未表态一旦把闲时输出从 ¥4.5 再往下打,第一个丢单的是牌价没有纵深的挑战者;权重补发则直接解掉自托管警报
智谱GLM-5.3 完整权重 8/28 上线(首次延迟开源的兑现日);摩根大通预测 8 月内发布万亿参数级 GLM-5.5;五折 9 月 9 日到期高缓存任务冠军「换班」进入倒计时;GLM-5.5 若如期登场,旗舰—Flash 的代际梯子会比阿里 Qwen4 更先搭好
阿里Flash-Next 交给社区检验(微调、量化、评测会在两周内爆发式出现);Qwen4 时间表随架构验证进度浮动社区实测将最先逼近 Flash 的真实位置<若> AA 收录后站上 56-57,「以小胜大」的故事即刻改写座次
场外变量OpenAI 8/21 宣布 GPT-5.6 Sol API 降价超 20%(为期三个月);Gemini 3.7 Flash 促销价 12/31 到期回 $1.5/$7.5;Kimi K2.5 月底退役、K3 无法新订阅海外降价与国产内卷同步发生——8 月的「斩杀线」由中国厂商定义,但接球的窗口正在变窄

来源<每经>/新浪(OpenRouter 与调价报道)、电子工程专辑(8/27)、摩根大通研报(8/16)、知乎 AI 热点日报(8/21-22)、OSCHINA/什么值得买(8/20-25)、智谱 GLM-5.3 官方开源承诺。

这意味着:三家都已没有「按兵不动」这个选项——DeepSeek 要决定是否把价格战重新点燃,智谱要证明 57 分不是发布日烟花,阿里要等社区替它把 AA 的空白填上。三个月后回看,8 月 26 日大概率被记住的不是「谁赢了」,而是「前沿模型的采购清单第一次需要三家同时开着计费页来写」


七、选型决策 — 按场景对号入座#

你的负载首选次选/备选关键理由
Coding Agent 主力(改大库、长会话、多步工具)GLM-5.3-FlashV4-Flash-073157 分硬认证、六项同框四项第一;DS 的 384K 输出在整仓生成时是隐藏武器
Office 助手、文档/PPT 流水线、中文办公Qwen3.8-Flash(千问办公)GLM 五折窗口95% 日常办公覆盖的宣传是否属实另说,协同优化 + 阿里邮箱/钉钉生态是真实加成
移动端/GUI/具身 AgentQwen3.8-FlashGLM(ZCode BUA/CUA)AndroidWorld 84.5、MathVision 95.7 的自报分属第一梯队,但注意「超 Opus 4.6」口径
截图 OCR、表格抽取、轻量视觉任务,存量 DS 技术栈V4-Flash-Vision-Exp不用换栈改一行模型名解锁看图,价格不变、Files API 免费——迁移成本最低的多模态方案
高并发在线服务(客服、内容生成、搜索摘要)V4-Flash(错峰调度)Qwen(等吞吐实测)并发 2500 + 缓存价 + 闲时五折,为「重复提问 × 巨大前缀」而生
夜间批处理、评测、数据加工V4-Flash 空闲段GLM 五折到期后重算离线任务天然吃满峰谷规则
一次性啃大上下文(整库首问、长文档冷读)GLM-5.3-FlashQwen¥0.8 未命中输入全场最低;若产物超 128K,加挂 DS 做续写
私有化/本地部署GLM(MIT)/ Qwen(待确认许可)智谱 MIT 最干净;Qwen 先看 License 再动 GPU;DeepSeek 注意陷阱<可下载的权重是> 4 月旧版,线上 API 跑的是新版
预算极紧的学生/个人三家全部<网页版免费额度>DS 网页/App、智谱清言、千问网页端均有免费入口,先用真实任务喂它们一周

三步走决策法,顺序不能反:第一步看负载结构(缓存命中率?输出长度?并发量?——这三问直接分出 DeepSeek 还是两家新王);第二步看生态绑定(已在 Claude Code/OpenCode/千问办公/钉钉哪个壳里?换壳成本大于换模型成本);第三步才看牌价打折——限时五折这类窗口期数据,写预算时按原价算,写营销 PPT 时才按五折算。


八、FAQ — 6 个关键问答#

Q1<8> 月 26 日那一晚,到底谁赚了? A<分开看>发布声量上 DeepSeek 是输家——它 4.5 倍涨价留下的真空被两家同夜瓜分,「最低档位价格」的叙事权第一次易主。但它输的是叙事,不是生意 调用量冠军、免费网页入口、存量技术栈粘性都没丢;Vision-Exp 又恰好卡在「迁移不用换商」的生态位上。两家新王各拿半满分<智谱拿到了>「认证最强 Flash」,阿里拿到了「单位成本最低 Flash」。赢家通吃的剧本这轮没上演。

Q2<我们已经在> DeepSeek 上跑 Agent,要迁吗? A:三个判断题<①> **要不要视频/深度多模态?**要 → Vision-Exp 不给(仅图片),迁 GLM 或 Qwen;② **单轮产出是否常超 128K?**是 → 只能留在 DS 或用拆分方案;③ **账单里高峰时段的占比?**超半数 → 先做错峰调度再谈迁移,大概率一分钱不用花。三问都是「否」,你其实不用动——DeepSeek 用价格弹性换掉了迁移理由。

Q3<三家做多模态>,谁是真·原生? A:含金量排序:**智谱、阿里是预训练期原生多模态(30T 多模态语料/文本+图像+视频输入);DeepSeek 是后挂实验版(仅图片、Exp 标签)。**但别急着下结论——V4-Flash-Vision-Exp 在 ApexBench、Chartography 两项第三方记录中已经摸到 Opus 4.8,「实验版」的成绩已经进场,GLM/Qwen 的原生溢价还没兑换成独立认证。2026 年看模型,动作要听、身份更要看权重和评测记录。

Q4<自托管用户怎么选>? A:三条残酷事实<①> 智谱 MIT 是协议最干净的,320B 多机可部署,FP8/量化配方社区已在路上;② 阿里 125B+51B 体积最小、架构对 CPU/GPU 混合推理最友好(51B 外挂设计本就是给异构内存写的),但许可证未注明,Max 的自定义条款先例必须查模型卡;③ DeepSeek 的开源权重停在 4 月 Preview——API 已升级到 0731 重新后训版,线下部署的仍是旧模型,官方没有承诺同步放出。自托管的账,这次智谱阿里算得清,DeepSeek 的图纸是旧的。

Q5<价格战下一轮什么时候来>?盯什么? A:三个日历节点:9 月上旬(Qwen 秋季发布节奏/云栖大会前哨;DeepSeek 有没有「促销回血」动作)、12 月 31 日(Gemini 3.7 Flash $0.75/$3.75 促销价到期回 $1.5/$7.5,国际牌价重算)、以及智谱五折到期的次日(高缓存负载冠军易主回 DeepSeek,前面算过了)。最值得盯的反而是 DeepSeek 的降价自由——它 8/17 涨上去的每一分,都是未来价格战的弹药。

Q6<三家跑分>,哪些可以直接进采购文档? A:只有两行.3-Flash 的 AA 57 与 V4-Flash-0731 的 AA 52(Artificial Analysis 独立评测)。其余全部是厂商自报或对手转测<智谱表的> DS 列是对手跑的,阿里表的 Opus 列是锚旧的(4.6)、Qwen 的「超 Opus 4.6 九分」没有第三方复现。采购文档的正确写法<先列两条独立认证>,再放各家自报成绩单并标注口径,最后补一条「我方 N 个真实任务的实测通过率与单任务成本重测日期」——那才是真正的跑分。

**一句收口:**2026 年 8 月的中国大模型市场,第一次同时拥有「被承认的最强大脑(智谱 57)、打不穿的流量堤坝(DeepSeek)、造不出第二遍的效率配方(阿里 1/9)」——三块拼图凑齐了前沿普惠的全部原料,只差把采购决策从「选最强」改成「选最对」的终端用户。


九、参考资料#

厂商官方

  • DeepSeek 更新日志与模型定价页(api-docs.deepseek.com/zh-cn/updates、/quick_start/pricing)、V4 Preview 发布(4/24)、V4-Flash-0731 更新、V4-Flash-Vision-Exp 发布文(微信公众号,8/21)与视觉 API 文档(guides/vision)、Harness 开发者预览公告(8/13)
  • 智谱.3-Flash 官方博客(z.ai/blog/glm-5.3-flash)、BigModel 模型文档(docs.bigmodel.cn/cn/guide/models/vlm/glm-5.3-flash)、官方 X 公告(8/26 22<12>)、HuggingFace zai-org/GLM-5.3-Flash(MIT)
  • 阿里 官方博客(qwen.ai/blog?id=qwen3.8-flash-next)、技术报告(QwenLM/Qwen3.8-Flash-Next GitHub)、HuggingFace/ModelScope Qwen/Qwen3.8-Flash-Next(8/26 23<00>)

第三方评测与媒体

  • Artificial Analysis Index v4.1.1(GLM-5.3-Flash 57、V4-Flash-0731 与 Qwen3.8-27B 各 52、Qwen3.8-Max 58)、GLM vs Qwen3.8-Max 比较页
  • DataLearner / llm-stats.3-Flash vs Qwen3.8-Flash-Next 同框对比(8/26)
  • 威易网 / GLM-5.3-Flash / Qwen3.8-Flash 三强横评(8/26)
  • 电子工程专辑:《DeepSeek 补齐视觉「睁开眼」,指标向 Opus-4.8 靠拢》(8/27)
  • 每日经济新闻/新浪 调用量周报与 DeepSeek 涨价报道(8/17);新京报/北京商报/上证报/潮新闻/广州日报/界面/IT之家/快科技对 8/13-8/26 各发布日的报道
  • 链捕手<智谱> 10 万卡国产芯片与国内定价(8/27);摩根大通研报(8/16,via 华尔街见闻)
  • 掘金/知乎:《阿里一日双发》(8/15)、《Qwen3.8-27B 就是新的模型斩杀线》(8/21)、《怎么看 GLM-5.3-Flash 发布》多答主实测(8/26-27)

相关阅读(本系列)

  • 《GLM-5.3-Flash 深度解读<57> 分追平 Opus 4.8、价格只有 1/40》
  • 《Qwen3.8-Flash 深度解读<千亿参数只点> 6B 的「灶」、训练成本砍到 1/9》

数据截至 2026 年 8 月 27 日 10 时。三场发布、两次调价、一份实验版视觉模型都发生在过去四周——这意味着本文的每一张表,保质期都可能只有两周。下一次动手前 榜单刷一遍、三家定价页各看一眼、你的任务集自己跑一天。

分享

如果这篇文章对你有帮助,欢迎分享给更多人!

三 Flash 对决全景横评
https://mizuki-eaf.pages.dev/posts/others/三flash对决横评/
作者
无名之子
发布于
2026-08-27
许可协议
CC BY-NC-SA 4.0

部分信息可能已经过时

目录