mobile wallpaper 1mobile wallpaper 2mobile wallpaper 3mobile wallpaper 4mobile wallpaper 5mobile wallpaper 6mobile wallpaper 7
1387 字
4 分钟
Grok 4.3:1M 上下文视频
2026-07-08

Grok 4.3 模型解读:1M 上下文与原生视频#

模型:Grok 4.3(xAI / SpaceXAI) 发布:2026-04-17(grok.com 静默 Beta,仅 SuperGrok Heavy);2026-04-30(API 正式 GA) 定价:API $1.25/$2.50 每百万 token(输入/输出);Heavy 档 $300/月订阅 这是 xAI 进入”性价比时代”的第一代。Grok 4.3 不再跟旗舰拼总分——上下文干到 1M、原生视频输入、聊天里直接生成 PDF/PPT/Excel,定价却只有同期旗舰的 1/5 到 1/10。Artificial Analysis 智能指数 53(GPT-5.5 是 60)说明它”不是最强”,但结合价格看,它是”最能打又最便宜”的那个。它也第一次把视频理解装进 Grok——多模态的最后一个拼图。


一、引言:悄悄上线,重磅配置#

2026 年 4 月 17 日,Grok 4.3 在 grok.com 静默上线(仅 SuperGrok Heavy 订阅可用),4 月 30 日 API 正式开放。没有发布会——此时的 xAI 正忙着并入 SpaceX,产品发布已经”流程化”。

但配置一点不低调:1M token 上下文原生视频输入、Heavy 档 16 智能体并行、聊天内直接生成 PDF/PPT/Excel 文档。这套组合在 2026 年 4 月的市场里独一份。

二、能力:视频 + 文档 + 超长上下文#

  • 原生视频输入:xAI 第一款支持视频理解的模型——视觉编码器可处理最长 5 分钟、1080p 的视频(MP4/MOV/WebM),能直接”看懂”视频内容回答问题;
  • 1M 上下文:一次吃进百万 token,长文档、大代码库、整场会议记录都是”一条 prompt”的事;
  • 文档生成:聊天中直接产出可编辑的 PDF、PPT、Excel,办公场景闭环;
  • 思维链默认开启;Heavy 档从 Grok-4 的 4 代理升级到 16 智能体并行
  • ⚠️ 最大输出 token 各家口径不一(16K/30K/64K 都有说法,存疑),官方未给出明确数字。

三、成绩:不是最强,但性价比炸裂#

Artificial Analysis(AA)智能指数 53,同期横向:

模型AA 智能指数
GPT-5.560
Claude Opus 4.757
Gemini 3.1 Pro57
Grok 4.353
Claude Sonnet 4.6约 52

第三方基准:GPQA Diamond 90.1%、HLE 35.0%、τ²-Bench 97.7%、IFBench 81.3%;LMArena Elo 1165±5(2026-06-15 快照)。⚠️ AIME、MMMU-视频官方未公布(存疑)。

关键在于价格:API $1.25/$2.50(输入/输出),约为同期旗舰(GPT-5.5 的 $4/$16 级别)的 1/5 到 1/10。用 53 的智能指数、1/5 的价格——这就是”性价比推理”的完整定义。

四、定位:xAI 的价格战策略#

Grok 4.3 是 xAI 定价策略的转折点:

  • Grok-4 时代是”最强 = 最贵”($3/$15);
  • Grok 4.3 转向”够强 + 便宜 + 多模态全”——用 Colossus 的规模效应打价格战;
  • 实时 X 数据依然是差异化:4.3 的搜索问答接的是 X 全网实时信息流。

这个策略的背景是 2026 年上半年的市场:DeepSeek、MiniMax 等中国模型已经把推理价格打穿,xAI 如果不跟进,API 生态就要被抢光。4.3 的”降维定价”是 xAI 对价格战的第一声回应。

收尾:我的一点看法#

Grok 4.3 是一篇”策略 > 技术”的解读。技术上它没有 Grok-4 那种范式级创新,但战略上它极其重要——它标志着 xAI 从”只做最强”转向”通吃全价位”

原生视频输入是真正的增量:2026 年各家都在卷视频理解,但把 5 分钟 1080p 视频 + 1M 上下文 + 文档生成打包进一个 $1.25 的 API,xAI 是第一个。对开发者来说,“一个模型干完视频分析、长文档、办公生成三件事”的吸引力是实打实的。

短板:53 的智能指数说明它跟 GPT-5.5、Opus 4.7 有代差,纯拼智商拼不过;视频理解的实际效果第三方评测还不多,宣传意义大于实证;而且它出生在 xAI 被 SpaceX 收购的过渡期,产品运营明显不如前几代上心。但作为”价格战宣言”,它把球踢给了 OpenAI 和 Anthropic——下一个接招的,是两个月后的 Grok 4.5。


附:核心数据速查#

基本盘

项目数值
发布2026-04-17(Beta)/ 04-30(API GA)
上下文1M token
视频输入原生支持(≤5 分钟 1080p,MP4/MOV/WebM)
文档生成PDF/PPT/Excel
Heavy 档16 智能体并行
定价API $1.25/$2.50;Heavy $300/月

成绩与对比

  • AA 智能指数 53(GPT-5.5 60 / Opus 4.7 57 / Gemini 3.1 Pro 57)
  • GPQA Diamond 90.1%;HLE 35.0%;τ²-Bench 97.7%(第三方)
  • 定价约为同期旗舰的 1/5–1/10

关键概念清单

  • AA 智能指数 = Artificial Analysis 的综合能力加权指标(满分 100)
  • 原生视频输入 = 模型直接处理视频帧/音频,无需外部分段
  • 智能体并行 = 多个 Agent 同时工作再汇总
  • GA = General Availability,正式公开发布
  • τ²-Bench = 真实世界任务基准(研究/客服/办公)
分享

如果这篇文章对你有帮助,欢迎分享给更多人!

Grok 4.3:1M 上下文视频
https://mizuki-eaf.pages.dev/posts/grok/grok-431m-上下文视频/
作者
无名之子
发布于
2026-07-08
许可协议
CC BY-NC-SA 4.0

部分信息可能已经过时

目录