xAI 的 Grok 系列一直有两个标签:实时信息和敢说话。但 2026 年的 Grok 4.3 悄悄补上了第三个标签:编码利器。它在 SWE-Bench(真实 GitHub issue 修复)上的成绩再刷新,同时把价格相比 4.2 砍掉了一半多——输入从 $3 降到 $1.25,输出从 $15 降到 $2.5。这让 Grok 4.3 成了一个意外的高性价比选择:既有 xAI 传统优势的实时信息推理,又能在编码基准上和 Claude、Kimi 掰手腕,价格还不到它们的一半。这篇解读它的核心升级。
说明:本文的能力描述来自 xAI 官方发布与公开基准数据(SWE-Bench / HumanEval / MMLU 等),非本站实测。价格数据为 QuickRouter 控制台实时值。
一、Grok 4.3 在卷什么?官方公布的三件事
根据 xAI 官方发布,Grok 4.3 的升级重点可以归纳成三件事:
编码能力再上台阶:SWE-Bench Verified 成绩刷新,逼近 Claude Opus 4.8。在真实仓库的 issue 修复、多文件重构、测试驱动开发等工程场景下表现稳定。
价格大幅下调:相比 4.2(输入 $3 / 输出 $15),4.3 降到输入 $1.25 / 输出 $2.5——输出价格打了对折都不止。这是 xAI 押注规模化的信号。
实时信息推理保留:Grok 系列的看家本领——联网获取最新信息并推理——在 4.3 上继续强化,时效性场景(新闻摘要、行情解读、热点分析)仍是强项。
公开评测机构汇总的 Grok 4.3 关键 benchmark 成绩:
| 基准 | GROK 4.3 | 对比 |
|---|---|---|
| SWE-bench Verified | 71.4 – 75% | 逼近 Claude Opus 4.7(79.2%) |
| Artificial Analysis 智能指数 | 53 | 输入价格降约 40% |
| HLE w/tools(长程推理) | 领先 4.2 | Agent 任务强化 |
二、能力总览
| 测评点 | GROK 4.3 | GROK 4.2 |
|---|---|---|
| 推理 | ★★★★½S 级 | ★★★★☆A 级 |
| 代码 | ★★★★½S 级 | ★★★★½S 级 |
| 数学 | ★★★★½S 级 | ★★★★☆A 级 |
| 多模态 | ★★★★☆A 级 | ★★★★☆A 级 |
| 长上下文 | ★★★★½S 级 | ★★★★☆A 级 |
| 工具调用 | ★★★★½S 级 | ★★★★☆A 级 |
相比 Grok 4.2,4.3 的提升是全面而均匀的:推理(88→91)、代码(90→93)、数学(87→90)都有 3 分左右的提升。没有极端偏科,是一个均衡的"全能工程型"模型。最值得注意的还是价格腰斩——同等能力的模型里,它目前是最便宜的之一。
三、价格:意外的高性价比
实时价格 · grok-4.3
按官方计费规则,Grok 4.3 的定价在同级能力模型里极具竞争力:
| 模型 | 输入 ($/M TOKEN) | 输出 ($/M TOKEN) |
|---|---|---|
| Grok 4.3 | $1.25 | $2.5 |
| Grok 4.2 | $3 | $15 |
| Claude Opus 4.8 | $15 | $75 |
| Kimi K2.6 | $6.5 | $27 |
这笔账要算清
编码任务首选 4.3:同等编码能力下,Grok 4.3 的输出价格只有 Opus 的 1/30、K2.6 的 1/10。批量代码生成/重构用 4.3 省一大笔。
复杂推理仍看 Opus:如果是极复杂的算法设计或架构决策,Opus 4.8 仍是天花板,但日常工程任务 4.3 完全够用。
时效性场景用 4.3:需要联网信息的任务(新闻、行情),Grok 的实时能力是独门优势。
四、横向对比
编码模型价格对比(Grok 4.3 / 4.2 / Kimi K2.6 / Claude Opus 4.8 / Qwen3 Coder)
人民币 · 每 100 万 tokens · 充值比例 ¥1 = $1 · 数据来自 QuickRouter 控制台
| 模型 | 厂商 | 类型 | 输入 | 输出 |
|---|---|---|---|---|
| grok-4.3 | xAI | 文本 | ¥1.25/百万token | ¥2.50/百万token |
| grok-4.2 | — | — | ¥3.00/百万token | ¥15.00/百万token |
| kimi-k2.6 | Moonshot | 文本 | ¥6.50/百万token | ¥27.00/百万token |
| claude-opus-4-8 | Anthropic | 文本 | ¥5.00/百万token | ¥25.00/百万token |
| qwen3-coder | Bailian (阿里云百炼) | 文本 | ¥6.00/百万token | ¥24.00/百万token |
五、适合谁用?
| 场景 | 推荐 | 理由 |
|---|---|---|
| 日常代码生成 / 重构 | ✅ 强烈推荐 | 编码强 + 价格极低 |
| 批量工程任务 | ✅ 推荐 | 输出价格是 Opus 的 1/30 |
| 实时信息 + 推理 | ✅ 推荐 | xAI 独门的联网时效性 |
| 极复杂架构设计 | △ 看需求 | Opus 4.8 仍是天花板 |
| 长上下文(>128K) | △ 看需求 | 上下文窗口非其最强项 |
总结
Grok 4.3 是 xAI 迄今最"务实"的一个模型:不卷噱头,把编码做到接近第一梯队,同时把价格打到地板。对于预算敏感、又有大量日常工程任务的团队,它是当前性价比最高的编码模型之一。加上 xAI 独门的实时信息推理能力,它在"需要联网 + 写代码"的混合场景里几乎没有对手。
价格腰斩的背后,是 xAI 对规模化部署的押注——这对用户是实打实的利好。
