官方API

Grok API 2026 中转倍率:官方价格与中转对比实测

Grok / xAI API 官方定价详解与 API 中转倍率核对,覆盖 Grok 4.6/4.3/Grok Build 0.1 长上下文缓存成本,含工程验证方案与业务选型建议。

Grok API 2026 中转倍率:官方价格与中转对比实测

这是 Grok API 官方定价的完整指南,覆盖 2026 年最新版表(包括 Grok 4.6、Grok 4.3、Grok Build 0.1 等模型的长上下文缓存成本)。如果你是开发者、业务团队或 API 接入方,想精确核对中转倍率、规划 TCO 并决策业务选型,本文就是你的工程验证方案。

Grok API 官方定价 2026 年最新版表

xAI 官方定价(数据以 2026 年 8 月 13 日当日报纸页为准,USD/百万 tokens)如下。长上下文(≥200k 输入 token)会触发双倍率,所有模型均支持 Prompt Caching 机制。 [[1]](https://x.ai/docs/developers/pricing.md)

模型上下文输入价格 (/1M)缓存输入 (/1M)输出价格 (/1M)
grok-4.6 (<200k)500k$2.00$0.50$6.00
grok-4.6 (≥200k)500k$4.00$1.00$12.00
grok-4.5 (<200k)500k$2.00$0.30$6.00
grok-4.5 (≥200k)500k$4.00$0.60$12.00
grok-4.3 (<200k)1M$1.25$0.20$2.50
grok-4.3 (≥200k)1M$2.50$0.40$5.00
grok-4.20-reasoning (<200k)1M$1.25$0.20$2.50
grok-4.20-reasoning (≥200k)1M$2.50$0.40$5.00
grok-build-0.1 (<200k)256k$1.00$0.20$2.00
grok-build-0.1 (≥200k)256k$2.00$0.40$4.00
grok-4.20-multi-agent (<200k)1M$1.25$0.20$2.50
grok-4.20-multi-agent (≥200k)1M$2.50$0.40$5.00

提示缓存规则:缓存命中时,输入 token 按缓存价格计费(典型 RAG/对话场景可节省 50-80%)。批量处理(Batch API)对 grok-4.3、grok-4.20 等模型提供 20% 折扣。

官方 vs 中转:倍率工程核对方法

官方价格是中转倍率的基准。你可以用开源 SDK(OpenAI 兼容)或 HTTP 测试工具(如 Postman / curl)模拟真实请求,记录输入+输出 token 数与实际调用费用。

  1. 注册 xAI 控制台,生成 API Key。
  2. 用 vLLM 或本地部署环境复现相同请求(保持上下文长度一致)。
  3. 对比:中转倍率 = 实际花费 / 官方单价。
  4. 工程验证:开启 Prompt Caching 后,重新跑相同 prompt,测缓存命中率。

通过这种方法,你可快速确认中转商提供的倍率是否在 0.5-1.8 倍区间内(低于 0.7 倍通常需额外验证稳定性)。更多中转验证方案请查阅 API 中转工具页

长上下文(200K+)与缓存读写成本差异

Grok 4.6 等旗舰模型在 ≥200k 输入 token 时,输入价格直接翻倍($4.00 / $1.00 cached),输出也相应调整。这与短上下文形成鲜明对比。

  • 短上下文(<200k):输入 $2.00 / 缓存 $0.50。
  • 长上下文:输入 $4.00 / 缓存 $1.00(仍远低于双倍输出成本)。

缓存读写差异体现在:读缓存 token 只计 $0.50–$1.00 /1M,写缓存则按全额输入计费。实际业务中,RAG 场景(文档重复加载)缓存命中率 60%+ 可将总成本降低 40-60%。

工程对比模板(假设 1M tokens,80% 缓存命中):

场景官方输入成本官方输出成本总成本
短上下文$2.00$6.00$8.00
长上下文(200k+)$4.00$12.00$16.00
带缓存长上下文$1.00$12.00$13.00

注意:长上下文定价只影响输入 token,输出始终按输出价格计算。实际以官方文档当日报纸页为准。

批量折扣与实际 TCO 计算模板

批量处理(Batch API)对 grok-4.3 及以上模型提供 20% 折扣,实时 API 则无此优惠。优先处理(Priority)则加 2 倍费用。

实际 TCO 计算模板(每月 10M 输入 + 2M 输出,缓存命中 70%):

  1. 标准价格(假设 Grok 4.6):

- 输入:10M × $2.00 = $20 - 输出:2M × $6.00 = $12 - 缓存节省:10M × $0.50 × 70% = $3.5 节省 - 总计:$28.5

  1. 批量折扣后:总成本 $28.5 × 80% = $22.8(约节省 20%)
  1. 添加本地部署迁移:vLLM 部署同模型,硬件成本约 $0.05–0.15/小时,月 TCO 可进一步降至 $15-18(视算力规模)。

检查清单:每月 token 量 >5M?优先计算批量折扣;上下文 200k+?必须测试缓存命中率。

xAI 中转场景下的速度与合规注意点

官方 API 实时延迟通常 <1s,Batch API 则需 24 小时内完成。xAI 中转场景常见痛点包括:

  • 速度:实时请求在高峰期可能受配额限制,建议配合中转商的预热或连接池。
  • 合规:需遵守 xAI 使用条款(禁止滥用、数据泄露)。中转商合规需提供 SOC2 等认证,部分区域(GDPR、数据本地化)官方支持有限。
  • 速率限制:免费/低配额用户每分钟 10-50 请求;企业版可提升至 1000+。

建议:在代码中实现重试 + 指数退避,结合中转平台实时监控面板核对实际延迟。

Grok 4.6 实战选型:何时用官方 API 更优

Grok 4.6 是当前最强代码与代理模型(知识截止 2026 年 2 月 1 日),上下文 500k,价格亲民。

  • 官方 API 更优场景

- 代码生成、agentic 工具调用、长对话代理(单次请求 >50k tokens)。 - 预算敏感型业务(低于 $3/M blended 成本时仍胜率领先)。 - 需要实时最新数据(搜索工具集成)。

  • 中转/本地部署更优场景

- 高频小任务(<10k tokens/次),中转倍率 <0.7 时可节省 30%+。 - 严格隐私合规或离线部署(vLLM 本地运行,成本 $0.01-0.03/次)。 - 批量处理量大,抢占 20% 批量折扣。

决策建议:先用官方跑 1000 次测试请求,记录实际 TCO。若中转倍率 >1.3 且延迟无优势,则迁移至本地部署。更多本地部署方案请查阅 本地部署实验室

GrokCode = 中转验真 + 模型天梯 + 本地部署实验室。以上数据均工程可核验,欢迎在 官方 API 页面模型天梯 中验证最新价格。

延伸阅读

风险与边界

本文仅供参考,具体价格以 xAI 官网 定价页 或控制台实时数据为准。使用中请遵守 xAI 使用条款与数据安全规范。本内容非法律意见,实际业务请咨询专业顾问与律师。任何中转行为均需合法合规。

English summary

Grok API 2026 official pricing guide: this document details the latest 2026 rates for models including Grok 4.6, Grok 4.3, and Grok Build 0.1, with full long-context and caching costs. It provides engineering-verified methods to calculate midtransit multipliers, TCO templates, speed/compliance tips for xAI midtransit scenarios, and clear Grok 4.6 selection guidelines (when official is better than midtransit or local vLLM deployment). All tables and calculations are based on xAI's official August 2026 pricing, with practical decision checklists for developers and businesses to verify costs and optimize API usage.

适用于 GrokCode 倍率榜。信息仅供参考,不构成购买、投资或法律意见。