先说结论
如果你今天只想知道 xAI API 该怎么迁,先记住下面 7 句话:
- xAI 已经明确:
grok-4-0709、grok-4-fast-*、grok-4-1-fast-*、grok-code-fast-1、grok-3等旧模型会在 2026 年 5 月 15 日 12:00pm PT 退役。 - 这对应中国时间是 2026 年 5 月 16 日 03:00(北京时间 / 上海时间),不是“本地 5 月 15 日中午”。
- 推理类工作负载,官方推荐直接迁到
grok-4.3。 - 非推理类低延迟工作负载,官方推荐迁到
grok-4.20-non-reasoning。 - 代码类工作负载,官方也建议从
grok-code-fast-1迁到grok-4.3。 grok-4.3的价格是输入 $1.25 / 1M、缓存输入 $0.20 / 1M、输出 $2.50 / 1M,同时给到1M context和none / low / medium / high四档 reasoning_effort。- 如果你今天还把
grok-4-0709当成默认主力,不应该先争论 benchmark,而应该先完成迁移清点。
一句话判断:
- 需要推理、代码、代理任务:先迁
grok-4.3 - 需要低延迟非推理:迁
grok-4.20-non-reasoning - 仍在用旧 Grok 4 / Fast / Code Fast 线路的人:优先级是“先迁移”,不是“再观望一周”
外部标杆页面怎么写,我们补了什么
这次最值得研究的页面主要有三类:
- xAI 官方退役页,会直接给出退役日期、替代模型和工作负载映射。
- xAI 官方模型 / 定价页,会把
grok-4.3的 1M 上下文、费率和 reasoning_effort 讲清楚。 - 媒体和第三方评测更喜欢抓 Grok 4 的 benchmark 或订阅价格,但往往不会把“明天 / 后天 API 怎么迁”写得足够清楚。
这些页面共同做对的一件事是:先解决模型生命周期问题,再谈模型有多强。
这篇文章补的是更适合工程团队做决策的三件事:
- 退役时间换算到中国时区后,真实 deadline 到底是什么。
grok-4.3和grok-4.20-non-reasoning分别该接什么工作负载。- 这次迁移除了换模型名,还该顺手检查哪些请求参数和调用习惯。
先把时间说清楚:退役不是“今天”,也不是中国时间 5 月 15 日中午
xAI 官方 Grok Model Retirement on May 15, 2026 文档写得非常明确:
- 生效时间:
May 15, 2026 at 12:00pm PT
如果换算成中国时间,就是:
2026-05-16 03:00(北京时间 / 上海时间)
今天系统日期是 2026-05-14,所以对中国团队来说,这不是“已经过期”,也不是“明天中午”,而是还有一个跨时区窗口,但已经非常近。
这类时间差最容易让中文团队误判,所以必须按绝对时间执行。
哪些模型会退役,哪些替换最重要
按 xAI 官方退役文档,以下模型会被退役:
grok-4-1-fast-reasoninggrok-4-1-fast-non-reasoninggrok-4-fast-reasoninggrok-4-fast-non-reasoninggrok-4-0709grok-code-fast-1grok-3grok-imagine-image-pro
官方给出的核心替换关系是:
| 旧模型 | 官方推荐替代 |
|---|---|
| grok-4-1-fast-reasoning | grok-4.3 |
| grok-4-fast-reasoning | grok-4.3 |
| grok-4-0709 | grok-4.3 |
| grok-code-fast-1 | grok-4.3 |
| grok-3 | grok-4.3 |
| grok-4-1-fast-non-reasoning | grok-4.20-non-reasoning |
| grok-4-fast-non-reasoning | grok-4.20-non-reasoning |
| grok-imagine-image-pro | grok-imagine-image |
最值得注意的不是“替换表存在”,而是 xAI 已经把工作负载路线讲得很明确了。
为什么推理和代码负载优先看 grok-4.3
xAI 官方退役文档对 grok-4.3 的描述非常直接:
- 1M context
low / medium / high三档 reasoning_effort输入 $1.25 / 1M输出 $2.50 / 1M- 官方称其为“fastest, most intelligent model we have ever built”
与此同时,独立模型页还给出了:
cached input = $0.20 / 1M- reasoning 也可以设为
none - 默认 reasoning_effort 是
low
这意味着它比旧 grok-4-0709 更像一个统一主力层:
- 旧
grok-4-0709:256Kcontext,$3 / $15 - 新
grok-4.3:1Mcontext,$1.25 / $2.50
不管是上下文、价格还是分档推理控制,grok-4.3 都更适合做新的主力迁移目标。
什么时候该迁到 grok-4.20-non-reasoning
xAI 官方退役页给出的建议也很明确:
- 如果你在用
grok-4-1-fast-non-reasoning或grok-4-fast-non-reasoning - 推荐迁到
grok-4.20-non-reasoning
这条路线更适合:
- 非推理问答
- 强低延迟要求
- 批量轻任务
- 你明确不想付 reasoning token 成本的场景
如果你的负载并没有那么极端追低延迟,官方也建议你考虑用 grok-4.3 配 reasoning_effort: low。
这其实给了团队一个很好的分层方式:
- 低延迟纯吞吐层:
grok-4.20-non-reasoning - 统一主力层:
grok-4.3
这次迁移不只是改模型名
很多团队会把迁移理解成只改一行:
{
"model": "grok-4.3"
}
但 xAI 文档其实提醒了更多事。
1. 推理参数要重看
xAI Reasoning 文档明确写到:
grok-4.3支持reasoning_effort- 可选值:
none、low、medium、high - 默认值是
low
如果你过去靠不同“fast / non-fast / reasoning / non-reasoning”模型名来分层,现在更合理的做法是把分层逻辑写进参数和路由策略里。
2. 旧 endpoint 和旧兼容习惯也该一起检查
xAI Migrating to New Models 文档建议同时确认:
- 你是否仍在用旧 endpoint
- 你是否仍在依赖已经不再推荐的 legacy 兼容方式
- 你的 prompt、请求参数和工具调用是否适配新模型
这意味着这次迁移更像一次小规模 API 清理,而不是单纯字符串替换。
3. 成本模型要重算
如果你之前在用:
grok-4-0709:高输入 / 输出单价,256K contextgrok-4-fast-non-reasoning:更低成本,但能力更窄
那迁到 grok-4.3 后,你应该重新评估:
- 默认层是否统一成一个模型
- 哪些请求开
none - 哪些请求开
low - 哪些请求真的需要
medium / high
这样才算把这次迁移做完整。
普通开发者、Agent 团队、站长分别该怎么做
1. 普通开发者
如果你只是偶尔调 xAI API,先做两件事:
- 搜一遍仓库里是否还写着
grok-4-0709或grok-3 - 迁到
grok-4.3后重跑关键 prompt
2. Agent 团队
更合理的做法是分层:
- 默认推理和代码层:
grok-4.3 - 强低延迟非推理层:
grok-4.20-non-reasoning
同时检查工具调用、超时、reasoning_effort 和缓存收益。
3. 站长与内容团队
如果你在用 xAI 做:
- 搜索增强问答
- 热点追踪
- 代码脚本
- 多文档摘要
那么这次更值得你关注的是“是否可以把默认层统一、把成本压平”,而不是只盯着 Grok 4 旧 benchmark。
和站内哪些页面应该一起看
如果你想把 xAI 这条线看完整,建议把这篇和下面几页一起看:
这样你看到的就不只是“xAI 要退役旧模型”,还包括它在搜索、研究和工具调用路线里的位置。
质量门槛判断
如果一篇 Grok 文章只会重复“Grok 4 benchmark 很强”,它通常低于官方迁移文档的价值。
真正值得发布的页面,至少要回答:
- 退役的绝对时间是什么,换到中国时区后是什么时间?
- 哪些工作负载迁
grok-4.3,哪些迁grok-4.20-non-reasoning? grok-4.3为什么比旧grok-4-0709更适合做统一主力层?- 迁移时除了改模型名,还要检查哪些参数和 endpoint?
常见问题
我现在还在用 grok-4-0709,需要马上迁吗?
需要。xAI 官方已经写明它会在 2026-05-15 12:00pm PT 退役。对中国团队来说,对应的是 2026-05-16 03:00,窗口已经很近。
我做代码和推理任务,迁到哪个最稳?
官方建议直接迁到 grok-4.3。它更适合推理、代码和代理任务,而且上下文和价格都比旧 grok-4-0709 更友好。
我只做低延迟、非推理请求怎么办?
优先看 grok-4.20-non-reasoning。如果你的场景不是极致低延迟,也可以试 grok-4.3 + reasoning_effort=low。
这篇文章的首图来源是什么?
首图为本站根据 xAI 官方退役页、模型页和定价页公开信息自制的信息图,文件为 /article-images/grok-4-3-migration-guide-2026-05-14.svg,未使用受限版权截图或第三方图库素材。
资料来源
- xAI Docs:Grok Model Retirement on May 15, 2026
- xAI Docs:grok-4.3
- xAI Docs:Pricing
- xAI Docs:Migrating to New Models
- xAI Docs:Reasoning
- TechCrunch:Elon Musk's xAI launches Grok 4 alongside a $300 monthly subscription