Grok 4.5 于 2026 年 7 月 16 日发布,专业定位非常明确:编程、智能体任务、工程以及知识工作。对开发者来说,重要变化不只是模型能力更强。这次发布将 500,000 token 的上下文窗口、图像输入、可配置推理、函数调用、结构化输出,以及专为长时间技术工作设计的 API 结合在了一起。
实际访问方式分为两部分。开发者现在可以通过 xAI 直接使用官方 grok-4.5 API。想在浏览器中探索相关 Grok 对话的读者可以使用 Chat4O AI,不过 Chat4O 目前还没有经过验证的 Grok 4.5 模型页面或选择器。

Grok 4.5 发布特性:有哪些变化,哪些已被确认
Grok 4.5 是已正式发布的生产模型,而不是预览版。xAI 官方公告确认 2026 年 7 月 16 日为上线日期,并将该模型描述为 xAI 在编程、智能体工作和专业知识任务方面最强的选择。官方 API 标识符是 grok-4.5。
该模型已验证的规格让这一定位更加具体:
| Grok 4.5 规格 | 官方文档值 |
|---|---|
| 输入 | 文本和图像 |
| 输出 | 文本 |
| 上下文窗口 | 500,000 tokens |
| 推理强度 | low、medium 或 high;默认是 high |
| 核心能力 | 推理、函数调用和结构化输出 |
| 主要 API | Responses API 和 Chat Completions |
| 模型 ID | grok-4.5 |
| 当前别名 | grok-4.5-latest 和 grok-build-latest |
当任务包含大型代码仓库、大量技术文档或很长的交互历史时,上下文窗口最有价值。但这并不保证模型能在提示词的任意位置都完美检索信息,因此团队仍然应该在真实的上下文规模下测试模型查找需求、代码引用和矛盾证据的准确性。
图像输入让该模型的能力超越了纯文本编程。开发者可以把 bug 报告和界面截图结合起来,把示意图和实现说明结合起来,或者把图表和结构化分析请求结合起来。输出仍然是文本,这使 Grok 4.5 更适合做分析和智能体控制,而不是直接生成图像。
xAI 公布了大量基准测试结果,但这些数字更适合被视为发布证明,而不是通用排名。该公司自己的图表显示,Grok 4.5 在某些工程评测中领先,而在另一些系统上落后。测试框架、推理设置、上下文、工具和任务选择都会影响结果。对于软件团队来说,基于真实工单和代码仓库构建的私有评估集,比单一排行榜名次更有价值。

面向编程智能体与长时工程工作的 Grok 4.5
最好把 Grok 4.5 理解为一种能够参与流程的工程模型,而不只是回答编程问题的模型。xAI 表示,其强化学习工作重点强调了多步骤软件工程和其他技术任务,而 Grok Build 则把这种模型能力转化为基于终端的编程智能体。
最强的使用场景是那些包含多个相互依赖步骤的任务:
- 在提出修改建议之前,先分析一个不熟悉的代码仓库。
- 跨多个模块追踪测试失败的原因。
- 将实现与产品规格或截图进行比较。
- 在保持外部行为不变的前提下重构子系统。
- 生成有针对性的测试,运行测试,检查失败原因,然后修订补丁。
- 在规划升级之前研究当前依赖包文档。
- 审查 pull request 的 diff 并识别高风险假设。
- 协调专门的子智能体来执行探索、实现和审查。
Grok Build 是实际的智能体化执行层。其当前功能集包括计划模式、子智能体、可复用技能、hooks、MCP 服务器、通过 AGENTS.md 定义的仓库约定、持久记忆、代码搜索、多文件编辑、Git 集成、终端执行、代码审查、沙箱执行,以及面向 CI/CD 的无头操作。Grok 4.5 是该环境中的默认模型。
这种区分有助于团队选择合适的使用界面。当你要构建自己的编排、权限、工具注册表或产品体验时,使用 Grok 4.5 API。当你想在终端中使用现成的编程智能体界面时,使用 Grok Build。当工作主要是解释、规划、头脑风暴或一次性代码审查时,使用普通浏览器聊天即可。
长时间运行的智能体循环仍然需要运维控制。限制哪些工具可以修改生产系统,对破坏性操作强制审查,隔离不受信任的代码,并记录工具调用。模型即使能力很强,仍然可能对某个仓库或命令做出错误假设。智能体获得的自主性越高,作用域受限的凭证、检查点、测试以及回滚路径就越重要。

Grok 4.5 API 定价、推理控制与集成基础
Grok 4.5 API 根据提示长度采用两档定价。根据实时的 xAI 定价文档,短上下文请求的价格为:每百万输入 token 2 美元、每百万缓存输入 token 0.30 美元、每百万输出 token 6 美元。当提示达到 200,000 token 的长上下文阈值后,列出的费率分别变为 4 美元、0.60 美元和 12 美元。
| 每 100 万 token 价格 | 低于 200K 提示 token | 达到或超过 200K 提示 token |
|---|---|---|
| 输入 | $2.00 | $4.00 |
| 缓存输入 | $0.30 | $0.60 |
| 输出 | $6.00 | $12.00 |
xAI 表示,当一个请求达到长上下文阈值时,该请求中的所有 token 都按长上下文费率计费。这意味着上下文设计本身就是一个成本决策。不要在每一轮都发送整个代码仓库;如果检索、文件选择、摘要或上下文压缩能够更高效地提供所需证据,就应该采用这些方法。
推理强度可配置为 low、medium 或 high,默认使用 high。低强度适合分类、抽取、简单转换或快速对话响应。高强度更适合复杂调试、架构决策或多步骤工程任务,但可能消耗更多时间和 token。应当在每种设置下测量可接受结果,而不是假设最大推理总是最划算。
一个基础的 Responses API 请求如下所示:
curl https://api.x.ai/v1/responses \
-H "Authorization: Bearer $XAI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "grok-4.5",
"reasoning": {"effort": "high"},
"input": "Inspect this bug description, propose the smallest safe fix, and list the tests that should prove it."
}'
对于智能体系统而言,函数调用和结构化输出比自由文本更重要。应定义范围狭窄的工具,校验参数,为机器消费型响应使用 JSON Schema,并返回模型能够恢复处理的清晰工具错误。官方文档还建议:为对话采用稳定的提示缓存路由,并在工具密集的长循环中使用上下文压缩。
生产评估应跟踪首 token 延迟、任务总耗时、提示和补全文本 token 数、缓存命中率、工具调用有效性、重试次数、JSON Schema 合规性、测试结果以及人工修正时间。最有用的指标不是孤立的“每百万 token 单价”,而是“每个被接受工作流的成本”。服务器端工具还可能增加调用费用,因此在测试网页搜索、代码执行、文件检索或其他托管工具时,也应把这些成本计算在内。

Grok 4.5 vs Grok 4.3 和 Grok 4:在 Chat4O 上该用什么
如果项目明确需要 xAI 最新的编程与智能体模型,那么 Grok 4.5 是最强选择,但这并不意味着所有早期的 Grok 工作流都已经过时。模型选择取决于使用界面、任务类型,以及实际可用的内容。
| 用户需求 | 实用起点 | 原因 |
|---|---|---|
| 官方 Grok 4.5 API 开发 | xAI API | 已验证的 grok-4.5 模型访问、定价、工具和推理控制 |
| 终端编程智能体 | Grok Build | Grok 4.5 是当前默认模型,并具备仓库与终端工具链 |
| Chat4O 上经过验证的 Grok 页面 | Chat4O Grok 4.3 | 当前在 Chat4O 上能找到的最新专用 Grok 模型页面 |
| 更广泛地探索早期模型 | Chat4O Grok 4 | 面向浏览器的推理、编程和对话使用 |
| 比较可用聊天模型 | Chat4O AI Chat | 便于测试多个已列出助手的浏览器界面 |
从概念上看,Grok 4.5 的重点已经从高级聊天转向持续性的工程执行。Grok 4 和 Grok 4.3 在推理、编程支持、长篇分析和浏览器对话方面仍然是相关的参考点。不过,来自 Chat4O 上 Grok 4.3 的回答不应被表述为 Grok 4.5 的结果,这些版本也不应被视为可互换。
在正式投入 API 集成之前,Chat4O 适合作为一个低摩擦的地方来探索相关的 Grok 工作流。开发者可以测试提示结构,比较可用模型如何解释代码,或者看看浏览器聊天是否适合研究型任务。当需求明确指定为 Grok 4.5 时,官方 xAI 访问方式是目前已验证的路径。
Chat4O 是独立的第三方平台。它的实时页面、模型选择器、订阅条款和使用限制可能会与 xAI 分开变化。截至 2026 年 7 月 23 日,无法验证专门的 Chat4O Grok 4.5 模型页面或可选的 Grok 4.5 会话。因此,最稳妥的发布表述应是“在 Chat4O 上探索相关 Grok 模型”,而不是“在 Chat4O 上使用 Grok 4.5”。
要做出诚实的比较,应使用相同任务和相同源材料进行测试,并对事实正确性、代码质量、指令遵循、结构化输出有效性、延迟和修订工作量进行评分。这样才能看出切换模型是否真正改善了重要工作流,而不是仅仅换了一个模型名称。

Grok 4.5 常见问题与最终建议
Grok 4.5 是什么时候发布的?
xAI 于 2026 年 7 月 16 日发布了 Grok 4.5。官方公告和开发者文档说明,它可通过 xAI API、Grok Build 以及其他列出的集成方式使用。
Grok 4.5 API 的模型 ID 是什么?
官方模型 ID 是 grok-4.5。xAI 还记录了 grok-4.5-latest 和 grok-build-latest 这两个别名,但生产团队在依赖它们进行可复现评估之前,应先验证别名行为。
Grok 4.5 支持图像吗?
支持。官方模型页面列出其输入为文本和图像,输出为文本。这支持对截图、示意图、图表和文档图像进行分析,但并不意味着模型会直接返回生成的图像。
Grok 4.5 API 费用是多少?
在 200,000 个提示 token 以下,公开价格为每百万输入 token 2 美元、每百万缓存输入 token 0.30 美元,以及每百万输出 token 6 美元。达到或超过该阈值后,对应的长上下文价格分别为 4 美元、0.60 美元和 12 美元。
Grok 4.5 可以在 Chat4O 上使用吗?
本次评测未能验证 Chat4O 上有专门的 Grok 4.5 页面或实时选择器。Chat4O 目前提供 Grok 4.3 和 Grok 4 的索引页面,它们适合做相关的浏览器测试,但不能替代经过验证的 Grok 4.5 访问方式。
开发者应该切换到 Grok 4.5 吗?
构建编程智能体、仓库级分析、多模态工程工具或长时间知识工作流的团队应该测试它。只有当受控试验表明,与当前模型相比,它能带来更高的任务接受率、更低的审查工作量,或更优的完成成本比时,切换才有意义。
最终建议
对于基于 API 的编程、智能体工作流和高要求工程任务,Grok 4.5 是 xAI 目前最明确的选择。当应用明确要求 Grok 4.5 时,请使用官方 API;当目标产品形态是终端编程智能体时,请使用 Grok Build。
对于浏览器中的探索,Chat4O Grok 4.3 是目前最新且已验证的专用 Grok 页面,而 Chat4O AI Chat 则是更灵活的比较起点。发布前请再次检查实时模型选择器,因为后续可能会出现专门的 Grok 4.5 选项。
相关阅读
- 在 Chat4O 上了解 Grok 4 AI
- Grok 4 vs GPT-5:哪种 AI 更适合你的工作流?
- 2026 年的 Grok Imagine:xAI 新闻以及在哪里试用 Grok
- Introducing Grok 4.5
- Grok 4.5 developer overview



