xAI 具体型号指南

Grok 4.6 API

xAI 旗舰模型,面向编码、Agent 任务、知识工作、长流程工具调用与视觉交互。

核心规格规格复核于 2026 年 9 月 1 日
官方模型 IDgrok-4.6
上下文 / 最大输出500K / No published text-output cap
厂商输入 / 输出每百万 Token$2 input / $6 output
推理控制low · medium · high · xhigh
选型结论Grok 4.6 适合长流程工具任务,但必须管理搜索来源与上下文增长。
优先考虑

多文件编码、网页与 X 搜索研究、长资料分析和代码执行工作流。

不建议

依赖 Batch API、无限累积对话历史,或不需要搜索与工具的简单高频任务。

02

按决策阅读

01
任务定位

什么时候选择 Grok 4.6

Grok 4.6 的差异点是把长上下文、可配置推理、搜索和代码执行放在同一模型中。适合需要连续操作与新鲜外部信息的任务,而不是所有普通聊天请求。

  • 多文件编码、调试与仓库分析。
  • 结合网页搜索与 X 搜索的研究 Agent。
  • 跨大量资料的长篇知识工作。
  • 使用代码执行与函数调用的多步骤流程。
02
200K 阈值

标准上下文与长上下文价格分界

输入规模价格规则建议
≤ 200K标准厂商价格仍应筛选输入并测缓存
> 200K更高长上下文价格先压缩历史、检索相关片段
长 Agent 循环费用随重发历史增长使用缓存亲和与上下文压缩
03
来源策略

Web Search、X Search 和无搜索怎么选

模式适用问题风险控制
Web Search当前网页事实、公开资料保存来源并检查日期
X SearchX 平台实时讨论与信号区分观点、传闻与事实
不启用搜索稳定知识、私有上下文不要暗示结果包含最新信息
04
状态管理

长流程 Agent 的上下文设计

  • 保留任务状态、关键决策与未完成动作,不保留所有原始日志。
  • 将稳定提示词与动态对话分开,以便测试缓存。
  • 工具结果过长时抽取结论和可追溯引用。
  • 对每轮工具调用设置上限、超时与终止条件。
05
API 协议

Responses 与 Chat Completions 的接入选择

xAI 公开 Responses 与 Chat Completions 接口。选择应用真正需要并且 LLMFly AI 路由开放的协议,不要假设两者的工具字段完全相同。

request.example可复制示例
curl https://app.llmfly.ai/v1/chat/completions \
  -H "Authorization: Bearer $LLMFLY_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "grok-4.6",
    "messages": [{"role": "user", "content": "Summarize the tradeoffs in three bullets."}],
    "stream": false
  }'
06
生产检查

搜索与工具上线前验证

  • 分别验证无工具、Web Search、X Search、代码执行和函数调用。
  • 记录来源、工具错误、循环次数和完整任务成本。
  • 验证不支持的旧采样字段和图片预处理。
  • 准备工具不可用时的降级回答与停止条件。
07
限制

Grok 4.6 的限制与不适用场景

  • 超过厂商公布的 200K 长上下文阈值后,请求适用更高价格。
  • 新鲜互联网或 X 信息必须启用对应搜索工具。
  • Grok 4.6 未公开支持 Batch API。
  • 上线前应验证图片预处理、不支持的旧采样字段以及路由特有工具行为。
08
资料边界

Grok 4.6 规格来源与使用说明

规格、工具与上下文价格说明核对自 xAI Grok 4.6 documentation:https://docs.x.ai/developers/models/grok-4.6。实际 Endpoint、搜索工具和费率请以 LLMFly AI 模型广场为准。

常见问题

Grok 4.6 的上下文窗口多大?

厂商公开 500K 上下文;输入超过 200K 时要注意更高的长上下文价格。

什么时候使用 Web Search,什么时候使用 X Search?

网页事实和正式资料优先 Web Search;需要 X 平台实时讨论时使用 X Search,并把观点与已核实事实分开。

Grok 4.6 支持 Batch API 吗?

当前厂商页面未公开该型号支持 Batch API,不应在验证前依赖。

长 Agent 如何避免成本持续增长?

使用缓存亲和、上下文压缩、工具结果摘要和明确的循环上限。

LLMFly AI 会开放所有 xAI 工具吗?

不一定。请在模型广场确认路由与 Endpoint,并逐项发送测试请求。

用真实任务测试 Grok 4.6

获取 API Key,确认当前路由,再从一个小型代表性请求开始。

获取 API Key