POST /v1/chat/completions 调用。模型 ID 为 grok-4.6。
xAI 上游规格给出的上下文窗口为 500,000 Token,支持文本和图片输入、文本输出。
适用场景
- 长时间运行的编程和智能体任务
- 多步骤知识工作与复杂分析
- 结合文本和图片输入的视觉理解
快速示例
图片输入
使用 OpenAI 兼容的多模态消息格式传入图片 URL:推理行为
通过顶层reasoning_effort 字段控制推理强度:
核心请求字段
响应与流式输出
非流式请求的最终答案位于choices[0].message.content。流式请求需要依次拼接 SSE 返回的文本增量。
usage.completion_tokens_details.reasoning_tokens 会返回推理 Token 数量。这部分 Token 会计入 usage.total_tokens,最终回答仍位于 choices[0].message.content。
本页仅说明 AnyFast Chat Completions 核心接口。xAI 原生 Responses API 的服务端网页搜索、X 搜索、代码执行、会话存储和加密推理等能力,不代表可通过此端点使用。
API 参考
查看 Grok 4.6 的请求与响应结构。