Skip to main content
GPT-6 Astra 是 OpenAI 面向复杂推理、编码、研究、计算机操作和文档创建的 GPT-6 旗舰模型。使用模型 ID gpt-6-astra,通过 OpenAI 兼容的 Responses API POST /v1/responses 调用。
gpt-6-astra 同时支持 POST /v1/responsesPOST /v1/chat/completions。工具调用、图片和文件输入、结构化输出及提示词缓存请使用 Responses API。

模型规格

核心能力

  • 长上下文推理 — 在 105 万 Token 上下文窗口中分析大型代码库、文档和多步骤工作流。
  • 软件工程 — 跨文件、工具和验证步骤规划并执行长周期编码任务。
  • 图片理解 — 将图片和文本指令一起传入模型。
  • 结构化输出 — 按指定 Schema 返回 JSON。
  • 提示词缓存prompt_cache_keyprompt_cache_options 支持 30m 缓存时长,并返回缓存写入与命中 Token 数。
  • Responses API 工具 — AnyFast 支持网页搜索、代码解释器、Hosted Shell、Apply Patch、Computer Use、MCP、Function 和 Custom Tool。
  • 异步工具调用 — Function 和 Custom Tool 支持 async: true,并返回相应工具调用项。

能力示例

使用 reasoning.effort 在延迟和推理深度之间进行选择。GPT-6 Astra 支持 lowmediumhighxhighmax
cURL

推理配置

GPT-6 Astra 不支持 noneminimal,也不支持 temperaturetop_ptop_logprobs。使用 Chat Completions 时也不要传入 logprobs

接口说明

  • 工具调用请使用 Responses API。
  • 显式配置提示词缓存时,请使用 prompt_cache_options.ttl,不要使用旧的 prompt_cache_retention 字段。
  • 如需无状态传递加密推理项,请同时使用 include: ["reasoning.encrypted_content"]store: false
  • 使用 max_tool_calls 限制内置工具调用总数,使用 parallel_tool_calls 控制并行 Function 调用。
  • 公开图片 URL 必须允许服务端下载;如果远端主机阻止自动访问,可改用 Data URL。
  • 支持图片输入,不支持音频和视频输入。
AnyFast 当前不提供 Responses 查询、Conversations 或 Vector Stores 管理端点。请勿依赖 backgroundconversationprevious_response_id、已保存提示词引用或 configuration_update。跨请求引用输出项时,也可能因请求被路由到不同上游资源而失败。

核心参数

API 参考

查看 GPT-6 Astra Responses API 参考。

官方参考