gpt-6-astra,通过 OpenAI 兼容的 Responses API POST /v1/responses 调用。
gpt-6-astra 同时支持 POST /v1/responses 和 POST /v1/chat/completions。工具调用、图片和文件输入、结构化输出及提示词缓存请使用 Responses API。模型规格
核心能力
- 长上下文推理 — 在 105 万 Token 上下文窗口中分析大型代码库、文档和多步骤工作流。
- 软件工程 — 跨文件、工具和验证步骤规划并执行长周期编码任务。
- 图片理解 — 将图片和文本指令一起传入模型。
- 结构化输出 — 按指定 Schema 返回 JSON。
- 提示词缓存 —
prompt_cache_key和prompt_cache_options支持30m缓存时长,并返回缓存写入与命中 Token 数。 - Responses API 工具 — AnyFast 支持网页搜索、代码解释器、Hosted Shell、Apply Patch、Computer Use、MCP、Function 和 Custom Tool。
- 异步工具调用 — Function 和 Custom Tool 支持
async: true,并返回相应工具调用项。
能力示例
- 文本与推理
- 图片和文件输入
- 结构化输出
- 工具工作流
使用
reasoning.effort 在延迟和推理深度之间进行选择。GPT-6 Astra 支持 low、medium、high、xhigh 和 max。cURL
推理配置
接口说明
- 工具调用请使用 Responses API。
- 显式配置提示词缓存时,请使用
prompt_cache_options.ttl,不要使用旧的prompt_cache_retention字段。 - 如需无状态传递加密推理项,请同时使用
include: ["reasoning.encrypted_content"]和store: false。 - 使用
max_tool_calls限制内置工具调用总数,使用parallel_tool_calls控制并行 Function 调用。 - 公开图片 URL 必须允许服务端下载;如果远端主机阻止自动访问,可改用 Data URL。
- 支持图片输入,不支持音频和视频输入。
核心参数
API 参考
查看 GPT-6 Astra Responses API 参考。