Skip to main content
GPT-6 Astra 使用 Responses API 处理文本、图片和文件输入、结构化输出及工具工作流。请切换到对应能力查看请求格式。
gpt-6-astra 也可通过 POST /v1/chat/completions 处理文本请求。推理控制、工具、图片和文件输入、结构化输出、流式传输及提示词缓存请使用本 Responses API 参考。

创建响应

POST /v1/responses
cURL

请求头

string
必填
Bearer 鉴权,格式为 Bearer YOUR_API_KEY
string
默认值:"application/json"
必填
数据交换格式。

请求体

string
必填
AnyFast 模型 ID,固定为 gpt-6-astra
string | object[]
必填
文本,或由消息、图片、文件和工具结果组成的有序列表。
string
插入模型上下文的 System 或 Developer 指令。
object
推理配置。
string
lowmediumhighxhighmax。不支持 noneminimal
string
autoconcisedetailed
string
autocurrent_turnall_turns
string
使用 standard。当前 AnyFast 路由未开放 GPT-6 Astra Pro 模式。
integer
可见输出和推理 Token 的总上限,最大为 128000
string
lowmediumhigh
string[]
附加响应数据。使用 reasoning.encrypted_content 返回加密推理项。不要使用 message.output_text.logprobs
string
改善相关请求缓存匹配的稳定键。
object
提示词缓存选项。mode 选择隐式或显式断点;ttl 当前支持 30mcomparison_response_id 用于请求比较诊断。
string
implicitexplicit
string
默认值:"30m"
当前仅支持 30m
object
标记显式可复用提示词前缀边界。使用 { "mode": "explicit" }
object
应用定义的字符串键值元数据。
boolean
默认值:false
是否通过 SSE 流式返回响应事件。
boolean
控制流式事件混淆。
boolean
默认值:true
控制上游是否保存响应。AnyFast 不提供响应查询端点。
string
默认值:"disabled"
当前 AnyFast 路由使用 disabled
不要传入 temperaturetop_ptop_logprobs。GPT-6 Astra 的 include 也不支持 message.output_text.logprobs
AnyFast 不提供 Responses 查询、Conversations 或 Vector Stores 管理端点。请勿使用 backgroundconversationprevious_response_id、已保存提示词引用或 configuration_update

响应

200
string
响应 ID。
string
固定为 response
string
queuedin_progresscompletedincompletefailedcancelled
object[]
按顺序返回的推理、消息和工具调用输出项。
string
可用时聚合返回文本输出。
object
输入、输出、缓存写入、缓存命中和推理 Token 用量。
object | null
响应未完整结束的原因。
object | null
响应失败时的错误信息。

常见错误

error
输入无效、推理或采样参数不受支持、状态字段冲突,或工具/Schema 配置无效。
error
API Key 缺失或无效。
error
达到速率或额度限制。

官方参考