gpt-6-astra 也可通过 POST /v1/chat/completions 处理文本请求。推理控制、工具、图片和文件输入、结构化输出、流式传输及提示词缓存请使用本 Responses API 参考。- 文本与推理
- 图片和文件输入
- 结构化输出
- 工具工作流
- Chat Completions
创建响应
POST /v1/responsescURL
请求头
string
必填
Bearer 鉴权,格式为
Bearer YOUR_API_KEY。string
默认值:"application/json"
必填
数据交换格式。
请求体
string
必填
AnyFast 模型 ID,固定为
gpt-6-astra。string | object[]
必填
文本,或由消息、图片、文件和工具结果组成的有序列表。
string
插入模型上下文的 System 或 Developer 指令。
object
推理配置。
string
low、medium、high、xhigh 或 max。不支持 none 和 minimal。string
auto、concise 或 detailed。string
auto、current_turn 或 all_turns。string
使用
standard。当前 AnyFast 路由未开放 GPT-6 Astra Pro 模式。integer
可见输出和推理 Token 的总上限,最大为
128000。string
low、medium 或 high。string[]
附加响应数据。使用
reasoning.encrypted_content 返回加密推理项。不要使用 message.output_text.logprobs。string
改善相关请求缓存匹配的稳定键。
object
提示词缓存选项。
mode 选择隐式或显式断点;ttl 当前支持 30m;comparison_response_id 用于请求比较诊断。string
implicit 或 explicit。string
默认值:"30m"
当前仅支持
30m。object
标记显式可复用提示词前缀边界。使用
{ "mode": "explicit" }。object
应用定义的字符串键值元数据。
boolean
默认值:false
是否通过 SSE 流式返回响应事件。
boolean
控制流式事件混淆。
boolean
默认值:true
控制上游是否保存响应。AnyFast 不提供响应查询端点。
string
默认值:"disabled"
当前 AnyFast 路由使用
disabled。响应
200
string
响应 ID。
string
固定为
response。string
queued、in_progress、completed、incomplete、failed 或 cancelled。object[]
按顺序返回的推理、消息和工具调用输出项。
string
可用时聚合返回文本输出。
object
输入、输出、缓存写入、缓存命中和推理 Token 用量。
object | null
响应未完整结束的原因。
object | null
响应失败时的错误信息。
常见错误
error
输入无效、推理或采样参数不受支持、状态字段冲突,或工具/Schema 配置无效。
error
API Key 缺失或无效。
error
达到速率或额度限制。