UnioAPI 文档
API 参考

POST /v1/responses

OpenAI-compatible Responses 主操作,含直传与桥接边界。

请求

curl https://api.unioapi.com/v1/responses \
  -H "Authorization: Bearer $UNIO_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "gpt-5.6-sol",
    "input": "Hello",
    "stream": false
  }'

service_tier 档位规则与 Chat Completions 相同。

直传与桥接

平台按候选能力自动选择两条路径之一,对调用方透明:

路径行为
原生直传保留原始 Responses JSON 与命名 SSE,仅恢复 Unio 模型标识回显
Responses-to-Chat 桥接合成 Chat 能表达的字段子集、token usage 与最小事件族

桥接路径上无法安全降级的字段可能被丢弃;multi_agent 在桥接候选上明确拒绝。 对字段完整性敏感的调用建议先在目标模型上验证。

明确不支持的能力

能力行为
background: true稳定返回 400,错误码 unsupported_background
服务端状态操作(查询、删除、输入项、取消)稳定返回 501,错误码 unsupported_origin_stateless
service_tier 取值 flex / batch返回 400(Flex processing 与 Batch API 不在服务范围)

辅助端点

POST /v1/responses/compact

上下文压缩。原生路径回传上游成功 JSON 并仅改写顶层模型回显;摘要降级路径只返回 output 数组(0 或 1 个 assistant message)。两者均非 SSE。

POST /v1/responses/input_tokens

本地输入 token 估算:按候选计划选择 tokenizer 在本地计算,不调用上游、不产生计费、 不创建请求记录。结果为近似值,不承诺与任一上游 tokenizer 或最终结算 usage 一致。

流式

原生直传转发上游命名 SSE,桥接合成最小事件族并保证 sequence_number 单调递增; 两者都不追加 [DONE]。详见流式调用。

本页目录