Responses 文本接口
接口地址:POST https://api.baiyun.si/v1/responses。
适合明确支持 Responses 协议的应用。当前可使用同步和 SSE 流式文本请求;完整接口的工具、文件、图像等扩展功能暂未开放。
同步文本请求
curl --fail-with-body https://api.baiyun.si/v1/responses \
-H "Authorization: Bearer $BAIYUN_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model":"gpt-6-luna",
"input":"请用一句话介绍你能帮我做什么。",
"stream":false
}'响应中的 output 数组包含输出项。读取消息项 content 中 type 为 output_text 的 text 字段,并保留 usage 用量信息。不要假设原始 REST JSON 一定存在 SDK 提供的便利字段 output_text。
SSE 流式请求
curl --no-buffer --fail-with-body https://api.baiyun.si/v1/responses \
-H "Authorization: Bearer $BAIYUN_API_KEY" \
-H 'Content-Type: application/json' \
-d '{"model":"gpt-6-luna","input":"请写两句普通的问候语。","stream":true}'按 SSE 事件类型解析:response.output_text.delta 提供文本增量;完整结束时应收到 response.completed。流未完成、出现失败事件或网络中断时,不应把已经显示的部分内容当成完整响应。
提交完整文本历史
{
"model": "gpt-6-luna",
"instructions": "用中文简短回答。",
"input": [
{"role": "user", "content": "什么是 Token?"},
{"role": "assistant", "content": "Token 是模型处理文本时使用的计量单位。"},
{"role": "user", "content": "它与字数完全相同吗?"}
],
"stream": false
}当前应把必要上下文以文本随本次请求提交。引用上游会话的 previous_response_id、外部历史、工具调用或不可检查的媒体载荷暂不开放。
使用前核对
- 先通过带 Bearer 鉴权的
/v1/models核对实际模型名称。 - 当前仅开放文本模式,不支持任意 Responses 扩展字段或 SDK 自动附加的工具功能。
max_output_tokens等参数不是已保证的输出或费用硬上限;按实际用量和消费记录核对费用。- 每凭据最多 2 个并发请求;遇限流先等待,避免自动无限重试。