Chat Completions 文本接口
接口地址:POST https://api.baiyun.si/v1/chat/completions。
当前提供 Chat 形式的纯文本对话,可用于明确支持 OpenAI 兼容 Chat 协议的客户端。请求要使用本站密钥,并提交本次对话需要的完整文本上下文。
请求结构
{
"model": "gpt-6-luna",
"messages": [
{"role": "system", "content": "用简洁的中文回答。"},
{"role": "user", "content": "请解释什么是 Token。"}
],
"stream": false
}model 是本站实际开放的模型名称;messages 是按顺序提交的文本消息;stream 决定同步返回或流式返回。本文只展示已开放的基础文本结构,复杂 SDK 参数及扩展功能不应默认可用。
同步调用
curl --fail-with-body https://api.baiyun.si/v1/chat/completions \
-H "Authorization: Bearer $BAIYUN_API_KEY" \
-H 'Content-Type: application/json' \
-d '{"model":"gpt-6-luna","messages":[{"role":"user","content":"用一句话解释 Token。"}],"stream":false}'生成文本位于 choices[].message.content;用量信息位于 usage。具体内容、Token 数和费用以本次实际响应及消费记录为准。
流式调用
curl --no-buffer --fail-with-body https://api.baiyun.si/v1/chat/completions \
-H "Authorization: Bearer $BAIYUN_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model":"gpt-6-luna",
"messages":[{"role":"user","content":"用三句话介绍 Token。"}],
"stream":true,
"stream_options":{"include_usage":true}
}'流式返回采用 SSE:读取 data: 中的 JSON,按顺序拼接 choices[].delta.content。data: [DONE] 表示该流结束;启用 include_usage 后需保留末尾用量消息。不要将 SSE 的每一个分片视为独立 HTTP 响应。
对话上下文与参数边界
当前通道使用模型默认采样。temperature、top_p、frequency_penalty 和 presence_penalty 暂不提供可调控制;客户端常见的默认值会由兼容处理移除,不会改变模型的采样设置。
多轮对话应在 messages 中提交必要的完整文本历史。当前暂停外部工具、联网、图片及文件等功能,也不提供通过不可检查的外部历史绕过文本提交的方式。
某些模型或客户端对输出参数的支持不同。即使请求填写 max_tokens、max_completion_tokens 或 8192 等数值,也不能把它当作本站已经保证的输出长度或费用硬上限。请从简短请求开始,核对消费记录,并为密钥设置适合自己的余额限制。
同一凭据最多同时进行 2 个请求;模型调用还受频率限制。遇到 429 先等待,按错误说明判断原因,避免高频循环重试。