白云超级智能 BAIYUN.SI

Chat Completions 文本接口

接口地址:POST https://api.baiyun.si/v1/chat/completions。

当前提供 Chat 形式的纯文本对话,可用于明确支持 OpenAI 兼容 Chat 协议的客户端。请求要使用本站密钥,并提交本次对话需要的完整文本上下文。

请求结构

json
{
  "model": "gpt-6-luna",
  "messages": [
    {"role": "system", "content": "用简洁的中文回答。"},
    {"role": "user", "content": "请解释什么是 Token。"}
  ],
  "stream": false
}

model 是本站实际开放的模型名称;messages 是按顺序提交的文本消息;stream 决定同步返回或流式返回。本文只展示已开放的基础文本结构,复杂 SDK 参数及扩展功能不应默认可用。

同步调用

bash
curl --fail-with-body https://api.baiyun.si/v1/chat/completions \
  -H "Authorization: Bearer $BAIYUN_API_KEY" \
  -H 'Content-Type: application/json' \
  -d '{"model":"gpt-6-luna","messages":[{"role":"user","content":"用一句话解释 Token。"}],"stream":false}'

生成文本位于 choices[].message.content;用量信息位于 usage。具体内容、Token 数和费用以本次实际响应及消费记录为准。

流式调用

bash
curl --no-buffer --fail-with-body https://api.baiyun.si/v1/chat/completions \
  -H "Authorization: Bearer $BAIYUN_API_KEY" \
  -H 'Content-Type: application/json' \
  -d '{
    "model":"gpt-6-luna",
    "messages":[{"role":"user","content":"用三句话介绍 Token。"}],
    "stream":true,
    "stream_options":{"include_usage":true}
  }'

流式返回采用 SSE:读取 data: 中的 JSON,按顺序拼接 choices[].delta.content。data: [DONE] 表示该流结束;启用 include_usage 后需保留末尾用量消息。不要将 SSE 的每一个分片视为独立 HTTP 响应。

对话上下文与参数边界

当前通道使用模型默认采样。temperature、top_p、frequency_penalty 和 presence_penalty 暂不提供可调控制;客户端常见的默认值会由兼容处理移除,不会改变模型的采样设置。

多轮对话应在 messages 中提交必要的完整文本历史。当前暂停外部工具、联网、图片及文件等功能,也不提供通过不可检查的外部历史绕过文本提交的方式。

某些模型或客户端对输出参数的支持不同。即使请求填写 max_tokens、max_completion_tokens 或 8192 等数值,也不能把它当作本站已经保证的输出长度或费用硬上限。请从简短请求开始,核对消费记录,并为密钥设置适合自己的余额限制。

同一凭据最多同时进行 2 个请求;模型调用还受频率限制。遇到 429 先等待,按错误说明判断原因,避免高频循环重试。