Skip to main content
Sub2API 完整兼容 OpenAI Chat Completions API 格式。你可以直接将现有的 OpenAI SDK 客户端指向 Sub2API 的 base URL,无需修改其他代码即可调用各种 LLM 模型。该接口支持多轮对话上下文、流式输出、Function Calling 等完整功能。

接口端点

POST https://sub2api.ruilinlu.com/v1/chat/completions

请求参数

string
required
模型名称标识符,例如 gpt-4oclaude-3-5-sonnet 等。具体可用模型请参考 模型列表
array
required
对话消息数组,按时间顺序排列。每条消息包含以下字段:
  • role: 消息角色,可选 systemuserassistanttool
  • content: 消息内容(字符串)
boolean
default:"false"
是否启用流式输出。设为 true 时,API 将使用 SSE (Server-Sent Events) 逐字返回内容。详情参考 流式输出文档
number
default:"1"
采样温度,控制输出的随机性。取值范围 0 到 2,值越高输出越随机。建议根据任务类型调整,代码生成推荐 0.2,创意写作推荐 0.8 以上。
integer
生成内容的最大 Token 数量限制。实际可用上限取决于所选模型。
number
default:"1"
核采样参数。与 temperature 一起使用时建议只调整其中一个。

完整请求示例

以下是一个多轮对话的完整 cURL 请求:

响应结构

响应字段

string
本次请求的唯一标识符。
string
对象类型,固定为 chat.completion
array
生成的回复列表。通常只包含一个元素,包含:
  • message: 包含 rolecontent 的完整消息对象
  • finish_reason: 生成结束原因,如 stoplengthcontent_filter
integer
输入提示消耗的 Token 数量。
integer
模型生成的 Token 数量。

流式输出

如需使用流式输出,将 stream 设为 true。API 将返回 SSE 数据流,逐块(chunk)返回生成内容。
详细流式输出用法请参考 流式输出文档

相关接口