接口端点
POSThttps://sub2api.ruilinlu.com/v1/chat/completions
请求参数
array
required
对话消息数组,按时间顺序排列。每条消息包含以下字段:
role: 消息角色,可选system、user、assistant、toolcontent: 消息内容(字符串)
number
default:"1"
采样温度,控制输出的随机性。取值范围 0 到 2,值越高输出越随机。建议根据任务类型调整,代码生成推荐 0.2,创意写作推荐 0.8 以上。
integer
生成内容的最大 Token 数量限制。实际可用上限取决于所选模型。
number
default:"1"
核采样参数。与 temperature 一起使用时建议只调整其中一个。
完整请求示例
以下是一个多轮对话的完整 cURL 请求:响应结构
响应字段
string
本次请求的唯一标识符。
string
对象类型,固定为
chat.completion。array
生成的回复列表。通常只包含一个元素,包含:
message: 包含role和content的完整消息对象finish_reason: 生成结束原因,如stop、length、content_filter
integer
输入提示消耗的 Token 数量。
integer
模型生成的 Token 数量。
流式输出
如需使用流式输出,将stream 设为 true。API 将返回 SSE 数据流,逐块(chunk)返回生成内容。
相关接口
- Responses API - OpenAI 新一代有状态 API
- Anthropic Messages API - Anthropic 原生格式接口
- 流式输出 - SSE 流式输出详细指南

