Chat Completions
发送 messages,处理文本与流式返回。
Chat Completions 使用 messages 数组描述对话,适合大多数支持 OpenAI 兼容格式的聊天应用。
非流式请求
bash
curl --fail-with-body https://weason.cn/v1/chat/completions \
-H "Authorization: Bearer $WEASON_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6.1-sol",
"messages": [
{"role": "user", "content": "解释一下输入 token 和输出 token。"}
],
"stream": false
}'
将模型替换成你的 Key 可用 ID。非流式文本一般从 choices[0].message.content 读取;工具调用返回可能位于其他字段,需要客户端单独处理。
连续对话
下一次请求需要带上希望模型看到的历史消息:
json
{
"model": "gpt-6.1-sol",
"messages": [
{"role": "user", "content": "什么是 API?"},
{"role": "assistant", "content": "API 是应用之间交换数据和功能的接口。"},
{"role": "user", "content": "请给一个生活中的类比。"}
]
}
每次传入的历史内容会增加输入长度。应用可按业务需要摘要或裁剪旧消息,同时保留用户问题的必要上下文。
流式输出
把 stream 改为 true,并为 curl 使用 -N 可观察逐步输出。应用应按 SSE 事件边界解析,而不是把每个网络数据块当成完整 JSON。
流式响应的文本增量通常在 choices[0].delta.content。收到 HTTP 200 后仍可能发生连接中断或流内错误,应处理完成状态与异常。
参数支持
先用本页最小参数验证。temperature、max_tokens、工具调用及图片输入等参数,可能因模型而不同。400 时根据错误信息删减或修正字段,不要一次添加大量未经验证的选项。
仍有疑问?把问题告诉我们