通过 OpenAI 兼容接口调用大模型,支持流式输出。以下为完整请求格式示例。
01 接口地址
请求方式
POST
接口 URL
https://ai.vthree.cn/v1/chat/completions
02 请求头 Headers
| 参数 | 说明 |
| Authorization | Bearer sk-live-你的APIKey |
| Content-Type | application/json |
03 请求体 Body
| 字段 | 类型 | 说明 |
| model | string | 模型名,见下方「模型说明」 |
| messages | array | 对话消息数组,含 role 与 content |
| stream | bool | 是否流式输出(true 时实时吐字) |
| temperature | float | 采样温度,0~2,默认 0.7 |
| max_tokens | int | 本次回复最大 token 数,默认 2048 |
| persona | string | 可选。预设人设/角色设定,传值将覆盖该用户的人设(优先级:接口 persona 参数 > 开放平台设置 > 平台内置默认)。留空或省略时,使用开放平台设置的人设;若两者都未设置,则使用平台内置默认人设。注意:人设内容请勿在公开前端展示。 |
示例
{
"model": "V4-2.0-fast",
"messages": [
{"role": "system", "content": "你是一个温柔体贴的虚拟恋人……"},
{"role": "user", "content": "你好呀"}
],
"stream": false,
"temperature": 0.7,
"max_tokens": 2048,
"persona": "你是V4,一个活泼的虚拟助手……"
}
04 模型说明
| 模型名 | 消耗额度 | 说明 |
| V4-2.0-fast | 1 次/次对话(约 2000 token) | 快速响应 |
| V4-2.0-pro | 3 次/次对话 | 更强推理 |
05 cURL 调用示例
curl -X POST https://ai.vthree.cn/v1/chat/completions \
-H "Authorization: Bearer sk-live-你的APIKey" \
-H "Content-Type: application/json" \
-d '{
"model": "V4-2.0-fast",
"messages": [{"role":"user","content":"你好"}],
"stream": false,
"persona": "你是V4,一个活泼的虚拟助手……"
}'