Appearance
参数说明
参数说明
Novalink 兼容 OpenAI Chat Completions API 参数规范,以下是常用参数说明。
请求参数
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
model | string | 是 | 模型名称,如 hy3、claude-sonnet-5 |
messages | array | 是 | 对话消息数组,每条包含 role 和 content |
temperature | number | 否 | 采样温度 (0-2)。越高越随机。推荐 0.7 |
top_p | number | 否 | 核采样参数 (0-1)。推荐 0.9 |
max_tokens | integer | 否 | 最大输出 Token 数 |
stream | boolean | 否 | 是否流式输出。默认 false |
thinking | object | 否 | DeepSeek/Claude 推理模式配置 |
reasoning_effort | string | 否 | 推理强度:low / medium / high |
Message 格式
| role | 说明 |
|---|---|
system | 系统提示词,定义 AI 角色和行为 |
user | 用户消息 |
assistant | AI 回复(用于多轮对话) |
DeepSeek 推理模式
使用 DeepSeek V4 系列模型时,可以通过 thinking 参数开启深度推理:
{
"model": "deepseek-v4-pro",
"messages": [{"role": "user", "content": "证明费马大定理"}],
"thinking": {"type": "enabled"},
"reasoning_effort": "high"
}响应格式
提示
非流式响应:返回完整的 JSON,包含 choices[0].message.content 和 usage 信息。
提示
流式响应:Server-Sent Events (SSE),每条 data: 行包含增量内容。最后以 data: [DONE] 结束。
推理参数(reasoning_effort)
对支持深度推理的模型,可通过 reasoning_effort 控制思考强度:
| 取值 | 含义 |
|---|---|
low | 低思考强度,响应快、费用低 |
medium | 中等思考(默认) |
high | 高强度思考,适合复杂推理/编程 |
提示
说明:DeepSeek、Claude、Qwen 等推理模型均支持该参数;设置后可同时返回 reasoning_content 字段查看思考过程。
结构化输出(JSON 模式)
通过 response_format 让模型稳定返回 JSON,便于程序解析:
client.chat.completions.create(
model="gpt-5.6-sol",
messages=[{"role":"user","content":"返回JSON"}],
response_format={"type":"json_object"}
)提示词缓存
Claude 系列模型支持提示词缓存:对重复使用的长前缀(如系统提示词),命中缓存后费用大幅降低(约 1/10),响应也更快。
提示
用法:无需额外配置,同一会话内重复的长前缀自动命中缓存,在响应的 usage 中可看到 cache_read 字段。
