Skip to content

参数说明

参数说明

Novalink 兼容 OpenAI Chat Completions API 参数规范,以下是常用参数说明。

请求参数

参数类型必填说明
modelstring模型名称,如 hy3、claude-sonnet-5
messagesarray对话消息数组,每条包含 role 和 content
temperaturenumber采样温度 (0-2)。越高越随机。推荐 0.7
top_pnumber核采样参数 (0-1)。推荐 0.9
max_tokensinteger最大输出 Token 数
streamboolean是否流式输出。默认 false
thinkingobjectDeepSeek/Claude 推理模式配置
reasoning_effortstring推理强度:low / medium / high

Message 格式

role说明
system系统提示词,定义 AI 角色和行为
user用户消息
assistantAI 回复(用于多轮对话)

DeepSeek 推理模式

使用 DeepSeek V4 系列模型时,可以通过 thinking 参数开启深度推理:

{
  "model": "deepseek-v4-pro",
  "messages": [{"role": "user", "content": "证明费马大定理"}],
  "thinking": {"type": "enabled"},
  "reasoning_effort": "high"
}

响应格式

提示

非流式响应:返回完整的 JSON,包含 choices[0].message.contentusage 信息。

提示

流式响应:Server-Sent Events (SSE),每条 data: 行包含增量内容。最后以 data: [DONE] 结束。

推理参数(reasoning_effort)

对支持深度推理的模型,可通过 reasoning_effort 控制思考强度:

取值含义
low低思考强度,响应快、费用低
medium中等思考(默认)
high高强度思考,适合复杂推理/编程

提示

说明:DeepSeek、Claude、Qwen 等推理模型均支持该参数;设置后可同时返回 reasoning_content 字段查看思考过程。

结构化输出(JSON 模式)

通过 response_format 让模型稳定返回 JSON,便于程序解析:

client.chat.completions.create(
    model="gpt-5.6-sol",
    messages=[{"role":"user","content":"返回JSON"}],
    response_format={"type":"json_object"}
)

提示词缓存

Claude 系列模型支持提示词缓存:对重复使用的长前缀(如系统提示词),命中缓存后费用大幅降低(约 1/10),响应也更快。

提示

用法:无需额外配置,同一会话内重复的长前缀自动命中缓存,在响应的 usage 中可看到 cache_read 字段。

Novalink API 中转站