文档目录

Parameters / Model Families

模型参数

本页只解释常见重要参数和不同厂商/系列的差异,不维护固定模型清单。实际可用模型、上下文长度、输出上限、图片尺寸、音频格式和计费规则以控制台和上游官方文档为准。

通用文本参数

大多数 OpenAI 兼容文本模型都支持以下参数,但范围、默认值和是否生效会因上游而不同。遇到 400 错误时,先删除非必要采样参数,只保留 modelmessages 和输出长度限制。

参数作用常见注意点
temperature控制生成随机性和创造性。低值更稳定,高值更发散;建议不要和 top_p 同时大幅调整。
top_p核采样,限制候选 token 的累计概率范围。适合需要更细地控制候选范围的场景;很多厂商建议与 temperature 二选一。
top_k限制每步可选 token 数量。并非所有 OpenAI 兼容模型都支持;部分模型会忽略或报错。
max_tokens限制可见输出或总输出长度。推理模型可能把思考 token 也计入输出预算,过小会导致截断。
stop遇到指定字符串时停止生成。适合模板化生成;不要把常见换行或标点误设为停止符。
presence_penalty降低重复已出现内容的概率。适合鼓励新主题;不是所有上游都支持。
frequency_penalty按出现频率降低重复 token 概率。适合减少机械重复;对事实类任务不宜过高。
response_format约束输出为文本或 JSON。即使设置 JSON,也要在提示词中明确字段和格式。
stream是否通过 SSE 分片返回。长输出建议开启;排障时建议先关闭。
tools声明函数调用工具。模型和上游需要同时支持,工具参数 JSON 需严格校验。

OpenAI / GPT / 推理系列

OpenAI 兼容文本模型通常支持 temperaturetop_pmax_tokensresponse_formattoolsstream 等参数。推理系列还会引入 reasoning.effort 或类似参数,用于在速度、成本和推理深度之间取舍。

参数用途建议
reasoning.effort控制推理深度。简单问答用低档,代码、规划、复杂分析用高档;可用值随模型变化。
max_tokens / max_output_tokens限制输出预算。不同 API 面使用的字段名不同;接入前确认客户端走 Chat Completions 还是 Responses。
response_format结构化输出。JSON 任务要同时写清楚 schema、字段含义和异常处理。

官方参考:OpenAI Reasoning modelsOpenAI API Reference

Anthropic / Claude 系列

Claude 兼容接口通常使用 /v1/messages。常见字段包括 systemmessagesmax_tokensstop_sequencestoolstool_choice。较新的 Claude 系列对采样和思考参数有更严格限制。

参数用途差异点
max_tokens控制输出上限。Messages 请求通常需要显式设置。
system顶层系统指令。不要把所有系统规则塞进最后一条用户消息。
temperature / top_p / top_k采样控制。部分新系列对非默认采样参数会返回 400;不确定时先省略。
thinking / output_config.effort控制自适应思考或努力程度。不同代际差异很大,迁移模型时必须核对官方迁移说明。

官方参考:Anthropic Messages APIClaude migration guide

Google / Gemini 系列

Gemini 原生接口使用 contentsgenerationConfig,通过 OpenAI 兼容层接入时字段会被映射。多模态输入支持文本、图片、音频、视频和文件,但具体能力取决于模型。

参数用途差异点
generationConfig.temperature控制随机性。OpenAI 兼容层通常映射为顶层 temperature
generationConfig.topP / topK核采样和候选数量控制。是否允许 topK 由模型决定。
generationConfig.maxOutputTokens输出 token 上限。OpenAI 兼容层常映射为 max_tokens
responseMimeType控制响应 MIME 类型。JSON 或特定结构输出时要同时配合提示词。

官方参考:Gemini GenerateContent APIGemini TTS generation

DeepSeek 系列

DeepSeek 的聊天接口接近 OpenAI Chat Completions,但推理模式和非推理模式参数差异明显。部分推理模式会忽略或不支持 temperaturetop_ppresence_penaltyfrequency_penalty 这类采样参数。

参数用途建议
thinking开启或关闭思考模式。只在支持该字段的模型上使用。
reasoning_effort控制推理努力程度。具体可用值由上游定义;不支持时会报错或被映射。
response_formatJSON 输出。使用 json_object 时,提示词中也必须明确要求 JSON。
stream_options.include_usage流式返回中包含 usage。只在 stream: true 时设置。

官方参考:DeepSeek Chat CompletionDeepSeek Thinking Mode

Qwen / DashScope 系列

Qwen 在 DashScope / Model Studio 中提供 OpenAI 兼容接口。常见文本参数包括 top_ptemperaturepresence_penaltynmax_tokensseedstream。部分参数只在特定商业或开源系列中支持。

参数用途差异点
seed控制随机种子。便于回归测试,但不能保证所有模型完全复现。
n返回多个候选结果。会增加输出消耗;部分模型或工具调用场景固定为 1。
presence_penalty减少重复。部分模型系列才支持。
enable_thinking控制部分思考模型是否启用思考。仅在支持思考模式的系列上使用。

官方参考:Qwen OpenAI-compatible API

图片生成参数

图片生成模型的参数差异比文本模型更大。OpenAI 图像接口常见参数包括 promptsizequalitynoutput_formatresponse_format。Stable Diffusion / Stability、FLUX、Qwen-Image、Wan 等系列还常见 aspect_rationegative_promptseedprompt_extendwatermark

参数常见厂商/系列说明
prompt所有图片生成系列正向提示词,描述主体、构图、风格、文字、光照和限制。
negative_promptStable Diffusion、Qwen/Wan 等负向提示词,描述不要出现的元素;OpenAI 图像接口通常不用这个字段。
sizeOpenAI、Qwen/Wan 等可能是 1024x10241280*1280 或其他格式,必须按上游要求填写。
aspect_ratioStability、FLUX 等1:116:99:16 这类比例控制画幅。
qualityOpenAI 图像系列控制质量档位;不同模型可用枚举不同。
seedQwen/Wan、FLUX、Stable Diffusion 等用于近似复现;图像生成仍有概率性。
output_formatOpenAI、Stability、FLUX 等常见为 pngjpegwebp
prompt_extendQwen/Wan 等是否让模型自动扩写提示词,适合用户提示较短的场景。

官方参考:OpenAI Image generationOpenAI Create image referenceStability AI APIBlack Forest Labs FLUX APIQwen-Image APIWan text-to-image API

音频生成参数

音频生成主要分为文本转语音、语音转语音和实时语音。文本转语音常见参数包括 inputtextvoicespeedvolumepitchresponse_formatsample_ratebitratestream_format。不同厂商命名差异明显。

参数常见厂商/系列说明
voice / voice_idOpenAI TTS、MiniMax、CosyVoice、ElevenLabs音色标识。克隆音色或设计音色通常需要先创建,再在合成请求中引用。
speedOpenAI TTS、MiniMax、CosyVoice 等语速。范围由厂商定义,过高会影响自然度。
vol / volumeMiniMax、CosyVoice 等音量控制。OpenAI 标准 TTS 接口通常没有同名音量字段。
pitchMiniMax、CosyVoice 等音高控制,适合角色音色微调。
response_format / formatOpenAI TTS、MiniMax、CosyVoice 等输出格式,常见为 mp3wavpcmopusflac
audio_sample_rate / sample_rateMiniMax、CosyVoice 等采样率,决定音频清晰度、体积和兼容性。
stream_formatOpenAI TTS 等控制流式返回格式;不是所有模型都支持 SSE。
stability / similarity_boostElevenLabs 类克隆音色控制声音稳定性和与原始音色的相似度。

官方参考:OpenAI Create speechMiniMax T2A guideCosyVoice speech synthesisElevenLabs voice settings

调参建议

目标建议
稳定、可复现降低 temperature,减少采样参数,固定提示词和输入;图像可尝试设置 seed
更有创意提高 temperaturetop_p,但一次只改一个维度。
降低成本降低 max_tokens 或推理 effort,精简上下文,图片降低尺寸或张数,音频降低采样率或时长。
降低延迟开启 stream,减少输出长度,使用更快模型或低 effort;音频优先选择流式接口。
排查 400 错误删除厂商特有参数,先用最小请求跑通,再逐个加回参数。