DeepSeek V4
在 DeepSeek V4 上进行对话补全,一个 OpenAI 兼容端点:Flash 处理日常任务,Pro 处理困难推理。
POST
/v3/llm/deepseek-v4/chat/completions试一试- 价格0.01 / 0.02 IC每 1k 词元,输入 / 输出
- 累计调用19K次
- v4
- 运行中
请求
JSON,采用 OpenAI 聊天补全的格式,OpenAI 客户端只需改 base URL 即可使用。
请求头
apikeystring必填您的 API 密钥,在控制台的 API Keys 中创建。
请求体
modelstring必填deepseek-v4-flash 或 deepseek-v4-pro。其他值返回 400,因此拼写错误不会让您误付更贵的档位。messagesarray必填对话:含
role(system、user 或 assistant)与 content 的对象。max_tokensinteger最多生成的词元数。默认 4096。
streamboolean设为
true 时以 server-sent events 逐词元返回。默认 false。temperaturefloat0 至 2,默认 0.7。代码和数学接近 0,分析用 1.0,对话和翻译用 1.3,创意写作用 1.5。
top_pfloat核采样,默认 0.9。
价格
| 模型 | 适用 | 输入 | 输出 |
|---|---|---|---|
deepseek-v4-flash | 聊天、文档问答、分类、起草 | 每 1K 词元 0.01 IC | 每 1K 词元 0.02 IC |
deepseek-v4-pro | 困难推理、多步智能 体、奥赛级数学与代码 | 每 1K 词元 0.20 IC | 每 1K 词元 0.40 IC |
默认使用 Flash:Pro 每词元的价格是 Flash 的二十倍,只把真正需要深度推理的请求交给它。
响应
OpenAI 聊天补全对象,如右侧面板所示:答案在
choices[0].message.content,usage 为计费的词元数。stream: true 时以 data: 行逐块返回,每块含 choices[0].delta,以 data: [DONE] 结束。OpenAI 聊天补全对象,如右侧面板所示:答案在 choices[0].message.content,usage 为计费的词元数。stream: true 时以 data: 行逐块返回,每块含 choices[0].delta,以 data: [DONE] 结束。