### 更快捷高效的经济之选 - DeepSeek-V4 拥有百万字超长上下文,在 Agent 能力、世界知识和推理性能上均实现国内与开源领域的领先。 - 相比 DeepSeek-V4-Pro,DeepSeek-V4-Flash 在世界知识储备方面稍逊一筹,但展现出了接近的推理能力。而由于模型参数和激活更小,相较之下 V4-Flash 能够提供更加快捷、经济的 API 服务。 - 在 Agent 测评中,DeepSeek-V4-Flash 在简单任务上与 DeepSeek-V4-Pro 旗鼓相当,但在高难度任务上仍有差距。
from openai import OpenAI
client = OpenAI(
base_url="https://api.openroute.cn/v1",
api_key="<ONTOROUTE_API_KEY>",
)
completion = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[
{
"role": "user",
"content": "Write a one-sentence bedtime story about a unicorn.",
}
],
)
print(completion.choices[0].message.content)价格为人民币(¥)/ 百万 token,按量计费;缓存读取可显著降低重复上下文成本。
| 提供商 | 输入上限 | 输出上限 | 上下文长度 | 工具调用 |
|---|---|---|---|---|
volcengine deepseek-v4-flash-260425 | 128K | 384K | 1M | 支持 |
deepseek deepseek/deepseek-v4-flash | 1M | 384K | 1M | 支持 |
| 参数 | 说明 | 默认值 |
|---|---|---|
| tools | 工具 | 由请求决定 |