//
DeepSeek‑V4‑Flash 是DeepSeek V4 系列面向效率优化的变体版本,该模型面向有如下需求的开发者:希望以速度更快、成本更低的API服务,获取V4系列的长上下文与推理能力。相较于V4‑Pro,V4‑Flash的总参数量与激活参数量更小,因此响应速度更快,API调用成本也更低。其推理能力接近V4‑Pro,在简单智能体任务上可与V4‑Pro持平,仅在要求最高的智能体工作流场景下才会出现可观测的性能差距。其世界知识储备略逊于V4‑Pro,但在开源模型中依旧具备较强竞争力。
该模型可通过多个入口访问,选择不同入口即可查看对应的价格与代码示例。
DeepSeek API
按 token 用量计费,价格透明,无订阅或隐藏费用。
复制下方示例,几行代码即可接入该模型。
from openai import OpenAI
client = OpenAI(
base_url="https://api.apipod.ai/v1",
api_key="<YOUR_API_KEY>",
)
# Chat Completions
completion = client.chat.completions.create(
model="deepseek-v4-flash",
messages=[
{
"role": "user",
"content": "What is the meaning of life?",
}
],
)
print(completion.choices[0].message.content)