发布时间:2026-08-13,由预览版转正,调用名称不变:deepseek-v4-pro

一、核心硬件与规格
- 架构:MoE 混合专家,总参 1.6T,激活 49B
- 上下文窗口:1,000,000 Token(1M)
- 最大单次输出:384K Token
- 原生支持两种推理模式:
- thinking(默认开启,支持 high/max 推理强度)
- non-thinking(快速模式,FIM 代码补全仅该模式可用)
二、关键功能特性
- Agent 生态完整:工具调用 Tool Call、结构化 JSON Output、Responses API
- 双接口兼容
- OpenAI 兼容地址:
https://api.deepseek.com - Anthropic 兼容地址:
https://api.deepseek.com/anthropic
- OpenAI 兼容地址:
- Beta 特性:对话续写、FIM 代码填空
- 并发限制:500(远低于 V4-Flash 的 2500)
三、官方 API 定价(人民币 / 百万 Token)
表格
| 计费类型 | V4-Pro | V4-Flash |
|---|---|---|
| 输入(缓存命中) | 0.025 元 | 0.02 元 |
| 输入(缓存未命中) | 3 元 | 1 元 |
| 输出 | 6 元 | 2 元 |
提示:Pro 输出价格恰好为 Flash 的 3 倍;官方同步预告后续或将开启整体调价,重度使用者建议错峰调度。
四、能力定位与适用场景
✅ 适合:
- 百万级超长文档通读、整本代码库分析、大型项目重构
- 复杂多步骤 AI Agent、数学深度推理、专业科研长文本
- 需要连续生成超长内容(几十万字报告、长小说)
⚠️ 不适合:
- 高并发、大规模批量简单问答(优先 V4-Flash 控成本)
五、V4 Pro vs V4 Flash 快速选型建议
- 追求性价比、高吞吐、日常开发 / 对话 → V4-Flash
- 极致长上下文、硬核推理、复杂 Agent、大型代码工程 → V4-Pro
六、调用简易示例(OpenAI 格式)
from openai import OpenAI
client = OpenAI(
api_key="你的Key",
base_url="https://api.deepseek.com"
)
resp = client.chat.completions.create(
model="deepseek-v4-pro",
messages=[{"role":"user","content":"你的指令"}],
extra_body={
"thinking": {"type": "enabled"} # 开启思考模式
}
👀 阅读量:84 次
