跳至正文

DeepSeek V4 Pro 正式版上线速报

发布时间:2026-08-13,由预览版转正,调用名称不变:deepseek-v4-pro

一、核心硬件与规格

  • 架构:MoE 混合专家,总参 1.6T,激活 49B
  • 上下文窗口:1,000,000 Token(1M)
  • 最大单次输出:384K Token
  • 原生支持两种推理模式:
    • thinking(默认开启,支持 high/max 推理强度)
    • non-thinking(快速模式,FIM 代码补全仅该模式可用)

二、关键功能特性

  1. Agent 生态完整:工具调用 Tool Call、结构化 JSON Output、Responses API
  2. 双接口兼容
    • OpenAI 兼容地址:https://api.deepseek.com
    • Anthropic 兼容地址:https://api.deepseek.com/anthropic
  3. Beta 特性:对话续写、FIM 代码填空
  4. 并发限制:500(远低于 V4-Flash 的 2500)

三、官方 API 定价(人民币 / 百万 Token)

表格

计费类型V4-ProV4-Flash
输入(缓存命中)0.025 元0.02 元
输入(缓存未命中)3 元1 元
输出6 元2 元

提示:Pro 输出价格恰好为 Flash 的 3 倍;官方同步预告后续或将开启整体调价,重度使用者建议错峰调度。

四、能力定位与适用场景

✅ 适合:

  • 百万级超长文档通读、整本代码库分析、大型项目重构
  • 复杂多步骤 AI Agent、数学深度推理、专业科研长文本
  • 需要连续生成超长内容(几十万字报告、长小说)

⚠️ 不适合:

  • 高并发、大规模批量简单问答(优先 V4-Flash 控成本)

五、V4 Pro vs V4 Flash 快速选型建议

  • 追求性价比、高吞吐、日常开发 / 对话 → V4-Flash
  • 极致长上下文、硬核推理、复杂 Agent、大型代码工程 → V4-Pro

六、调用简易示例(OpenAI 格式)

from openai import OpenAI

client = OpenAI(
    api_key="你的Key",
    base_url="https://api.deepseek.com"
)

resp = client.chat.completions.create(
    model="deepseek-v4-pro",
    messages=[{"role":"user","content":"你的指令"}],
    extra_body={
        "thinking": {"type": "enabled"} # 开启思考模式
    }
👀 阅读量:84
标签:

发表回复

您的邮箱地址不会被公开。 必填项已用 * 标注

分享
扫码分享

扫码分享本文

//这里粘贴百度统计完整script代码