BlackHalo logo
Published on

DeepSeek V4 Pro 0813 正式发布:高性能混合专家模型,定价与基准详解

Authors
  • Name
    explosion-s
    openrouter.ai
DeepSeek V4 Pro 0813 模型性能基准测试与定价对比图
头图来源: Wikimedia Commons(请在文件页查看原作者与许可条款)

模型概况

DeepSeek V4 Pro 0813 是 DeepSeek 公司最新发布的大型混合专家模型(Mixture-of-Experts, MoE),属于 V4 Pro 系列的正式可用(GA)版本。该模型于 2026 年 8 月 12 日发布,旨在通过稀疏激活的专家架构在推理效率和模型能力之间取得平衡。MoE 架构使得模型在每次前向传播时只激活部分专家,从而在保持大规模参数量的同时降低计算成本。

目前该模型已通过 OpenRouter 平台对外开放 API 调用,用户无需自行部署即可直接使用。OpenRouter 作为统一路由层,将请求直接转发至 DeepSeek 官方提供商,无需额外的路由决策,保证了请求的稳定性和低延迟。

定价与上下文

DeepSeek V4 Pro 0813 的定价策略具有竞争力:

  • 输入 tokens:每百万 tokens 收费 $0.435
  • 输出 tokens:每百万 tokens 收费 $0.87

需要注意的是,上述价格为挂牌价。实际用户支付的平均价格通常会低于此,因为 OpenRouter 支持缓存命中折扣以及多种优惠措施。例如,当请求的部分内容命中缓存时,输入 token 费用可能大幅降低。

模型的上下文窗口长度达到 1,048,576 tokens(约 1M),最大单次输出长度可达 384,000 tokens。这一超大上下文窗口使其非常适合处理长文档、多轮对话、代码仓库分析等需要长期记忆的任务。

性能与基准测试

OpenRouter 为 DeepSeek V4 Pro 0813 提供了独立的性能监控和基准测试数据,涵盖多个维度:

  • 吞吐量(Throughput):模型每秒生成的 tokens 数量,数值越高代表处理速度越快。
  • 延迟(Latency):完整的请求-响应往返时间,数值越低用户体验越好。
  • 首 token 时间(TTFT, Time-to-First-Token):从发送请求到看到第一个 token 的时间,反映模型响应速度。
  • 正常运行时间(Uptime):过去 30 天内请求成功率的百分比。OpenRouter 持续监控所有提供商,并在出现错误时自动重试次优提供商,确保高可用性。

在标准化基准测试中,该模型取得了较高的评分,并在 OpenRouter 所有模型中的排名百分位表现突出。虽然具体评测分数未在页面中完全列出,但从“排名百分位”指标可以看出,DeepSeek V4 Pro 0813 在同类模型中处于领先地位。

应用与生态

OpenRouter 展示了向该模型发送流量最多的公共应用列表,这些应用反映了真实生产环境中的使用场景。从 token 量和请求数量的趋势图可以看出,该模型发布后迅速获得大量采用,尤其适用于需要高吞吐量和长上下文的场景,如代码生成、内容创作、智能客服等。

此外,该模型支持工具调用(Tool Calling)和结构化输出(Structured Outputs),这使得开发者可以将其集成到复杂的自动化工作流中,例如调用外部 API、生成 JSON 格式的数据等。

快速入门

调用 DeepSeek V4 Pro 0813 非常简单,因为 OpenRouter 的 API 兼容 OpenAI 的格式。只需将基础 URL 替换为 OpenRouter 的端点,并在请求中指定模型 slug 即可。以下是一个示例(使用 Python 和 requests 库):

  • 设置 API 密钥和基础 URL
  • 发送聊天补全请求,指定模型为 "deepseek/deepseek-v4-pro-0813"
  • 接收响应并处理 tokens

具体代码模板可在 OpenRouter 的模型页面上直接获取,支持多种开发语言和框架。

常见问题

Q:DeepSeek V4 Pro 0813 是什么? A:这是 DeepSeek 公司发布的大型混合专家模型 GA 版本,采用 MoE 架构,在性能与成本之间进行了优化。

Q:费用如何计算? A:输入输出分别按 tokens 计费,百万 tokens 输入 $0.435,输出 $0.87。实际因缓存和折扣可能更低。

Q:上下文长度是多少? A:支持 1,048,576 tokens 的上下文窗口,最大输出 384,000 tokens。

Q:是否支持工具调用和结构化输出? A:是的,该模型支持这些功能,便于构建复杂应用。

Q:DeepSeek 还有其他文本模型吗? A:DeepSeek 提供多个版本的模型,包括 V3、V4 系列等,用户可根据需求选择。

Q:模型何时发布? A:2026 年 8 月 12 日。

综上所述,DeepSeek V4 Pro 0813 凭借其大规模 MoE 架构、极具竞争力的定价、超长上下文以及丰富的 API 功能,为开发者和企业提供了一个高性能的语言模型选择。随着生成式 AI 应用的持续扩展,这类模型将在代码生成、内容理解、对话系统等领域发挥重要作用。

原标题:DeepSeek V4 Pro 0813。 HN 原始发布时间:2026年8月13日星期四。当前记录为 741 分、284 条评论。

阅读原文 · 查看 HN 讨论