- Published on
DeepSeek V4 Pro 0813 正式发布:高性能混合专家模型,定价与基准详解
- Authors
- Name
- explosion-s
- openrouter.ai

模型概况
DeepSeek V4 Pro 0813 是 DeepSeek 公司最新发布的大型混合专家模型(Mixture-of-Experts, MoE),属于 V4 Pro 系列的正式可用(GA)版本。该模型于 2026 年 8 月 12 日发布,旨在通过稀疏激活的专家架构在推理效率和模型能力之间取得平衡。MoE 架构使得模型在每次前向传播时只激活部分专家,从而在保持大规模参数量的同时降低计算成本。
目前该模型已通过 OpenRouter 平台对外开放 API 调用,用户无需自行部署即可直接使用。OpenRouter 作为统一路由层,将请求直接转发至 DeepSeek 官方提供商,无需额外的路由决策,保证了请求的稳定性和低延迟。
定价与上下文
DeepSeek V4 Pro 0813 的定价策略具有竞争力:
- 输入 tokens:每百万 tokens 收费 $0.435
- 输出 tokens:每百万 tokens 收费 $0.87
需要注意的是,上述价格为挂牌价。实际用户支付的平均价格通常会低于此,因为 OpenRouter 支持缓存命中折扣以及多种优惠措施。例如,当请求的部分内容命中缓存时,输入 token 费用可能大幅降低。
模型的上下文窗口长度达到 1,048,576 tokens(约 1M),最大单次输出长度可达 384,000 tokens。这一超大上下文窗口使其非常适合处理长文档、多轮对话、代码仓库分析等需要长期记忆的任务。
性能与基准测试
OpenRouter 为 DeepSeek V4 Pro 0813 提供了独立的性能监控和基准测试数据,涵盖多个维度:
- 吞吐量(Throughput):模型每秒生成的 tokens 数量,数值越高代表处理速度越快。
- 延迟(Latency):完整的请求-响应往返时间,数值越低用户体验越好。
- 首 token 时间(TTFT, Time-to-First-Token):从发送请求到看到第一个 token 的时间,反映模型响应速度。
- 正常运行时间(Uptime):过去 30 天内请求成功率的百分比。OpenRouter 持续监控所有提供商,并在出现错误时自动重试次优提供商,确保高可用性。
在标准化基准测试中,该模型取得了较高的评分,并在 OpenRouter 所有模型中的排名百分位表现突出。虽然具体评测分数未在页面中完全列出,但从“排名百分位”指标可以看出,DeepSeek V4 Pro 0813 在同类模型中处于领先地位。
应用与生态
OpenRouter 展示了向该模型发送流量最多的公共应用列表,这些应用反映了真实生产环境中的使用场景。从 token 量和请求数量的趋势图可以看出,该模型发布后迅速获得大量采用,尤其适用于需要高吞吐量和长上下文的场景,如代码生成、内容创作、智能客服等。
此外,该模型支持工具调用(Tool Calling)和结构化输出(Structured Outputs),这使得开发者可以将其集成到复杂的自动化工作流中,例如调用外部 API、生成 JSON 格式的数据等。
快速入门
调用 DeepSeek V4 Pro 0813 非常简单,因为 OpenRouter 的 API 兼容 OpenAI 的格式。只需将基础 URL 替换为 OpenRouter 的端点,并在请求中指定模型 slug 即可。以下是一个示例(使用 Python 和 requests 库):
- 设置 API 密钥和基础 URL
- 发送聊天补全请求,指定模型为 "deepseek/deepseek-v4-pro-0813"
- 接收响应并处理 tokens
具体代码模板可在 OpenRouter 的模型页面上直接获取,支持多种开发语言和框架。
常见问题
Q:DeepSeek V4 Pro 0813 是什么? A:这是 DeepSeek 公司发布的大型混合专家模型 GA 版本,采用 MoE 架构,在性能与成本之间进行了优化。
Q:费用如何计算? A:输入输出分别按 tokens 计费,百万 tokens 输入 $0.435,输出 $0.87。实际因缓存和折扣可能更低。
Q:上下文长度是多少? A:支持 1,048,576 tokens 的上下文窗口,最大输出 384,000 tokens。
Q:是否支持工具调用和结构化输出? A:是的,该模型支持这些功能,便于构建复杂应用。
Q:DeepSeek 还有其他文本模型吗? A:DeepSeek 提供多个版本的模型,包括 V3、V4 系列等,用户可根据需求选择。
Q:模型何时发布? A:2026 年 8 月 12 日。
综上所述,DeepSeek V4 Pro 0813 凭借其大规模 MoE 架构、极具竞争力的定价、超长上下文以及丰富的 API 功能,为开发者和企业提供了一个高性能的语言模型选择。随着生成式 AI 应用的持续扩展,这类模型将在代码生成、内容理解、对话系统等领域发挥重要作用。
原标题:DeepSeek V4 Pro 0813。 HN 原始发布时间:2026年8月13日星期四。当前记录为 741 分、284 条评论。