返回列表
DeepSeek V4 Pro 0813 正式发布:支持百万级上下文的超大规模混合专家模型
产品发布DeepSeek人工智能大模型

DeepSeek V4 Pro 0813 正式发布:支持百万级上下文的超大规模混合专家模型

DeepSeek 于 2026 年 8 月 12 日正式发布了 DeepSeek V4 Pro 0813 的 GA(正式商用)版本。该模型采用先进的超大规模混合专家(MoE)架构,支持高达 100 万 token 的超长上下文处理。其定价极具竞争力,输入每百万 token 仅需 0.435 美元,输出为 0.87 美元。目前该模型已通过 OpenRouter 平台上线,并全面兼容 OpenAI API 标准,为开发者提供高性能、低成本的 AI 解决方案。

Hacker News

核心要点

  • 正式商用发布:DeepSeek V4 Pro 0813 已正式进入 GA 阶段,标志着该模型的稳定性和性能已达到生产环境要求。
  • 超长上下文支持:具备 1,000,000 (1M) token 的上下文窗口,能够处理极长文档和复杂的大规模数据任务。
  • MoE 架构优势:采用超大规模混合专家(Mixture-of-Experts)架构,在保持强大性能的同时优化了推理效率。
  • 极高性价比:定价策略非常激进,输入价格为 $0.435/1M tokens,输出价格为 $0.87/1M tokens。
  • 无缝集成:通过 OpenRouter 提供服务,API 完全兼容 OpenAI 格式,开发者可快速完成模型切换。

详细分析

超大规模 MoE 架构的正式落地

DeepSeek V4 Pro 0813 是 DeepSeek 在混合专家(MoE)架构上的最新力作。作为 GA 版本,它不仅代表了技术的突破,更意味着模型在处理复杂逻辑、代码生成和多语言理解方面达到了新的高度。MoE 架构允许模型根据任务动态调用不同的专家子网络,从而在不显著增加计算成本的前提下,实现了超大规模参数量的性能表现。

百万级上下文开启的应用新场景

1M token 的上下文长度是该模型的核心竞争力之一。在实际应用中,这意味着用户可以将数本长篇著作、整个项目的源代码库或长达数小时的会议记录一次性输入模型。这种超长上下文的处理能力,极大地扩展了 AI 在深度法律合规审查、复杂系统架构分析以及长程对话管理中的应用潜力。

开发者友好的生态与定价

在当前的 AI 模型市场中,DeepSeek V4 Pro 0813 提供了极具吸引力的价格体系。其输入与输出的定价比例经过优化,显著降低了企业构建长文本应用的成本门槛。此外,通过 OpenRouter 平台,开发者可以享受到低延迟、高吞吐量的服务,且由于其 API 兼容 OpenAI 标准,现有的 AI 应用可以几乎零成本地迁移到这一新模型上。

行业影响

DeepSeek V4 Pro 0813 的发布进一步推动了大模型行业的“长上下文”竞赛。其高性价比的定价策略可能会迫使其他主流模型供应商重新评估其商业模式。同时,作为国产大模型的代表,DeepSeek 在 MoE 架构上的成功实践,证明了其在超大规模模型研发领域的领先地位,为全球开发者提供了更多样化、更具成本效益的选择。

常见问题

DeepSeek V4 Pro 0813 的上下文长度是多少?

该模型支持最高 1,000,000 (1M) token 的上下文窗口,非常适合处理超长文档分析任务。

如何集成 DeepSeek V4 Pro 0813 的 API?

该模型通过 OpenRouter 提供,其 API 与 OpenAI 完全兼容。开发者只需在现有 SDK 中更换 Base URL 和模型标识符(deepseek/deepseek-v4-pro-0813)即可完成集成。

该模型的定价标准是怎样的?

DeepSeek V4 Pro 0813 的输入价格为每百万 token 0.435 美元,输出价格为每百万 token 0.87 美元。

相关新闻

Weedout 插件正式发布:一键过滤 YouTube AI 生成视频,重塑纯净内容流
产品发布

Weedout 插件正式发布:一键过滤 YouTube AI 生成视频,重塑纯净内容流

开发者在 Hacker News 上推出了 Weedout,这是一款专为 Safari 浏览器设计的插件,旨在帮助用户自动隐藏 YouTube 上带有“AI 制作”标签的视频。该工具支持过滤首页、搜索、相关视频及 Shorts,提供无感移除和“调暗”两种模式。Weedout 售价 1.99 美元,采用买断制,且完全在本地运行以保护用户隐私,为反感 AI 生成内容的观众提供了简洁的解决方案。

Anthropic发布Claude Fable 5.1与Mythos 5.1:性能升级且Agent任务成本骤降45%
产品发布

Anthropic发布Claude Fable 5.1与Mythos 5.1:性能升级且Agent任务成本骤降45%

Anthropic正式推出全新AI模型Claude Fable 5.1和Mythos 5.1,旨在解决用户在价格、数据保留及安全限制方面的核心关切。新模型在性能上超越了前代Fable 5,并显著降低了使用门槛。其中,Fable 5.1的常规成本降低了约25%,而在处理复杂的智能体(Agentic)任务时,成本降幅最高可达45%,为开发者提供了更高的效费比。

Anthropic发布Claude Fable 5.1与Mythos 5.1:性能升级且最高降价45%
产品发布

Anthropic发布Claude Fable 5.1与Mythos 5.1:性能升级且最高降价45%

Anthropic正式推出Claude Fable 5.1和Claude Mythos 5.1,被誉为全球最先进的编程与知识工作模型。Fable 5.1现已全面开放,而Mythos 5.1则针对网络安全和生命科学领域提供特定安全保护。新版本在成本上显著优化,典型工作负载降价约25%,智能体任务最高可节省45%。此外,通过全新的企业前沿安全保护(EFS)系统,Anthropic实现了由客户完全控制数据的零保留政策。