产品发布
DeepSeek-R2推理模型发布:多模态能力全面突破,推理性能超越GPT-5
全新升级的DeepSeek-R2推理模型在数学推理、代码生成与多模态理解方面实现全面突破。在AIME 2025数学竞赛中取得92.3%的准确率,代码能力在SWE-bench Verified上达到65.8%。
全新升级的DeepSeek-R2推理模型在数学推理、代码生成与多模态理解方面实现全面突破。在AIME 2025数学竞赛中取得92.3%的准确率,代码能力在SWE-bench Verified上达到65.8%。
从MoE路由策略的设计、专家负载均衡到大规模分布式训练的通信优化——揭秘DeepSeek如何高效训练万亿参数级大模型,训练成本仅为同行的1/10。