DeepSeek · 2025-05-28 00:00
deepseek-reasoner 模型升级为 DeepSeek-R1-0528: 推理能力增强 基准测试提升显著(Pass@1) AIME 2025: 70.0→ 87.5 (+17.5) GPQA: 71.5 → 81.0 (+9.5) LCB_v6: 63.5 → 73.3 (+9.8) Aider: 57.0 → 71.6 (+14.6) 注:复杂推理问题相比老版本R1会使用更多token
原文:DeepSeek | 返回 AI 资讯列表