DeepSeek Updates · 2025-05-28

deepseek-reasoner

deepseek-reasoner 模型升级为 DeepSeek-R1-0528: 推理能力增强 基准测试提升显著(Pass@1) AIME 2025: 70.0→ 87.5 (+17.5) GPQA: 71.5 → 81.0 (+9.5) LCB_v6: 63.5 → 73.3 (+9.8) Aider: 57.0 → 71.6 (+14.6) 注:复杂推理问题相比老版本R1会使用更多tokens Web前端开发能力优化 生成的网页与游戏更加美观 幻觉降低 极大程度抑制了老版本R1所存在的幻觉问题 Json Output与Function Cal...

Open original