DeepSeek Updates · 2024-06-28

deepseek-chat

deepseek-chat 模型升级为 DeepSeek-V2-0628,模型推理能力提升,相关基准测试: 代码,HumanEval Pass@1 79.88% -> 84.76% 数学,MATH ACC@1 55.02% -> 71.02% 推理,BBH 78.56% -> 83.40% 在 Arena-Hard 测评中,与 GPT-4-0314 的对战胜率从 41.6% 提升到了 68.3%。 模型角色扮演能力显著增强,可以在对话中按要求扮演不同角色。

Open original