DeepSeek 升级 deepseek-chat 至 DeepSeek-V2-0628
DeepSeek 将 deepseek-chat 模型升级至 DeepSeek-V2-0628,推理等能力显著提升。在 HumanEval、MATH 和 BBH 基准上分别达到 84.76%、71.02% 和 83.40%,Arena-Hard 对 GPT-4-0314 胜率从 41.6% 增至 68.3%。模型角色扮演能力也明显增强,可按对话要求扮演不同人物。
推荐理由:DeepSeek-V2-0628 在代码、数学与推理基准上较旧版明显提升,对 GPT-4-0314 胜率增至 68.3%,便于开发者评估模型替换。