AI 编程 › AI 资讯 › 正文

deepseek-chat

DeepSeek · 2024-06-28 00:00

deepseek-chat 模型升级为 DeepSeek-V2-0628,模型推理能力提升,相关基准测试: 代码,HumanEval Pass@1 79.88% -> 84.76% 数学,MATH ACC@1 55.02% -> 71.02% 推理,BBH 78.56% -> 83.40% 在 Arena-Hard 测评中,与 GPT-4-0314 的对战胜率从 41.6% 提升到了 68.3%。

原文:DeepSeek | 返回 AI 资讯列表