DeepSeek V4 Pro 发了钢镚·2 小时前+ 关注#AI模型在整体能力上,DeepSeek V4 Pro 与 Opus-4.8 及 Fable 5 处于同一梯队,互有胜负。在底层操作和工程能力上表现出色(如终端操作 87.9 分、全栈开发 71.1 分均高于对手),但在综合高难度推理(HLE 测试 60.0 分低于 Fable 5 的 63.0 分)和特定复杂软件工程任务(DeepSWE 62.7 分低于 Opus 的 58.0 分)上,仍略逊于这两款顶尖竞品。902分享☺添加表情
评论 (0)
还没有评论,来发第一条吧