推理。DeepSeek-V4-Pro-Max在所有以前的开放模型中, 务中也超过了之前最佳的开源模型K2.6-Thinking。同时,DeepSeek-V4-Pro和DeepSeek-V4- 次在此任务上与封闭模型相匹配。在Codeforces排行榜上,DeepSeek-V4-Pro-Max目前在众 多人类候选者中排名第23。 取得了最先进的结果,女 超越了以前的模型,如Seed Prover (Chen et al.,2025), 在计算密集型流程中, 超越了包括Aristotle(Achim et al.,2025)在内的系统,并在该设置下匹配 了已知的最佳结果。 -Pro取得的结果与K2.6和GLM-5.1相当,但所有这些开放模型仍然落后于它们的闭源对应物。 0上。其他代理评估中也观察到了类似的趋势。值得注意的是,DeepSeek-V4-Pro在MCPAtlas