SuperCLUE2025年年度测评数学推理总分对比
2026-02-04 14:57:38
42
相关数据
行业数据1
SuperCLUE测评基准2025年年度总体表现(数据截至2026年2月27日)
2026-03-16 08:15:43
28
原图定位
行业数据1
SuperCLUE2025年年度测评科学推理总分对比
2026-02-04 14:57:38
30
原图定位
行业数据1
SuperCLUE2025年年度测评智能体(任务规划)总分对比
2026-02-04 14:57:38
30
原图定位
行业数据1
SuperCLUE2025年年度测评开闭源大模型6大任务平均分对比
2026-02-04 14:57:38
33
原图定位
行业数据1
SuperCLUE2025年年度测评代码生成总分对比
2026-02-04 14:57:38
29
原图定位
行业数据1
SuperCLUE2025年年度基准测评Qwen3-Max-Thinking六大任务得
2026-02-04 14:57:38
31
原图定位
行业数据1
SuperCLUE2025年年度测评海内外大模型6大任务平均分对比
2026-02-04 14:57:38
29
原图定位
行业数据1
SuperCLUE2025年年度基准测评Kimi-K2.5-Thinking六大任务得分
2026-02-04 14:57:38
38
原图定位
行业数据1
SuperCLUE2025年年度测评六大任务国内Top3
2026-02-04 14:57:38
30
原图定位
行业数据1
SuperCLUE2025年年度通用测评推理模型推理效能区间分布(含补测)
2026-02-04 14:57:38
27
原图定位
行业数据1
SuperCLUE2025年年度通用测评性价比区间分布
2026-02-04 14:57:38
33
原图定位
行业数据1
2025年全年SuperCLUE通用基准测评海内外大模型Top3
2026-02-04 14:57:38
36
原图定位
行业数据1
SuperCLUE2025年年度测评精确指令遵循总分对比
2026-02-04 14:57:38
30
原图定位
行业数据1
SuperCLUE2025年年度测评六大任务国内外Top20热力图
2026-02-04 14:57:38
37
原图定位
行业数据1
国资委79号文件央国企信创替代方案
2024-10-10 08:15:13
21462
原图定位
最新数据
行业数据1
区域洞察 英国
2026-04-02 08:30:00
9
原图定位
行业数据1
全球洞察
2026-04-02 08:30:00
8
原图定位
行业数据1
Q14: Thinking about the future, where do you see AI having the biggest impact in HR in 2026? Multiple responses allowed.
2026-04-02 08:30:00
11
原图定位
行业数据1
The State of AI in Small Business HR: 2026 Industry Report
2026-04-02 08:30:00
9
原图定位
行业数据1
2026年小型企业人力资源人工智能状况报告
2026-04-02 08:30:00
12
原图定位
政策法规1
问题9:您的企业是否有人工智能使用政策?
2026-04-02 08:30:00
11
原图定位
介绍:主要考察模型运用数学概念和逻辑进行多步推理和问题解答的能力。包括但不限于几何学、代数学、概率论与数理统计等竞赛级别数据集。 评价方式:基于参考答案的0/1评估,模型答案与参考答案一致得1分,反之得0分,不对回答过程进行评价。 1.国内头部模型追平。 取得80.87分,并列全球第一 Kimi-K2.5-Thinking也以77.39分位 居全球第四,体现了国内模型在数 学推理领域的突破性进展。 2.国内整体梯队靠后。 数学推理Top10中,国内模型仅占4 席,海外模型密度更高;国内大多 数模型集中在平均分(67.49分)附 近的后半段,与国际顶尖模型差距
行业数据
原图定位
相关数据
最新数据