DeepSeek正以极致性价比改写AI商业格局。湘财证券研报显示,DeepSeek-V3推理价格输入0.14元/1M tokens、输出0.28元/1M tokens,仅为GPT-4o的1/30。性能方面MMLU达88.5分与GPT-4o(87.2)持平,AIME 2024数学推理得分39.2远超GPT-4o的9.3。DeepSeek-R1登顶权威大模型榜单,打破OpenAI o1垄断。推理成本的大幅下降有望推动AI应用繁荣,端侧AI部署门槛同步降低。
推理价格为GPT-4o的1/30,性能全面超越
DeepSeek-V3的API定价在主流提供商中极具竞争力。正常价格输入0.14元/1M tokens、输出0.28元/1M tokens,约为基础电信运营商TogetherAI价格的1/9,约为GPT-4o的1/30。极低的推理成本使更多企业和开发者能够负担高质量AI服务。
性能方面,DeepSeek-V3的MMLU(Massive Multitask Language Understanding)得分88.5,与GPT-4o的87.2分持平;SWE Verified(软件工程验证)得分42.0%,显著优于GPT-4o的38.8%;AIME 2024(数学竞赛基准)得分39.2,远超GPT-4o的9.3分;MATH-500得分90.2,全面领先竞品。特别是在数学推理和代码生成等需要深度推理的任务上,DeepSeek展现出显著优势。
DeepSeek-R1在权威大模型排名榜单中登顶,与OpenAI o1并列领先,超越了Claude 3.5 Sonnet、GPT-4o等主流模型。开源模型首次达到闭源顶级模型水平,标志着开源生态的重大胜利。
DeepSeek-V3与竞品对比| 模型 | 输入价格(元/1M) | 输出价格(元/1M) | MMLU | AIME 2024 |
|---|
| DeepSeek-V3 | 0.14 | 0.28 | 88.5 | 39.2 |
| GPT-4o-0513 | 2.50 | 10.00 | 87.2 | 9.3 |
| Claude-3.5-Sonnet | 3.00 | 15.00 | 88.3 | 16.0 |
| Gemini 1.5 Pro | 1.25 | 5.00 | 86.0 | 20.0 |
推理成本下降推动AI应用繁荣,端侧部署门槛降低
DeepSeek大幅降低了大模型训练门槛以及推理调用价格,有望推动优质AI应用的繁荣。当AI调用成本从“每百万tokens数十元”降至“每百万tokens不足1元”时,大量原本不经济的AI应用场景变得可行,包括实时客服、内容生成、代码辅助、数据分析等。
DeepSeek降低了端侧小模型部署门槛。通过蒸馏DeepSeek-R1生成的800K样本,小规模模型(1.5B-70B)在推理任务中表现显著。70B蒸馏版仅需2张RTX 4090即可本地运行,使端侧AI应用开发门槛大幅降低,有望推动AI手机、AI PC、智能汽车等终端设备的智能化升级。
阿里巴巴引领新一轮AI算力资本开支周期
DeepSeek降低了算力卡门槛,大量应用需求将使云厂商资源利用率提升。阿里巴巴宣布,未来三年集团在云和AI基础设施投入预期将超越过去10年总和,引领国内新一轮AI算力资本开支周期。
DeepSeek让中国AI产业摆脱了追随者的角色,成为AI创新玩家,促使海外厂商反思传统AI发展路径,开始重视算法优化。建议关注国产算力需求,包括昇腾系服务器制造、国产算力芯片、液冷、超级电容、存储等环节。