返回顶部
返回首页 会员充值 我的足迹 返回上一页
跳转三个皮匠报告小程序
具身智能
情绪经济
商业航天
十五五
银发经济

DeepSeek模型升级

DeepSeek正在以惊人的迭代速度重塑开源大模型的竞争格局。东方证券人工智能动态跟踪报告显示,3月24日DeepSeek-V3升级为新版本DeepSeek-V3-0324,参数量增至6850亿,代码水平接近当前最强的Claude3.7 Sonnet,推理能力达到非推理模型排名第一并超越部分推理模型。运行效率进一步提升,输出速率超20 token/s,生成代码价格较Claude3.7低53倍。此次升级为即将发布的DeepSeek-R2奠定基础,开源策略加速了AI技术普惠化,或将对封闭生态的OpenAI等企业构成挑战。本文从技术突破、成本优势、生态影响三个维度解析DeepSeek的升级逻辑。

技术突破——代码接近Claude3.7,推理能力非推理模型第一

DeepSeek-V3-0324在多个维度实现显著突破。代码水平接近当前最强的Claude3.7 Sonnet,在前端开发、物理模拟等任务中表现卓越。推理能力达到非推理模型排名第一并超越部分推理模型。在Misguided Attention基准下新版V3得分明显领先旧版。测试显示,新版V3甚至能处理部分推理型任务,标志着基座模型能力边界的持续扩展。

此次升级为V3基座模型的小版本更新,但其技术突破已十分显著。DeepSeek-V3-0324采用MIT开源协议,支持商业应用与量化部署,经4-bit量化后可在苹果M3 Ultra设备实现每秒20 token的流畅运行。建议关注后续发布的升级版推理模型DeepSeek-R2,有望进一步缩小与全球顶尖闭源模型的差距。

成本优势——输出速率20 token/s,价格仅为Claude3.7的1/53

DeepSeek-V3-0324在运行效率与成本方面优势明显。输出速率提升至超20 token/s,生成代码的价格较Claude3.7低了53倍。结合DeepSeek此前极低的API定价,其性价比优势在开源大模型中处于领先地位。

低成本优势来自于技术创新。DeepSeek通过跨节点专家并行技术(EP)将671B模型推理日成本压至8.7万美元,并通过MIT开源协议吸引全球开发者共建生态。低成本+高性能的组合使DeepSeek成为对价格敏感的开发者、中小企业及教育机构的首选。

生态影响——开源策略加速AI技术普惠化

DeepSeek的MIT开源协议允许商业应用与量化部署,进一步降低了AI技术的使用门槛。全球AI产品Web端访问量排名中,DeepSeek在2025年2月访问量达5.71亿(环比+122.73%),在全球AI聊天机器人中仅次于ChatGPT(40.4亿)。2025年3月24-30日周访问量达1.12亿,为国内AI应用第一。

DeepSeek的开源策略正在缩小中美AI差距。Huggingface排名前十的开源大模型全部基于Qwen系列或DeepSeek系列训练,中国开源大模型已成为全球AI社区的核心基础设施。DeepSeek-R2的发布有望进一步强化这一地位。开源AI大模型的快速迭代或将对封闭生态的OpenAI等企业构成挑战。
表3:DeepSeek-V3-0324关键升级指标
指标升级前升级后
参数量671B6850亿
代码能力行业领先接近Claude3.7 Sonnet
推理能力行业领先非推理模型第一
输出速率>20 token/s
开源协议MIT

投资建议——关注开源AI生态受益标的

DeepSeek的快速迭代验证了开源大模型的竞争力,建议关注相关受益标的:阿里巴巴-W(09988,买入),通义系列为全球最大开源模型族群,Huggingface前十开源模型均基于Qwen;快手-W(01024,买入),可灵视频生成技术全球领先,商业化加速;腾讯控股(00700,买入),卡位最佳社交场景,具备数据+应用生态优势。
点击阅读报告原文: 【东方证券】人工智能动态跟踪2025年3月第3期:阿里发布多款大模型,AI产业链持续景气-250331(26页)
相关报告