2025年3月最后一周,全球AI大模型迎来密集迭代升级。国金证券最新发布的TMT行业研究周报指出,OpenAI在GPT-4o模型中集成原生图像生成功能,DeepSeek-V3完成重要版本升级,腾讯混元T1正式版推理模型上线。多模态大模型的应用正推动算力需求成倍增长——Sam Altman已明确表示ChatGPT的文生图应用需求过高,造成GPU超负荷,公司不得不暂时引入频率限制。与此同时,DeepSeek R1模型持续引爆市场关注,Web端日活达1024万人。本文从模型迭代、算力需求、应用落地三个维度解析AI大模型的发展趋势。
GPT-4o原生图像生成——多模态能力的里程碑式突破
3月26日,OpenAI宣布在GPT-4o模型中集成原生图像生成功能,这是多模态AI领域的重要进展。该功能的核心优势在于:能精准呈现文字内容,严格遵循指令要求,并充分调用GPT-4o内置知识库和对话上下文——包括对上传图像进行转化处理或将其作为视觉灵感来源。这使得用户能更轻松地创造出与构想完全一致的图像,将图像生成技术升级为兼具精确性与实用性的强大工具。
然而,图像生成能力的提升也带来了算力消耗的急剧增加。Sam Altman已明确表示,ChatGPT的文生图应用需求过高,已造成GPU超负荷,公司暂时引入文生图频率限制。这一信号清晰反映了多模态大模型对算力的巨大消耗——图像生成所需的GPU算力成倍增长,远高于纯文本推理。据测算,GPT-4o的图像生成功能所需算力约为文本推理的数倍至数十倍。
DeepSeek-V3升级与腾讯混元T1——国产大模型的加速追赶
3月25日,DeepSeek-V3模型完成重要版本更新,推理任务表现提高、前端开发能力增强、中文写作升级、中文搜索能力优化。V3模型的小版本升级为后续DeepSeek-R2的发布奠定了基础。DeepSeek R1模型自1月20日发布以来持续引爆市场,在数学、代码、自然语言推理领域性能比肩OpenAI o1正式版。截至2月21日,DeepSeek的Web端日活为1024万人,是当日ChatGPT日活量的14.5%。
腾讯混元T1正式版推理模型同期上线,在数学、逻辑推理、科学及代码等领域的推理能力显著提升。API调用价格方面,T1输入价格低至1元/百万tokens,输出价格低至4元/百万tokens,定价策略极具竞争力。目前模型已通过腾讯云API开放,未来或接入腾讯元宝等C端应用。腾讯元宝Web端日活持续增长,已达到50万人。DeepSeek-V3最新版也已上线腾讯元宝,国产大模型应用生态持续丰富。
多模态大模型推动算力需求结构性增长
多模态大模型的密集发布正在从根本上改变算力需求的结构。相比纯文本模型,多模态模型(图像生成、视频生成、音频处理等)的算力消耗呈指数级增长。OpenAI的GPT-4o图像生成功能上线后即造成GPU超负荷,充分说明当前算力供给仍然难以满足多模态应用的爆发式需求。
从投资角度看,算力产业链的受益确定性最强。国金证券指出,多模态大模型将带动算力需求进一步提升,持续看好算力链。无论下游应用在哪个场景率先落地,对AI算力的拉动是明确的。AI算力最优质资产主要在互联网、通信/运营商巨头体系,计算机板块的IDC受益明确,垂类AI算力服务具体看下游场景和客户结构。A股日均成交额维持1.26万亿元高位,两融余额1.9万亿元,市场流动性充裕,算力板块有望持续受益于AI模型迭代驱动的需求增长。
表1:主要AI大模型Web端日活对比(2025.2.21)| 模型 | 日活(万人) | 相对ChatGPT比例 |
|---|
| ChatGPT | 约7060 | 100% |
| DeepSeek | 1024 | 14.5% |
| Gemini | — | — |
| 腾讯元宝 | 50 | — |
投资建议——关注AI大模型产业链核心标的
AI大模型的持续迭代将带动算力、应用、端侧全产业链受益。国金证券建议关注:AI算力(寒武纪、海光信息等)、AI应用(金山办公、科大讯飞等)、AI端侧(立讯精密、恒玄科技等)。大模型多模态处理能力、推理能力、搜索能力的快速提升,对搜索等场景的赋能更加突显,继续看好“Chat”类产品及基于算法的应用/工具,重点关注AI陪伴、AI玩具、AI工具变化及相关标的,同时关注AI生成视频的进展。