82%的企业倾向私有部署大模型以满足数据安全要求——当推理服务成为AI服务的主要形态,当核心业务数据必须“不出域”,企业级AI推理部署正在从“能用”走向“用好、用安全”。中国信通院这份报告揭示了企业级AI推理部署的三大核心趋势:专有云成为主流承载形态、交付逻辑从资源供给转向场景交付、全栈国产化成为核心门槛。
推理服务成为AI服务主流形态
大模型服务重心已从训练转向推理。IDC预测2025年中国推理工作负载占比达67%,中国工程院邬贺铨院士提到2026年全球推理服务占AI服务总负载70%-80%,中国推理需求为训练的8倍。Gartner预测至2028年推理与训练算力占比将达3:1,中国可能达到4:1以上。
截至2026年3月,我国智能算力规模超过1882 EFLOPS。全国日均词元调用量从2024年初1000亿攀升至2026年3月140万亿,两年增幅超千倍,其中企业本地化部署词元调用占比持续提升。大模型专有云已然成为承接产业级AI应用落地的核心载体。
三大行业部署形态分化成型
政务行业:超80%省市级政务单位通过省属大数据公司或政务平台公司托管专用资源部署大模型服务,形成“省级统筹建设、地市分级接入”的专用部署模式,依托全省统一的政务专有云平台实现大模型能力的全省复用与集约化运营。
金融行业:国有六大银行均已完成企业级自建智算资源布局,自建智算资源规模占比达96%(按智算规模口径)。头部券商、保险机构形成“核心业务自建、非核心业务托管”混合部署;城商行、农商行更多采用行业托管专用模式。
能源行业:形成“集团总部云+区域分公司云+厂站边缘节点”三级云边协同架构。核心业务自建、非核心业务托管分级适配,单主体累计超100PFlops需求优先自建,100PFlops以下以采购云服务商专有云智算服务为主。
交付逻辑四阶跃升
资源交付层面,从标准化供给转向场景化定制,针对政务公文处理、金融合规审查、工业视觉质检等不同场景定制化适配异构智算集群。平台服务层面,从单一部署延伸到覆盖模型微调、场景适配、推理优化、运维监控的全流程平台化服务。
成果交付层面,计费模式从按卡时、按智算规格向按词元消耗量、按任务完成度、按业务价值贡献升级。政务12345热线按有效咨询处理量计费,金融风控按风险识别准确率计费。词元资产化运营层面,头部服务商通过专有云环境帮助企业系统性沉淀Context资产和Memory资产,让每一次词元调用转化为可积累的业务资产。