计算机行业周报:大模型加速迭代,AI算力持续加码
机构: 上海证券
研究员: 杨佳伟 评级: 增持 增持 页数: 3 日期: 2026-07-29
行业: IT服务Ⅱ
通俗版摘要
大模型正加快更新换代,更便宜、更专注的模型接连亮相,带动对算力的需求继续升温。谷歌接连推出成本更低、定位更细分的AI模型,把比拼从单一最强芯片延伸到整体算账效率。Anthropic把旗舰能力压缩到成本更低的新模型里,让日常办公和写代码也能用得起更强AI。阿里即将发布并开源参数规模很大的千问新版本,把模型做得更大、可用范围更广。AMD用整机柜方式打包更多AI计算单元,在同样花销下能跑出更高算力、装下更多数据,让每一块钱换回更多结果。英伟达推出专门围绕AI任务重新设计的CPU,帮智能体更快把任务还给GPU,尽量少让昂贵的算力等空闲。谷歌本季营收和利润显著增长,云业务订单快速堆积,同时继续大手笔投入AI基础设施建设。全球AI算力产业正在从拼单块芯片转向拼CPU、GPU、网络和软件的整套组合。未来几年全球AI计算市场的总盘子可能突破两万亿元,其中AI加速器占比最大。算力租赁、数据中心配套和核心零部件的需求也会跟着水涨船高。总体看,模型越做越实用、越做越便宜,算力投入持续加码,行业景气度仍在爬坡。
专业版摘要
大模型加速迭代与成本下探推动AI算力需求持续走强。谷歌发布Gemini 3.6 Flash、Gemini 3.5 Flash-Lite及面向网络安全的Gemini 3.5 Flash Cyber等轻量级模型,并推进Gemini 3.5 Pro与Gemini 4训练;Anthropic推出Opus 5,在保持接近Fable 5综合性能的同时将调用成本降低约50%;阿里千问Qwen3.8即将发布并开源,参数规模达2.4T。AMD发布Helios机架级解决方案等全栈AI新品,单机架最高可部署72颗Instinct MI455X AI加速器,对比英伟达Vera Rubin NVL72,AI算力提升15%、HBM容量提升50%、横向扩展带宽提升50%,单位美元产出Token最多提升30%,并预计2030年全球AI计算市场规模将突破2万亿美元,其中AI加速器约1.4万亿美元、数据中心CPU约2200亿美元。英伟达发布首款自研CPU Vera,针对AI智能体任务优化,单核速度、内存带宽与延迟表现提升约50%,以提高GPU利用率,已于2024年6月交付OpenAI、Anthropic、SpaceX等客户。谷歌母公司Alphabet二季度营收1198亿美元、同比增24%,营业利润408亿美元、同比增30%,净利润1121亿元、同比增298%,云业务营收248亿美元、同比增82%,合同履约余额升至5140亿美元,Q2资本支出449亿美元并上调全年至1950亿—2050亿美元。产业趋势由单一GPU驱动转向CPU+GPU+DPU+FPGA+软件生态的全栈协同算力。建议关注国产AI芯片、超节点整机、算租/AIDC及核心配套等环节,同时警惕下游景气度、政策推进不及预期与技术迭代风险。
研报提及个股
关联个股