AI算力基建动态简报(2026.07.22)

📅 2026/7/22 21:52:58
AI算力基建动态简报(2026.07.22)
数据来源公开信息整理腾讯新闻、虎嗅、经济观察报、证券时报、21世纪经济报道等。本简报为客观信息汇总不构成投资建议。第1条微软宣布在 Azure 大规模部署 AMD Helios 机架级 AI 系统核心信息微软于 7 月 20 日宣布将在 Azure 数据中心部署 AMD Helios 机架式 AI 系统作为新一代 AI 推理基础设施用于支撑自身及云上客户的前沿大模型推理任务。Helios 是 AMD 首个正式出货的机架级 AI 系统微软加入 Meta、OpenAI、甲骨文等客户行列。性能/价格对比Helios 核心由 AMD Instinct MI455X GPU、第六代 EPYC Venice 数据中心处理器、Pensando 网络芯片及 ROCm 软件栈构成。AMD 称与上一代 MI400/MI450 系列相比新一代 GPU 在混合专家MoE模型推理上的性能有望取得数量级提升机架级设计进一步优化可扩展性与能效。对开发者/企业的影响Azure 将新增基于 AMD EPYC Venice 与 Instinct MI455X 的多款云实例为云上大模型推理、企业生产级 AI 工作负载及高性能计算场景提供更多非英伟达硬件选项有助于降低高端算力供给的集中度。信息来源虎嗅 / AMD 官方公告 | 2026-07-20第2条阿里千问发布 Qwen3.8 Max 预览版2.4 万亿参数并计划开源核心信息阿里千问于 7 月 19 日至 21 日密集发布多款新模型其中旗舰模型通义千问 3.8 Max 预览版参数规模达 2.4 万亿2.4T并计划于短期内开源已接入 Token Plan 与 Qoder 平台。花旗在研报中重申阿里 买入 评级称其发挥全栈优势。同期阿里还发布了第三代图像生成模型 Qwen-Image-3.0支持 4.5k token 超长输入与 12 国语言原生渲染及语音合成模型 Qwen-Audio-3.0-TTS。性能/价格对比Qwen3.8 Max 预览版宣称实力仅次于 Anthropic 的 Fable 5在长程多 Agent 任务上匹敌世界前沿。Qwen-Audio-3.0-TTS 含 Flash 与 Plus 双版本支持嘈杂环境克隆人声、16 种语言及 20 种方言Flash 版首包延时达 300ms 级。对开发者/企业的影响2.4T 参数模型计划开源延续了 Qwen 系列的开放权重路线使组织可下载、定制并本地部署前沿级模型Qwen-Image-3.0 与 Qwen-Audio-3.0-TTS 已分别在阿里云百炼、千问 AI 平台邀测为图像与语音场景提供新的 API 选项。信息来源腾讯新闻、凤凰网、观点新媒体 | 2026-07-19 至 2026-07-21第3条国内十万卡智算集群进入抢建周期2026 算力直接投资超 4000 亿核心信息据经济观察报 7 月 19 日报道国内正掀起十万卡级智算集群建设热潮。7 月初国内首座全链路国产十万卡 AI 超集群已在郑州落成同期甘肃庆阳总投资 51 亿元的西部智算中心开工一期 8860 架 AI 机柜按十万卡规模设计计划 2027 年 5 月交付济南推进 泉城算力一张网 十万卡集群规划。性能/价格对比中国国际工程咨询有限公司 7 月 11 日测算显示2026 年全国算力基础设施直接投资超 4000 亿元十五五 全产业链投资约 6 万亿元算力网已写入 十五五 六张核心基建清单。工信部等七部门 6 月 18 日印发行动方案推进全国一体化算力监测调度平台目标 2028 年实现规模化全域并网。对开发者/企业的影响大规模集群建设有望缓解高端算力供给紧张但报道同时指出部分已投产园区综合算力利用率不足五成算力调度与消纳成为新挑战国家级调度体系的推进将影响未来算力成本与可用性的区域分布。信息来源经济观察报 | 2026-07-19第4条谷歌被指通过 Chrome 静默安装约 4GB Gemini Nano 端侧模型核心信息据 7 月 21 日报道谷歌被指在用户未获明确通知的情况下于 Chrome 浏览器中静默安装约 4GB 的 Gemini Nano 设备端 AI 模型权重文件引发关于隐私与用户自主权的争议欧洲或面临相应法律后果。性能/价格对比Gemini Nano 属端侧on-device轻量模型相较云端大模型推理无需联网即可运行但其约 4GB 的权重体积对终端存储与带宽形成可观占用。该事件凸显端侧 AI 模型在分发机制上与用户知情权的冲突。对开发者/企业的影响端侧模型部署正成为浏览器与操作系统厂商的标配能力但静默分发方式可能触发合规风险面向企业的端侧 AI 方案需在模型更新透明度与用户体验之间建立更明确的授权机制。信息来源腾讯新闻地球档案馆 | 2026-07-21第5条国产差异化架构突围清微智能 TX82 与东方算芯 DF1000 亮相 WAIC核心信息在 2026 世界人工智能大会WAIC上除通用 GPU 路线外差异化架构企业展示了缓解先进制程与高端存储供给压力的新路径。清微智能推出第三代可重构架构与 TX82 3D 堆叠芯片原型配套千卡级 REX81 超节点以降低集群互联成本东方算芯全球首发 DF1000 3D 堆叠近存 AI 芯片采用成熟 14nm 工艺搭配存储计算垂直键合架构。性能/价格对比东方算芯 DF1000 的访存带宽据称远超传统 HBM 方案依靠架构创新缩小与先进制程芯片的差距可覆盖云端推理、人形机器人、智能终端等场景下半年规划十万片出货量。相关厂商均强调通过 3D 先进封装、一体化系统集成与全栈软件适配实现低成本、高适配的算力服务。对开发者/企业的影响在先进制程与 HBM 供给受限背景下近存计算与可重构架构为国产算力提供了不以单芯片峰值性能为核心的突围路径有利于降低中大规模 AI 应用场景的总体 Token 成本。信息来源证券时报、21 世纪经济报道 | 2026-07-19 至 2026-07-21本简报由 英辰朗迪GEO 整理