AI基础设施与模型层
聚合该赛道重要信号、值得关注的趋势与异动
- 英伟达向SB Energy投资15亿美元,该开发商正参与OpenAI项目
- 英伟达洽谈对 Perplexity 的投资,后者估值超 300 亿美元,同时考虑开展技术授权交易
- 英伟达将向人工智能模型初创公司Poolside支付60亿美元,作为一项许可和人才招聘协议的一部分。
- AI版权危机再度升级:独立音乐出版商起诉Anthropic与Suno,索赔或超 10 亿美元
- 全球最大生活指南百科 WikiHow 指控 OpenAI 爬取超 1.1 万篇教程文章训练 AI
- 因使用主播内容训练亚马逊 AI,Twitch 面临集体诉讼
- 英伟达Vera Rubin NVL72每瓦算力最高提升30倍
- 三星公布LPDDR5X-PIM性能,AI推理速度提升2倍
- 英伟达:NEMO Switchyard将基准测试完成成本降至Opus 4.8的三分之一。
AI能源短缺压力促使探索路径从地面延伸至太空,专属能源多元化趋势获更高层背书
支撑:#AI数据中心转向自备燃气与核能,专属能源成为算力扩张前置条件
国产头部芯片厂商针对Agent推理场景专项发布开放计算架构,自主化布局从通用算力向Agent任务链条延伸
支撑:#国产AI芯片算力自主化进入“可用”验证密集期
摩尔线程国产GPU成功完成主流国产大模型的极速适配,自主芯片生态兼容性持续拓宽
支撑:#国产AI芯片算力自主化进入“可用”验证密集期
芯片巨头以百亿美元级并购直接打通模型生态层,算力与应用层一体化整合提速
支撑:#大模型公司的竞争正在从模型能力扩展到芯片、算力与云基础设施
高通HBC在能效与带宽上形成对HBM的替代压力,内存环节的成本与性能博弈持续加剧
支撑:#算力成本矛盾已从芯片蔓延至内存、电源和终端设备全链条
GLM5.3Flash训练疑采用海光DCU,国产算力从推理侧向训练侧“可用”场景扩展
支撑:#国产AI芯片算力自主化进入“可用”验证密集期
英伟达CEO公开否认循环融资逻辑,头部厂商主动为算力扩张高杠杆模式背书
削弱:#算力基建融资转向贷款、担保与证券化,扩张继续推高杠杆风险
英伟达调整HBM4内存规格结构,8Hi低堆叠占比提升,说明内存选型已成为算力成本管控的主动变量
支撑:#算力成本矛盾已从芯片蔓延至内存、电源和终端设备全链条
英伟达强调自身提供差异化服务,侧面印证芯片层已成为大模型竞争的独立战场
支撑:#大模型公司的竞争正在从模型能力扩展到芯片、算力与云基础设施
MiniMax以5亿美元规模深度绑定单一云平台,表明算力基础设施已成大模型公司核心竞争投入方向
支撑:#大模型公司的竞争正在从模型能力扩展到芯片、算力与云基础设施
生成速度翻倍、Token消耗降75%,单位算力成本大幅压缩,按量计费的边际成本显著下降,混合定价中“量”的部分对用户更友好
支撑:#AI定价从"无限畅饮"转向"订阅+按量付费"式混合模式
外部政策层面出现对Token使用征税的倡议,从成本侧强化按量计费转型的合理性
支撑:#AI定价从"无限畅饮"转向"订阅+按量付费"式混合模式
英伟达专项定制HBM而非沿用通用标准,印证内存已成算力链条独立攻关战场
支撑:#算力成本矛盾已从芯片蔓延至内存、电源和终端设备全链条
英伟达从GPU扩张至高端CPU,单一架构垄断供给的格局被头部玩家自身打破
支撑:#AI算力供给正加速从单一GPU依赖走向多元芯片并存格局
英伟达以超130亿美元并购开源模型平台,算力与模型层之间的竞争边界被资本直接打穿,全栈整合提速
支撑:#大模型公司的竞争正在从模型能力扩展到芯片、算力与云基础设施
黄仁勋宣告AI进入变现时代,印证AI商业化加速但未涉及广告模式或中立争议
支撑:#聊天助手开始卖广告,商业化提速也带来回答中立争议
英伟达新一代GPU进入大规模出货阶段,头部供应商市场主导地位进一步巩固,多元芯片并存格局的形成节奏受阻
削弱:#AI算力供给正加速从单一GPU依赖走向多元芯片并存格局
算力巨头以500亿美元规模直接入股前沿实验室,芯片厂商竞争已深度延伸至模型生态层
支撑:#大模型公司的竞争正在从模型能力扩展到芯片、算力与云基础设施
云厂商与芯片巨头联手大规模扩建算力层,算力与云基础设施已成为竞争主战场之一
支撑:#大模型公司的竞争正在从模型能力扩展到芯片、算力与云基础设施
英伟达CEO将算力与收入直接画等号,头部厂商公开背书算力商品化定价逻辑,强化其可交易属性认知
支撑:#算力也能像商品一样交易,价格波动开始有了对冲工具
AI模型被实际用于入侵AI基础设施平台,攻击长达一周未被察觉,防御盲区已被实战验证
支撑:#AI模型本身正成为黑客攻击目标,"攻击AI"已从理论走向实战
OpenAI自研推理芯片已进入早期测试,大模型厂商向芯片层延伸由意向转为实质推进
支撑:#大模型公司的竞争正在从模型能力扩展到芯片、算力与云基础设施
谷歌将通用Gemini系列拆分出专项转录模型,通用与垂直模型产品线分化路径获头部厂商验证
支撑:#通用工作智能体与垂直智能体并行分化,编排能力和行业数据决定产品边界
Anthropic以450亿美元量级重金布局第三方数据中心,大模型公司对云算力基础设施的资本投入强度持续升级
支撑:#大模型公司的竞争正在从模型能力扩展到芯片、算力与云基础设施
10万张国产卡实际承载旗舰模型商业服务,国产算力大规模工程可用性得到直接验证
支撑:#国产AI芯片算力自主化进入“可用”验证密集期


