AI基础设施与模型层

聚合该赛道重要信号、值得关注的趋势与异动

重要信号 Top 3
01国产算力芯片爆单
02三星电子、SK海力士与高通合作推进HBC技术商业化
03我国日均词元调用量已突破500万亿
信号流
AI 硬件行动指引有更新
NASA 局长艾萨克曼力挺太空数据中心:缓解 AI 能源短缺,将带来巨大好处

AI能源短缺压力促使探索路径从地面延伸至太空,专属能源多元化趋势获更高层背书

支撑:#AI数据中心转向自备燃气与核能,专属能源成为算力扩张前置条件

28人正在追踪
AI 硬件
海光信息发布“Agent to Token开放计算架构

国产头部芯片厂商针对Agent推理场景专项发布开放计算架构,自主化布局从通用算力向Agent任务链条延伸

支撑:#国产AI芯片算力自主化进入“可用”验证密集期

136人正在追踪
AI 硬件
摩尔线程完成智谱GLM-5.3-Flash极速适配

摩尔线程国产GPU成功完成主流国产大模型的极速适配,自主芯片生态兼容性持续拓宽

支撑:#国产AI芯片算力自主化进入“可用”验证密集期

136人正在追踪
AI 硬件行动指引有更新
英伟达加速布局AI全链条生态,据称129亿美元收购Hugging Face

芯片巨头以百亿美元级并购直接打通模型生态层,算力与应用层一体化整合提速

支撑:#大模型公司的竞争正在从模型能力扩展到芯片、算力与云基础设施

70人正在追踪
AI 硬件
高通详解HBC近存架构:能效与带宽上比HBM有优势,云厂商已有兴趣

高通HBC在能效与带宽上形成对HBM的替代压力,内存环节的成本与性能博弈持续加剧

支撑:#算力成本矛盾已从芯片蔓延至内存、电源和终端设备全链条

204人正在追踪
AI 硬件
GLM5.3Flash训练线索浮现,知情人士称或依托海光DCU等国产算力

GLM5.3Flash训练疑采用海光DCU,国产算力从推理侧向训练侧“可用”场景扩展

支撑:#国产AI芯片算力自主化进入“可用”验证密集期

136人正在追踪
AI 硬件行动指引有更新
黄仁勋驳斥“循环融资”质疑:AI 行业需要巨额资金,英伟达投资风险很低

英伟达CEO公开否认循环融资逻辑,头部厂商主动为算力扩张高杠杆模式背书

削弱:#算力基建融资转向贷款、担保与证券化,扩张继续推高杠杆风险

42人正在追踪
AI 硬件
消息称英伟达调整 HBM4 内存需求,8Hi 低堆叠占比提升

英伟达调整HBM4内存规格结构,8Hi低堆叠占比提升,说明内存选型已成为算力成本管控的主动变量

支撑:#算力成本矛盾已从芯片蔓延至内存、电源和终端设备全链条

204人正在追踪
AI 硬件
黄仁勋回应 OpenAI 首款自研 AI 芯片挑战:英伟达提供“截然不同”服务

英伟达强调自身提供差异化服务,侧面印证芯片层已成为大模型竞争的独立战场

支撑:#大模型公司的竞争正在从模型能力扩展到芯片、算力与云基础设施

70人正在追踪
AI 硬件
深度绑定阿里云,MiniMax大幅上修算力采购上限至5亿美元

MiniMax以5亿美元规模深度绑定单一云平台,表明算力基础设施已成大模型公司核心竞争投入方向

支撑:#大模型公司的竞争正在从模型能力扩展到芯片、算力与云基础设施

70人正在追踪
AI 原生产品
千问办公上线Qwen3.8-Flash,生成速度提升100%,Token消耗减少75%

生成速度翻倍、Token消耗降75%,单位算力成本大幅压缩,按量计费的边际成本显著下降,混合定价中“量”的部分对用户更友好

支撑:#AI定价从"无限畅饮"转向"订阅+按量付费"式混合模式

116人正在追踪
AI 原生产品
比尔盖茨谈AI:建议征收Token税,并为人类留专属工作岗位

外部政策层面出现对Token使用征税的倡议,从成本侧强化按量计费转型的合理性

支撑:#AI定价从"无限畅饮"转向"订阅+按量付费"式混合模式

116人正在追踪
AI 硬件
英伟达推出 NVHBM 定制高带宽内存:相比 HBM4e 带宽提升 30%、功耗降低 15%

英伟达专项定制HBM而非沿用通用标准,印证内存已成算力链条独立攻关战场

支撑:#算力成本矛盾已从芯片蔓延至内存、电源和终端设备全链条

204人正在追踪
AI 硬件行动指引有更新
英伟达:明年客户需求可达翻倍级别,正式切入全球高端CPU赛道

英伟达从GPU扩张至高端CPU,单一架构垄断供给的格局被头部玩家自身打破

支撑:#AI算力供给正加速从单一GPU依赖走向多元芯片并存格局

147人正在追踪
AI 硬件
据报道,英伟达已就以超130亿美元收购Hugging Face展开谈判。

英伟达以超130亿美元并购开源模型平台,算力与模型层之间的竞争边界被资本直接打穿,全栈整合提速

支撑:#大模型公司的竞争正在从模型能力扩展到芯片、算力与云基础设施

70人正在追踪
AI 原生产品
英伟达黄仁勋:AI 已迈过商业化拐点,全球产业进入 AI 变现时代

黄仁勋宣告AI进入变现时代,印证AI商业化加速但未涉及广告模式或中立争议

支撑:#聊天助手开始卖广告,商业化提速也带来回答中立争议

23人正在追踪
AI 硬件
英伟达首席财务官:预计将在本季度晚些时候开始向早期客户大规模出货Groq 3 LPX

英伟达新一代GPU进入大规模出货阶段,头部供应商市场主导地位进一步巩固,多元芯片并存格局的形成节奏受阻

削弱:#AI算力供给正加速从单一GPU依赖走向多元芯片并存格局

147人正在追踪
AI 硬件
英伟达首席财务官:我们已对前沿实验室投资500亿美元。

算力巨头以500亿美元规模直接入股前沿实验室,芯片厂商竞争已深度延伸至模型生态层

支撑:#大模型公司的竞争正在从模型能力扩展到芯片、算力与云基础设施

70人正在追踪
AI 硬件
亚马逊云科技与英伟达将为智能体AI物理AI额外提供200万颗图形处理器及下一代基础设施。

云厂商与芯片巨头联手大规模扩建算力层,算力与云基础设施已成为竞争主战场之一

支撑:#大模型公司的竞争正在从模型能力扩展到芯片、算力与云基础设施

70人正在追踪
AI 硬件行动指引有更新
英伟达CEO黄仁勋表示:现在算力就是收入

英伟达CEO将算力与收入直接画等号,头部厂商公开背书算力商品化定价逻辑,强化其可交易属性认知

支撑:#算力也能像商品一样交易,价格波动开始有了对冲工具

14人正在追踪
AI 原生产品行动指引有更新
OpenAI:AI模型入侵Hugging Face的行为在一周后才被发现。

AI模型被实际用于入侵AI基础设施平台,攻击长达一周未被察觉,防御盲区已被实战验证

支撑:#AI模型本身正成为黑客攻击目标,"攻击AI"已从理论走向实战

94人正在追踪
AI 硬件
OpenAI正与博通合作自研AI芯片,以此在推理开销攀升之际降低硬件成本、提升利润率。早期测试结果显示,Jalapeño芯片或将削弱英伟达对其最重要客户之一的掌控力。

OpenAI自研推理芯片已进入早期测试,大模型厂商向芯片层延伸由意向转为实质推进

支撑:#大模型公司的竞争正在从模型能力扩展到芯片、算力与云基础设施

70人正在追踪
AI 硬件行动指引有更新
谷歌发布Gemini 3.5 Transcribe

谷歌将通用Gemini系列拆分出专项转录模型,通用与垂直模型产品线分化路径获头部厂商验证

支撑:#通用工作智能体与垂直智能体并行分化,编排能力和行业数据决定产品边界

70人正在追踪
AI 硬件
Anthropic 将以 450 亿美元租赁 Nscale 数据中心。

Anthropic以450亿美元量级重金布局第三方数据中心,大模型公司对云算力基础设施的资本投入强度持续升级

支撑:#大模型公司的竞争正在从模型能力扩展到芯片、算力与云基础设施

70人正在追踪
AI 硬件
智谱推出对标DeepSeek的轻量旗舰模型GLM-5.3 Flash,由10万国产卡支持

10万张国产卡实际承载旗舰模型商业服务,国产算力大规模工程可用性得到直接验证

支撑:#国产AI芯片算力自主化进入“可用”验证密集期

136人正在追踪
加载中…