AI基础设施与模型层
聚合该赛道关键人物一手判断,值得关注的趋势与信号
- OpenAI正与博通合作自研AI芯片,以此在推理开销攀升之际降低硬件成本、提升利润率。早期测试结果显示,Jalapeño芯片或将削弱英伟达对其最重要客户之一的掌控力。
- AMD 同意以 82 亿美元收购李飞飞创办的 AI 初创企业 World Labs。
- OpenAI称,计划在今年年底前开始部署与博通开发的AI芯片Jalapeño,同时与英伟达、AMD及其他合作伙伴的加速器协同推进。
- 英伟达与多家华尔街公司达成5000亿美元的人工智能融资协议
- 谷歌为Anthropic组建约2000亿美元融资计划,超1500亿与TPU相关,涉及博通、黑石、阿波罗等机构
- 美国四大科技巨头竞逐AI,支出承诺总计超2万亿美元
- 腾讯与甲骨文签订五年协议,租赁10万片AI芯片
- 阿里云将数据中心交付周期缩短至100天
- 中芯国际赵海军:中国互联网公司硬件投资超预期,算力及配套芯片供不应求
针对特定硬件平台定制软件栈并将性能压榨至硬件上限,直接体现软硬件联合优化路线的实际效果
支撑:#中国算力企业真正的全栈能力,将体现为软硬件联合优化,而不是简单扩大产品线
软件层减少数据读写通信开销,硬件层提供高速互连与调度,共同支撑超大规模任务,体现软硬件联合调优而非单纯堆叠产品线。
支撑:#中国算力企业真正的全栈能力,将体现为软硬件联合优化,而不是简单扩大产品线
KV Cache压缩机制的管理质量直接决定长序列推理的检索准确度,证明KV Cache已成为独立性能瓶颈层
支撑:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层
软硬件联合优化带来可量化客户成果,直接印证全栈能力的有效定义在于统一调优而非堆叠产品线
支撑:#中国算力企业真正的全栈能力,将体现为软硬件联合优化,而不是简单扩大产品线
节点间互连时延大幅下降,直接印证互连已成为算力网络独立竞争层
支撑:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层
围绕实际工作负载完成软件、架构、芯片三层联合优化,是软硬件协同而非产品线堆叠的直接体现
支撑:#中国算力企业真正的全栈能力,将体现为软硬件联合优化,而不是简单扩大产品线
Agent沙盒运行规模扩大,使存储成为需单独优化的技术层
支撑:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层
存储层直接介入AI推理调度并替代部分DRAM功能,印证存储已成为推理链路中的独立竞争层
支撑:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层
纯软件路径实现跨层调优降低Token成本,支持“围绕负载统一调优”而非扩大产品线的全栈能力定义
支撑:#中国算力企业真正的全栈能力,将体现为软硬件联合优化,而不是简单扩大产品线
华为冷却系统与计算芯片共享负载信息并协同响应,是围绕客户负载完成跨层联合调优的直接案例
支撑:#中国算力企业真正的全栈能力,将体现为软硬件联合优化,而不是简单扩大产品线
真实生产场景中KV Cache容量不足已成为推理瓶颈,外置存储方案直接改善推理效率,印证存储已成独立竞争层
支撑:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层
在集群服务层面同时优化吞吐与故障恢复,体现围绕客户负载做跨层联合调优而非单纯扩大硬件产品线
支撑:#中国算力企业真正的全栈能力,将体现为软硬件联合优化,而不是简单扩大产品线


