AI基础设施与模型层

聚合该赛道关键人物一手判断,值得关注的趋势与信号

重要信号 Top 3
01OpenAI推出新一代主力模型 GPT-6.1 Sol 和常驻型 Agent「Dots」
02DeepSeek开源昇腾平台编译工具与计算库,多项测试接近硬件上限
03新思科技与亚马逊达成多年期定制芯片战略IP协议
信号流
DeepSeek开源昇腾平台编译工具与计算库,多项测试接近硬件上限

针对特定硬件平台定制软件栈并将性能压榨至硬件上限,直接体现软硬件联合优化路线的实际效果

支撑:#中国算力企业真正的全栈能力,将体现为软硬件联合优化,而不是简单扩大产品线

33人正在追踪
曙光8000通过软件优化与硬件系统协同完成超大规模并行CFD仿真计算

软件层减少数据读写通信开销,硬件层提供高速互连与调度,共同支撑超大规模任务,体现软硬件联合调优而非单纯堆叠产品线。

支撑:#中国算力企业真正的全栈能力,将体现为软硬件联合优化,而不是简单扩大产品线

33人正在追踪
行动指引有更新
字节Seed团队发现分块KV缓存压缩导致长上下文检索准确度各阶段相差高达40个百分点

KV Cache压缩机制的管理质量直接决定长序列推理的检索准确度,证明KV Cache已成为独立性能瓶颈层

支撑:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层

38人正在追踪
华为通过UB互连、Peerium架构与原厂服务联合优化,头部客户训练成本降低、MFU大幅提升

软硬件联合优化带来可量化客户成果,直接印证全栈能力的有效定义在于统一调优而非堆叠产品线

支撑:#中国算力企业真正的全栈能力,将体现为软硬件联合优化,而不是简单扩大产品线

33人正在追踪
空心光纤在宁夏中卫智算中心间商用,节点间传输时延与损耗直降30%以上

节点间互连时延大幅下降,直接印证互连已成为算力网络独立竞争层

支撑:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层

38人正在追踪
华为τ芯片采用软件架构芯片全栈软硬芯协同设计基于实际负载实现指令流数据流细粒度控制

围绕实际工作负载完成软件、架构、芯片三层联合优化,是软硬件协同而非产品线堆叠的直接体现

支撑:#中国算力企业真正的全栈能力,将体现为软硬件联合优化,而不是简单扩大产品线

33人正在追踪
DeepSeek将Agent沙盒镜像数据迁入3FS并按需加载,提速约1.71倍

Agent沙盒运行规模扩大,使存储成为需单独优化的技术层

支撑:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层

38人正在追踪
江波龙端侧AI存储方案通过存储参与推理数据调度,减少大模型对DRAM的持续占用

存储层直接介入AI推理调度并替代部分DRAM功能,印证存储已成为推理链路中的独立竞争层

支撑:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层

38人正在追踪
是石科技不改动模型结构仅凭软件优化降低推理成本并提升GPU利用率

纯软件路径实现跨层调优降低Token成本,支持“围绕负载统一调优”而非扩大产品线的全栈能力定义

支撑:#中国算力企业真正的全栈能力,将体现为软硬件联合优化,而不是简单扩大产品线

33人正在追踪
华为TMU热管理单元与昇腾服务器实现原生适配并通过冷电联动跟随计算负载响应

华为冷却系统与计算芯片共享负载信息并协同响应,是围绕客户负载完成跨层联合调优的直接案例

支撑:#中国算力企业真正的全栈能力,将体现为软硬件联合优化,而不是简单扩大产品线

33人正在追踪
某头部股份制银行AI Coding场景部署外置KV存储后缓存命中率从60%升至95%、TPS提升30%

真实生产场景中KV Cache容量不足已成为推理瓶颈,外置存储方案直接改善推理效率,印证存储已成独立竞争层

支撑:#长上下文与Agent普及,将使显存、KV Cache、存储和互连成为独立的竞争层

38人正在追踪
华为云AICS实现Token吞吐提升20%并将故障恢复时间压缩至10分钟

在集群服务层面同时优化吞吐与故障恢复,体现围绕客户负载做跨层联合调优而非单纯扩大硬件产品线

支撑:#中国算力企业真正的全栈能力,将体现为软硬件联合优化,而不是简单扩大产品线

33人正在追踪
加载中…