英伟达的AI优势,正从GPU扩展到整套数据中心系统
随着AI算力集群迈向超大规模,决定效率的因素不再只是GPU数量,而是数据、存储、网络与计算之间能否顺畅协同。英伟达正在把竞争优势延伸到GPU之外的系统编排层。
阅读全文随着AI算力集群迈向超大规模,决定效率的因素不再只是GPU数量,而是数据、存储、网络与计算之间能否顺畅协同。英伟达正在把竞争优势延伸到GPU之外的系统编排层。
阅读全文苹果更新 Mac mini 和 Mac Studio,并推出 M6 与 M5 Ultra 芯片。高内存容量、统一内存带宽和 Thunderbolt 5 互联,让 Mac 逐渐成为本地大模型开发与推理的另类平台。
阅读全文当 GPU 从稀缺设备变成可按小时租赁的生产资料,算力价格波动就开始具备金融对冲需求。CME、Silicon Data 与 CFTC 的一系列动作,显示 GPU 期货正在从概念走向市场基础设施。
阅读全文随着数据中心和GPU投入持续攀升,AI算力正从技术资源变成需要管理价格风险的关键成本。Silicon Data希望建立GPU租赁参考价,并推动算力期货进入传统金融市场。
阅读全文AMD 宣布收购多伦多 AI 芯片初创公司 Taalas,后者主张将模型权重直接固化到硅片中,以绕开传统内存访问瓶颈。若交易按计划在 2026 年第四季度完成,AMD 的 AI 推理版图将增加一条非传统计算路径。
阅读全文Anthropic 已确认正在招聘定制硅团队,计划为 Claude 等模型探索自研芯片。公司强调未来仍会采用多芯片策略,而不是完全替代外部供应商。
阅读全文AMD 将 MI455X 与 Helios 机架级系统推到台前,试图用 2nm 计算芯粒、HBM4 大显存和开放互连体系切入 AI 基础设施核心市场。
阅读全文北弗吉尼亚一次输电线路故障没有造成大停电,却让 PJM 电网经历了异常电压波动。事件显示,密集布局的 AI 数据中心在电网扰动中同步脱网,正成为新的系统性风险。
阅读全文AMD发布面向大型AI数据中心的Helios机架级系统,并称其将于今年晚些时候开始向客户交付。随着微软、Anthropic、OpenAI等客户计划部署,AMD正试图在Nvidia长期占优的AI算力基础设施市场打开缺口。
阅读全文由三名哈佛辍学生创办的 AI 芯片公司 Etched 完成 3 亿美元 C 轮融资,估值达到 103 亿美元。公司押注推理计算瓶颈,试图用自研芯片、内存与互连系统挑战 GPU 主导格局。
阅读全文在WAIC 2026上,奇异摩尔首次集中展示了国产超节点互联全栈方案、国产GPU直通国产RDMA网卡的IBGDA Demo,以及面向下一代光互联的布局。更重要的是,这不是单点产品秀,而是在推动国产算力从“芯片可用”走向“系统可用”。
阅读全文安谋科技在 WAIC 2026 展示的不是单一加速器,而是一套面向边端 AI 的系统化方案:CPU 负责控制与轻量向量计算,NPU 承担复杂推理,VPU 面向机器视觉重构编码,AIOS 则尝试补上异构调度与 Agent 编排。
阅读全文云天励飞披露了面向未来两年多的AI推理芯片路线图,计划以三款DeepVerse芯片分别优化Prefill、Decode和Decode FFN负载。其核心思路不是单纯堆峰值算力,而是用异构集群降低大规模Token生成成本。
阅读全文General Compute获得Upper90提供的4亿美元贷款,并以面向推理的AI芯片作为抵押。这笔交易显示,AI基础设施资本正从训练GPU热潮,转向更便宜、更高效的推理算力。
阅读全文VentureBeat Pulse Research 对 107 家企业的调查显示,企业正在加速购买 AI 基础设施,但对真实成本、利用率和单位经济性的掌握明显滞后。所谓“算力缺口”,正成为 AI 从试点走向规模化时的新风险。
阅读全文arXiv 新论文提出 Kaleido,通过挖掘视频扩散 Transformer 潜空间中的通道级时空相关性,在算法与硬件两端同时降低生成视频的计算成本。
阅读全文