-
NVIDIA Rubin Ultra大调整:四芯片封装方案回退至双芯片,规格直接腰斩
【IT168原创新闻】据报道,英伟达对下一代数据中心GPU Rubin Ultra进行了重大设计调整,从此前计划的四芯片(Die)封装设计回归双芯片方案,核心规格直接腰斩,产业链对此高度关注。
资讯 2026-04-02
-
富士通拟开发 1.4nm AI 芯片,联合 Rapidus 本土制造
富士通计划开发采用Rapidus 1.4nm工艺的AI服务器定制芯片,整合自研NPU与CPU,实现本土化生产。该项目已申请约580亿日元研发支持,目标在2030年实现自研CPU与英伟达GPU互连,并与AMD合作,展现日本在先进半导体领域的追赶布局。
资讯 2026-03-31
-
2026年AI 算力服务商盘点:谁能提升资源利用率?谁把算力“用满”?
、调度效率低,导致大量 GPU 在非高峰期处于闲置状态,整体利用率偏低、成本居高不下,成为企业 AI 落地过程中难以忽视的“隐形痛点”。
资讯 2026-03-28
-
GTC解读:当我们谈论 AI 推理的 KV Cache,我们在做什么?
2026年3月,在全球人工智能与GPU计算领域最具影响力的技术盛会——NVIDIA GTC 2026大会上,阿里云资深技术总监张为受邀发表演讲,带来了《基于全局KV Cache存储系统的高效LLM推理加速方案》的深度分享。
资讯 2026-03-26
-
GTC现场官宣!英特尔至强6成英伟达DGX Rubin主控CPU
在英伟达GTC 2026大会上,英特尔正式宣布,英特尔至强 6处理器将作为主控处理器,应用于NVIDIA DGX Rubin NVL8 系统。这一举措充分彰显了在AI工作负载快速迈向大规模、实时推理的关键阶段,至强系列处理器为GPU加速AI系统,提供架构一致性与强大扩展能力所发挥的重要支撑作用。
资讯 2026-03-19
-
电力与算力:为AI时代重构数据中心架构
“解耦”处理,既为高密集堆叠的服务器腾出空间,又要以远超以往的效率输送更多电力。仅从额定功耗来看,一个兆瓦级的GPU机架产生的热量约是满载CPU机架的50倍。
资讯 2026-03-19
-
2026高性价比游戏本:华硕天选6 Pro酷睿版性能续航双优解
,L2+L3缓存66MB)和115W满功耗RTX 5060 GPU(8GB GDDR7显存,支持DLSS 4多帧生成),游戏性能足以应对《黑神话:悟空》《CS2》等主流大作;同时,90Wh大容量电池
资讯 2026-03-02
-
强强联手:当高性能硬件遇上多模态AI
5060显卡,支持180W性能释放,兼顾2.5K 180Hz高刷屏与国风设计;标准版将星X16则以13代酷睿i9+RTX 50系笔记本GPU组合主攻轻薄游戏本市场,给玩家更多的配置型号选择。
厂商动态 2025-12-10
-
突破显存瓶颈:基于 DeepSeek-V3.2-Exp 的 Latent Cache 卸载预取方案设计与模拟验证
凸显。核心症结在于,Decode 过程中 Latent Cache 规模会随序列长度呈线性增长,而 GPU 显存容量有限,这直接导致 Batch Size 难以提升,进而抑制了 Decode 阶段的吞吐增长。
资讯 2025-12-05
-
超聚变专用计算旗舰产品X3智能工作站,搭载NVIDIA驱动打造AI就绪算力
近日,超聚变首款工作站产品获得NVIDIA专业可视化能力认证。这一重要里程碑将助力超聚变持续以技术创新为核心,推出完整的高性能工作站产品组合,这些产品搭载 NVIDIA RTX PRO GPU,包括
资讯 2025-12-03