Intel 之前在Computex 2026 上揭露了一款不走常规路线的资料中心GPU,产品代号Crescent Island。这款晶片舍弃了当下AI 加速器必用的HBM(高频宽记忆体),转而采用LPDDR5X 作为记忆体方案。 日前Hot Chips 2026 大会上Intel 进一步补上架构规格:32 个Xe 核心、256 个XMX 引擎,记忆体部分公版配备160GB,ODM 合作伙伴最高可扩充到480GB。
为什么不用HBM?
Intel 的选择其实相当务实,当前HBM 半导体的产能几乎被NVIDIA 、TPU 等高阶GPU 产品吃光,早已不是秘密。 SK Hynix 掌握约57% 的HBM 市场营收,连同Samsung 在内,两家供应商的产能已全数分配完毕。 SK Hynix 公开表示无法满足所有客户订单,Samsung 记忆体部门主管更警告「显著缺货」将延续到2027 年以后。
对于一张需要数百GB HBM 的加速卡来说,这种供货紧张是结构性的产能天花板。 Intel 给出的答案是直接跳过HBM,改用LPDDR5X,同一套在手机与笔记本上量产多年的记忆体标准,由数十家工厂同时量产,供货无虞。 Crescent Island 采用Intel Xe3P 架构(Xe3 的效能强化版,与Panther Lake 笔记本处理器同源),定位为纯推理用的资料中心加速器。
容量vs 频宽:一场设计取舍
用LPDDR5X 代替HBM,最直接代价是频宽。 Crescent Island 在公版160GB 配置下约提供684 GB/s 记忆体频宽,约是NVIDIA H200(HBM3e)的七分之一。从数字上看,差距确实很大。但Intel 的论点是:推理场景的瓶颈不在频宽,在容量。举例来说,一个2000 亿参数的模型以FP8 储存,约需200GB 记忆体。在单张480GB 的Crescent Island 上,这个模型不需量化、不需跨卡切分就能完整载入。对比之下,NVIDIA H200 仅141GB HBM3e,B200 约192GB,装不下就要切成多卡分散部署,连带产生跨GPU 的通讯开销。
Intel 锁定的目标是代理型AI 推理(agentic AI inference),也就是多步骤推理链、长上下文文件分析、连续程式码生成这类工作负载。这些场景不易在跨卡环境中平行化,一张卡能装下完整模型,部署与管理都简单得多。 Intel 执行长陈立武在Computex 主题演讲中强调,Crescent Island 是专为「代理型AI」设计的晶片。
记忆体频宽的实际影响得看配置。公版160GB 版本的684 GB/s 频宽,来自640-bit 汇流排搭配LPDDR5X-10667 颗粒。若ODM 将记忆体扩充到480GB,汇流排可能需要拉宽到1280-bit,此时频宽有机会提升到1.5 TB/s 左右,缩小与HBM 加速器的差距。
以小批次推理为例,当每批只送一两个提示时,运算单元大部分时间在等资料从记忆体送过来,频宽就是瓶颈。这部分Crescent Island 和HBM 加速器的七倍差距会直接反映在输出速度上。但当推理链拉长、上下文累积到数万token 时,计算本身的耗时逐渐主导延迟,频宽的影响就没那么显著了。 Intel 的论述建立在后一种场景上:代理型AI 的推理链天然就长,频宽的边际效用递减,容量才是决定能跑什么模型的关键。
350W 气冷卡,部署门槛更低
Crescent Island 是一张标准PCIe 附加卡,350W 功耗,不需液冷即可在传统4U 或5U 伺服器机箱内运作。 NVIDIA 最新的Blackwell 系列加速器功耗落在700W 到1000W 之间,需搭配客制化液冷基础设施。对于没有液冷资料中心的企业来说,Crescent Island 可以直接插进现有机柜,部署门槛明显更低。
一张480GB 容量的卡跑在350W,代表八卡全满的系统总功耗约2,800W,仍落在标准机柜供电范围内。从硬体配置来看,Intel 的目标客户很明确:那些排不上NVIDIA 供货名单、又需要大容量推理方案的企业用户。 Intel 的Arc Pro B70 工作站级推理卡已经证明这条路线可行,Crescent Island 把同一个策略放大到资料中心等级。
八张Crescent Island 插满一台4U 伺服器,总记忆体容量可达3.84TB(以480GB 版本计算),足以载入完整的7000 亿参数模型。对照NVIDIA DGX B200 的1.4TB HBM3e 总容量,Crescent Island 在记忆体容积上占了明显优势。当然,频宽差距会让大批量推理的每卡输出速度受限,但对于注重模型完整度的场景,容量就是硬道理。
软体生态与出货时程
Intel 为Crescent Island 搭配oneAPI 软体堆叠,oneAPI 的普及度远不如NVIDIA 的CUDA 或AMD 的ROCm,但对已经在Intel 生态系内开发的团队来说,迁移成本相对可控。 Intel 没有公布任何运算效能数据,没有TFLOPS,没有TOPS,也没有推理基准测试。目前整个论述建立在记忆体容量与部署弹性上。
送样时间订在2026 下半年。对照Computex 六月揭露到八月Hot Chips 才补上核心规格的节奏来看,Intel 对这款产品的资讯释放相当审慎。直到有第三方独立测试数据出来之前,Crescent Island 的实际推理效能仍是个问号。但以单卡480GB 容量对抗HBM 供应天花板的策略,至少在市场定位上找到了没人抢的空间。
从产业角度来看,Crescent Island 更大的意义在于它打破了AI 加速器「非HBM 不可」的既定印象。如果LPDDR5X 路线在推理场景被验证可行,未来可能会有更多厂商跟进这条路径,特别是那些被HBM 供应链排除在外的晶片设计公司。 Intel 赌的是记忆体容量比频宽重要,而且赌对的机率随着模型参数量持续增长而愈来愈高。 2026 下半年送样后,真实世界的测试结果会给出答案。

