单颗至强6+跑超1000个智能体 英特尔重构以CPU为核心的智算中心

移动通信网 云坪

2026年9月22日,在2026英特尔技术创新与产业生态大会上,英特尔展示了以CPU为中枢、面向智能体AI需求的全新智算中心架构,覆盖CPU、GPU、IPU到存储的完整链路。这一架构调整的直接动因是智能体的规模化落地:全球已有近80%的企业开始在内部尝试和导入智能体,在中国,活跃的企业智能体预计到2031年将超过3.5亿个。英特尔数据中心集团副总裁、中国区总经理陈葆立在主题演讲中直言:“数据中心的架构必须随智能体AI而变。一个智能体从思考到执行,牵动的是模型推理、任务编排、数据搬运与记忆管理的完整链路。因此,全新的智算中心,应该以CPU为核心、CPU与GPU、IPU、存储协同运作,而不是单纯比拼某一环节的参数。”这一表态标志着智算基础设施评价体系的转向——从“部署了多少算力”转向“在既定电力和资源条件下,能够稳定高效完成多少有效任务”,CPU在AI基础设施中的角色被重新定义。

【关键数据】

[1] 单颗至强6+处理器最高可支持超过1000个智能体稳定部署(个)

[2] 在200毫秒启动时延SLA约束下,单颗至强6+支持350个沙箱并发创建,为某同类产品的1.46倍(个/倍)

[3] KV Cache智能加速套件将传输速率最高提升9.66倍,首字时延(TTFT)性能最高提升15倍(倍)

[4] 中国活跃企业智能体预计到2031年将超过3.5亿个(个)

[5] 全球已有近80%的企业开始在内部尝试和导入智能体(%)


至强6+处理器是这一架构的核心承载。凭借微架构创新以及操作系统和运行平台层面的协同优化,单颗至强6+处理器最高可支持超过1000个智能体的稳定部署。在沙箱并发能力上,在满足200毫秒启动时延的SLA约束条件下,单颗至强6+最多可支持350个沙箱并发创建,是某款同类产品的1.46倍。这组数据的行业背景在于:智能体AI区别于传统生成式AI的关键,在于AI从“生成答案”转向“主动执行”,沙箱的冷启动、热启动与快照备份速度直接决定智能体能否按需快速就位。单芯片性能之外,英特尔联合产业伙伴发布了英特尔开放Agent整机柜平台规范,让更多厂商基于统一标准打造整机柜产品,在计算、内存、供电与散热之间做出合理配置。当数据中心需要在极短时间内批量拉起海量沙箱,考验的已不是单颗CPU性能,而是整机柜的协同作战能力,这一定位与当前机柜级交付成为智算中心主流建设模式的方向一致。

在竞争格局层面,英特尔此次打出的是“系统级方案”牌而非单点参数对比。至强已是国内智算服务器机头CPU的主流选择,承担数据预处理、KV Cache管理与任务协调职责。存储侧的突破尤为具体:英特尔与焱融科技基于至强打造的全闪存储一体机F9000X Turbo,依托至强6的I/O能力和MRDIMM带来的内存带宽提升,在全球MLPerf Storage v3.0基准测试榜单中多项成绩位列第一。针对长上下文、多Agent并发推理场景的记忆瓶颈,英特尔推出KV Cache智能加速套件,充分利用至强内置的AMX、QAT加速器,客户验证数据显示,KV Cache传输速率最高提升达9.66倍,首字时延(TTFT)性能最高提升达15倍。与GPU厂商以算力参数为核心的竞争路径不同,英特尔选择以CPU为中枢、串联GPU(代号Crescent Island的数据中心GPU)、以太网控制器和存储,构建从云到端的完整产品矩阵,将竞争维度拉回到系统整体效率与词元经济的成本账上。

从产业链视角看,英特尔的方案贯穿了智能体AI运行的供给侧与消费侧两端。供给侧的核心是KV Cache的复用效率——决定系统能否减少重复计算,英特尔与合作伙伴提供G3.5创新存储方案,打造内存容量扩展和高性能共享KV Cache存储池,在容量、成本和性能三者间取得平衡;消费侧的核心是沙箱启动速度,英特尔IAA、QAT、AMX等内置加速引擎分别实现压缩数据体积、卸载重复计算、缩短沙箱唤醒时间等优化。产业链协同方面,英特尔与忆联发布了以至强6为核心的分层KV Cache方案,充分发挥忆联高性能UH812a企业级SSD的性能优势。上游存储介质、内存(MRDIMM)与CPU内置加速器的深度耦合,正在改变智算中心的成本结构——让昂贵计算资源不再因数据供给速度不足而空转,其逻辑与当下数据中心“以有效任务量衡量投入产出”的采购评价趋势相吻合。

商业化落地方面,英特尔在大会上发布了面向智能体AI时代的三种新产品形态与两种新部署形态。部署形态之一是集装箱式AI算力仓,通过模块化设计应对大型数据中心建设周期难以匹配业务增长的现实,同时更高效利用绿色能源;形态之二是推动AI基础设施向分布式、本地化演进,如推出词元一体机,让算力从中央机房延伸至企业业务一线。面向噪音敏感、空间有限的部署场景,英特尔TBX16词元一体机提供了兼顾散热效率与静音体验的机柜参考设计。生态合作阵容覆盖云厂商、传统数据中心、AI服务器提供商等多个层面:机头CPU场景中至强承担数据预处理与任务协调;存储系统中至强管理KV Cache的全生命周期;开放Agent整机柜平台规范则邀请更多厂商基于标准构建整机柜产品。英特尔官方表示,随着更多智能体工作负载走向规模化落地,至强平台将持续演进,为客户提供更稳定高效的基础设施支撑。

从行业动向看,本次大会折射出智算基础设施的三重变化。其一,评价体系从峰值算力转向有效任务密度,200毫秒SLA约束下的沙箱并发数、TTFT时延、KV Cache传输速率等指标正在成为新的采购标尺。其二,CPU重回AI基础设施核心位置,与GPU形成“思考—执行”分工,机头CPU、存储管理CPU、整机柜协同的多元角色持续扩展。其三,液冷等配套技术加速跟进——9月23日的会议环节,英特尔携手合作伙伴揭晓液冷领域最新技术进展,为高密度算力场景下的液冷部署提供新参考。在智能体数量向3.5亿规模迈进的国内市场,从MLPerf Storage榜单第一的存储一体机,到9.66倍的KV Cache传输加速,再到开放整机柜标准,英特尔的系统级打法能否在与GPU阵营、ARM服务器阵营的多线竞争中巩固机头CPU的基本盘并向上延伸,将取决于生态伙伴的跟进速度与真实业务场景中的验证结果。


微信扫描分享本文到朋友圈
扫码关注5G通信官方公众号,免费领取以下5G精品资料
  • 1、回复“YD5GAI”免费领取《中国移动:5G网络AI应用典型场景技术解决方案白皮书》
  • 2、回复“5G6G”免费领取《5G_6G毫米波测试技术白皮书-2022_03-21》
  • 3、回复“YD6G”免费领取《中国移动:6G至简无线接入网白皮书》
  • 4、回复“LTBPS”免费领取《《中国联通5G终端白皮书》》
  • 5、回复“ZGDX”免费领取《中国电信5GNTN技术白皮书》
  • 6、回复“TXSB”免费领取《通信设备安装工程施工工艺图解》
  • 7、回复“YDSL”免费领取《中国移动算力并网白皮书》
  • 8、回复“5GX3”免费领取《R1623501-g605G的系统架构1》
  • 本周热点本月热点

     

      最热通信招聘

      最新招聘信息

    最新技术文章

    最新论坛贴子