| 分享: |
2026 世界人工智能大会,算力核心焦点依旧围绕AI 算力规模化落地、大模型降本增效、国产基础设施替代三大主线。随着长文本大模型、多模态 AI、智能体应用多面爆发,行业痛点已从 “算力不够” 升级为 “互联不够快、显存不够用、推理成本居高不下”。
本届 WAIC,迈存信息双核心互联产品重磅亮相:成熟商用PCIe 5.0 架构 16 卡 Full Mesh 全互联 AI 算力集群(两种落地形态)、我司自研 PCIe 6.0 高速交换机;同步展出2U 机架式 24 盘位 DPU 硬件卸载 JBOF 全闪 KV Cache 存储整机,以PCIe5.0 成熟算力 + PCIe6.0 前沿互联 + 高密度池化存储全栈方案,为企业级大模型训练、高并发推理、RAG 知识库场景提供可落地、可量产、可降本的国产智算底座。
一、成熟商用主力:16 卡 PCIe5.0 Full Mesh 全互联 AI 算力集群,双架构按需选型
本届展会核心商用真机,两套硬件形态统一搭载PCIe 5.0 交换芯片搭建无阻塞 Full Mesh 拓扑,覆盖单机高密度、模块化弹性扩容两类客户需求,解决传统多卡机器带宽拥堵、跨卡延迟高、算力空转痛点。
方案 1:一体化 16 卡整机(单机高密度方案)
整机内置自研PCIe 5.0 Full Mesh 交换背板,16 张 RTX5090 GPU 集成单机箱,原生硬件全对等互通。
AllToAll 实测带宽高达 45GB/s,PCIe5.0 高带宽通道消除跨柜信号衰减,多卡协同吞吐拉满。
整机统一供电、散热、运维,部署简易,单台即可承载 70B–400B 模型分布式训练。
机房布线、运维成本低,适配固定算力机房、长期私有化大模型研发团队。
方案 2:2U 计算机头 + 两台 8 卡 GPU JBOG 扩展柜(模块化分布式方案)
机头 - 扩展柜分离架构,标准 2U 双路主机作为管理计算节点,通过 PCIe5.0 高速线缆外接两台 8 卡 GPU JBOG 柜,三台设备联动组成完整 16 卡算力集群,依托 PCIe5.0 交换实现跨柜全互联。
弹性拆分:业务低谷仅用 2U 机头 + 单台 8 卡 JBOG(8 卡集群),业务扩容叠加另一台扩展柜,硬件零浪费。
机房兼容性强:2U 机头适配通用标准机位,8 卡独立 GPU 柜分散整机功耗与散热压力,降低液冷改造成本。
适配分期建设、云厂商弹性算力平台、多项目错峰研发场景。
两套 PCIe5.0 集群统一核心优势
PCIe5.0 交换芯片构建 Full Mesh 无阻塞拓扑,16 张 GPU卡 两两全速点对点通信,无主机总线瓶颈。
AllToAll 实测 45GB/s 高吞吐,根除分布式训练数据排队、IO 抖动、长尾推理延迟。
原生兼容 SGLang、vLLM、DeepSpeed 主流大模型框架。
支撑 70B~400B 稠密大模型预训练、超长上下文多轮对话推理。
落地选型对比
传统多卡集群多采用低代次 PCIe、树状级联交换,互联带宽不足造成算力闲置;迈存 PCIe5.0 Full Mesh 架构实现算力释放:
一体整机:专为追求高性能、简易运维、固定算力规模客户设计。
2U 机头 + 双 8 卡 JBOG:专为机房机位受限、分期投入、需要弹性扩容客户设计。
二、本届 WAIC 重磅新品:迈存自研 PCIe 6.0 高速交换机,前瞻布局下一代智算互联
本次大会迈存正式发布全国产自研 PCIe 6.0 交换机,是面向下一代 CXL 4.0、万卡级 AI 集群、高速内存池化的前沿互联核心硬件,填补国产 PCIe 6.0 交换设备空白。
核心技术亮点
PCIe 6.0 原生 64GT/s 高速通道,单通道带宽翻倍于 PCIe5.0,支持 x16/x8 灵活 Gearbox 通道拆分,兼容 GPU、CXL 内存卡、NVMe 存储全品类设备。
全交叉无阻塞交换架构,低硬件转发延迟,支持多主机、多机柜全局 Fabric 组网。
深度适配 CXL 3.1/4.0 协议,可搭建跨服务器全局统一内存池,突破单机内存物理上限。
向下兼容 PCIe5.0/4.0 设备,新旧集群平滑升级,无需整机替换现有算力硬件。
全链路国产硬件设计,自主可控,适配政企信创、超大规模智算中心建设需求。
落地应用场景
下一代万卡级 AI 超算集群,海量 GPU 跨机柜高速 AllToAll 数据交互。
CXL 全域内存池化平台,多服务器共享 TB 级扩展内存,大幅降低 GPU 显存采购成本。
高密度分布式 JBOF 存储集群,承载 PB 级 KV Cache、向量数据库高速读写。
前瞻算力基建项目,提前布局 PCIe6.0 标准,规避硬件迭代淘汰风险。
三、解决行业核心痛点:两层硬件架构合力击穿 “内存墙”
随着大模型落地常态化,四大行业瓶颈持续凸显:
1.HBM 显存成本高昂,KV Cache 易占满显存长文本、多用户并发推理场景下 KV 缓存数据量暴涨,仅靠 GPU 显存承载需大量新增显卡,整体投入翻倍。
2.服务器原生内存存在物理天花板主板 DIMM 插槽数量固定,单机扩容成本高、上限低,无法灵活弹性拓展系统内存。
3.传统存储 IO 性能不足普通存储延迟高、随机读写弱,难以匹配 AI 高频 KV 缓存读写需求,造成推理 TTFT 过高、体验波动。
4.老旧低代次互联架构带宽瓶颈PCIe4.0 及以下、非 Full Mesh 级联架构,多卡数据传输拥堵,GPU 算力无法充分释放。
针对层层递进的内存资源压力,迈存打造PCIe5.0 商用 Full Mesh 集群 / PCIe6.0 前瞻交换机 + 2U 24 盘位 JBOF 池化存储两层协同架构,分层化解内存墙压力:
其一层:双代际 PCIe 交换方案,成熟 PCIe5.0 集群满足当下商用算力,全新 PCIe6.0 交换机面向下一代高速互联,打通 GPU、内存、存储之间高速数据通道。
其二层:2U 24 盘位 DPU JBOF 全闪存储,承载海量低频 KV 缓存,分流昂贵 GPU 显存压力。
四、核心存储展品:迈存自研 2U 24 盘位 DPU 硬件卸载 JBOF 全闪 KV Cache 存储整机
专为 KV Cache 场景打造的高密度池化存储,标准 2U 机架规格,单机箱容纳 24 块 U.2 NVMe SSD,国产高性能 AI 推理缓存标杆方案。
核心技术亮点
紧凑 2U 24 盘位高密度设计:单台实现百 TB 级闪存池容量,多台横向堆叠可扩容至 PB 级,机房机位占用少。
全 DPU 硬件卸载架构:板载 DPU 芯片,NVMe-oF、RoCE RDMA、EC 纠删、数据压缩全部硬件加速。
主机 CPU 占用降至 5% 以内,解决传统存储抢占算力、拉高推理延迟问题。
NVMe over Fabrics 远端池化,兼容 PCIe5.0/6.0 GPU 集群,多台算力服务器共享统一闪存资源池。
原生三层智能缓存分层:GPU HBM(热数据)→主机内存(温数据)→2U 24 盘位 JBOF 闪存池(冷 KV 数据)。
实测业务收益
自动将低频超长上下文 KV 数据下沉至低成本企业级闪存,释放 GPU 宝贵显存,无需新增显卡即可提升推理并发:
大模型推理并发承载量提升50% 以上。
长上下文场景显存溢出问题基本消除。
整套智算集群综合 TCO 降低 35%–45%。
原生适配 vLLM、SGLang 主流推理框架,零改造即插即用,适配私有化企业知识库、多租户 AI 推理平台。
五、迈存核心差异化:全链路自研 PCIe 互联分层解决方案
区别于市面仅做整机组装的厂商,迈存具备从交换硬件设计、GPU 集群架构到存储整机的全栈自研能力,本次 WAIC 形成成熟商用 + 前沿前瞻完整产品矩阵:
1.双代际 PCIe 交换技术全覆盖成熟商用 PCIe5.0 Full Mesh 算力集群(一体化整机 / 2U 机头 + 8 卡 JBOG 双形态),AllToAll 实测 45GB/s;同期发布自研 PCIe6.0 交换机,前瞻布局下一代高速 CXL 智算集群,兼顾当下落地与未来迭代。
2.自研 2U 24 盘位高密度 JBOF 存储整机搭载 DPU 硬件卸载架构,专为 KV Cache 高频随机 IO 深度调优,从存储层分流显存压力。
3.全链路国产化底层设计交换背板、高速通道、存储整机自主研发,适配政企信创、超大规模国产智算中心建设需求。
不堆料、不溢价,分层架构一站式解决算力、显存、存储三重瓶颈:PCIe5.0 商用集群保障现有业务、全新 PCIe6.0 交换机支撑未来算力升级、2U 24 盘位 JBOF 承接海量 KV 缓存,让企业 “少买卡、多并发、稳运行、长期可迭代”。
六、WAIC 2026现场交流火热,多套真机同步演示
大会期间,迈存展台迎来大量 AI 算法企业、算力集成商、政企智算平台、科研机构客户深度交流。技术团队现场真机演示:
16 卡 PCIe5.0 集群 45GB/s AllToAll 吞吐实测、全新 PCIe6.0 交换机高速互联演示、8 卡 GPU JBOG 模块化弹性拓展方案、2U 24 盘位 JBOF KV Cache 下沉实测、整机延迟与并发数据。
现场同步深度探讨国产算力国产化替代、长上下文推理降本、CXL 全域内存池化、PCIe6.0 下一代 Fabric、存算分离架构升级行业趋势。
2026 年 AI 产业进入规模化落地周期,算力基础设施的总线代际迭代能力、弹性扩展能力、高密度存储成本优势,直接决定企业 AI 商业化落地效率。
迈存信息持续深耕PCIe5.0 商用 GPU 集群、自研 PCIe6.0 高速交换机、模块化 GPU JBOG 扩展柜、2U24 盘位高密度 JBOF 存储、KV Cache 底层优化全栈产品,持续输出可量产、高性价比、平滑迭代的国产智算基础设施,助力 AI 产业从 “能用” 迈向 “好用、低成本、长期可持续大规模商用”。
阅读原文
展会咨询



![]() |
![]() |
![]() |
![]() |
![]() |
世展网公众号 |
微信小程序 |
国内展客服 |
国外展客服 |
门票客服 |

