GPU与AI算力卡深度分析
2026-09-30 03:59:50  小红书   [查看原文]

国产GPU与AI算力卡深度分析 资料截至 2026-09-29。 先统一比较对象 一个厂商可能同时公开芯片、板卡、服务器、超节点和集群。 算力还必须注明精度、稠密或稀疏、单卡或整机。FP4、FP8、FP16和FP64对应的工作负载不同。厂商公布的理论峰值不能替代模型实测。 国产主要路线 --摩尔线程 S4000采用第三代MUSA架构,公开显存48GB、带宽768GB/s。 S5000搭载PH100芯片,属于第四代MUSA平台和平湖架构,公开显存80GB、带宽1.6TB/s。 S5000支持MTLink 8卡全互联。软件侧为MUSA、KUAE训练与推理套件。 --沐曦 C500、C550、C588属于MXC500家族的不同产品,不能画成连续三代芯片。 C500为PCIe标卡,公开64GB HBM。 C600属于MXC600系列,采用OAM 2.0形态。公开产品页未给出完整显存容量,因此本文不

OCR:IMG:川更开的操角 见更大的日是 coNntETS. 国产GPU,8张图看清 厂商是谁?芯片怎么演进?差别在哪? 女 更强的 芯片 芯片 到力 连 速智未来 m 更的 GPU FCA COMPUTE ABRICNTER TOMGAROW CHINA CHINESI EMFOWLRS TECH IORAMORE OFEN WORLD AubnT OPENAIFUTURE 通用计算/训推 图形路线 AI加速器参照 摩尔线程·沐曦·壁仞· 景嘉微 华为昇腾·寒武纪 天数智芯·海光 代表厂商梳理:不是销量排名 0nn 芯片、算力卡、整机:分开看才不会比错 UUu TIDAL TELECOMMUNICATIONS 中东AI与通信观察 至2026.09.29 01/08

OCR:IMG:摩尔线程 AI CONNECTS OPEN AMORE 卡的名字,不等于芯片的名字 已公开产品 MTTS4000 MTTS5000 第三代MUSA平台 PH100芯片/平湖架构 48GB·768GB/s 80GB·1.6TB/s 后续规划:花港架构 华山面向AI/庐山面向图形 软件栈:MUSA 系统路线:MTLink互联+KUAE集群 路线图不等于现货交付,规格按具体SKU核对 TIDAL TELECOMMUNICATIONS 中东AI与通信观察 资料截至2026.09.29 02/08

OCR:IMG:沐曦 A1 连接 FORAMORE CONNECTED 智能 MIDDLE EAST 更广阔的 中东 C500家族,别排成多代芯片 MXC500系列 MXC600系列 家族 演进 MXC MXC MXC MXC C500 C550 C588 C600 C500:64GBHBM C500:PCle标卡 C600:OAM2.0模组 MXC MXC 升级同时涉及芯片、互联与整机散热 TIDALTELECOMMUNICATIONS 软件栈:M00ACA:C600页面末披完整存规格 中东AI与通信观察 科2026.09.29 03/08

OCR:IMG:壁仞与天数智芯 AMOEE OPEN AICONNECTS TOMOREOW 封装升级,和训练产品迭代 壁仞 BR166 更强的 166M/166L/166C 计算单元 BR106 BR106 形态与用途不同,不是三代芯片 构建更大的 AI可能 INTELLIGENCE SCALING COARIGHTEN BR166封装内含两颗BR106计算芯粒 MORE. TOMOREOW AFRIOHTER TOUOSROW 天数智芯 用更高效的算力 加速智能未来 天垓100 → 天垓150 天垓300 面 CHIPS. FROM INTELLIGEN TOAMORE TOMOEEOW 智铠100 :推理产品线 天垓300已列官网, 具体交付按型号确认 资料载至2026.09.29 TIDALTELECOMMUNICATIONS 中东AI与通信观察 04/08

OCR:IMG:海光与景嘉微 一个看计算生态,一个先看图形需求 海光DCU 后续代际:以正式披露和交付型号为准 DTK基础层 bcu DCU DAS人工智能软件 深算一号 深算二号 DAP应用平台 评估训练、推理与科学计算 景嘉微GPU GPU GPU GPU JM7系列 JM9系列 JM11系列 先看图形渲染、驱动与应用适配 图形GPU与大模型训练卡,用途和指标不能混排 05/08 TIDALTELECOMMUNICATIONS 中东AI与通信观察 资料至2026.09.29

OCR:IMG:06/08 昇腾与寒武纪 参与AI算力竞争,架构路线各有不同 华为昇腾NPU 910系列/950系列 软件 Ascend Atlas350 950PR Ascend950PR Atlas350 CANN 112GBHBM·1.4TB/s A2、A3是系统产品家族名称 寒武纪MLU 软件 MLU270 MLU290 MLU370 MLU590 MLU270/290 MLU370 MLU590 NeuWare MLU590已见官方SDK支持清单 尚 rtp 模型可运行,还要验证算子、精度与稳定性 516 TIDAL TELECOMMUNICATIONS 中东A与通信观察 资科至2026.09.29

OCR:IMG:代表算力卡, VRAM 先比显存 规格样本,非同代性能排名 产品 单卡/模组显存 显存带宽 H200SXM 141GB 4.8TB/s AMDMI355X 288GB 8TB/s 华为Atlas350 112GB 1.4TB/s 摩尔MTTS5000 80GB 1.6TB/s 容量: aL 带宽: 模型和KV缓存装得下多少 LII 数据送得够不够快 SXM、OAM、PCle形态不同;显存更大不代表所有任务更快 TIDALTELECOMMUNICATIONS 中东AI与通信观察 资料至2026.09.29 07/08

OCR:IMG:买算力,也要看数据怎么走 01 卡上HBM GPU 放权重、激活与KV缓存 HBM 02 卡间互联 NVLink/灵衡/InfinityFabric/MTLink 英伟达 华为 AMD 摩尔线程 03 跨服务器网络 多机训练要看集合通信效率 04 外部存储 装数据集、模型文件与检查点 1 同模型、同精度、同并发,实测token/s与时延 不同代际采用不同互联方案:详细对比见配套PPT TIDALTELECOMMUNICATIONS 中东AI与通信观察 资料截至2026.09.29 08/08

本栏目中的所有页面均系自动生成,自动分类排列,采用联索网络信息采集、网页信息提取、语义计算等智能搜索技术。内容源于公开的媒体报道,包括但不限于新闻网站、电子报刊、行业门户、客户网站等。使用本栏目前必读