漫步远方,心荡神往

国产GPU崛起之路:从追赶到突破

10 家主流国产 GPU 厂商技术路线、性能参数、落地现状与 Chiplet 方案全梳理

基于各厂商官网/官方发布会、公开财报与行业研报,图文梳理国产 GPU 产业全景:技术发展历程、稠密 FP16/显存/带宽横向对比、落地场景与营收出货数据、Chiplet 突破制程方案与未来趋势。覆盖华为昇腾、壁仞科技、寒武纪、百度昆仑芯、摩尔线程、沐曦、海光信息、天数智芯、阿里平头哥、燧原科技 10 家厂商;已对关键数据做口径校正(如 BR100 的 1024 实为 INT8 TOPS 而非 FP16),并逐项标注官方/研报来源。

国内外 GPU 芯片全景:从 CPU/GPU/GPGPU 概念到国产替代

一文看懂 GPU 是什么、国外国内进展到哪了、市场份额如何分布、未来还有哪些期待与挑战

图文并茂梳理 GPU 产业全景:先讲清 CPU / GPU / GPGPU 概念,再盘点国外 NVIDIA / AMD / Intel 与云厂商自研 ASIC 的最新进展与市场占比(NVIDIA 官方财报 + Jon Peddie Research + Silicon Analysts),接着梳理国内 GPU 厂商图谱(华为昇腾、寒武纪、海光、摩尔线程、沐曦、壁仞、天数智芯、燧原、昆仑芯、平头哥)技术路线、性能参数与落地现状(IDC 2025 出货数据),随后做国内外横向对比,最后讨论制程、HBM、软件生态三大挑战与未来展望。

深度剖析 NVIDIA 数据中心 GPU:从整机拆解到架构演进(Pascal → Rubin)

一篇讲清 GPU 服务器由什么组成,以及每一代旗舰卡的核心参数

系统梳理 NVIDIA 数据中心 GPU 的发展史:先从整机视角拆解 GPU 服务器的各个组件(GPU Die、HBM 显存、NVLink 互联、NVSwitch 交换、网络、CPU、内存、散热、供电)及其核心能力,再逐代盘点 Pascal / Volta / Turing / Ampere / Ada Lovelace / Hopper / Blackwell / Rubin 的关键技术参数,并附中国特供版说明。数据来自官方 Datasheet 与公开路线图。

一文读懂 PFLOPS 算力:从 FP32 到 FP4,NVIDIA 与华为昇腾算力对比

为什么同一张卡在不同精度下算力差好几倍?

面向大模型时代的算力科普:讲清 FLOPS / TFLOPS / PFLOPS 的单位换算,解释 FP32、FP16/BF16、FP8、FP4 等数值精度的差异与取舍,并以 NVIDIA H100/B200 和华为昇腾 910B/910C 为例,横向对比不同精度下的峰值算力,最后说明峰值算力与真实性能之间的鸿沟。

NVIDIA GPU 系统诊断与运维排查手册:常用命令与一键脚本指南

全面掌握 GPU 系统诊断:从硬件到驱动的一站式排查指南

本文系统整理了在使用 NVIDIA GPU 及其他加速卡时常见的系统诊断工具与命令,覆盖硬件信息、操作系统状态、内核日志、网络互联(OFED/Fabric)、IPMI 管理以及 NVIDIA 专属监控工具(如 nvidia-smi、nvidia-bug-report.sh) 等关键维度,为 GPU 用户提供全面的系统诊断工具箱。