GPU trung tâm dữ liệu cao cấp nhất của NVIDIA thiết lập tiêu chuẩn mới cho hiệu năng AI và điện toán hiệu năng cao.
Ngày 26/8/2025, NVIDIA chính thức công bố thông số kỹ thuật của Blackwell Ultra GB300, mẫu GPU trung tâm dữ liệu mạnh nhất của hãng. Đây là bước tiến lớn so với GB200, hướng đến các mô hình AI khổng lồ và siêu máy tính thế hệ mới.
Hiệu năng và kiến trúc
- Số lõi CUDA: 20.480 – tăng từ 18.432 trên GB200.
- Số đơn vị xử lý (SM): 160 (tăng từ 144).
- Quy trình sản xuất: TSMC 4NP, sử dụng hai chip (die) kích thước reticle, kết nối bằng NV-HBI với băng thông 10 TB/s.
- Tổng số transistor: khoảng 208 tỷ.
Mỗi SM được trang bị:
- Lõi Tensor thế hệ 5 hỗ trợ FP8, FP6 và định dạng mới NVFP4.
- 256 KB bộ nhớ Tensor (TMEM), tổng cộng 40 MB trên toàn GPU.

Bộ nhớ và băng thông
- Dung lượng HBM3E: 288 GB – tăng 50% so với 192 GB của GB200.
- Băng thông bộ nhớ: 8 TB/s, giữ nguyên so với GB200, nhờ 8 cụm 12 lớp (12-Hi).
- Giao diện bộ nhớ: 16 kênh x 512-bit (tổng cộng 8.192-bit).
Dung lượng lớn giúp lưu trữ toàn bộ mô hình AI trong bộ nhớ, giảm độ trễ và tăng tốc độ xử lý.

Kết nối và hiệu quả năng lượng
- Kết nối GPU-GPU: NVLink 5.0, băng thông 1.800 GB/s (hai chiều).
- Kết nối với CPU Grace: NVLink-C2C, 900 GB/s, hỗ trợ tính nhất quán (coherency).
- Kết nối với hệ thống (host): PCIe Gen6 x16 – đạt 256 GB/s (hai chiều), gấp đôi PCIe Gen5. Đây là sản phẩm đầu tiên của NVIDIA hỗ trợ chuẩn PCIe 6.0.
- Công suất tiêu thụ (TGP): 1.400W – tăng từ 1.200W.
Định dạng dữ liệu mới: NVFP4
- NVFP4 là định dạng độ chính xác thấp mới, kết hợp FP8 (E4M3) và FP32.
- Giảm 1,8 lần dung lượng lưu trữ so với FP8 và 3,5 lần so với FP16.
- Duy trì độ chính xác gần bằng FP8, phù hợp cho suy luận AI hiệu quả.
Hệ thống và nền tảng
- Cặp nối với CPU: Grace Superchip – 72 nhân Arm, 480 GB LPDDR5X.
- Giải pháp hệ thống: Ghế NVL72 tích hợp 72 GPU GB300, tổng cộng 20,7 TB HBM3E và 576 TB/s băng thông bộ nhớ.
So sánh với thế hệ trước
| Thông số | GB200 | GB300 |
|---|---|---|
| Lõi CUDA | 18.432 | 20.480 |
| HBM3E | 192 GB | 288 GB |
| PCIe | Gen5 x16 (128 GB/s) | Gen6 x16 (256 GB/s) |
| TGP | 1.200W | 1.400W |
Kết luận
Blackwell Ultra GB300 là đỉnh cao của công nghệ GPU trung tâm dữ liệu, hướng đến các ứng dụng AI quy mô lớn như LLM, huấn luyện mô hình và siêu máy tính. Với bộ nhớ khổng lồ, kết nối PCIe Gen6 và định dạng NVFP4, đây là nền tảng mạnh mẽ cho tương lai của điện toán AI.
NVIDIA cho biết GB300 đã bắt đầu sản xuất hàng loạt và giao cho khách hàng đầu tiên. Kiến trúc kế nhiệm Rubin cũng đã hoàn thành thiết kế (tape-out).



