Chip đồ họa chuyên biệt cho inference AI với bộ nhớ khổng lồ, dự kiến ra mắt cuối năm 2026.
Tập đoàn NVIDIA vừa chính thức giới thiệu Rubin CPX – dòng GPU chuyên biệt cho các tác vụ AI và xử lý dữ liệu quy mô lớn, sở hữu 128GB bộ nhớ GDDR7 và hiệu năng tính toán lên đến 30 petaFLOPs (NVFP4). Khác với các GPU gaming thông thường, Rubin CPX tập trung vào thị trường doanh nghiệp và nghiên cứu trí tuệ nhân tạo.
Thông số kỹ thuật ấn tượng
- Kiến trúc: Rubin monolithic die
- Bộ nhớ: 128GB GDDR7
- Hiệu suất: 30 petaFLOPs NVFP4
- Media engine: 4 NVENC + 4 NVDEC cho xử lý video
- Kết nối: NVLink Gen6, Spectrum-6 với co-packaged optics
“Rubin CPX được thiết kế cho các workload AI dài hạn như phát triển phần mềm, xử lý video độ dài lớn và nghiên cứu khoa học”, NVIDIA nhấn mạnh.

Triển khai trong hệ thống server
Rubin CPX sẽ được tích hợp trong platform Vera Rubin NVL144 CPX với cấu hình mỗi rack bao gồm:
- 144 GPU Rubin CPX
- 144 GPU Rubin tiêu chuẩn
- 36 CPU Vera
- Tổng hiệu suất: 8 exaFLOPS NVFP4
- Băng thông bộ nhớ: 1.7 PB/s
- Kết nối mạng: Quantum-X800 InfiniBand hoặc Spectrum-X Ethernet
Lộ trình phát triển
- Cuối 2026: Rubin CPX và NVL144 CPX bắt đầu giao hàng
- 2027: Rubin Ultra (4 GPU/module, HBM4E)
- 2028: Feynman (NVLink 8, Spectrum-7)
Ứng dụng thực tế:
- Xử lý mô hình AI với context dài (hàng triệu token)
- Phân tích video độ phân giải cao trong thời gian thực
- Nghiên cứu khoa học dữ liệu và mô phỏng phức tạp





