Máy chủ GPU – Máy chủ AI cho huấn luyện và suy luận mô hình Máy chủ GPU
Giỏ hàng của bạn (0)
Giỏ hàng trống
Đặt mua hàng

Máy chủ AI NVIDIA GB200 NVL2 – hai GPU Blackwell cho trung tâm dữ liệu doanh nghiệp

4.9/5(105 đánh giá)
Máy chủ NVIDIA
DGX và nền tảng Grace Blackwell
SKU: NV-GB200-NVL2
Thông số sản phẩm
Thương hiệu
NVIDIA
Form factor
Rack 2U, làm mát bằng khí
GPU
2 × NVIDIA Blackwell
CPU
NVIDIA Grace, 72 lõi Arm Neoverse V2 mỗi siêu chip
CPU – GPU
NVLink-C2C, 900 GB/s mỗi chiều
NVLink GPU – GPU
3,6 TB/s
Khe mở rộng
PCIe Gen 6
Bảo hành
36 tháng
Xuất xứ
Chính hãng, nhập khẩu
  • Hàng chính hãng NVIDIA tại Việt Nam
  • Bảo hành chính hãng 36 tháng trên toàn quốc
  • Sản phẩm mới 100% chưa sử dụng
  • Giao hàng toàn quốc các ngày trong tuần

Grace Blackwell trong khuôn khổ phòng máy sẵn có

GB200 NVL2 tồn tại để trả lời một câu hỏi thực tế: làm sao dùng kiến trúc Grace Blackwell khi phòng máy không thể cấp trăm kilowatt và không có hệ thống làm mát chất lỏng. Thay vì cả tủ rack, NVL2 gói hai GPU Blackwell và hai CPU Grace vào một khung 2U đặt vừa tủ rack tiêu chuẩn, làm mát bằng khí như máy chủ thông thường.

Bạn không có 72 GPU trong một miền NVLink, nhưng vẫn giữ được thứ quan trọng nhất của kiến trúc này: CPU và GPU nối trực tiếp qua NVLink-C2C với 900 GB/s mỗi chiều, thay vì phải đi qua khe PCIe.

Vì sao NVLink-C2C quan trọng

Trong máy chủ GPU truyền thống, dữ liệu phải chép từ RAM hệ thống qua PCIe sang bộ nhớ GPU trước khi tính toán. Với mô hình lớn hơn bộ nhớ GPU, bước chép này lặp lại liên tục và trở thành điểm nghẽn. NVLink-C2C rút băng thông đó lên nhiều lần, cho phép GPU coi bộ nhớ LPDDR5X của Grace như phần mở rộng của bộ nhớ riêng. Với suy luận mô hình có ngữ cảnh dài và bộ nhớ đệm KV lớn, khác biệt thể hiện ngay ở độ trễ.

144 lõi Arm không phải để trang trí

Hai CPU Grace cung cấp 144 lõi Arm Neoverse V2. Trong nhiều đường ống AI thực tế, phần tiền xử lý dữ liệu — giải mã ảnh, tách token, tăng cường dữ liệu — chạy trên CPU và thường khiến GPU phải chờ. Số lõi dồi dào ở đây giúp giữ GPU luôn có việc, điều mà một máy chủ x86 hai socket tầm trung khó làm được khi tải dữ liệu nặng.

Hợp với ai

NVL2 là lựa chọn cho doanh nghiệp muốn tự chạy mô hình nội bộ ở quy mô phòng ban tới toàn công ty: trợ lý nội bộ, tìm kiếm ngữ nghĩa trên kho tài liệu, phân tích văn bản hợp đồng, hệ khuyến nghị. Đây cũng là bước đệm hợp lý trước khi cam kết đầu tư vào một tủ NVL72.

Thông số kỹ thuật của Máy chủ AI NVIDIA GB200 NVL2 – hai GPU Blackwell cho trung tâm dữ liệu doanh nghiệp

Thông số kỹ thuật Máy chủ AI NVIDIA GB200 NVL2 – hai GPU Blackwell cho trung tâm dữ liệu doanh nghiệp
Thông số Chi tiết
Tên sản phẩm Máy chủ AI NVIDIA GB200 NVL2 – hai GPU Blackwell cho trung tâm dữ liệu doanh nghiệp
Thương hiệu NVIDIA
Form factor Rack 2U
Số socket 2 CPU Grace
Nền tảng vi xử lý NVIDIA Grace Arm Neoverse V2
Số GPU tối đa 2 GPU Blackwell
Công suất nguồn Nguồn dự phòng, tuỳ cấu hình OEM
Xuất xứ Chính hãng, nhập khẩu
Bảo hành 36 tháng
Thông số chính
Form factor Rack 2U, làm mát bằng khí
GPU 2 × NVIDIA Blackwell
CPU NVIDIA Grace, 72 lõi Arm Neoverse V2 mỗi siêu chip
CPU – GPU NVLink-C2C, 900 GB/s mỗi chiều
NVLink GPU – GPU 3,6 TB/s
Khe mở rộng PCIe Gen 6
Hiệu năng
Hiệu năng NVFP4 40 PFLOPS (20 PFLOPS đặc) trên mỗi siêu chip
Bộ nhớ GPU 372 GB HBM3E, băng thông 16 TB/s
Bộ nhớ CPU Tới 480 GB LPDDR5X, băng thông tới 512 GB/s
Triển khai
Làm mát Khí, không cần cải tạo phòng máy
Vị trí lắp Tủ rack tiêu chuẩn 19 inch
Phần mềm NVIDIA AI Enterprise, NIM, Triton
* Dựa theo datasheet của hãng

Câu hỏi thường gặp

NVL2 là một máy chủ 2U với 2 GPU, làm mát bằng khí, đặt vừa tủ rack thường. NVL72 là cả một tủ rack với 72 GPU, làm mát bằng chất lỏng và cần khoảng 120 kW. Hai sản phẩm nhắm vào hai quy mô hoàn toàn khác nhau.

Không. Máy dùng làm mát bằng khí và lắp vào tủ rack 19 inch tiêu chuẩn. Bạn chỉ cần kiểm tra công suất nguồn của tủ và khả năng thoát nhiệt của phòng.

Với lượng tử hoá FP4 hoặc FP8, hệ thống phục vụ tốt các mô hình từ 70 đến 200 tỷ tham số. Nhờ NVLink-C2C, mô hình lớn hơn bộ nhớ GPU vẫn chạy được bằng cách tràn sang bộ nhớ LPDDR5X của Grace, dù tốc độ sẽ giảm.

Các framework chính như PyTorch, TensorRT-LLM, vLLM đều có bản Arm64 và container NGC dựng sẵn. Cần lưu ý với thư viện nội bộ biên dịch riêng cho x86 — chúng tôi kiểm tra danh sách phụ thuộc của bạn trước khi bàn giao.


Giao sản phẩm Máy chủ AI NVIDIA GB200 NVL2 – hai GPU Blackwell cho trung tâm dữ liệu doanh nghiệp toàn quốc

Vì sao chọn Máy chủ GPU?

01

Cấu hình theo tải thực tế

Chọn GPU, CPU, RAM và dung lượng lưu trữ theo đúng mô hình bạn chạy — huấn luyện, tinh chỉnh hay suy luận — thay vì mua thừa rồi để không.

02

Nguồn và tản nhiệt đủ ngưỡng

Máy chủ GPU ăn điện và toả nhiệt lớn. Chúng tôi tính sẵn công suất nguồn, luồng gió và tải giá đỡ để hệ thống chạy hết hiệu năng mà không bị hạ xung.

03

Bàn giao chạy được ngay

Máy về đã cài sẵn driver, CUDA và môi trường container, kiểm tra thông số dưới tải trước khi giao.

Chat Zalo Máy chủ GPU Chat Zalo Chat Facebook Máy chủ GPU Chat Facebook Hotline Máy chủ GPU Gọi ngay 09x.6666666