Máy chủ GPU – Máy chủ AI cho huấn luyện và suy luận mô hình Máy chủ GPU
Giỏ hàng của bạn (0)
Giỏ hàng trống
Đặt mua hàng

Máy chủ AI Supermicro SYS-821GE-TNHR – NVIDIA HGX 8 GPU H100/H200, 8U

4.9/5(109 đánh giá)
Máy chủ Supermicro
SuperServer và hệ thống HGX
SKU: SMC-SYS-821GE-TNHR
Thông số sản phẩm
Thương hiệu
Supermicro
Form factor
Rack 8U, 2 socket
Model khung
CSE-GP801TS
GPU
NVIDIA HGX 8 GPU H100 hoặc H200 SXM
CPU
Intel Xeon Scalable thế hệ 4 / 5
RAM
32 khe DIMM DDR5 5600 MT/s, tối đa 8 TB
Nguồn điện
8 × 3000W Titanium (4+4) hoặc 6 × 3000W (4+2)
Bảo hành
36 tháng
Xuất xứ
Chính hãng, nhập khẩu
  • Hàng chính hãng Supermicro tại Việt Nam
  • Bảo hành chính hãng 36 tháng trên toàn quốc
  • Sản phẩm mới 100% chưa sử dụng
  • Giao hàng toàn quốc các ngày trong tuần

Cấu hình được triển khai nhiều nhất trong hai năm qua

Nếu có một mẫu máy chủ AI được lắp đặt nhiều nhất trong các dự án huấn luyện mô hình từ 2023 tới nay, đó là dòng HGX 8 GPU H100. SYS-821GE-TNHR là phiên bản Supermicro của cấu hình đó, dùng khung CSE-GP801TS 8U với hai socket Intel Xeon Scalable thế hệ 4 hoặc 5.

Giá trị lớn nhất của máy này không nằm ở thông số mà ở mức độ chín của hệ sinh thái. Mọi framework, mọi hướng dẫn tối ưu, mọi bài viết khắc phục sự cố về máy chủ AI trong hai năm qua đều viết cho nền tảng này. Khi có vấn đề lúc hai giờ sáng, đó là khác biệt rất thực.

Chọn H100 hay H200

Hai GPU dùng chung kiến trúc Hopper, khác nhau ở bộ nhớ. H100 SXM có 80 GB HBM3, H200 có 141 GB HBM3e với băng thông cao hơn khoảng 1,4 lần. Với huấn luyện, chênh lệch này cho phép batch size lớn hơn hoặc mô hình dài ngữ cảnh hơn mà không phải dùng kỹ thuật chia trạng thái. Với suy luận, bộ nhớ lớn hơn nghĩa là phục vụ được nhiều phiên đồng thời hơn trên cùng một máy — thường là yếu tố quyết định chi phí trên mỗi lượt truy vấn.

Nguyên tắc thực dụng: nếu bạn suy luận là chính, chọn H200. Nếu huấn luyện mô hình cỡ vừa và muốn tối ưu chi phí đầu tư, H100 vẫn rất hợp lý.

Bộ nhớ và lưu trữ dồi dào

32 khe DIMM DDR5 5600 MT/s cho dung lượng tối đa 8 TB — cao hơn hẳn nhiều máy chủ HGX khác. Điều này quan trọng với các đường ống huấn luyện cần giữ toàn bộ tập dữ liệu đã tiền xử lý trong RAM. Phần lưu trữ gồm hai khe M.2 NVMe cho hệ điều hành, 16 khay NVMe 2,5 inch tháo lắp nóng cho dữ liệu nóng và 3 khay SATA cho các nhu cầu phụ.

Mạng và mở rộng

Tám khe PCIe Gen 5.0 x16 low-profile cùng bốn khe FHHL. Cấu hình phổ biến là mỗi GPU một card InfiniBand NDR 400 Gb/s để ghép cụm, phần khe còn lại dành cho card lưu trữ hoặc mạng quản trị. Nếu bạn chỉ chạy một máy đơn lẻ, phần lớn khe này sẽ trống — nhưng khi mở rộng lên nhiều node thì đây chính là thứ khiến máy có ghép cụm được hay không.

Chuẩn bị lắp đặt

Tám bộ nguồn 3000W cấu hình 4+4 (hoặc 6 bộ 4+2 tuỳ đơn hàng) chuẩn Titanium. Dự trù khoảng 8 kW điện cho một máy khi đầy tải, và kiểm tra tủ rack chịu được chiều cao 8U cùng trọng lượng của một máy chủ HGX đầy đủ.

Thông số kỹ thuật của Máy chủ AI Supermicro SYS-821GE-TNHR – NVIDIA HGX 8 GPU H100/H200, 8U

Thông số kỹ thuật Máy chủ AI Supermicro SYS-821GE-TNHR – NVIDIA HGX 8 GPU H100/H200, 8U
Thông số Chi tiết
Tên sản phẩm Máy chủ AI Supermicro SYS-821GE-TNHR – NVIDIA HGX 8 GPU H100/H200, 8U
Thương hiệu Supermicro
Form factor Rack 8U
Số socket 2 socket Intel Xeon Scalable Gen 4/5
Nền tảng vi xử lý Intel Xeon Scalable Gen 4/5
Số GPU tối đa 8 GPU H100 hoặc H200 SXM (HGX)
Công suất nguồn 8 × 3000W Titanium (4+4)
Xuất xứ Chính hãng, nhập khẩu
Bảo hành 36 tháng
Thông số chính
Form factor Rack 8U, 2 socket
Model khung CSE-GP801TS
GPU NVIDIA HGX 8 GPU H100 hoặc H200 SXM
CPU Intel Xeon Scalable thế hệ 4 / 5
RAM 32 khe DIMM DDR5 5600 MT/s, tối đa 8 TB
Nguồn điện 8 × 3000W Titanium (4+4) hoặc 6 × 3000W (4+2)
Lưu trữ
Ổ khởi động 2 × M.2 NVMe
Ổ dữ liệu 16 × NVMe 2,5 inch hot-swap
Ổ phụ 3 × SATA 2,5 inch hot-swap
Mở rộng
Khe PCIe 8 × PCIe Gen 5.0 x16 LP
Khe bổ sung 4 × PCIe Gen 5.0 x16 FHHL
Cấu hình mạng gợi ý 1 card InfiniBand NDR 400 Gb/s cho mỗi GPU
Vận hành
Làm mát Bằng khí
Công suất thực tế Dự trù khoảng 8 kW khi đầy tải
Hiệu suất nguồn Titanium
* Dựa theo datasheet của hãng

Câu hỏi thường gặp

H200 có 141 GB HBM3e so với 80 GB HBM3 của H100, băng thông cũng cao hơn khoảng 1,4 lần. Nếu công việc chính là suy luận phục vụ nhiều người dùng, chọn H200 vì bộ nhớ lớn giúp giảm chi phí trên mỗi truy vấn. Nếu huấn luyện mô hình cỡ vừa và cần tối ưu vốn đầu tư, H100 vẫn là lựa chọn tốt.

Với nhiều bài toán thì có, nhưng nó hữu ích khi bạn giữ toàn bộ tập dữ liệu đã tiền xử lý trong RAM để tránh đọc đĩa trong mỗi epoch. Bạn không bắt buộc lắp đầy — cấu hình phổ biến là 1 TB đến 2 TB, và nâng cấp sau khi cần.

Cần kiểm tra hai điều: chiều sâu tủ đủ cho khung CSE-GP801TS, và tải trọng ray đỡ được một máy chủ HGX đầy đủ. Với tủ rack 42U tiêu chuẩn, bạn lắp được tối đa bốn máy nếu nguồn điện cho phép — thực tế điện thường giới hạn trước chiều cao.

Có. Tám khe PCIe 5.0 x16 cho phép lắp một card mạng tốc độ cao trên mỗi GPU. Đây là cấu hình chuẩn khi mở rộng lên nhiều node; nếu bỏ qua phần này lúc mua ban đầu thì việc nâng cấp sau sẽ tốn kém hơn nhiều.

Chúng tôi bàn giao với Ubuntu Server hoặc Rocky Linux, driver NVIDIA, CUDA, container runtime và bộ container NGC đã cấu hình sẵn. Có thể kèm Slurm hoặc Kubernetes tuỳ cách vận hành của đội bạn.


Giao sản phẩm Máy chủ AI Supermicro SYS-821GE-TNHR – NVIDIA HGX 8 GPU H100/H200, 8U toàn quốc

Vì sao chọn Máy chủ GPU?

01

Cấu hình theo tải thực tế

Chọn GPU, CPU, RAM và dung lượng lưu trữ theo đúng mô hình bạn chạy — huấn luyện, tinh chỉnh hay suy luận — thay vì mua thừa rồi để không.

02

Nguồn và tản nhiệt đủ ngưỡng

Máy chủ GPU ăn điện và toả nhiệt lớn. Chúng tôi tính sẵn công suất nguồn, luồng gió và tải giá đỡ để hệ thống chạy hết hiệu năng mà không bị hạ xung.

03

Bàn giao chạy được ngay

Máy về đã cài sẵn driver, CUDA và môi trường container, kiểm tra thông số dưới tải trước khi giao.

Chat Zalo Máy chủ GPU Chat Zalo Chat Facebook Máy chủ GPU Chat Facebook Hotline Máy chủ GPU Gọi ngay 09x.6666666