NVIDIA nâng cấp NVIDIA Hopper – Nền Tảng Tính Toán Trí Tuệ Nhân Tạo Hàng Đầu Thế Giới

Published on

Quảng cáo

NVIDIA vừa công bố nền tảng tính toán trí tuệ nhân tạo (AI) hàng đầu thế giới NVIDIA HGX H200. Dựa trên kiến trúc NVIDIA Hopper, nền tảng này sử dụng GPU Tensor Core NVIDIA H200 với bộ nhớ cấp tiến để xử lý lượng dữ liệu khổng lồ cho các nhiệm vụ trí tuệ nhân tạo sáng tạo và tính toán hiệu suất cao.

hpc press hgx h100 MMOSITE - Thông tin công nghệ

NVIDIA H200 là GPU đầu tiên trang bị HBM3e – bộ nhớ nhanh hơn và lớn hơn để đẩy nhanh quá trình tăng tốc trí tuệ nhân tạo sáng tạo và mô hình ngôn ngữ lớn, đồng thời thúc đẩy tính toán khoa học cho các nhiệm vụ tính toán hiệu suất cao (HPC). Với HBM3e, NVIDIA H200 cung cấp 141GB bộ nhớ tại tốc độ 4,8 terabytes mỗi giây, gần gấp đôi dung lượng và 2,4 lần băng thông so với tiền bối NVIDIA A100.

Các hệ thống được trang bị NVIDIA H200 từ các nhà sản xuất máy chủ hàng đầu thế giới và các nhà cung cấp dịch vụ đám mây dự kiến sẽ bắt đầu xuất hàng vào quý II năm 2024.

“Để tạo ra trí tuệ với trí tuệ nhân tạo sáng tạo và các ứng dụng HPC, lượng dữ liệu lớn phải được xử lý một cách hiệu quả ở tốc độ cao bằng bộ nhớ GPU lớn và nhanh”, Ian Buck, Phó Chủ tịch hyperscale và HPC tại NVIDIA nói. “Với NVIDIA H200, nền tảng siêu máy tính trí tuệ nhân tạo từ đầu đến cuối hàng đầu của ngành đã nhanh hơn để giải quyết một số thách thức quan trọng nhất trên thế giới.”

Đổi mới và nhảy vọt về hiệu suất vĩnh viễn

Kiến trúc NVIDIA Hopper mang lại một sự nhảy vọt về hiệu suất không giới hạn so với người tiền nhiệm và tiếp tục đặt ra một mức tiêu chuẩn mới thông qua việc cải thiện phần mềm liên tục với H100, bao gồm việc ra mắt gần đây các thư viện mã nguồn mở mạnh mẽ như NVIDIA TensorRT-LLM.

1511 NVIDIA GPU H200 2 MMOSITE - Thông tin công nghệ

Việc giới thiệu H200 sẽ dẫn đến những bước nhảy vọt về hiệu suất tiếp theo, bao gồm gần gấp đôi tốc độ suy luận trên Llama 2, một mô hình LLM với 70 tỷ tham số, so với H100. Dự kiến sẽ có thêm sự lãnh đạo về hiệu suất và cải thiện với H200 thông qua các bản cập nhật phần mềm trong tương lai.

Các phiên bản Của NVIDIA H200

NVIDIA H200 sẽ có sẵn trong các bo mạch máy chủ NVIDIA HGX H200 với cấu hình bốn và tám lõi, tương thích với cả phần cứng và phần mềm của các hệ thống HGX H100. Nó cũng có sẵn trong NVIDIA GH200 Grace Hopper Superchip với HBM3e, được công bố vào tháng 8.

Với những tùy chọn này, H200 có thể triển khai trong mọi loại trung tâm dữ liệu, bao gồm trên cơ sở, đám mây, đám mây lai và điểm cuối. Hệ sinh thái toàn cầu của đối tác sản xuất máy chủ của NVIDIA – bao gồm ASRock Rack, ASUS, Dell Technologies, Eviden, GIGABYTE, Hewlett Packard Enterprise, Ingrasys, Lenovo, QCT, Supermicro, Wistron và Wiwynn – có thể cập nhật hệ thống hiện có của họ với H200.

51956 MMOSITE - Thông tin công nghệ
H200 – Chip AI mạnh nhất thế giới của Nvidia

Amazon Web Services, Google Cloud, Microsoft Azure và Oracle Cloud Infrastructure sẽ là những nhà cung cấp dịch vụ đám mây đầu tiên triển khai các phiên bản dựa trên H200 bắt đầu từ năm sau, cùng với CoreWeave, Lambda và Vultr.

Được hỗ trợ bởi NVIDIA NVLink và NVSwitch, HGX H200 cung cấp hiệu suất cao nhất trên nhiều nhiệm vụ ứng dụng khác nhau, bao gồm đào tạo và suy luận LLM cho các mô hình lớn vượt quá 175 tỷ tham số.

Một bộ HGX H200 tám lõi cung cấp hơn 32 petaflops tính toán đào tạo FP8 và tổng cộng 1,1TB bộ nhớ băng thông cao cho hiệu suất cao nhất trong trí tuệ nhân tạo sáng tạo và ứng dụng HPC.

Khi kết hợp với CPU NVIDIA Grace với kết nối siêu nhanh NVLink-C2C, H200 tạo ra GH200 Grace Hopper Superchip với HBM3e – một mô-đun tích hợp được thiết kế để phục vụ các ứng dụng HPC và AI quy mô khổng lồ.

Tăng tốc Trí tuệ nhân tạo với Phần mềm toàn diện Của NVIDIA

Nền tảng tính toán tăng cường của NVIDIA được hỗ trợ bởi các công cụ phần mềm mạnh mẽ giúp các nhà phát triển và doanh nghiệp xây dựng và tăng tốc các ứng dụng sẵn sàng cho sản xuất từ trí tuệ nhân tạo đến HPC. Điều này bao gồm bộ phần mềm NVIDIA AI Enterprise dành cho các nhiệm vụ như phát triển phần mềm phát biểu, hệ thống gợi ý và suy luận quy mô lớn.

NVIDIA H200 sẽ có sẵn từ các nhà sản xuất hệ thống toàn cầu và các nhà cung cấp dịch vụ đám mây hàng đầu bắt đầu từ quý II năm 2024.

Tin mới

X phát hiện mạng lưới 200.000 bot Trung Quốc, một phần chống trung tâm dữ liệu AI

X vừa gỡ bỏ mạng lưới khoảng 200.000 tài khoản Trung Quốc, trong đó 200 tài khoản đăng nội dung khuấy động tranh cãi về trung tâm dữ liệu AI tại Mỹ.

Razer ra mắt bộ phụ kiện xanh trong suốt mừng Xbox 25 năm

Razer hợp tác Xbox tung bộ sưu tập giới hạn mừng sinh nhật 25 năm, gồm chuột Basilisk V3 Pro 35K, bàn phím BlackWidow V4 75% và tai nghe Hammerhead V3 X phiên bản xanh trong suốt.

Viewing Part chung kết tổng VCT 2026 PACIFIC STAGE 2 tổ chức tại TP.HCM và Hà Nội

Cộng đồng hâm mộ Thể thao điện tử toàn quốc sắp có dịp trải...

Xiaomi chính thức ra mắt REDMI Note 17 Series với pin dung lượng 10.000mAh

REDMI Note 17 Series nâng cấp toàn diện các tiêu chuẩn về pin, độ...

Chip Fujitsu Monaka 3D CPU 2nm ra mắt năm 2029 cùng công nghệ NVLink Fusion

Mẫu CPU Monaka của Fujitsu dự kiến trình làng vào năm 2027 với 144...

Sự kiện ra mắt dòng sản phẩm ROG kỉ niệm 20 năm

ASUS Republic of Gamers (ROG) chính thức giới thiệu bộ sưu tập ROG Edition...

Tặng 3 tháng Google AI cho khách hàng sở hữu laptop ASUS & ROG

Từ tháng 8/2026, khách hàng sở hữu các dòng laptop ASUS và ROG đủ...

GIGABYTE RTX AI PC DAY 2026 tại TP.HCM: Trải nghiệm AI PC, gaming

Dự kiến quy tụ hơn 1.500 người tham dự, GIGABYTE RTX AI PC DAY...

Xiaomi tăng trưởng mạnh mẽ trên toàn cầu với 16,2 tỷ USD

Trong bối cảnh ngành công nghệ chịu nhiều áp lực từ chi phí linh...

Colourful ra mắt bo mạch chủ iGame X870E VULCAN W OC

Công ty TNHH Công Nghệ COLORFUL, nhà cung cấp phần cứng máy tính, máy...

tin liên quan