GPU NVIDIA Blackwell vận hành mô hình OpenAI GPT-5.2 với hiệu năng và chi phí tối ưu

Published on

Quảng cáo

OpenAI vừa giới thiệu GPT-5.2, được huấn luyện trên hạ tầng NVIDIA Blackwell và Hopper, mang lại hiệu suất vượt trội và tối ưu hóa chi phí cho doanh nghiệp.

OpenAI chính thức công bố mô hình ngôn ngữ thế hệ mới mang tên GPT-5.2, được mô tả là mô hình AI biên tiên tiến nhất hiện nay. Theo công bố, mô hình này giúp người dùng doanh nghiệp tiết kiệm từ 40 đến 60 phút mỗi ngày, trong khi người dùng cường độ cao có thể tiết kiệm hơn 10 giờ mỗi tuần. GPT-5.2 là thành quả của sự hợp tác chiến lược giữa OpenAI, Microsoft và NVIDIA.

end to end press best models trained 1920x1080 4660123 MMOSITE - Thông tin công nghệ

Hạ tầng huấn luyện quy mô lớn của dự án dựa trên các trung tâm dữ liệu Azure kết hợp với hệ thống GPU NVIDIA bao gồm các dòng H100, H200 và GB200-NVL72. Sự phối hợp này cho phép mở rộng năng lực tính toán một cách tin cậy và rút ngắn đáng kể thời gian đưa các mô hình mới ra thị trường.

Sức mạnh từ kiến trúc Blackwell và Blackwell Ultra

GPT-5.2 không chỉ được huấn luyện mà còn được triển khai vận hành trực tiếp trên các kiến trúc GPU Hopper và Blackwell của NVIDIA. Các dòng chip Blackwell tiếp tục ghi nhận những bước tiến lớn về hiệu năng nhờ các tối ưu hóa phần mềm và mô hình độ chính xác NVFP4. Cụ thể, nền tảng GB200 NVL72 đã đạt mức tăng trưởng hiệu suất 45% trong bài kiểm tra chuẩn công nghiệp MLPerf v5.1 so với phiên bản v5.0 trước đó.

A bar chart titled 'MLPerf Llama 3.1 405B Training Performance (512 GPUs)' shows the GB300 NVL72 v5.1 achieving the highest performance improvement at 4.2x compared to other models.

Đặc biệt, nền tảng Blackwell Ultra thể hiện sức mạnh vượt trội với tốc độ xử lý nhanh gấp 1,9 lần so với GB200 NVL72 và gấp tới 4,2 lần so với giải pháp Hopper H100. Các số liệu này được ghi nhận thông qua bài kiểm tra huấn luyện mô hình Llama 3.1 405B trên quy mô 512 GPU, khẳng định vị thế dẫn đầu của NVIDIA trong mảng phần cứng AI.

Tối ưu hóa chi phí và hiệu suất huấn luyện

Bên cạnh tốc độ xử lý, NVIDIA cũng chú trọng nâng cao hiệu quả kinh tế cho các đơn vị phát triển AI. Nền tảng Blackwell GB200 NVL72 cung cấp hiệu suất huấn luyện trên mỗi đồng đô la đầu tư tốt hơn 90% so với thế hệ H100, đồng thời mang lại mức tăng hiệu suất huấn luyện tổng thể gấp 3,2 lần.

A bar chart titled 'Training Performance Per Dollar' shows the GB200 NVL72 achieving 1.9x performance compared to the H100 in Llama 3.1 405 B Pretraining with 512 GPUs.

Khi so sánh trực tiếp với kiến trúc Hopper, hệ thống GB200 NVL72 cho tốc độ huấn luyện nhanh gấp 3 lần trên các mô hình lớn nhất trong bảng xếp hạng MLPerf Training. Đối với hệ thống cao cấp hơn là NVIDIA GB300 NVL72, tốc độ tăng tốc đạt mức hơn 4 lần so với Hopper. Hiện tại, các dòng GPU Blackwell và Blackwell Ultra đã bắt đầu được phân phối rộng rãi thông qua các nhà cung cấp dịch vụ đám mây, đám mây thế hệ mới (neo-clouds) và các nhà sản xuất máy chủ trên toàn cầu.

Nguồn: wccftech

Tin mới

Huawei khởi động chương trình Back To School 2026 “Ready – Set – Sync”

Nhằm đồng hành cùng học sinh, sinh viên chuẩn bị cho năm học mới,...

Galaxy Z Fold8 dùng màn hình 4:3, giá từ 46,99 triệu đồng tại Việt Nam

Samsung Galaxy Z Fold8 sở hữu thân máy thấp rộng, màn hình chính 7.6 inch tỷ lệ 4:3 mới, cấu hình Snapdragon 8 Elite Gen 5, giá khởi điểm 46,99 triệu đồng.

Philips Evnia 32M2N6901A: Màn hình QD-OLED 4K định hình không gian giải trí cao cấp

Thương hiệu Philips vừa chính thức ra mắt Evnia 32M2N6901A, mẫu màn hình chuyên...

NVIDIA RTX Spark nhận bản cập nhật Driver đầu tiên

NVIDIA vừa chính thức phát hành bản xem trước đầu tiên của driver hỗ...

Apple tăng giá iCloud+ tại Việt Nam, gói 50 GB tăng mạnh nhất 31,58%

Apple tăng giá iCloud+ tại Việt Nam từ 17/7, lần đầu kể từ tháng 6/2023, với gói 50 GB tăng mạnh nhất 31,58%, nằm trong đợt điều chỉnh giá tại 8 quốc gia.

Intel Nova Lake lộ tên gọi Core Ultra Series 400, ra mắt rải rác đến 2027

Rò rỉ mới cho thấy Intel Nova Lake sẽ mang tên Core Ultra Series 400, ra mắt theo từng đợt từ đầu đến cuối năm 2027, với flagship 52 nhân đến sau cùng.

Garmin Cirqa lại lộ diện, lần này trên chính website của Garmin

Website Romania của Garmin vừa vô tình để lộ tên Cirqa trong mục Health Status, củng cố thêm tin đồn về mẫu smart band không màn hình sắp ra mắt.

AMD dọn đường ra mắt dòng vi xử lý Ryzen AI MAX PRO 400 với bản cập nhật ROCm 7.14

"Đội Đỏ" AMD đã chính thức đặt nền móng cho màn ra mắt của...

Người dùng MacBook tự mài cạnh máy để cổ tay đỡ đau

Nhiều người dùng MacBook chọn cách tự mài giũa cạnh viền sắc của máy bằng giũa kim loại và giấy nhám để giảm khó chịu khi kê cổ tay, dù Apple vốn nổi tiếng khắt khe về thiết kế.

Google AI Mode cho phép kết nối Instacart, Canva, YouTube Music

Google mở rộng AI Mode trong Search, cho phép liên kết Instacart, Canva và YouTube Music để hỗ trợ người dùng hoàn tất tác vụ nhanh hơn.

tin liên quan

Kimi K3: Moonshot AI ra mắt mô hình mã nguồn mở 2,8 nghìn tỷ tham số

Moonshot AI công bố Kimi K3, mô hình mở lớn nhất từ trước đến nay với 2,8 nghìn tỷ tham số, vượt Claude Fable 5 ở benchmark code frontend dù vẫn dùng phần cứng bị hạn chế xuất khẩu.

Silicon Motion đã bắt đầu phát triển controller SSD PCIe Gen7

Alex Chou, lãnh đạo mảng doanh nghiệp của Silicon Motion, tiết lộ hãng đã bắt đầu phát triển controller PCIe Gen7 và đang bám sát sáng kiến Storage Next của Nvidia cho hạ tầng AI.

Nvidia bác tin trì hoãn Vera Rubin, nhưng né tránh câu hỏi về Rubin Ultra

CEO Jensen Huang khẳng định Vera Rubin đã vào sản xuất với sản lượng khổng lồ, bác bỏ tin đồn trì hoãn, nhưng không đề cập đến báo cáo về việc hệ thống Rubin Ultra Kyber NVL144 có thể bị chậm tiến độ.