[GTC 2025] NVIDIA ra mắt DGX Spark và Station cho nhà phát triển AI

Published on

Quảng cáo

Tại GTC 2025, NVIDIA giới thiệu dòng siêu máy tính cá nhân (personal supercomputers) DGX mới, gồm DGX Spark và DGX Station, sử dụng nền tảng Grace Blackwell. Hai hệ thống này được thiết kế cho nhà phát triển (developer), nhà nghiên cứu, nhà khoa học dữ liệu và sinh viên, cho phép thử nghiệm, tinh chỉnh và suy luận (inference) mô hình AI lớn ngay trên máy để bàn (desktop).

Người dùng có thể vận hành mô hình cục bộ hoặc triển khai lên NVIDIA DGX Cloud, đám mây tăng tốc (accelerated cloud) hoặc trung tâm dữ liệu mà không cần chỉnh sửa nhiều mã nguồn. Các nhà sản xuất toàn cầu như ASUS, Dell Technologies, HP và Lenovo sẽ phát triển hai dòng máy này.

NVIDIA ra mắt DGX Spark và Station cho nhà phát triển AI

DGX Spark, trước đây là Project DIGITS, được xem là siêu máy tính AI nhỏ nhất thế giới. Máy tích hợp siêu chip (superchip) GB10 Grace Blackwell, tối ưu cho dạng máy để bàn, với GPU Blackwell thế hệ thứ năm, hỗ trợ FP4 và lõi Tensor, đạt tới 1.000 nghìn tỷ phép tính mỗi giây. Hiệu suất này phù hợp để xử lý các mô hình AI suy luận mới như NVIDIA Cosmos Reason và GR00T N1 cho robot. Công nghệ NVLink-C2C kết nối CPU và GPU, mang lại băng thông gấp 5 lần PCIe thế hệ năm, tối ưu cho khối lượng công việc AI nặng về bộ nhớ.

DGX Station mang hiệu suất cấp trung tâm dữ liệu xuống máy để bàn. Đây là hệ thống đầu tiên dùng siêu chip GB300 Grace Blackwell Ultra Desktop, với bộ nhớ mạch lạc (coherent memory) 784GB, tăng tốc huấn luyện và suy luận quy mô lớn. GB300 kết hợp GPU Blackwell Ultra và CPU Grace qua NVLink-C2C, đảm bảo giao tiếp hệ thống hiệu quả. Máy còn trang bị ConnectX-8 SuperNIC, hỗ trợ mạng tốc độ 800Gb/s, cho phép kết nối nhiều DGX Station để xử lý khối lượng công việc lớn hơn và truyền dữ liệu nhanh qua mạng cho tác vụ AI.

IMG 2112 MMOSITE - Thông tin công nghệ

Jensen Huang, CEO NVIDIA, cho biết DGX Spark và Station mở rộng AI từ đám mây sang máy để bàn và ứng dụng biên (edge applications). DGX Spark hướng tới hàng triệu nhà phát triển robot, khoa học dữ liệu, hỗ trợ AI tạo sinh (generative AI) và AI vật lý (physical AI) với hiệu suất cao. Nền tảng AI toàn diện của NVIDIA giúp người dùng DGX Spark chuyển mô hình từ máy để bàn sang DGX Cloud hoặc hạ tầng khác mà không cần thay đổi nhiều, đơn giản hóa quá trình thử nghiệm và tinh chỉnh.

DGX Station, với sự kết hợp CUDA-X AI, đáp ứng nhu cầu phát triển AI của nhóm lớn hơn trên máy để bàn. Người dùng cả hai dòng máy được truy cập microservices NIM qua phần mềm NVIDIA AI Enterprise, cung cấp dịch vụ suy luận tối ưu và hỗ trợ cấp doanh nghiệp. Tuy nhiên, để tận dụng hết khả năng, người dùng cần kỹ năng kỹ thuật và hạ tầng mạng phù hợp, đặc biệt với ConnectX-8 trên DGX Station.

DGX Spark hiện mở đặt trước từ ngày công bố. DGX Station dự kiến ra mắt cuối năm 2025 qua các đối tác như ASUS, BOXX, Dell, HP, Lambda và Supermicro. Grace Blackwell, vốn chỉ dùng trong trung tâm dữ liệu, nay được thu gọn cho máy cá nhân, nhưng chưa có thông tin chi tiết về giá cả hay hiệu suất thực tế so với các hệ thống khác.

DGX Spark phù hợp cho cá nhân hoặc nhóm nhỏ nhờ thiết kế nhỏ gọn và siêu chip GB10 tiết kiệm năng lượng. Ngược lại, DGX Station nhắm đến khối lượng công việc lớn như huấn luyện mô hình AI phức tạp, với bộ nhớ lớn và kết nối mạng tốc độ cao. Cả hai đều yêu cầu người dùng hiểu biết về triển khai mô hình AI để tận dụng tối đa sức mạnh phần cứng.

NVIDIA chưa công bố dữ liệu hiệu suất cụ thể khi so với các dòng máy khác, nhưng nhấn mạnh hai hệ thống này đáp ứng xu hướng AI bản địa (AI-native). NVLink-C2C và ConnectX-8 tăng hiệu quả giao tiếp nội bộ và mạng, nhưng đòi hỏi hạ tầng tương thích để hoạt động tối ưu. Các nhà phát triển cần xem xét khả năng tích hợp với công cụ hiện có trước khi đầu tư. Thông tin chi tiết sẽ được các đối tác sản xuất cập nhật trong thời gian tới.

Tin mới

Mùa Back To School 2026 khác biệt của ASUS

Mùa tựu trường 2026, ASUS vẫn giữ những giá trị cốt lõi thực dụng...

Huawei khởi động chương trình Back To School 2026 “Ready – Set – Sync”

Nhằm đồng hành cùng học sinh, sinh viên chuẩn bị cho năm học mới,...

Galaxy Z Fold8 dùng màn hình 4:3, giá từ 46,99 triệu đồng tại Việt Nam

Samsung Galaxy Z Fold8 sở hữu thân máy thấp rộng, màn hình chính 7.6 inch tỷ lệ 4:3 mới, cấu hình Snapdragon 8 Elite Gen 5, giá khởi điểm 46,99 triệu đồng.

Philips Evnia 32M2N6901A: Màn hình QD-OLED 4K định hình không gian giải trí cao cấp

Thương hiệu Philips vừa chính thức ra mắt Evnia 32M2N6901A, mẫu màn hình chuyên...

NVIDIA RTX Spark nhận bản cập nhật Driver đầu tiên

NVIDIA vừa chính thức phát hành bản xem trước đầu tiên của driver hỗ...

Apple tăng giá iCloud+ tại Việt Nam, gói 50 GB tăng mạnh nhất 31,58%

Apple tăng giá iCloud+ tại Việt Nam từ 17/7, lần đầu kể từ tháng 6/2023, với gói 50 GB tăng mạnh nhất 31,58%, nằm trong đợt điều chỉnh giá tại 8 quốc gia.

Intel Nova Lake lộ tên gọi Core Ultra Series 400, ra mắt rải rác đến 2027

Rò rỉ mới cho thấy Intel Nova Lake sẽ mang tên Core Ultra Series 400, ra mắt theo từng đợt từ đầu đến cuối năm 2027, với flagship 52 nhân đến sau cùng.

Garmin Cirqa lại lộ diện, lần này trên chính website của Garmin

Website Romania của Garmin vừa vô tình để lộ tên Cirqa trong mục Health Status, củng cố thêm tin đồn về mẫu smart band không màn hình sắp ra mắt.

AMD dọn đường ra mắt dòng vi xử lý Ryzen AI MAX PRO 400 với bản cập nhật ROCm 7.14

"Đội Đỏ" AMD đã chính thức đặt nền móng cho màn ra mắt của...

Người dùng MacBook tự mài cạnh máy để cổ tay đỡ đau

Nhiều người dùng MacBook chọn cách tự mài giũa cạnh viền sắc của máy bằng giũa kim loại và giấy nhám để giảm khó chịu khi kê cổ tay, dù Apple vốn nổi tiếng khắt khe về thiết kế.

tin liên quan

Kimi K3: Moonshot AI ra mắt mô hình mã nguồn mở 2,8 nghìn tỷ tham số

Moonshot AI công bố Kimi K3, mô hình mở lớn nhất từ trước đến nay với 2,8 nghìn tỷ tham số, vượt Claude Fable 5 ở benchmark code frontend dù vẫn dùng phần cứng bị hạn chế xuất khẩu.

Silicon Motion đã bắt đầu phát triển controller SSD PCIe Gen7

Alex Chou, lãnh đạo mảng doanh nghiệp của Silicon Motion, tiết lộ hãng đã bắt đầu phát triển controller PCIe Gen7 và đang bám sát sáng kiến Storage Next của Nvidia cho hạ tầng AI.

Nvidia bác tin trì hoãn Vera Rubin, nhưng né tránh câu hỏi về Rubin Ultra

CEO Jensen Huang khẳng định Vera Rubin đã vào sản xuất với sản lượng khổng lồ, bác bỏ tin đồn trì hoãn, nhưng không đề cập đến báo cáo về việc hệ thống Rubin Ultra Kyber NVL144 có thể bị chậm tiến độ.