NVIDIA đưa ra giải pháp lưu trữ tăng tốc GPU giúp chuẩn hóa dữ liệu doanh nghiệp cho ứng dụng AI

Published on

Quảng cáo

Các nền tảng dữ liệu AI mới của NVIDIA sẽ tích hợp GPU để giải quyết thách thức về dữ liệu phi cấu trúc, giúp doanh nghiệp triển khai các tác nhân AI hiệu quả và bảo mật.

Theo số liệu từ Gartner, chỉ khoảng 40% các nguyên mẫu AI được đưa vào sản xuất thực tế, trong đó rào cản lớn nhất được ghi nhận là tính khả dụng và chất lượng dữ liệu. Tương tự như nhân sự, các tác nhân AI (AI agents) cần nguồn dữ liệu an toàn, chính xác và cập nhật để mang lại giá trị kinh doanh, khái niệm này được ngành công nghiệp gọi là “dữ liệu sẵn sàng cho AI” (AI-ready data).

nvidia-dua-ra-giai-phap-tang-toc-gpu--cho-ung-dung-ai

Tuy nhiên, việc chuẩn hóa dữ liệu doanh nghiệp gặp nhiều khó khăn khi 70% đến 90% dữ liệu tổ chức tồn tại dưới dạng phi cấu trúc như tài liệu văn bản, email, video và tệp âm thanh. Loại dữ liệu này đặt ra thách thức lớn về quản trị do khối lượng khổng lồ, sự đa dạng định dạng và thiếu cấu trúc nhất quán. Để giải quyết vấn đề này, một lớp cơ sở hạ tầng lưu trữ và dữ liệu mới được tăng tốc bởi GPU, hay còn gọi là nền tảng dữ liệu AI, đã xuất hiện nhằm chuyển đổi nhanh chóng dữ liệu phi cấu trúc thành dữ liệu sẵn sàng cho AI.

Quy trình xử lý và bảo mật dữ liệu

Dữ liệu sẵn sàng cho AI là loại dữ liệu có thể được sử dụng ngay lập tức bởi các quy trình huấn luyện, tinh chỉnh và tạo sinh tăng cường truy xuất (RAG) mà không cần thêm bước chuẩn bị. Quá trình này bao gồm thu thập từ nhiều nguồn, áp dụng siêu dữ liệu (metadata), chia nhỏ tài liệu nguồn thành các đoạn ngữ nghĩa liên quan và nhúng chúng vào các vector để lưu trữ và tìm kiếm hiệu quả.

Các nền tảng dữ liệu AI thực hiện việc này bằng cách nhúng khả năng tăng tốc GPU trực tiếp vào đường dẫn dữ liệu, biến đổi dữ liệu cho các đường ống AI dưới dạng tác vụ nền. Phương pháp này xử lý dữ liệu tại chỗ, giảm thiểu việc sao chép không cần thiết và các rủi ro bảo mật đi kèm. Bất kỳ thay đổi nào đối với tài liệu gốc, bao gồm chỉnh sửa nội dung hoặc thay đổi quyền truy cập, đều được truyền ngay lập tức đến các bản nhúng vector liên quan, đảm bảo tính chính xác và tuân thủ quy định.

Kiến trúc tham chiếu từ NVIDIA và đối tác

NVIDIA đã giới thiệu thiết kế tham chiếu cho nền tảng dữ liệu AI, kết hợp GPU NVIDIA RTX PRO 6000 Blackwell Server Edition, DPU NVIDIA BlueField-3 và các quy trình xử lý dữ liệu tích hợp dựa trên NVIDIA Blueprints. Kiến trúc này giúp cải thiện thời gian tạo ra giá trị bằng cách cung cấp các đường ống dữ liệu AI tích hợp sẵn, giảm độ tr lệch dữ liệu (data drift) và đơn giản hóa quản trị.

Hiệu suất sử dụng GPU cũng được tối ưu hóa khi dung lượng tính toán được quy hoạch phù hợp với khối lượng và tốc độ thay đổi của dữ liệu. Hiện tại, thiết kế nền tảng dữ liệu AI của NVIDIA đã được các nhà cung cấp hạ tầng và lưu trữ hàng đầu áp dụng, bao gồm Cisco, Dell Technologies, HPE, IBM, NetApp, Pure Storage và VAST Data. Sự hợp tác này đánh dấu bước chuyển mình của hệ thống lưu trữ doanh nghiệp từ các kho chứa thụ động sang các động cơ chủ động, thúc đẩy kỷ nguyên AI tạo sinh.

Tin mới

Philips Evnia 32M2N6901A: Màn hình QD-OLED 4K định hình không gian giải trí cao cấp

Thương hiệu Philips vừa chính thức ra mắt Evnia 32M2N6901A, mẫu màn hình chuyên...

NVIDIA RTX Spark nhận bản cập nhật Driver đầu tiên

NVIDIA vừa chính thức phát hành bản xem trước đầu tiên của driver hỗ...

Apple tăng giá iCloud+ tại Việt Nam, gói 50 GB tăng mạnh nhất 31,58%

Apple tăng giá iCloud+ tại Việt Nam từ 17/7, lần đầu kể từ tháng 6/2023, với gói 50 GB tăng mạnh nhất 31,58%, nằm trong đợt điều chỉnh giá tại 8 quốc gia.

Intel Nova Lake lộ tên gọi Core Ultra Series 400, ra mắt rải rác đến 2027

Rò rỉ mới cho thấy Intel Nova Lake sẽ mang tên Core Ultra Series 400, ra mắt theo từng đợt từ đầu đến cuối năm 2027, với flagship 52 nhân đến sau cùng.

Garmin Cirqa lại lộ diện, lần này trên chính website của Garmin

Website Romania của Garmin vừa vô tình để lộ tên Cirqa trong mục Health Status, củng cố thêm tin đồn về mẫu smart band không màn hình sắp ra mắt.

AMD dọn đường ra mắt dòng vi xử lý Ryzen AI MAX PRO 400 với bản cập nhật ROCm 7.14

"Đội Đỏ" AMD đã chính thức đặt nền móng cho màn ra mắt của...

Người dùng MacBook tự mài cạnh máy để cổ tay đỡ đau

Nhiều người dùng MacBook chọn cách tự mài giũa cạnh viền sắc của máy bằng giũa kim loại và giấy nhám để giảm khó chịu khi kê cổ tay, dù Apple vốn nổi tiếng khắt khe về thiết kế.

Google AI Mode cho phép kết nối Instacart, Canva, YouTube Music

Google mở rộng AI Mode trong Search, cho phép liên kết Instacart, Canva và YouTube Music để hỗ trợ người dùng hoàn tất tác vụ nhanh hơn.

UGREEN hợp tác Honkai: Star Rail, ra mắt bộ sạc phiên bản giới hạn

UGREEN bắt tay HoYoverse cho ra mắt bộ sạc và phụ kiện lấy cảm hứng từ Honkai: Star Rail, dự kiến trưng bày tại HoYo FEST 2026 ở Đông Nam Á.

ASUS ra mắt BIOS Beta tăng tương thích RAM CXMT cho bo mạch AMD 600/800 series

ASUS phát hành BIOS Beta mới cho loạt bo mạch chủ AMD X670 và X870, cải thiện khả năng tương thích và hiệu năng với RAM DDR5 dùng chip CXMT.

tin liên quan

Kimi K3: Moonshot AI ra mắt mô hình mã nguồn mở 2,8 nghìn tỷ tham số

Moonshot AI công bố Kimi K3, mô hình mở lớn nhất từ trước đến nay với 2,8 nghìn tỷ tham số, vượt Claude Fable 5 ở benchmark code frontend dù vẫn dùng phần cứng bị hạn chế xuất khẩu.

Silicon Motion đã bắt đầu phát triển controller SSD PCIe Gen7

Alex Chou, lãnh đạo mảng doanh nghiệp của Silicon Motion, tiết lộ hãng đã bắt đầu phát triển controller PCIe Gen7 và đang bám sát sáng kiến Storage Next của Nvidia cho hạ tầng AI.

Nvidia bác tin trì hoãn Vera Rubin, nhưng né tránh câu hỏi về Rubin Ultra

CEO Jensen Huang khẳng định Vera Rubin đã vào sản xuất với sản lượng khổng lồ, bác bỏ tin đồn trì hoãn, nhưng không đề cập đến báo cáo về việc hệ thống Rubin Ultra Kyber NVL144 có thể bị chậm tiến độ.