HomeAIGPU RTX của NVIDIA mang đến hiệu năng AI nhanh nhất cho...

GPU RTX của NVIDIA mang đến hiệu năng AI nhanh nhất cho mô hình “gpt-oss” mới nhất của OpenAI

Published on

NVIDIA và OpenAI vừa đưa dòng mô hình mã nguồn mở gpt-oss đến tay người dùng phổ thông, mở ra hiệu năng AI vượt trội trên các PC và workstation sử dụng GPU RTX.

Mô hình AI mạnh mẽ từng chỉ có trên cloud, giờ chạy mượt ngay tại nhà

Trong thông báo hôm nay, NVIDIA cho biết đã hợp tác với OpenAI để mang gpt-oss – dòng mô hình AI mở mới nhất – đến cộng đồng người dùng cá nhân. Những mô hình AI từng chỉ vận hành trong trung tâm dữ liệu giờ đây chạy siêu nhanh ngay trên máy tính cá nhân có trang bị GPU RTX.

gpu-rtx-cua-nvidia-mang-den-hieu-nang-ai-nhanh-nhat

Jensen Huang, nhà sáng lập kiêm CEO của NVIDIA, nhấn mạnh:

“OpenAI đã cho thế giới thấy điều kỳ diệu có thể xây dựng trên nền NVIDIA AI – và giờ họ đang thúc đẩy sự đổi mới trong phần mềm mã nguồn mở. Các mô hình gpt-oss giúp nhà phát triển toàn cầu phát triển trên nền tảng tiên tiến, củng cố vị thế công nghệ AI của Mỹ – tất cả đều vận hành trên hạ tầng AI lớn nhất thế giới.”

Hai mô hình AI mới – tốc độ cao, xử lý dài, thiết kế cho RTX

Sự kiện ra mắt đánh dấu một thế hệ AI chạy trên thiết bị cá nhân nhanh và thông minh hơn, nhờ sức mạnh từ GPU GeForce RTX và RTX PRO. Dòng gpt-oss hiện có hai phiên bản:

OpenAI raises $8.3 billion funds

  • gpt-oss-20b: Tối ưu hóa cho các PC AI dùng RTX có ít nhất 16GB VRAM, đạt tốc độ lên đến 250 token/giây trên GPU RTX 5090.
  • gpt-oss-120b: Phiên bản lớn hơn, dành cho workstation chuyên nghiệp dùng GPU RTX PRO.

Cả hai mô hình đều được huấn luyện trên GPU NVIDIA H100, và là những mô hình đầu tiên hỗ trợ MXFP4 – một kỹ thuật mới giúp tăng chất lượng và độ chính xác mô hình mà không làm giảm hiệu năng so với phương pháp cũ.

Các điểm nổi bật khác:

  • Hỗ trợ độ dài ngữ cảnh đến 131.072 tokens – dài nhất trong số các mô hình AI chạy cục bộ hiện nay.
  • Kiến trúc mixture-of-experts (MoE) linh hoạt, hỗ trợ chain-of-thought, thực hiện chỉ dẫn, và sử dụng công cụ.

Người dùng có thể bắt đầu ngay với các công cụ sau:

  • Ollama App: Ứng dụng dễ dùng nhất để thử nghiệm gpt-oss, với giao diện trực quan và tối ưu hóa sẵn cho GPU RTX.
  • Llama.cpp: NVIDIA hợp tác với cộng đồng mã nguồn mở để cải thiện hiệu năng, mới đây đã tích hợp CUDA Graphs giúp giảm độ trễ. Có thể bắt đầu tại GitHub của Llama.cpp.
  • Microsoft AI Foundry: Các nhà phát triển Windows có thể truy cập gpt-oss qua Microsoft AI Foundry Local (bản thử nghiệm công khai). Chỉ cần gõ lệnh Foundry model run gpt-oss-20b trong terminal để bắt đầu.

Sự kết hợp giữa NVIDIA và OpenAI hứa hẹn sẽ đưa khả năng AI cao cấp đến gần hơn với cộng đồng nhà phát triển và người dùng phổ thông, đồng thời đẩy nhanh bước tiến của mô hình mã nguồn mở trong kỷ nguyên AI chạy tại thiết bị cá nhân.

Nguồn: wccftech

tin mới nhất

AMD sắp ra mắt công nghệ FSR Multi-Frame Generation

AMD đang phát triển công nghệ Multi-Frame Generation cho hệ thống FSR, thông tin...

ASRock ra mắt nguồn máy tính Pro Series chuẩn ATX 3.1

ASRock chính thức giới thiệu dải sản phẩm nguồn máy tính Pro Series chuẩn...

TCL KHAI MỞ KỶ NGUYÊN HIỂN THỊ MỚI, KIẾN TẠO CHUẨN SỐNG PHONG CÁCH

Tại không gian mang tính biểu tượng của Nhà Hát Thành Phố, TCL –...

Vi xử lý AMD Ryzen 3D V-Cache tăng 88% hiệu suất mô hình AI RAG

Vi xử lý AMD trang bị công nghệ 3D V-Cache ghi nhận mức tăng...

Intel ra mắt vi xử lý Wildcat Lake cạnh tranh với MacBook Neo

Intel vừa ra mắt dòng vi xử lý Wildcat Lake Core Series 3 dành...

tin liên quan

NVIDIA chuẩn bị ra mắt GeForce RTX 5060 Ti và RTX 5060 bản 9GB VRAM

NVIDIA dự kiến giới thiệu hai phiên bản GeForce...

Người dùng có thể kích hoạt sớm tính năng Nvidia Dynamic Multi-Frame Generation qua OTA

Tính năng Nvidia Dynamic Multi-Frame Generation có thể được...

NVIDIA giới thiệu DGX Spark cho workload AI agent và mô hình 700B tham số

NVIDIA công bố DGX Spark, nền tảng máy trạm...

NVIDIA công bố DLSS 5 với công nghệ dựng hình thần kinh thế hệ mới

DLSS 5 nâng cấp chất lượng đồ họa bằng...

NVIDIA công bố GPU Feynman với công nghệ xếp chồng 3D và HBM tùy biến

NVIDIA tiết lộ thêm chi tiết về nền tảng...