Mô hình Google Gemma 4 chính thức hoạt động trên card đồ họa Nvidia RTX

Published on

Quảng cáo

Mô hình nguồn mở Google Gemma 4 hiện hỗ trợ triển khai trên phần cứng Nvidia RTX, cung cấp hiệu năng tối ưu cho các tác vụ AI tự chủ.

Các mô hình ngôn ngữ mở đang thúc đẩy làn sóng trí tuệ nhân tạo trực tiếp trên thiết bị, đưa những đổi mới công nghệ vượt ra khỏi ranh giới điện toán đám mây truyền thống. Giá trị cốt lõi của các mô hình này phụ thuộc vào khả năng truy cập dữ liệu cục bộ theo thời gian thực để đưa ra phản hồi chính xác.

eevee nv blog 1280x680 1 1 MMOSITE - Thông tin công nghệ

Google và Nvidia vừa chính thức công bố thỏa thuận hợp tác tối ưu hóa dòng mô hình Gemma 4 cho các hệ thống sử dụng đơn vị xử lý đồ họa (GPU) Nvidia. Việc triển khai mang lại hiệu suất vận hành ổn định trên nhiều nền tảng phần cứng khác nhau, từ các trung tâm dữ liệu quy mô lớn, máy tính cá nhân và máy trạm tích hợp GPU RTX, siêu máy tính AI cá nhân DGX Spark cho đến các mô-đun AI biên Jetson Orin Nano.

Đa dạng phiên bản và khả năng xử lý đa phương thức

Dòng mô hình nguồn mở Gemma 4 được phân chia thành bốn biến thể chính bao gồm E2B, E4B, 26B và 31B. Các phiên bản này được tinh chỉnh để phục vụ nhiều mục đích triển khai từ thiết bị biên đến hệ thống phần cứng hiệu năng cao.

Thế hệ mô hình nhỏ gọn mới hỗ trợ toàn diện các tác vụ phức tạp như suy luận logic, lập trình mã nguồn, gỡ lỗi phần mềm và cung cấp hỗ trợ gốc cho các hệ thống AI tự chủ thông qua chức năng gọi công cụ. Gemma 4 sở hữu năng lực xử lý đa phương thức ấn tượng, cho phép nhận diện hình ảnh, nhận dạng giọng nói tự động và phân tích tài liệu hoặc video. Người dùng có quyền kết hợp văn bản và hình ảnh theo bất kỳ trình tự nào trong một câu lệnh duy nhất.

A bar chart titled 'Up to 2.7x Gemma 4 Inference Performance on NVIDIA GPUs with llama.cpp' shows NVIDIA RTX 5090 outperforming M3 Ultra in various Gemma-4 configurations.

Hệ thống hỗ trợ sẵn hơn 35 ngôn ngữ và được đào tạo trước trên tập dữ liệu gồm 140 ngôn ngữ khác nhau. Biến thể E2B và E4B hướng đến quá trình suy luận độ trễ thấp trên thiết bị biên, hoạt động hoàn toàn ngoại tuyến trên các nền tảng như Jetson Nano. Trong khi đó, biến thể 26B và 31B tập trung vào khả năng suy luận hiệu năng cao, tối ưu hóa cho các hệ thống GPU RTX và DGX Spark để vận hành môi trường lập trình và các quy trình làm việc do AI tự chủ điều khiển.

Ứng dụng thực tiễn và phương thức triển khai

Sự phát triển của AI tự chủ cục bộ tạo điều kiện cho các ứng dụng như OpenClaw vận hành trợ lý ảo liên tục trên thiết bị cá nhân. Dòng Gemma 4 tương thích hoàn toàn với OpenClaw, giúp người dùng xây dựng các tác nhân nội bộ có khả năng trích xuất ngữ cảnh từ tệp tin cá nhân để tự động hóa công việc. Để hỗ trợ quá trình cài đặt, Nvidia đã hợp tác cùng Ollama và llama.cpp nhằm cung cấp trải nghiệm triển khai thuận lợi nhất.

Người dùng có thể tải xuống phần mềm Ollama hoặc cài đặt llama.cpp kết hợp cùng tệp trọng số GGUF trên nền tảng Hugging Face. Nền tảng Unsloth cung cấp hỗ trợ tức thời thông qua các mô hình đã được lượng tử hóa để tinh chỉnh cục bộ qua công cụ Unsloth Studio. Việc vận hành các mô hình mở như Gemma 4 trên phần cứng Nvidia mang lại hiệu năng tối đa nhờ lõi Tensor chuyên dụng giúp tăng tốc độ xử lý suy luận.

Ngăn xếp phần mềm CUDA đảm bảo khả năng tương thích rộng rãi trên các khung làm việc hàng đầu, cho phép dòng mô hình mới mở rộng quy mô hoạt động từ thiết bị biên đến máy trạm di động mà không yêu cầu quá trình tinh chỉnh phức tạp.

Nguồn: wccftech

Tin mới

Microsoft âm thầm xóa khuyến nghị 32GB RAM cho Windows 11

Khủng hoảng bộ nhớ DRAM toàn cầu đã buộc Microsoft phải thay đổi hoàn...

GIGABYTE chính thức ra mắt nguồn máy tính AORUS P1600W

GIGABYTE vừa chính thức trình làng mẫu nguồn máy tính (PSU) cao cấp AORUS...

ASUS ROG Strix XG259QNSR Ace: Màn hình Fast IPS 420Hz dành riêng cho eSports

Thương hiệu phần cứng đình đám ASUS vừa bổ sung vào dải sản phẩm...

Samsung phô diễn công nghệ lưu trữ BV-NAND V10 siêu tốc

Tại sự kiện Future of Memory and Storage (FMS) 2026 diễn ra ở Santa...

Elon Musk cam kết SpaceX sử dụng độc quyền GPU NVIDIA

Giám đốc điều hành kiêm Nhà sáng lập SpaceX, Elon Musk, vừa khẳng định...

DJI ra mắt DJI Mic Mini 2S: Định nghĩa lại chuẩn mực âm thanh 32-BIT Float

DJI, thương hiệu hàng đầu thế giới về thiết bị quay phim và giải...

MSI trình làng hệ sinh thái DRACO EPIC Edition cùng “siêu phẩm” RTX 5080

Nhân dịp kỷ niệm 40 năm thành lập, MSI đã chính thức giới thiệu...

Nikon thua kiện Viltrox, bằng sáng chế ngàm Z bị tuyên vô hiệu tại Trung Quốc

Cơ quan sở hữu trí tuệ Trung Quốc bác đơn kiện của Nikon nhắm vào Viltrox, tuyên bố các bằng sáng chế liên quan đến ngàm Z-mount không đủ tính mới để được bảo hộ.

MSI ra mắt màn hình OLED 27 inch đột phá: Ứng dụng công nghệ in phun thay thế mặt nạ kim loại

MSI vừa chính thức giới thiệu PRO MAX OLED 271UPJW12 – mẫu màn hình...

CFVL 2026 Mùa 2 khép lại với hành trình đầy cảm xúc, Team Falcons lên ngôi vô địch

Sau 2 tháng tranh tài sôi nổi, CrossFire Vietnam League (CFVL) 2026 Mùa 2...

tin liên quan

Laptop Surface chạy Nvidia N1X bị thử nghiệm sớm, driver chưa theo kịp phần cứng

Một chiếc Microsoft Surface Laptop Ultra thử nghiệm dùng chip Nvidia RTX Spark N1X vừa bị lộ, cho thấy tiềm năng nhưng vẫn còn nhiều lỗi driver và hiệu năng chưa ổn định.