Mô hình Google Gemma 4 chính thức hoạt động trên card đồ họa Nvidia RTX

Published on

Quảng cáo

Mô hình nguồn mở Google Gemma 4 hiện hỗ trợ triển khai trên phần cứng Nvidia RTX, cung cấp hiệu năng tối ưu cho các tác vụ AI tự chủ.

Các mô hình ngôn ngữ mở đang thúc đẩy làn sóng trí tuệ nhân tạo trực tiếp trên thiết bị, đưa những đổi mới công nghệ vượt ra khỏi ranh giới điện toán đám mây truyền thống. Giá trị cốt lõi của các mô hình này phụ thuộc vào khả năng truy cập dữ liệu cục bộ theo thời gian thực để đưa ra phản hồi chính xác.

eevee nv blog 1280x680 1 1 MMOSITE - Thông tin công nghệ

Google và Nvidia vừa chính thức công bố thỏa thuận hợp tác tối ưu hóa dòng mô hình Gemma 4 cho các hệ thống sử dụng đơn vị xử lý đồ họa (GPU) Nvidia. Việc triển khai mang lại hiệu suất vận hành ổn định trên nhiều nền tảng phần cứng khác nhau, từ các trung tâm dữ liệu quy mô lớn, máy tính cá nhân và máy trạm tích hợp GPU RTX, siêu máy tính AI cá nhân DGX Spark cho đến các mô-đun AI biên Jetson Orin Nano.

Đa dạng phiên bản và khả năng xử lý đa phương thức

Dòng mô hình nguồn mở Gemma 4 được phân chia thành bốn biến thể chính bao gồm E2B, E4B, 26B và 31B. Các phiên bản này được tinh chỉnh để phục vụ nhiều mục đích triển khai từ thiết bị biên đến hệ thống phần cứng hiệu năng cao.

Thế hệ mô hình nhỏ gọn mới hỗ trợ toàn diện các tác vụ phức tạp như suy luận logic, lập trình mã nguồn, gỡ lỗi phần mềm và cung cấp hỗ trợ gốc cho các hệ thống AI tự chủ thông qua chức năng gọi công cụ. Gemma 4 sở hữu năng lực xử lý đa phương thức ấn tượng, cho phép nhận diện hình ảnh, nhận dạng giọng nói tự động và phân tích tài liệu hoặc video. Người dùng có quyền kết hợp văn bản và hình ảnh theo bất kỳ trình tự nào trong một câu lệnh duy nhất.

A bar chart titled 'Up to 2.7x Gemma 4 Inference Performance on NVIDIA GPUs with llama.cpp' shows NVIDIA RTX 5090 outperforming M3 Ultra in various Gemma-4 configurations.

Hệ thống hỗ trợ sẵn hơn 35 ngôn ngữ và được đào tạo trước trên tập dữ liệu gồm 140 ngôn ngữ khác nhau. Biến thể E2B và E4B hướng đến quá trình suy luận độ trễ thấp trên thiết bị biên, hoạt động hoàn toàn ngoại tuyến trên các nền tảng như Jetson Nano. Trong khi đó, biến thể 26B và 31B tập trung vào khả năng suy luận hiệu năng cao, tối ưu hóa cho các hệ thống GPU RTX và DGX Spark để vận hành môi trường lập trình và các quy trình làm việc do AI tự chủ điều khiển.

Ứng dụng thực tiễn và phương thức triển khai

Sự phát triển của AI tự chủ cục bộ tạo điều kiện cho các ứng dụng như OpenClaw vận hành trợ lý ảo liên tục trên thiết bị cá nhân. Dòng Gemma 4 tương thích hoàn toàn với OpenClaw, giúp người dùng xây dựng các tác nhân nội bộ có khả năng trích xuất ngữ cảnh từ tệp tin cá nhân để tự động hóa công việc. Để hỗ trợ quá trình cài đặt, Nvidia đã hợp tác cùng Ollama và llama.cpp nhằm cung cấp trải nghiệm triển khai thuận lợi nhất.

Người dùng có thể tải xuống phần mềm Ollama hoặc cài đặt llama.cpp kết hợp cùng tệp trọng số GGUF trên nền tảng Hugging Face. Nền tảng Unsloth cung cấp hỗ trợ tức thời thông qua các mô hình đã được lượng tử hóa để tinh chỉnh cục bộ qua công cụ Unsloth Studio. Việc vận hành các mô hình mở như Gemma 4 trên phần cứng Nvidia mang lại hiệu năng tối đa nhờ lõi Tensor chuyên dụng giúp tăng tốc độ xử lý suy luận.

Ngăn xếp phần mềm CUDA đảm bảo khả năng tương thích rộng rãi trên các khung làm việc hàng đầu, cho phép dòng mô hình mới mở rộng quy mô hoạt động từ thiết bị biên đến máy trạm di động mà không yêu cầu quá trình tinh chỉnh phức tạp.

Nguồn: wccftech

Tin mới

Hiệu năng NVIDIA DLSS 5 nhanh hơn 5 lần bản thử nghiệm

NVIDIA vừa chính thức chia sẻ những thông số hiệu năng đầu tiên của...

LG Grambook AI 2026 lộ thiết kế nhẹ hơn Samsung Galaxy Book6

Ngay sau khi Samsung trình làng mẫu laptop Galaxy Book6 trang bị vi xử...

Alienware ra mắt màn hình 4K AW3226K công nghệ RGB Stripe Tandem OLED

Alienware vừa chính thức bổ sung hai tân binh vào dải sản phẩm màn...

X phát hiện mạng lưới 200.000 bot Trung Quốc, một phần chống trung tâm dữ liệu AI

X vừa gỡ bỏ mạng lưới khoảng 200.000 tài khoản Trung Quốc, trong đó 200 tài khoản đăng nội dung khuấy động tranh cãi về trung tâm dữ liệu AI tại Mỹ.

Razer ra mắt bộ phụ kiện xanh trong suốt mừng Xbox 25 năm

Razer hợp tác Xbox tung bộ sưu tập giới hạn mừng sinh nhật 25 năm, gồm chuột Basilisk V3 Pro 35K, bàn phím BlackWidow V4 75% và tai nghe Hammerhead V3 X phiên bản xanh trong suốt.

Viewing Part chung kết tổng VCT 2026 PACIFIC STAGE 2 tổ chức tại TP.HCM và Hà Nội

Cộng đồng hâm mộ Thể thao điện tử toàn quốc sắp có dịp trải...

Xiaomi chính thức ra mắt REDMI Note 17 Series với pin dung lượng 10.000mAh

REDMI Note 17 Series nâng cấp toàn diện các tiêu chuẩn về pin, độ...

Chip Fujitsu Monaka 3D CPU 2nm ra mắt năm 2029 cùng công nghệ NVLink Fusion

Mẫu CPU Monaka của Fujitsu dự kiến trình làng vào năm 2027 với 144...

Sự kiện ra mắt dòng sản phẩm ROG kỉ niệm 20 năm

ASUS Republic of Gamers (ROG) chính thức giới thiệu bộ sưu tập ROG Edition...

Tặng 3 tháng Google AI cho khách hàng sở hữu laptop ASUS & ROG

Từ tháng 8/2026, khách hàng sở hữu các dòng laptop ASUS và ROG đủ...

tin liên quan

Laptop Surface chạy Nvidia N1X bị thử nghiệm sớm, driver chưa theo kịp phần cứng

Một chiếc Microsoft Surface Laptop Ultra thử nghiệm dùng chip Nvidia RTX Spark N1X vừa bị lộ, cho thấy tiềm năng nhưng vẫn còn nhiều lỗi driver và hiệu năng chưa ổn định.