NVIDIA ra mắt dòng mô hình AI mở Nemotron 3 với hiệu năng gấp 4 lần

Published on

Quảng cáo

NVIDIA vừa công bố dòng mô hình Nemotron 3 gồm ba phiên bản, tích hợp kiến trúc MoE tiên tiến giúp tăng tốc độ xử lý và tối ưu hóa chi phí.

A scatter plot titled 'Intelligence vs. Output Speed' shows 'gpt-oss-20B (high)' from OpenAI and 'NVIDIA Nemotron 3 Nano' in the most attractive quadrant, indicating high output speed and intelligence index.

NVIDIA đã chính thức giới thiệu gia đình mô hình mở (open models) mới nhất mang tên Nemotron 3, bao gồm dữ liệu và các thư viện hỗ trợ được thiết kế để thúc đẩy phát triển AI tác nhân (agentic AI) minh bạch và hiệu quả trên nhiều ngành công nghiệp.

Dòng sản phẩm này ra mắt với ba kích thước khác nhau gồm Nano, Super và Ultra, giới thiệu kiến trúc chuyên gia hỗn hợp tiềm ẩn (hybrid latent Mixture-of-Experts – MoE) mang tính đột phá. Công nghệ này hỗ trợ các nhà phát triển xây dựng và triển khai các hệ thống đa tác nhân tin cậy ở quy mô lớn.

The image shows an announcement for the NVIDIA Nemotron 3 family of models: 'Nano' (30B-A3B) available now, 'Super' (~100B-A10B) coming Q1 2026, and 'Ultra' (~500B-A50B) coming 1H 2026, with additional sections on '

Động thái này cũng củng cố nỗ lực phát triển AI chủ quyền của NVIDIA, cho phép các tổ chức từ châu Âu đến Hàn Quốc xây dựng hệ thống AI phù hợp với dữ liệu và quy định riêng biệt. Hiện tại, nhiều doanh nghiệp lớn như Accenture, Oracle Cloud Infrastructure, Siemens và Zoom đã bắt đầu tích hợp các mô hình Nemotron vào quy trình làm việc.

Cải tiến kiến trúc và hiệu suất vượt trội

Phiên bản Nemotron 3 Nano, hiện đã có sẵn, là mô hình tối ưu nhất về chi phí tính toán với 30 tỷ tham số (trong đó có 3 tỷ tham số kích hoạt). Mô hình này được thiết kế cho các tác vụ mục tiêu như gỡ lỗi phần mềm, tóm tắt nội dung và trợ lý AI. Nhờ kiến trúc MoE lai độc đáo, Nemotron 3 Nano đạt thông lượng token cao gấp 4 lần so với phiên bản Nemotron 2 Nano tiền nhiệm.

A bar chart titled 'Output Speed' shows the NVIDIA Nemotron 3 Nano outperforming other models with a score of 377 tokens per second.

Đồng thời, khả năng tạo token suy luận giảm tới 60%, giúp tiết kiệm đáng kể chi phí vận hành. Với cửa sổ ngữ cảnh lên tới 1 triệu token, phiên bản Nano có khả năng ghi nhớ tốt hơn, đảm bảo độ chính xác khi kết nối thông tin trong các tác vụ dài và phức tạp. Tổ chức đánh giá độc lập Artificial Analysis đã xếp hạng đây là mô hình mở hiệu quả nhất trong phân khúc cùng kích thước.

Phân khúc cao cấp và lộ trình phát hành

Bên cạnh phiên bản Nano, dòng sản phẩm còn bao gồm Nemotron 3 Super và Ultra. Phiên bản Super sở hữu khoảng 100 tỷ tham số (10 tỷ kích hoạt), chuyên dụng cho các ứng dụng đa tác nhân đòi hỏi độ trễ thấp. Trong khi đó, Nemotron 3 Ultra là động cơ suy luận mạnh mẽ nhất với 500 tỷ tham số (50 tỷ kích hoạt), phục vụ các quy trình công việc phức tạp yêu cầu nghiên cứu sâu và lập kế hoạch chiến lược.

Cả hai phiên bản này đều sử dụng định dạng huấn luyện NVFP4 4-bit siêu hiệu quả trên kiến trúc NVIDIA Blackwell, giúp giảm yêu cầu bộ nhớ và tăng tốc độ huấn luyện mà không làm giảm độ chính xác.A scatter plot titled 'Artificial Analysis Openness Index vs. Artificial Analysis Intelligence Index' shows NVIDIA products like 'Nemotron Nano 12B v2 VL' and 'Nemotron 3 Nano' in the most attractive quadrant.

Về khả năng tiếp cận, Nemotron 3 Nano hiện đã có mặt trên Hugging Face và các nhà cung cấp dịch vụ suy luận như AWS (thông qua Amazon Bedrock), Google Cloud và Coreweave. Mô hình này cũng được cung cấp dưới dạng vi dịch vụ NVIDIA NIM để đảm bảo tính bảo mật. Hai phiên bản cao cấp hơn là Nemotron 3 Super và Ultra dự kiến sẽ chính thức ra mắt vào nửa đầu năm 2026.

Nguồn: wccftech

Tin mới

Mùa Back To School 2026 khác biệt của ASUS

Mùa tựu trường 2026, ASUS vẫn giữ những giá trị cốt lõi thực dụng...

Huawei khởi động chương trình Back To School 2026 “Ready – Set – Sync”

Nhằm đồng hành cùng học sinh, sinh viên chuẩn bị cho năm học mới,...

Galaxy Z Fold8 dùng màn hình 4:3, giá từ 46,99 triệu đồng tại Việt Nam

Samsung Galaxy Z Fold8 sở hữu thân máy thấp rộng, màn hình chính 7.6 inch tỷ lệ 4:3 mới, cấu hình Snapdragon 8 Elite Gen 5, giá khởi điểm 46,99 triệu đồng.

Philips Evnia 32M2N6901A: Màn hình QD-OLED 4K định hình không gian giải trí cao cấp

Thương hiệu Philips vừa chính thức ra mắt Evnia 32M2N6901A, mẫu màn hình chuyên...

NVIDIA RTX Spark nhận bản cập nhật Driver đầu tiên

NVIDIA vừa chính thức phát hành bản xem trước đầu tiên của driver hỗ...

Apple tăng giá iCloud+ tại Việt Nam, gói 50 GB tăng mạnh nhất 31,58%

Apple tăng giá iCloud+ tại Việt Nam từ 17/7, lần đầu kể từ tháng 6/2023, với gói 50 GB tăng mạnh nhất 31,58%, nằm trong đợt điều chỉnh giá tại 8 quốc gia.

Intel Nova Lake lộ tên gọi Core Ultra Series 400, ra mắt rải rác đến 2027

Rò rỉ mới cho thấy Intel Nova Lake sẽ mang tên Core Ultra Series 400, ra mắt theo từng đợt từ đầu đến cuối năm 2027, với flagship 52 nhân đến sau cùng.

Garmin Cirqa lại lộ diện, lần này trên chính website của Garmin

Website Romania của Garmin vừa vô tình để lộ tên Cirqa trong mục Health Status, củng cố thêm tin đồn về mẫu smart band không màn hình sắp ra mắt.

AMD dọn đường ra mắt dòng vi xử lý Ryzen AI MAX PRO 400 với bản cập nhật ROCm 7.14

"Đội Đỏ" AMD đã chính thức đặt nền móng cho màn ra mắt của...

Người dùng MacBook tự mài cạnh máy để cổ tay đỡ đau

Nhiều người dùng MacBook chọn cách tự mài giũa cạnh viền sắc của máy bằng giũa kim loại và giấy nhám để giảm khó chịu khi kê cổ tay, dù Apple vốn nổi tiếng khắt khe về thiết kế.

tin liên quan

Kimi K3: Moonshot AI ra mắt mô hình mã nguồn mở 2,8 nghìn tỷ tham số

Moonshot AI công bố Kimi K3, mô hình mở lớn nhất từ trước đến nay với 2,8 nghìn tỷ tham số, vượt Claude Fable 5 ở benchmark code frontend dù vẫn dùng phần cứng bị hạn chế xuất khẩu.

Silicon Motion đã bắt đầu phát triển controller SSD PCIe Gen7

Alex Chou, lãnh đạo mảng doanh nghiệp của Silicon Motion, tiết lộ hãng đã bắt đầu phát triển controller PCIe Gen7 và đang bám sát sáng kiến Storage Next của Nvidia cho hạ tầng AI.

Nvidia bác tin trì hoãn Vera Rubin, nhưng né tránh câu hỏi về Rubin Ultra

CEO Jensen Huang khẳng định Vera Rubin đã vào sản xuất với sản lượng khổng lồ, bác bỏ tin đồn trì hoãn, nhưng không đề cập đến báo cáo về việc hệ thống Rubin Ultra Kyber NVL144 có thể bị chậm tiến độ.