NVIDIA và Meta thúc đẩy sức mạnh AI với mô hình ngôn ngữ Llama 3

Published on

Quảng cáo

NVIDIA hôm nay đã công bố việc tối ưu hóa trên tất cả các nền tảng của mình để thúc đẩy hiệu suất của Meta Llama 3, thế hệ mới nhất của mô hình ngôn ngữ lớn (LLM). Được xây dựng dựa trên công nghệ của NVIDIA, Llama 3 hiện đã sẵn sàng để sử dụng trên các thiết bị từ máy chủ đến PC, qua đó mở rộng khả năng tiếp cận và tăng cường đổi mới trong nghiên cứu và ứng dụng thực tiễn.

Sức mạnh học máy trên nền tảng khủng

Meta đã huấn luyện Llama 3 trên một cụm máy tính chứa 24,576 GPU NVIDIA H100 Tensor Core, kết nối bằng mạng NVIDIA Quantum-2 InfiniBand. Với sự hỗ trợ từ NVIDIA, Meta đã tinh chỉnh mạng lưới, phần mềm và kiến trúc mô hình để phù hợp nhất với LLM của mình. Gần đây, Meta còn tiết lộ kế hoạch mở rộng cơ sở hạ tầng của mình lên tới 350,000 GPU H100.

Ứng dụng thực tiễn của Llama 3

Hiện tại, Llama 3 đã được tăng tốc bởi GPU NVIDIA và có sẵn cho việc sử dụng trong đám mây, trung tâm dữ liệu, thiết bị biên và PC. Các nhà phát triển có thể trải nghiệm Llama 3 thông qua trình duyệt tại ai.nvidia.com, nơi nó được đóng gói dưới dạng dịch vụ micro NVIDIA NIM với giao diện lập trình ứng dụng chuẩn, có thể triển khai mọi nơi.

meta llama 768x403 1 MMOSITE - Thông tin công nghệ

Doanh nghiệp có thể tinh chỉnh Llama 3 với dữ liệu của họ sử dụng NVIDIA NeMo, một khung làm việc mã nguồn mở cho LLMs, là một phần của nền tảng NVIDIA AI Enterprise được bảo mật và hỗ trợ. Các mô hình tùy chỉnh có thể được tối ưu hóa cho suy luận với NVIDIA TensorRT-LLM và triển khai với NVIDIA Triton Inference Server.

Hiệu năng tối ưu trên thiết bị và PC

Llama 3 cũng được chạy trên NVIDIA Jetson Orin cho robot và thiết bị tính toán biên, tạo ra các trợ lý tương tác như trong Jetson AI Lab. Hơn nữa, GPU NVIDIA RTX và GeForce RTX cho máy trạm và PC tăng tốc suy luận trên Llama 3, cung cấp cho các nhà phát triển mục tiêu hơn 100 triệu hệ thống được tăng tốc bởi NVIDIA trên toàn cầu.

Kết nối cộng đồng thông qua mô hình mở

Là một người đóng góp tích cực cho mã nguồn mở, NVIDIA cam kết tối ưu hóa phần mềm cộng đồng giúp người dùng giải quyết những thách thức khó khăn nhất. Mô hình mã nguồn mở cũng thúc đẩy sự minh bạch trong AI và cho phép người dùng chia sẻ rộng rãi công việc về an toàn và sức bền của AI.

Để tìm hiểu thêm về nền tảng suy luận AI của NVIDIA, bao gồm cách sử dụng các kỹ thuật tiên tiến như thích ứng hạng thấp để tăng tốc các LLM mới nhất, hãy truy cập trang web của NVIDIA.

Tin mới

Huawei tự hào giảm 50% bộ đệm xung nhịp nhờ LogicFolding

Công nghệ LogicFolding của Huawei, dù ra đời trong bối cảnh ngặt nghèo của...

ASRock trang bị GPU RTX Pro 4000 và 2000 cho dòng máy tính nhỏ gọn DeskSlim

Hãng phần cứng danh tiếng ASRock vừa công bố các cấu hình mới cho...

POCO ra mắt POCO C95 Pro tại Việt Nam: Pin 7.500mAh bền bỉ

POCO C95 Pro nổi bật với viên pin dung lượng lớn 7.500mAh, sạc nhanh...

Xiaomi Smart Band 11 ra mắt: Tiếp nối sức hút “vòng đeo tay thông minh quốc dân”

Với màn hình AMOLED 1.72 inch có độ sáng lên đến 2.000 nit, cùng...

AOC trình làng màn hình gaming IPS 1000Hz đầu tiên trên thế giới

Theo công bố từ AOC, điểm khác biệt của sản phẩm này so với...

Montage Technology (Trung Quốc) sản xuất hàng loạt chip CKD DDR5 đạt tốc độ 9200 MT/s

Bất chấp tình trạng khan hiếm và biến động giá cả trên toàn cầu,...

Microsoft lý giải sự vắng bóng của chip AMD trên dòng Surface

Dòng sản phẩm Surface của Microsoft hiện nay chủ yếu sử dụng vi xử...

Nothing ra mắt Headphone (1) Pro

Nothing, công ty công nghệ có trụ sở tại Luân Đôn giới thiệu Headphone...

Noctua hé lộ thiết bị theo dõi nguồn WireView Pro II “Noctua” Edition

Thương hiệu tản nhiệt danh tiếng Noctua vừa tiếp tục mở rộng hệ sinh...

Meta ra mắt kính thực tế ảo Meta VR Glasses và kính Ray-Ban Meta Audio

Tại sự kiện Meta Connect 2026, Meta đã chính thức trình làng hai mẫu...

tin liên quan

Laptop Surface chạy Nvidia N1X bị thử nghiệm sớm, driver chưa theo kịp phần cứng

Một chiếc Microsoft Surface Laptop Ultra thử nghiệm dùng chip Nvidia RTX Spark N1X vừa bị lộ, cho thấy tiềm năng nhưng vẫn còn nhiều lỗi driver và hiệu năng chưa ổn định.