NVIDIA và Meta thúc đẩy sức mạnh AI với mô hình ngôn ngữ Llama 3

Published on

Quảng cáo

NVIDIA hôm nay đã công bố việc tối ưu hóa trên tất cả các nền tảng của mình để thúc đẩy hiệu suất của Meta Llama 3, thế hệ mới nhất của mô hình ngôn ngữ lớn (LLM). Được xây dựng dựa trên công nghệ của NVIDIA, Llama 3 hiện đã sẵn sàng để sử dụng trên các thiết bị từ máy chủ đến PC, qua đó mở rộng khả năng tiếp cận và tăng cường đổi mới trong nghiên cứu và ứng dụng thực tiễn.

Sức mạnh học máy trên nền tảng khủng

Meta đã huấn luyện Llama 3 trên một cụm máy tính chứa 24,576 GPU NVIDIA H100 Tensor Core, kết nối bằng mạng NVIDIA Quantum-2 InfiniBand. Với sự hỗ trợ từ NVIDIA, Meta đã tinh chỉnh mạng lưới, phần mềm và kiến trúc mô hình để phù hợp nhất với LLM của mình. Gần đây, Meta còn tiết lộ kế hoạch mở rộng cơ sở hạ tầng của mình lên tới 350,000 GPU H100.

Ứng dụng thực tiễn của Llama 3

Hiện tại, Llama 3 đã được tăng tốc bởi GPU NVIDIA và có sẵn cho việc sử dụng trong đám mây, trung tâm dữ liệu, thiết bị biên và PC. Các nhà phát triển có thể trải nghiệm Llama 3 thông qua trình duyệt tại ai.nvidia.com, nơi nó được đóng gói dưới dạng dịch vụ micro NVIDIA NIM với giao diện lập trình ứng dụng chuẩn, có thể triển khai mọi nơi.

meta llama 768x403 1 MMOSITE - Thông tin công nghệ

Doanh nghiệp có thể tinh chỉnh Llama 3 với dữ liệu của họ sử dụng NVIDIA NeMo, một khung làm việc mã nguồn mở cho LLMs, là một phần của nền tảng NVIDIA AI Enterprise được bảo mật và hỗ trợ. Các mô hình tùy chỉnh có thể được tối ưu hóa cho suy luận với NVIDIA TensorRT-LLM và triển khai với NVIDIA Triton Inference Server.

Hiệu năng tối ưu trên thiết bị và PC

Llama 3 cũng được chạy trên NVIDIA Jetson Orin cho robot và thiết bị tính toán biên, tạo ra các trợ lý tương tác như trong Jetson AI Lab. Hơn nữa, GPU NVIDIA RTX và GeForce RTX cho máy trạm và PC tăng tốc suy luận trên Llama 3, cung cấp cho các nhà phát triển mục tiêu hơn 100 triệu hệ thống được tăng tốc bởi NVIDIA trên toàn cầu.

Kết nối cộng đồng thông qua mô hình mở

Là một người đóng góp tích cực cho mã nguồn mở, NVIDIA cam kết tối ưu hóa phần mềm cộng đồng giúp người dùng giải quyết những thách thức khó khăn nhất. Mô hình mã nguồn mở cũng thúc đẩy sự minh bạch trong AI và cho phép người dùng chia sẻ rộng rãi công việc về an toàn và sức bền của AI.

Để tìm hiểu thêm về nền tảng suy luận AI của NVIDIA, bao gồm cách sử dụng các kỹ thuật tiên tiến như thích ứng hạng thấp để tăng tốc các LLM mới nhất, hãy truy cập trang web của NVIDIA.

Tin mới

REDMI Note 17 Series tăng trưởng 160% chỉ sau 10 ngày ra mắt tại Việt Nam

Chỉ sau 10 ngày ra mắt, REDMI Note 17 Series ghi nhận mức tăng...

Kingston Technology Mang Lại Những Ngày Học Thông Minh Hơn

Từ giảng đường đến các dự án sáng tạo, những giải pháp bộ nhớ...

HKC ra mắt màn hình 4K Ultrawide 43,8 inch đầu tiên trên thế giới với tỷ lệ 24:9

Thương hiệu HKC vừa chính thức trình làng Tianqi 43H180C, mẫu màn hình 43,8...

BIWIN ra mắt kit RAM DW100 24GB x2 DDR5-6000 chuẩn AMD EXPO ULL

Thương hiệu bộ nhớ đình đám BIWIN vừa chính thức trình làng bộ kit...

NVIDIA ra mắt card đồ họa RTX PRO 5500 Blackwell

NVIDIA vừa bổ sung vào dải sản phẩm Blackwell PRO mẫu card đồ họa...

Philips ra mắt màn hình cong 34 inch 200Hz giá chỉ 299 Bảng Anh

Thương hiệu Philips vừa tiếp tục mở rộng dải sản phẩm giá rẻ bằng...

Apple A20 Pro lập kỷ lục điểm single-core trên Geekbench 6

Sự kết hợp giữa tiến trình sản xuất mới và thiết kế đóng gói...

MSI ra mắt màn hình UltraWide 34 inch QD-OLED thế hệ 5

Trong khi thị trường tràn ngập các mẫu màn hình chuyên game, MSI vừa...

Apple trình làng Watch Series 12 và Watch Ultra 4: Bổ sung chỉ số Health Age, Readiness Scoring

Apple vừa chính thức ra mắt hai mẫu đồng hồ thông minh thế hệ...

A20 Pro: SoC 2nm đầu tiên trên iPhone

Thế hệ iPhone 18 Pro, iPhone 18 Pro Max và iPhone Duo sẽ được...

tin liên quan

Laptop Surface chạy Nvidia N1X bị thử nghiệm sớm, driver chưa theo kịp phần cứng

Một chiếc Microsoft Surface Laptop Ultra thử nghiệm dùng chip Nvidia RTX Spark N1X vừa bị lộ, cho thấy tiềm năng nhưng vẫn còn nhiều lỗi driver và hiệu năng chưa ổn định.