NVIDIA ra mắt Dịch vụ Đám Mây Mô Hình Ngôn Ngữ Lớn để nâng cao Trí tuệ nhân tạo và Sinh học kỹ thuật số

Published on

Quảng cáo

NVIDIA hôm nay đã công bố hai dịch vụ AI đám mây mô hình ngôn ngữ lớn mới – Dịch vụ mô hình ngôn ngữ lớn NVIDIA NeMo  và Dịch vụ NVIDIA BioNeMo LLM – cho phép các nhà phát triển dễ dàng điều chỉnh LLM và triển khai các ứng dụng AI tùy chỉnh để tạo nội dung, tóm tắt văn bản, chatbots , phát triển mã, cũng như dự đoán cấu trúc protein và thuộc tính phân tử sinh học, v.v.

Dịch vụ NeMo LLM cho phép các nhà phát triển nhanh chóng điều chỉnh một số mô hình nền tảng được đào tạo trước bằng cách sử dụng phương pháp đào tạo được gọi là học nhanh trên cơ sở hạ tầng do NVIDIA quản lý. Dịch vụ NVIDIA BioNeMo là một giao diện lập trình ứng dụng đám mây (API) mở rộng các trường hợp sử dụng LLM ngoài ngôn ngữ và sang các ứng dụng khoa học để đẩy nhanh việc khám phá thuốc cho các công ty dược phẩm và công nghệ sinh học.

Jensen Huang, người sáng lập và Giám đốc điều hành, NVIDIA cho biết: “Các mô hình ngôn ngữ lớn có tiềm năng thay đổi mọi ngành công nghiệp. Khả năng điều chỉnh các mô hình nền tảng giúp sức mạnh của LLM trong tầm tay của hàng triệu nhà phát triển, những người hiện có thể tạo ra các dịch vụ ngôn ngữ và cung cấp sức mạnh cho các khám phá khoa học mà không cần phải xây dựng một mô hình lớn từ đầu”.

Dịch vụ NeMo LLM tăng cường độ chính xác với việc học hỏi kịp thời, tăng tốc triển khai

Với Dịch vụ NeMo LLM, các nhà phát triển có thể sử dụng dữ liệu đào tạo của riêng họ để tùy chỉnh các mô hình nền tảng từ 3 tỷ thông số lên đến Megatron 530B, một trong những LLM lớn nhất thế giới. Quá trình này chỉ mất vài phút đến hàng giờ so với hàng tuần hoặc hàng tháng cần thiết để đào tạo một mô hình từ đầu.

Các mô hình được tùy chỉnh với tính năng học tập nhanh chóng, sử dụng một kỹ thuật gọi là p-tuning. Điều này cho phép các nhà phát triển chỉ sử dụng vài trăm ví dụ để điều chỉnh nhanh chóng các mô hình nền tảng đã được đào tạo ban đầu với hàng tỷ điểm dữ liệu. Quá trình tùy chỉnh tạo ra các mã thông báo nhắc nhở theo nhiệm vụ cụ thể, sau đó được kết hợp với các mô hình nền tảng để mang lại độ chính xác cao hơn và các phản hồi phù hợp hơn cho các trường hợp sử dụng cụ thể.

Các nhà phát triển có thể tùy chỉnh cho nhiều trường hợp sử dụng bằng cách sử dụng cùng một mô hình và tạo nhiều mã thông báo nhắc nhở khác nhau. Tính năng playround cung cấp tùy chọn không mã để dễ dàng thử nghiệm và tương tác với các mô hình, thúc đẩy hơn nữa hiệu quả và khả năng tiếp cận của LLM cho các trường hợp sử dụng cụ thể trong ngành.

Sau khi sẵn sàng triển khai, các mô hình đã điều chỉnh có thể chạy trên các phiên bản đám mây, hệ thống tại chỗ hoặc thông qua API.

Dịch vụ LLM của BioNeMo cho phép các nhà nghiên cứu khai thác sức mạnh của các mô hình hàng loạt

Dịch vụ BioNeMo LLM bao gồm hai mô hình ngôn ngữ BioNeMo mới cho các ứng dụng hóa học và sinh học. Nó cung cấp hỗ trợ cho dữ liệu protein, DNA và hóa học để giúp các nhà nghiên cứu khám phá các mẫu và hiểu biết sâu sắc về trình tự sinh học.

BioNeMo cho phép các nhà nghiên cứu mở rộng phạm vi công việc của họ bằng cách tận dụng các mô hình chứa hàng tỷ tham số. Những mô hình lớn hơn này có thể lưu trữ nhiều thông tin hơn về cấu trúc của protein, mối quan hệ tiến hóa giữa các gen và thậm chí tạo ra các phân tử sinh học mới cho các ứng dụng điều trị.

API đám mây cung cấp quyền truy cập vào Megatron 530B và các model sẵn có

Ngoài việc điều chỉnh các mô hình nền tảng, các dịch vụ LLM bao gồm tùy chọn sử dụng các mô hình tùy chỉnh và tạo sẵn thông qua API đám mây.

Điều này cung cấp cho các nhà phát triển quyền truy cập vào một loạt các LLM được đào tạo trước, bao gồm Megatron 530B. Nó cũng cung cấp quyền truy cập vào các mô hình T5 và GPT-3 được tạo bằng khung NVIDIA NeMo Megatron – hiện đã có trong bản beta mở – để hỗ trợ nhiều loại ứng dụng và yêu cầu dịch vụ đa ngôn ngữ.

Các nhà lãnh đạo trong lĩnh vực ô tô, máy tính, giáo dục, chăm sóc sức khỏe, viễn thông và các ngành khác đang sử dụng NeMo Megatron để tiên phong cung cấp dịch vụ cho khách hàng bằng tiếng Trung, tiếng Anh, tiếng Hàn, tiếng Thụy Điển và các ngôn ngữ khác.

Tính khả dụng

Các dịch vụ NeMo LLM và BioNeMo và các API đám mây dự kiến sẽ có sẵn trong quyền truy cập sớm bắt đầu từ tháng tới. Các nhà phát triển có thể đăng ký ngay bây giờ để biết thêm chi tiết.

Bản phát hành beta của khung NeMo Megatron có sẵn từ NVIDIA NGC™ và được tối ưu hóa để chạy trên NVIDIA DGX™ Foundry và NVIDIA DGX SuperPOD™, cũng như các phiên bản đám mây tăng tốc từ Amazon Web Services, Microsoft Azure và Oracle Cloud Infrastructure.

Để trải nghiệm khung NeMo Megatron, các nhà phát triển có thể dùng thử miễn phí phòng thí nghiệm NVIDIA LaunchPad.

Hãy theo dõi bài phát biểu quan trọng của giám đốc NVIDIA Jensen Huang tại GTC 22 để tìm hiểu thêm về các mô hình ngôn ngữ lớn được hỗ trợ bởi NVIDIA AI.

Tin mới

REDMI Note 17 Series tăng trưởng 160% chỉ sau 10 ngày ra mắt tại Việt Nam

Chỉ sau 10 ngày ra mắt, REDMI Note 17 Series ghi nhận mức tăng...

Kingston Technology Mang Lại Những Ngày Học Thông Minh Hơn

Từ giảng đường đến các dự án sáng tạo, những giải pháp bộ nhớ...

HKC ra mắt màn hình 4K Ultrawide 43,8 inch đầu tiên trên thế giới với tỷ lệ 24:9

Thương hiệu HKC vừa chính thức trình làng Tianqi 43H180C, mẫu màn hình 43,8...

BIWIN ra mắt kit RAM DW100 24GB x2 DDR5-6000 chuẩn AMD EXPO ULL

Thương hiệu bộ nhớ đình đám BIWIN vừa chính thức trình làng bộ kit...

NVIDIA ra mắt card đồ họa RTX PRO 5500 Blackwell

NVIDIA vừa bổ sung vào dải sản phẩm Blackwell PRO mẫu card đồ họa...

Philips ra mắt màn hình cong 34 inch 200Hz giá chỉ 299 Bảng Anh

Thương hiệu Philips vừa tiếp tục mở rộng dải sản phẩm giá rẻ bằng...

Apple A20 Pro lập kỷ lục điểm single-core trên Geekbench 6

Sự kết hợp giữa tiến trình sản xuất mới và thiết kế đóng gói...

MSI ra mắt màn hình UltraWide 34 inch QD-OLED thế hệ 5

Trong khi thị trường tràn ngập các mẫu màn hình chuyên game, MSI vừa...

Apple trình làng Watch Series 12 và Watch Ultra 4: Bổ sung chỉ số Health Age, Readiness Scoring

Apple vừa chính thức ra mắt hai mẫu đồng hồ thông minh thế hệ...

A20 Pro: SoC 2nm đầu tiên trên iPhone

Thế hệ iPhone 18 Pro, iPhone 18 Pro Max và iPhone Duo sẽ được...

tin liên quan