NVIDIA ra mắt Dịch vụ Đám Mây Mô Hình Ngôn Ngữ Lớn để nâng cao Trí tuệ nhân tạo và Sinh học kỹ thuật số

Published on

Quảng cáo

NVIDIA hôm nay đã công bố hai dịch vụ AI đám mây mô hình ngôn ngữ lớn mới – Dịch vụ mô hình ngôn ngữ lớn NVIDIA NeMo  và Dịch vụ NVIDIA BioNeMo LLM – cho phép các nhà phát triển dễ dàng điều chỉnh LLM và triển khai các ứng dụng AI tùy chỉnh để tạo nội dung, tóm tắt văn bản, chatbots , phát triển mã, cũng như dự đoán cấu trúc protein và thuộc tính phân tử sinh học, v.v.

Dịch vụ NeMo LLM cho phép các nhà phát triển nhanh chóng điều chỉnh một số mô hình nền tảng được đào tạo trước bằng cách sử dụng phương pháp đào tạo được gọi là học nhanh trên cơ sở hạ tầng do NVIDIA quản lý. Dịch vụ NVIDIA BioNeMo là một giao diện lập trình ứng dụng đám mây (API) mở rộng các trường hợp sử dụng LLM ngoài ngôn ngữ và sang các ứng dụng khoa học để đẩy nhanh việc khám phá thuốc cho các công ty dược phẩm và công nghệ sinh học.

Jensen Huang, người sáng lập và Giám đốc điều hành, NVIDIA cho biết: “Các mô hình ngôn ngữ lớn có tiềm năng thay đổi mọi ngành công nghiệp. Khả năng điều chỉnh các mô hình nền tảng giúp sức mạnh của LLM trong tầm tay của hàng triệu nhà phát triển, những người hiện có thể tạo ra các dịch vụ ngôn ngữ và cung cấp sức mạnh cho các khám phá khoa học mà không cần phải xây dựng một mô hình lớn từ đầu”.

Dịch vụ NeMo LLM tăng cường độ chính xác với việc học hỏi kịp thời, tăng tốc triển khai

Với Dịch vụ NeMo LLM, các nhà phát triển có thể sử dụng dữ liệu đào tạo của riêng họ để tùy chỉnh các mô hình nền tảng từ 3 tỷ thông số lên đến Megatron 530B, một trong những LLM lớn nhất thế giới. Quá trình này chỉ mất vài phút đến hàng giờ so với hàng tuần hoặc hàng tháng cần thiết để đào tạo một mô hình từ đầu.

Các mô hình được tùy chỉnh với tính năng học tập nhanh chóng, sử dụng một kỹ thuật gọi là p-tuning. Điều này cho phép các nhà phát triển chỉ sử dụng vài trăm ví dụ để điều chỉnh nhanh chóng các mô hình nền tảng đã được đào tạo ban đầu với hàng tỷ điểm dữ liệu. Quá trình tùy chỉnh tạo ra các mã thông báo nhắc nhở theo nhiệm vụ cụ thể, sau đó được kết hợp với các mô hình nền tảng để mang lại độ chính xác cao hơn và các phản hồi phù hợp hơn cho các trường hợp sử dụng cụ thể.

Các nhà phát triển có thể tùy chỉnh cho nhiều trường hợp sử dụng bằng cách sử dụng cùng một mô hình và tạo nhiều mã thông báo nhắc nhở khác nhau. Tính năng playround cung cấp tùy chọn không mã để dễ dàng thử nghiệm và tương tác với các mô hình, thúc đẩy hơn nữa hiệu quả và khả năng tiếp cận của LLM cho các trường hợp sử dụng cụ thể trong ngành.

Sau khi sẵn sàng triển khai, các mô hình đã điều chỉnh có thể chạy trên các phiên bản đám mây, hệ thống tại chỗ hoặc thông qua API.

Dịch vụ LLM của BioNeMo cho phép các nhà nghiên cứu khai thác sức mạnh của các mô hình hàng loạt

Dịch vụ BioNeMo LLM bao gồm hai mô hình ngôn ngữ BioNeMo mới cho các ứng dụng hóa học và sinh học. Nó cung cấp hỗ trợ cho dữ liệu protein, DNA và hóa học để giúp các nhà nghiên cứu khám phá các mẫu và hiểu biết sâu sắc về trình tự sinh học.

BioNeMo cho phép các nhà nghiên cứu mở rộng phạm vi công việc của họ bằng cách tận dụng các mô hình chứa hàng tỷ tham số. Những mô hình lớn hơn này có thể lưu trữ nhiều thông tin hơn về cấu trúc của protein, mối quan hệ tiến hóa giữa các gen và thậm chí tạo ra các phân tử sinh học mới cho các ứng dụng điều trị.

API đám mây cung cấp quyền truy cập vào Megatron 530B và các model sẵn có

Ngoài việc điều chỉnh các mô hình nền tảng, các dịch vụ LLM bao gồm tùy chọn sử dụng các mô hình tùy chỉnh và tạo sẵn thông qua API đám mây.

Điều này cung cấp cho các nhà phát triển quyền truy cập vào một loạt các LLM được đào tạo trước, bao gồm Megatron 530B. Nó cũng cung cấp quyền truy cập vào các mô hình T5 và GPT-3 được tạo bằng khung NVIDIA NeMo Megatron – hiện đã có trong bản beta mở – để hỗ trợ nhiều loại ứng dụng và yêu cầu dịch vụ đa ngôn ngữ.

Các nhà lãnh đạo trong lĩnh vực ô tô, máy tính, giáo dục, chăm sóc sức khỏe, viễn thông và các ngành khác đang sử dụng NeMo Megatron để tiên phong cung cấp dịch vụ cho khách hàng bằng tiếng Trung, tiếng Anh, tiếng Hàn, tiếng Thụy Điển và các ngôn ngữ khác.

Tính khả dụng

Các dịch vụ NeMo LLM và BioNeMo và các API đám mây dự kiến sẽ có sẵn trong quyền truy cập sớm bắt đầu từ tháng tới. Các nhà phát triển có thể đăng ký ngay bây giờ để biết thêm chi tiết.

Bản phát hành beta của khung NeMo Megatron có sẵn từ NVIDIA NGC™ và được tối ưu hóa để chạy trên NVIDIA DGX™ Foundry và NVIDIA DGX SuperPOD™, cũng như các phiên bản đám mây tăng tốc từ Amazon Web Services, Microsoft Azure và Oracle Cloud Infrastructure.

Để trải nghiệm khung NeMo Megatron, các nhà phát triển có thể dùng thử miễn phí phòng thí nghiệm NVIDIA LaunchPad.

Hãy theo dõi bài phát biểu quan trọng của giám đốc NVIDIA Jensen Huang tại GTC 22 để tìm hiểu thêm về các mô hình ngôn ngữ lớn được hỗ trợ bởi NVIDIA AI.

Tin mới

Cha đẻ Windows Task Manager viết lại ứng dụng tương tự cho macOS

Dave W. Plummer, cựu kỹ sư Microsoft tạo ra Windows Task Manager, đang phát triển một ứng dụng quản lý tác vụ mới hoàn toàn dành cho macOS bằng Swift.

Giả thuyết “chiều không gian tối”: Lời giải cho bí ẩn vật chất tối?

Các nhà vật lý đề xuất một chiều không gian thứ năm ẩn giấu chi phối cả vật chất tối lẫn năng lượng tối, có thể được kiểm chứng bằng thực nghiệm trong tương lai gần.

Xiaomi Pad 8S Pro lộ cấu hình: chip riêng, pin 12.000mAh

Rò rỉ mới hé lộ Xiaomi Pad 8S Pro dùng màn hình 12,5 inch 3.2K, chip tự phát triển XRING O3, pin 12.000mAh và sạc nhanh 120W.

MSI High-Efficiency Mode: Giải pháp hoàn hảo thay thế RAM AMD EXPO ULL

MSI vừa giới thiệu một tính năng mới hứa hẹn giảm đáng kể độ...

Amazon chi vượt 1,8 triệu USD vì dùng AI Claude cho tác vụ code đơn giản

Amazon vượt ngân sách 860% khi dùng AI Claude Sonnet cho một tác vụ đối chiếu dữ liệu, tiêu tốn thêm 1,8 triệu USD trong nhiều dự án nội bộ.

NVIDIA GeForce RTX 5070 SUPER: Bước tiến chiến lược với 18GB VRAM GDDR7

Dù lộ trình ra mắt của dòng RTX 50 SUPER còn nhiều biến số,...

Laptop Surface chạy Nvidia N1X bị thử nghiệm sớm, driver chưa theo kịp phần cứng

Một chiếc Microsoft Surface Laptop Ultra thử nghiệm dùng chip Nvidia RTX Spark N1X vừa bị lộ, cho thấy tiềm năng nhưng vẫn còn nhiều lỗi driver và hiệu năng chưa ổn định.

Huawei lên kế hoạch dùng chất nền kính cho chip AI từ năm 2027

Huawei được cho là đang xây dựng lộ trình sản xuất đại trà chip AI dùng chất nền kính vào năm 2027, sớm hơn Samsung một năm.

ASRock âm thầm xác nhận card đồ họa Radeon RX 9050 với hai phiên bản 4GB và 8GB

Thị trường chuẩn bị chào đón mẫu GPU kiến trúc RDNA 4 có mức...

COLORFUL Ra Mắt Laptop Rimbook L1 Plus

Công ty TNHH Công Nghệ COLORFUL, nhà cung cấp phần cứng máy tính, máy...

tin liên quan