Dự án “FlashMLA” mới nhất của DeepSeek cho thấy Trung Quốc không cần các máy gia tốc “tiên tiến” để tiến triển với AI

Published on

Quảng cáo

Theo báo cáo, Trung Quốc đã tìm được giải pháp thay thế cho các bộ gia tốc AI “tiên tiến” nhất của NVIDIA, dự án mới nhất của DeepSeek đã mang lại hiệu suất gấp tám lần TFLOPS trên bộ tăng tốc AI Hopper H800s.

Trung Quốc đang chứng minh rằng mình không cần phụ thuộc vào bất kỳ ai để mở rộng quy mô phần cứng, vì các công ty nội địa, đáng chú ý là DeepSeek, đang sử dụng sức mạnh của phần mềm để tìm giải pháp thay thế bằng thiết bị họ có sẵn. Những bước đột phá mới nhất của DeepSeek là điều điên rồ nhất mà ngành AI từng chứng kiến, vì theo công ty, họ đã xoay xở để khai thác hiệu suất đáng kể từ GPU Hopper H800 của NVIDIA bằng cách tối ưu hóa mức tiêu thụ bộ nhớ và phân bổ tài nguyên trên các yêu cầu suy luận.

What is DeepSeek - and why is everyone talking about it? - BBC News

DeepSeek đang tổ chức một tuần “Nguồn mở”, nơi công ty có kế hoạch tiết lộ các công nghệ và công cụ sẽ dễ dàng tiếp cận với công chúng thông qua các kho lưu trữ Github. Ngày đầu tiên của sự kiện có vẻ là một khởi đầu tuyệt vời vì công ty đã tiết lộ FlashMLA, một “hạt nhân giải mã” được thiết kế riêng cho GPU Hopper của NVIDIA.

DeepSeek tuyên bố rằng họ đã có thể đạt được 580 TFLOPS nhân ma trận BF16 trên Hopper H800, cao hơn khoảng tám lần so với sức mạnh tiêu chuẩn. Không chỉ vậy, với việc sử dụng bộ nhớ hiệu quả, FlashMLA cho phép băng thông bộ nhớ lên tới 3000 GB/giây, gần gấp đôi mức trần lý thuyết của H800. Điểm quan trọng ở đây là tất cả những điều này trở nên khả thi chỉ thông qua các dòng mã chứ không phải cải tiến phần cứng.

012725 deepseek result MMOSITE - Thông tin công nghệ

FlashMLA của DeepSeek triển khai “nén giá trị khóa cấp thấp”, theo cách nói dễ hiểu, phân tích các khối dữ liệu thành các phần nhỏ hơn, cho phép xử lý nhanh hơn, cùng với việc giảm mức tiêu thụ bộ nhớ tới 40%-60%.

Sự phát triển của DeepSeek cho thấy thế giới điện toán AI không phụ thuộc vào một yếu tố duy nhất. Hiện tại, có vẻ như công cụ này chỉ dành riêng cho GPU Hopper và sẽ rất thú vị khi công cụ này được áp dụng với H100.

Nguồn: wccftech

Tin mới

GIGABYTE ra mắt card đồ họa AORUS GeForce RTX 5060 ARI 8G

Thương hiệu phần cứng đình đám GIGABYTE vừa tiếp tục mở rộng dải sản...

ASUS giới thiệu laptop TUF Gaming 16 trang bị RTX 50 Series tại Việt Nam

ASUS ra mắt TUF Gaming 16 – laptop gaming phổ thông trang bị RTX...

AMD chính thức tăng giá GPU Radeon RX 9000 lên tới 20%

Trong Quý 3/2026, AMD đã chính thức nâng mức giá bán lẻ đề xuất...

CHUỘT MMO BIỂU TƯỢNG NÂNG CẤP SỨC MẠMH: RAZER GIỚI THIỆU NAGA V3 PRO

Biểu tượng của dòng chuột MMO chính thức tiến hoá. Razer Naga V3 Pro...

Nikon thua kiện bằng sáng chế ngàm Z trước Viltrox tại Trung Quốc

CNIPA tuyên bằng sáng chế ngàm Z của Nikon không hợp lệ, khiến hãng mất cơ sở đòi Viltrox trả tiền bản quyền ống kính đã bán.

Cloudflare: AI agent có thể chiếm 1.000 lần hoạt động con người trên internet

Cloudflare dự báo trong 5 năm tới, hoạt động từ AI agent trên internet có thể cao gấp 1.000 lần con người, khiến người dùng chỉ còn là "sai số làm tròn".

ASUS mở rộng hệ sinh thái ProArt cho nhà sáng tạo chuyên nghiệp

ASUS phát triển ProArt thành hệ sinh thái phần cứng đồng bộ, bổ sung bốn màn hình mới cùng loạt linh kiện, thiết bị ngoại vi dành cho nhà sáng tạo chuyên nghiệp.

Galaxy Z Fold8 và Z Flip8 lập kỷ lục đặt trước tại thị trường châu Âu

Samsung vừa chính thức công bố các mẫu smartphone màn hình gập thế hệ...

Motorola chính thức ra mắt Moto Pad 70: Màn hình 12.1 inch 90Hz, hỗ trợ 5G

Tiếp nối sự xuất hiện của Moto Pad 70 Pro vào tháng 6 và...

Microsoft âm thầm xóa khuyến nghị 32GB RAM cho Windows 11

Khủng hoảng bộ nhớ DRAM toàn cầu đã buộc Microsoft phải thay đổi hoàn...

tin liên quan