THƯỢNG HẢI, ngày 18 tháng 9 năm 2026 /PRNewswire/ — Trong khuôn khổ HUAWEI CONNECT 2026, ông David Wang, Phó Chủ tịch Hội đồng Quản trị kiêm Chủ tịch luân phiên của Huawei, chính thức giới thiệu giải pháp lưu trữ bộ nhớ ngữ cảnh OceanStor M900 trong bài phát biểu quan trọng của mình. Được thiết kế để phục vụ suy luận AI tại các trung tâm dữ liệu siêu quy mô, sản phẩm cung cấp cho các SuperPoDs một không gian bộ nhớ dùng chung hoàn toàn, mang đến dung lượng lớn cấp Petabyte và hiệu năng cấp TB/s. Điều này đánh dấu sự chuyển đổi trong hạ tầng AI từ mô hình lấy tính toán làm trung tâm sang phối hợp sâu giữa tính toán, mạng và lưu trữ. Điều này sẽ giúp giải phóng năng lực tính toán của các SuperPoD.
Năm 2026 đã chứng kiến sự chuyển đổi nhanh chóng của AI từ những đột phá công nghệ sang triển khai trên quy mô lớn. Các ứng dụng AI đã phát triển từ chatbot thành các tác nhân có khả năng tự chủ hoàn thành những tác vụ phức tạp. Các tác nhân này được ứng dụng rộng rãi trong các lĩnh vực quan trọng, đánh dấu sự khởi đầu của kỷ nguyên AI tác nhân (agentic AI).
Khi các mô hình lớn phát triển lên quy mô 10 nghìn tỷ tham số, các SuperPoD đang trở thành lựa chọn tối ưu cơ sở hạ tầng AI. Các mô hình lớn phổ biến đã hỗ trợ cửa sổ ngữ cảnh vượt một triệu token, suy luận đa lượt và các tác vụ phức tạp đã trở thành thông lệ, và dữ liệu bộ nhớ đệm KV được tạo ra trong quá trình suy luận tiếp tục gia tăng. Những xu hướng này đã đẩy bộ nhớ trên chip và DRAM vượt quá giới hạn về dung lượng và hiệu quả chi phí. Xây dựng hệ thống lưu trữ đa tầng, phối hợp bộ nhớ trên chip, DRAM và SSD để tạo ra một không gian bộ nhớ dùng chung hoàn toàn với dung lượng lớn, đã trở thành sự đồng thuận trong ngành.
Huawei đã giới thiệu giải pháp lưu trữ bộ nhớ ngữ cảnh OceanStor M900 nhằm khắc phục các nút thắt về dung lượng bộ nhớ trong suy luận với ngữ cảnh siêu dài và suy luận đa lượt. OceanStor M900 sử dụng mạng UnifiedBus để xây dựng bộ nhớ đệm KV đa tầng, quy mô Petabyte với các kết nối qua một chặng. Điều này phát huy tối đa tiềm năng sức mạnh tính toán của các SuperPoD và thúc đẩy suy luận AI tại các trung tâm dữ liệu siêu quy mô. Giải pháp lưu trữ bộ nhớ ngữ cảnh OceanStor M900 có ba năng lực chính:
Mở rộng giới hạn dung lượng nhằm trao quyền cho AI quy mô lớn với bộ nhớ khổng lồ
Được hỗ trợ bởi mạng kết nối tốc độ cao UnifiedBus, bộ nhớ đệm KV đạt khả năng gộp và chia sẻ trên phạm vi toàn cục thông qua lưu trữ phân tầng. Bộ nhớ đệm KV của các SuperPoD được mở rộng từ bộ nhớ trên chip và DRAM sang SSD, cho phép một cụm duy nhất đạt dung lượng 64 PB. Dung lượng bộ nhớ đệm KV khả dụng cho mỗi NPU được nâng từ gigabyte lên terabyte, cho phép lưu trữ, chia sẻ và tái sử dụng nhiều ngữ cảnh hơn. Điều này giúp tăng đáng kể tỷ lệ truy cập trúng bộ nhớ đệm KV.
Nâng cao hiệu năng suy luận để phát huy tối đa năng lực tính toán
OceanStor M900 là kiến trúc đầu tiên trong ngành tích hợp CPU, bộ điều khiển mạng và bộ điều khiển NAND. Sản phẩm cung cấp ngữ nghĩa KV gốc nhằm cho phép kết nối qua một chặng từ NPU của SuperPoD đến các SSD. Điều này loại bỏ nhu cầu chuyển đổi giao thức và chuyển tiếp CPU, giúp giảm độ trễ truy cập từ mili giây xuống còn 60 micro giây, tương đương mức giảm 90%. Một cụm duy nhất cung cấp băng thông truy cập tổng hợp 40 TB/s, cao hơn 1,5 lần so với các giải pháp tương đương. Trong các kịch bản lập trình AI điển hình, kiến trúc này giúp tăng gấp đôi thông lượng token của cụm suy luận và giảm một nửa thời gian đến token đầu tiên, qua đó chuyển năng lực tính toán thành năng suất.
Giảm chi phí token tạo điều kiện ứng dụng AI quy mô lớn hiệu quả về kinh tế
OceanStor M900 sử dụng công nghệ lưu trữ thích ứng nhận biết KV đầu tiên trong ngành, dự đoán vòng đời của bộ nhớ đệm KV dựa trên giá trị dữ liệu và phân phối dữ liệu một cách thông minh trên các phương tiện lưu trữ. Công nghệ này cho phép đạt tới 24 lần ghi trên ổ đĩa mỗi ngày (DWPD), kéo dài độ bền SSD lên 16 lần và đảm bảo tính ổn định trong ba năm. Bằng cách giảm chi phí thay thế phương tiện lưu trữ và chi phí vận hành & bảo trì (O&M), sản phẩm giúp giảm chi phí dài hạn của hạ tầng suy luận AI quy mô lớn và cho phép ứng dụng AI nhanh hơn.
Khi AI mở rộng vào các hệ thống sản xuất quan trọng trong mọi lĩnh vực ngành nghề đa dạng, hạ tầng AI đang chuyển từ mô hình lấy tính toán làm trung tâm sang sự phối hợp chặt chẽ hơn giữa tính toán – mạng – lưu trữ. Giải pháp lưu trữ bộ nhớ ngữ cảnh sẽ đóng vai trò thiết yếu trong việc liên tục nâng cao dung lượng và hiệu quả truy cập của bộ nhớ đệm KV phục vụ suy luận siêu quy mô.
View original content:https://www.prnewswire.com/vn/news-releases/u0068u0075u0061u0077u0065u0069u002Du0072u0061u002Du006Du1EAFu0074u002Du0067u0069u1EA3u0069u002Du0070u0068u0061u0070u002Du006Cu01B0u0075u002D-302882660.html
SOURCE Huawei

Nguồn: PR Newswire – Đơn vị phát hành hoàn toàn chịu trách nhiệm về nội dung thông báo này.



