Premium ReportIndustry Insights

HBF: Đột phá công nghệ bộ nhớ flash thay đổi cuộc chơi cho hạ tầng AI quy mô lớn

10/3/2026
1 VIEWS
Sự phát triển bùng nổ của các mô hình ngôn ngữ lớn (LLM) và xu hướng dịch chuyển sang các hệ thống tác vụ đại diện (agentic workflows) đã đẩy cơ sở hạ tầng trung tâm dữ liệu vào trạng thái khủng hoảng về tài nguyên bộ nhớ. Bài nghiên cứu mới từ Đại học UC Berkeley và FuriosaAI về công nghệ High Bandwidth Flash (HBF) không chỉ là một nỗ lực tối ưu hóa kỹ thuật, mà còn là một bước ngoặt chiến lược trong việc giải quyết nút thắt cổ chai giữa dung lượng lưu trữ và băng thông truyền tải. Hiện nay, các hệ thống AI phụ thuộc quá lớn vào HBM (High Bandwidth Memory) – vốn đắt đỏ và khan hiếm. HBF nổi lên như một giải pháp thay thế tiềm năng, tận dụng ưu thế của bộ nhớ flash tốc độ cao để lưu trữ trọng số mô hình và KV cache, từ đó mở rộng dung lượng bộ nhớ cho phép phục vụ các ngữ cảnh (context window) siêu dài mà không làm suy giảm hiệu năng. Xét về khía cạnh tác động công nghiệp, công nghệ HBF có khả năng làm thay đổi hoàn toàn kiến trúc của các cụm máy chủ AI. Thay vì phụ thuộc tuyệt đối vào các loại GPU tích hợp HBM đắt đỏ, các doanh nghiệp có thể phân tầng bộ nhớ, chuyển dịch các khối dữ liệu ít truy cập hơn sang hệ thống HBF. Điều này giúp tối ưu hóa chi phí sở hữu (TCO) đáng kể cho các nhà cung cấp dịch vụ đám mây (CSP). Đối với chuỗi cung ứng, đây là tin tốt cho các nhà sản xuất bộ nhớ NAND flash, những đơn vị đang tìm cách nâng cấp giá trị sản phẩm từ lưu trữ thuần túy sang phân khúc bộ nhớ hỗ trợ tính toán (computational storage). Khi sự cạnh tranh trong lĩnh vực bán dẫn ngày càng khốc liệt, việc tích hợp HBF vào hệ sinh thái AI có thể định hình lại cán cân quyền lực giữa các nhà sản xuất chip xử lý và các nhà cung cấp giải pháp lưu trữ. Trong tương lai, chúng ta dự đoán xu hướng chuyển dịch mạnh mẽ từ các thiết kế phần cứng độc quyền sang các giải pháp phân tầng bộ nhớ linh hoạt. Nếu HBF được tiêu chuẩn hóa, nó sẽ cho phép các mô hình LLM với hàng nghìn tỷ tham số được vận hành trên hạ tầng hiện tại với mức chi phí hợp lý hơn nhiều. Đây là chìa khóa để hiện thực hóa các ứng dụng AI đòi hỏi bộ nhớ lớn mà không cần phải đầu tư dàn trải vào phần cứng đắt đỏ, từ đó thúc đẩy tốc độ phổ cập AI trong doanh nghiệp và nghiên cứu.
Chat trực tuyến
Support

Tư vấn mua hàng

Trực tuyến

Xin chào! Tôi là tư vấn mua hàng chuyên trách của bạn. Hãy hỏi bất cứ điều gì.

Chúng tôi phân phối IC và linh kiện thương hiệu toàn cầu. BOM sourcing, linh kiện thay thế, hỗ trợ kỹ thuật.

WhatsApp
WhatsApp QR
Quét QR
DHX TECHNOLOGY • GLOBAL PARTNER
WhatsApp Live!
Trợ lý AI