Premium ReportIndustry Insights

CHIPSMORE: Bước ngoặt đột phá của chiplet bộ nhớ trong tăng tốc suy luận LLM

9/12/2026
2 VIEWS
Sự xuất hiện của nghiên cứu 'CHIPSMORE' từ Đại học Quốc gia Singapore (NUS) đánh dấu một bước tiến quan trọng trong kiến trúc phần cứng dành cho trí tuệ nhân tạo (AI). Trong bối cảnh các mô hình ngôn ngữ lớn (LLM) ngày càng chiếm lĩnh hạ tầng tính toán, thách thức lớn nhất không còn chỉ nằm ở khả năng tính toán thuần túy, mà ở 'nút thắt cổ chai' bộ nhớ (memory wall) và độ trễ truyền tải dữ liệu. CHIPSMORE giải quyết vấn đề này bằng cách tích hợp tính toán ngay trong kết nối liên thông (compute-in-interconnect) và tính toán tại bộ nhớ (compute-in-memory - CIM), tạo ra một hệ sinh thái chiplet linh hoạt hỗ trợ đồng thời chế độ cơ sở và hiệu chỉnh thích ứng bậc thấp (LoRA). Phân tích về tác động công nghiệp, kiến trúc này hứa hẹn thay đổi cuộc chơi cho các trung tâm dữ liệu. Hiện nay, việc suy luận nhiều yêu cầu cùng lúc (multi-request inference) trên LLM thường tiêu tốn năng lượng khổng lồ do dữ liệu phải di chuyển liên tục giữa bộ nhớ DRAM và bộ xử lý. Bằng cách hiện thực hóa tính toán tại nơi lưu trữ, CHIPSMORE giảm thiểu tối đa năng lượng lãng phí và độ trễ, cho phép các doanh nghiệp triển khai AI tại biên (edge AI) hoặc trong các môi trường điện toán đám mây với hiệu suất cao hơn nhiều lần so với các kiến trúc truyền thống. Về khía cạnh chuỗi cung ứng, công nghệ chiplet vốn đang là tâm điểm của các nhà sản xuất như TSMC, Samsung và Intel. Sự kết hợp giữa CIM và chiplet không chỉ tối ưu hóa diện tích bề mặt silicon mà còn cho phép các nhà thiết kế chip tích hợp nhiều mô hình chuyên biệt vào cùng một hệ thống (SoC). Điều này sẽ thúc đẩy các nhà cung cấp bộ nhớ (như SK Hynix, Micron) phải tái định hình chiến lược sản xuất để hỗ trợ tốt hơn các chiplet có tích hợp logic. Đây là tín hiệu tích cực cho thấy sự chuyển dịch từ các thiết bị rời rạc sang các hệ thống tích hợp sâu (System-in-Package). Trong tương lai, triển vọng của CHIPSMORE là rất rộng mở. Nếu được thương mại hóa thành công, nó sẽ tạo ra áp lực cạnh tranh lớn lên các nhà sản xuất GPU truyền thống, đồng thời mở ra kỷ nguyên mới cho các bộ tăng tốc AI chuyên biệt. Chúng ta có thể kỳ vọng vào những thế hệ phần cứng AI có khả năng xử lý các mô hình ngôn ngữ phức tạp với mức tiêu thụ điện năng thấp kỷ lục, giúp phổ cập hóa AI đến mọi phân khúc thị trường từ người dùng cuối đến doanh nghiệp lớn.
Chat trực tuyến
Support

Tư vấn mua hàng

Trực tuyến

Xin chào! Tôi là tư vấn mua hàng chuyên trách của bạn. Hãy hỏi bất cứ điều gì.

Chúng tôi phân phối IC và linh kiện thương hiệu toàn cầu. BOM sourcing, linh kiện thay thế, hỗ trợ kỹ thuật.

WhatsApp
WhatsApp QR
Quét QR
DHX TECHNOLOGY • GLOBAL PARTNER
WhatsApp Live!
Trợ lý AI