Liên hệ
Mua hàng 098.236.8008 Mua hàng 0862.535.536
Kỹ Thuật, Bảo Hành 086.552.8008 Tin tức
DANH MỤC SẢN PHẨM

Mục lục

NVLink Fusion Cho Phép XPU Tùy Biến Đi Chung Hạ Tầng NVIDIA

Thời gian 25-08-2026 | Chia sẻ: Facebook Zalo Twitter

NVLink Fusion Cho Phép XPU Tùy Biến Đi Chung Hạ Tầng NVIDIA

NVIDIA ngày 24/8/2026 tiếp tục làm rõ vai trò của NVLink Fusion trong các AI factory sử dụng custom silicon. Ý tưởng là cho phép hyperscaler hoặc công ty AI đưa XPU do họ tự thiết kế vào kiến trúc rack sử dụng nhiều thành phần NVIDIA như NVLink, Vera CPU, MGX, networking, cooling và power. Thay vì buộc data center chỉ dùng GPU NVIDIA hoặc chỉ dùng custom accelerator, NVLink Fusion hướng tới mô hình hỗn hợp.

XPU Tùy Biến Không Chỉ Là Bài Toán Thiết Kế Chip

Một công ty có thể thiết kế accelerator riêng, nhưng đưa chip từ bản vẽ vào data center là câu chuyện rộng hơn. NVIDIA liệt kê nhiều hạng mục gồm CPU interface, scale-up network, compute tray, switch tray, rack architecture, cooling, power, security, storage và chuỗi nhà cung cấp.

Mỗi phần có thể trở thành nguồn chậm tiến độ. Một XPU mạnh nhưng thiếu networking hoặc rack đã kiểm chứng vẫn khó triển khai ở quy mô lớn. NVLink Fusion được NVIDIA xây để cung cấp phần nền này, cho phép đội silicon tập trung nhiều hơn vào accelerator riêng.

NVLink-C2C Kết Nối XPU Với CPU

NVLink Fusion hỗ trợ NVLink-C2C để nối XPU với Vera CPU hoặc CPU khác trong hệ sinh thái. NVIDIA công bố interface này có thể tạo hiệu quả năng lượng cao hơn PCIe trong một số workload và cấu hình.

Với agentic AI, CPU không chỉ làm nhiệm vụ phụ. Orchestration, code execution, data processing và tool handling có thể tạo tải đáng kể lên CPU. Kết nối CPU và accelerator nhanh hơn giúp giảm thời gian dữ liệu phải chờ khi workflow chuyển giữa control logic và compute.

NVIDIA NVLink là gì? Cách hoạt động và ứng dụng thực tế

MGX Tạo Nền Rack Chung Cho GPU Và XPU

Các hệ thống NVLink Fusion có thể sử dụng kiến trúc rack MGX và chuỗi cung ứng đã tồn tại cho hệ thống Vera Rubin NVL72. Nhà sản xuất phụ trách tích hợp, còn nhà cung cấp MGX cung cấp các thành phần liên quan tới rack, cooling và power.

NVIDIA dẫn chia sẻ từ QCT và Quanta cho biết dây chuyền Vera Rubin đang hướng tới mức tự động hóa rất cao, và nhiều khoản đầu tư sản xuất có thể được dùng lại nếu XPU tương thích NVLink Fusion. Điều này có thể rút ngắn thời gian từ thiết kế chip tới deployment, ít nhất theo định hướng mà NVIDIA trình bày.

Chuẩn Hóa Hạ Tầng Giảm Rủi Ro Khi Chưa Chốt Accelerator

Data center được lên kế hoạch nhiều năm trước khi chip cuối cùng xuất hiện. Power procurement, cooling và thiết kế rack phải bắt đầu sớm.

Nếu facility bị khóa vào một accelerator cụ thể quá sớm, thay đổi silicon sau đó có thể gây chậm tiến độ. NVLink Fusion hướng tới việc cho GPU và XPU chia sẻ rack footprint, network, cooling, power delivery và management. Nhờ đó, operator có thể xây facility trước rồi quyết định tỷ lệ accelerator sau, tùy supply và workload.

Các Workload Khác Nhau Có Thể Dùng Chip Khác Nhau

Training, post-training, reasoning, retrieval và serving không tạo cùng một kiểu tải. Một accelerator có thể phù hợp cho inference cố định, trong khi GPU linh hoạt hơn cho training hoặc workload thay đổi.

NVIDIA cho rằng AI factory tương lai sẽ dùng hỗn hợp GPU, XPU, CPU và LPU. Cách nhìn này khá khác thời kỳ data center chỉ chọn một dòng accelerator rồi nhân lên. Khi workload agent trở nên phức tạp, mỗi lớp có thể được đưa sang phần cứng phù hợp.

NVLink Fusion Có Ý Nghĩa Với Intel Và MediaTek

NVIDIA dẫn ý kiến từ Intel rằng NVLink Fusion cho phép khách hàng lựa chọn CPU architecture, performance và software capability theo workload. MediaTek cũng cho rằng hyperscaler có thể triển khai rack NVIDIA trước trong khi phát triển XPU ở lịch khác. Điều này cho thấy NVIDIA đang cố mở NVLink thành một lớp hạ tầng mà chip bên thứ ba có thể đi vào, thay vì giới hạn hệ sinh thái ở accelerator của hãng.

Jensen Huang ra mắt mô hình AI mã nguồn mở đầu tiên, hoàn toàn miễn phí

PC Desktop Không Dùng NVLink Fusion Theo Cách Này

NVLink Fusion nhắm tới AI factory và custom silicon data center. Người dùng PC không cần chọn mainboard dựa trên công nghệ này. Đối với workstation AI, câu hỏi thực tế vẫn là GPU nào đủ VRAM, nguồn điện bao nhiêu, RAM hệ thống và SSD có đáp ứng model không.

Hoàng Long Computer cung cấp workstation, GPU, nguồn, RAM và SSD chính hãng, hỗ trợ cấu hình theo AI local, render hoặc tính toán.

Điều Cần Theo Dõi Tiếp Theo

Việc một ecosystem mở ra cho XPU không tự động bảo đảm mọi custom chip sẽ có economics tốt. Chi phí IP, packaging, manufacturing, software và validation vẫn rất lớn. Điều đáng theo dõi là có bao nhiêu hyperscaler thực sự triển khai XPU qua NVLink Fusion và hiệu năng rack hỗn hợp ra sao so với hệ thống thuần GPU. Ngoài benchmark compute, operator còn quan tâm utilization, failure recovery, power và tốc độ đưa hệ thống vào production.

NVLink Fusion là cách NVIDIA mở kiến trúc AI factory cho custom XPU trong khi giữ NVLink, MGX, networking, cooling và management làm phần nền. Nếu mô hình này được áp dụng rộng, AI data center có thể linh hoạt hơn trong việc phối hợp accelerator từ nhiều nguồn. Giá trị thực tế sẽ phụ thuộc deployment, nhưng hướng đi cho thấy hạ tầng AI đang dần trở thành nền tảng mô-đun thay vì một cụm chip đồng dạng.

Lê Minh Tuấn

Lê Minh Tuấn là một “Biên tập viên - Reviewer công nghệ” tại Tây Hồ, Hà Nội. Với hơn 10 năm hoạt động chuyên sâu trong lĩnh vực công nghệ, anh là một reviewer kỳ cựu, có tiếng trong cộng đồng đam mê phần cứng máy tính tại Hà Nội. Anh bắt đầu sự nghiệp từ năm 2014 với vai trò là kỹ thuật viên phần cứng, sau đó chuyển hướng sang review công nghệ nhờ đam mê chia sẻ kiến thức và trải nghiệm thực tế đến cộng đồng.

Hotline: 0982368008
ĐĂNG KÝ TƯ VẤN
X