Nvidia chuyển từ bán chip sang bán “hạ tầng công nghệ”

Sự bùng nổ của các chip AI tùy biến như ASIC và XPU đang khiến nhiều người đặt câu hỏi liệu Nvidia có còn giữ được vị thế thống trị hay không. ASIC là chip được thiết kế cho một tác vụ chuyên biệt, còn XPU là cách gọi rộng hơn cho các bộ xử lý tăng tốc như GPU, NPU hay chip AI riêng. Tuy nhiên, thay vì lo ngại trước làn sóng tự phát triển chip từ OpenAI, Meta, Microsoft hay Amazon, Nvidia lại chọn một hướng đi khác: biến chính công nghệ kết nối và thiết kế hệ thống của mình thành sản phẩm cấp phép IP. IP ở đây là “intellectual property” trong ngành bán dẫn, tức các khối thiết kế, chuẩn kết nối hoặc công nghệ lõi mà công ty khác có thể trả tiền để sử dụng trong chip và hệ thống của họ.

MediaTek gia nhập hệ sinh thái NVLink Fusion

MediaTek vừa trở thành cái tên mới nhất chấp nhận sử dụng NVLink Fusion cho dòng XPU trung tâm dữ liệu đang ở giai đoạn đầu. NVLink Fusion là phiên bản thương mại hóa của NVLink, công nghệ kết nối tốc độ cao vốn được Nvidia phát triển để liên kết nhiều GPU với nhau. Đổi lại, Nvidia đầu tư 3,5 tỷ USD vào trái phiếu chuyển đổi do MediaTek phát hành. Trái phiếu chuyển đổi là công cụ tài chính cho phép nhà đầu tư sau này có thể đổi trái phiếu thành cổ phiếu theo điều kiện định sẵn. Song song đó, Nvidia cũng tiếp tục cấp phép các thiết kế của MediaTek để dùng trong những hệ thống tương lai như DGX và RTX Spark.

NVLink Fusion là gì và vì sao các hãng chip muốn dùng nó?

Ban đầu, NVLink Fusion được giới thiệu với hai biến thể chính. Một là kết nối chip-to-chip, hay C2C, dùng để nối CPU với GPU hoặc XPU trong một “memory coherent fabric” — tức một cấu trúc liên kết cho phép các bộ xử lý khác nhau nhìn thấy và chia sẻ dữ liệu bộ nhớ theo cách nhất quán. Hai là switched fabric, một lớp mạng chuyển mạch chuyên dụng để ghép nhiều bộ tăng tốc thành một cụm logic quy mô rack. Nói đơn giản, công nghệ này giúp nhiều chip AI hoạt động như một cỗ máy lớn hơn. Việc tự xây dựng một chuẩn kết nối cạnh tranh với NVLink là cực kỳ tốn thời gian và công sức, vì vậy nhiều công ty chọn cấp phép thay vì tự làm lại từ đầu hoặc dùng các lựa chọn khác như UALink trên nền Ethernet truyền thống.

Danh sách đối tác cho thấy NVLink đang thành tiêu chuẩn thực tế

MediaTek không phải trường hợp duy nhất. Amazon, Fujitsu, Qualcomm, Arm và Marvell cũng nằm trong nhóm các công ty dự kiến tích hợp công nghệ này. Điều đó cho thấy NVLink Fusion đang dần trở thành một lớp hạ tầng chung cho AI quy mô lớn. Với các nhà thiết kế chip, lợi ích rất rõ ràng: họ có thể tập trung vào năng lực tính toán của bộ tăng tốc thay vì đau đầu với bài toán mở rộng hệ thống khi triển khai thực tế trong trung tâm dữ liệu.

Thiết kế rack MGX và NVL72 giúp rút ngắn đường từ silicon đến máy chủ AI

Một lợi thế quan trọng khác là các thiết kế rack MGX của Nvidia đã tham gia Open Compute Project, sáng kiến mở nhằm chuẩn hóa phần cứng trung tâm dữ liệu. Nhờ đó, đối tác như MediaTek có thể tận dụng sẵn kiến trúc NVL72 — một cấu hình rack tham chiếu của Nvidia dành cho cụm tăng tốc AI mật độ cao — rồi chỉ cần thay thế các compute blade, tức mô-đun tính toán có thể cắm vào khung máy. Cách làm này giúp giảm mạnh độ phức tạp trong thiết kế hệ thống, cơ khí và tích hợp sản phẩm, rút ngắn đáng kể thời gian đưa chip từ phòng thiết kế ra rack AI hoàn chỉnh.

Amazon là ví dụ rõ nhất cho chiến lược mới của Nvidia

Chiến lược này không còn là lý thuyết. Amazon đã dùng thiết kế tham chiếu MGX NVL72 của Nvidia cho các hệ thống rack dựa trên Trainium3, dòng chip AI nội bộ của hãng. Đáng chú ý hơn, thế hệ Trainium4 dự kiến ra mắt cuối năm nay được cho là sẽ bỏ NeuronLink — công nghệ kết nối do Amazon tự phát triển — để chuyển sang NVLink Fusion. Đây là tín hiệu cho thấy ngay cả những tập đoàn có đủ nguồn lực để tự xây dựng hạ tầng chip AI vẫn sẵn sàng dựa vào Nvidia ở lớp kết nối và mở rộng hệ thống.

Nvidia kiếm gì ngoài phí cấp phép?

Lợi ích của Nvidia không chỉ nằm ở tiền bản quyền. Trước đây, khi NVLink Fusion mới ra mắt, khách hàng gần như phải đi kèm thêm các thành phần khác của Nvidia như CPU Grace hoặc Vera, GPU Nvidia và đặc biệt là NVSwitch nếu muốn mở rộng nhiều bộ tăng tốc trong cùng một rack. NVSwitch là chip chuyển mạch tốc độ cao chuyên dùng cho kết nối nội bộ giữa các GPU/XPU. Nói cách khác, một đối tác dùng NVLink có thể kéo theo doanh số cho hàng loạt sản phẩm khác trong hệ sinh thái Nvidia.

Từ NVSwitch đến InfiniBand, Spectrum-X và DPU

Ngay cả khi Nvidia đã nới lỏng cách tiếp cận và cho phép cấu hình linh hoạt hơn, hãng vẫn giữ được cơ hội bán thêm nhiều lớp công nghệ xung quanh. Nếu doanh nghiệp đã dùng NVLink trong một rack, bước tiếp theo rất có thể là dùng InfiniBand hoặc Spectrum-X Ethernet để kết nối nhiều rack với nhau. InfiniBand là chuẩn mạng hiệu năng cao phổ biến trong siêu máy tính và AI, còn Spectrum-X là bộ giải pháp Ethernet tối ưu cho tải AI của Nvidia. Ngoài ra còn có DPU, tức Data Processing Unit, bộ xử lý chuyên trách các tác vụ hạ tầng như mạng, lưu trữ và bảo mật, giúp giảm tải cho CPU. Nvidia cho biết toàn bộ các lớp mạng và topo kết nối này đều có thể đi cùng NVLink Fusion.

Cấu trúc cấp phép vẫn chưa lộ diện, nhưng chắc chắn không miễn phí

Nvidia chưa công bố chi tiết mô hình cấp phép cho NVLink Fusion, song hãng khẳng định đây không phải công nghệ được chia sẻ miễn phí. Điều này đồng nghĩa Nvidia đang tạo ra một nguồn doanh thu mới ít phụ thuộc hơn vào việc bán trực tiếp GPU. Trong bối cảnh ngày càng nhiều khách hàng lớn muốn tự thiết kế chip AI, chiến lược bán IP và hạ tầng có thể giúp Nvidia tiếp tục hưởng lợi ngay cả khi họ không phải là nhà cung cấp bộ tăng tốc chính.

Tham vọng của Nvidia không dừng ở mạng kết nối

Tuần trước, Nvidia tiếp tục giới thiệu một gói IP khác mang tên NVHBM. HBM, viết tắt của High Bandwidth Memory, là bộ nhớ băng thông cao thường gắn sát chip AI để cung cấp tốc độ truyền dữ liệu cực lớn. NVHBM về cơ bản là một đế nền tùy biến tích hợp bộ điều khiển bộ nhớ. Theo Nvidia, cách tiếp cận này có thể giải phóng khoảng 25% diện tích khuôn chip cho phần tính toán, giảm 15% điện năng tiêu thụ của HBM và tăng 30% băng thông hiệu dụng. Annapurna Labs, đơn vị thiết kế chip thuộc Amazon, sẽ là một trong những bên đầu tiên áp dụng công nghệ này cho dòng Trainium.

Một cuộc chơi mới: đối thủ, đối tác hay “vừa hợp tác vừa cạnh tranh”?

Dù NVHBM không phải ý tưởng độc quyền tuyệt đối — Broadcom và Marvell cũng được cho là đang phát triển công nghệ đế nền tương tự — động thái này cho thấy Nvidia muốn chen sâu hơn vào mọi lớp của chuỗi giá trị AI. Tương lai có thể xuất hiện một mối quan hệ rất đặc biệt: Nvidia vừa là nhà cung cấp công nghệ nền, vừa là đối thủ của các công ty như Broadcom, Marvell hay MediaTek trong mảng XPU. Khái niệm này thường được gọi là “frenemy” trong kinh doanh, tức vừa là bạn hàng vừa là đối thủ.

Rào cản mới của AI không còn là thiết kế chip, mà là mở rộng hệ thống

Điểm mấu chốt trong nước cờ của Nvidia là nhận ra rằng việc thiết kế silicon tùy biến đang ngày càng dễ tiếp cận hơn, nhưng biến những con chip đó thành hệ thống AI quy mô lớn vận hành ổn định mới là phần khó nhất. Broadcom và Marvell đều có thiết bị chuyển mạch Ethernet đủ sức cạnh tranh, nhưng việc tích hợp toàn bộ vào một rack hoàn chỉnh vẫn là bài toán phức tạp. Trong khi đó, khả năng cắm một compute blade tùy biến vào hệ thống NVL72 gần như sẵn sàng vận hành là lợi thế rất đáng kể. Nếu NVLink Fusion giúp các hãng chip bán được nhiều XPU hơn, họ có thể chấp nhận chia sẻ một phần giá trị cho Nvidia. Và đó chính là cách Nvidia xây dựng một đế chế cấp phép IP mới: không cần bán mọi con chip, nhưng vẫn kiếm tiền từ gần như mọi hệ thống AI.

Danh mục máy quét mã vạch

Máy quét mã vạch - Quét mã Qr - Quét mã vạch sản phẩm.

DÒNG MÁY CÓ DÂY

máy quét mã vạch không dây

DÒNG MÁY KHÔNG DÂY

DÒNG MÁY KIỂM KHO PDA

DÒNG MÁY FITMOUNT