Nvidia tung phiên bản DGX Spark rút gọn để hạ giá

Nvidia vừa giới thiệu một biến thể mới của DGX Spark với 64 GB RAM và dung lượng lưu trữ bị cắt giảm một nửa, nhằm đưa hệ thống AI này xuống mức giá dễ tiếp cận hơn, khoảng 4.999 USD. DGX Spark là một máy trạm AI nhỏ gọn, còn “máy trạm” ở đây có thể hiểu là dòng máy tính hiệu năng cao phục vụ các tác vụ chuyên sâu như trí tuệ nhân tạo, phân tích dữ liệu hoặc dựng nội dung nặng. Phiên bản mới dùng nền tảng GB10 và sẽ được phân phối thông qua các đối tác phần cứng như Acer, Asus, Dell, Gigabyte, HP và MSI.

Giá bản 128 GB tăng gần 75% vì khủng hoảng bộ nhớ

Động thái tung bản 64 GB diễn ra ngay sau khi Nvidia nâng giá mẫu DGX Spark 128 GB lên 6.950 USD, tức cao hơn gần 75% so với thời điểm ra mắt năm ngoái. Nguyên nhân chính là giá bộ nhớ tăng mạnh trên toàn thị trường. Trong bối cảnh nguồn cung RAM tiếp tục căng thẳng, mẫu 64 GB trở thành lựa chọn rẻ hơn đáng kể so với cấu hình cao nhất. Tuy vậy, mức giá này vẫn cao hơn khoảng 25% so với giá khởi điểm trước đây của bản 128 GB, cho thấy áp lực chi phí phần cứng AI vẫn chưa hề giảm.

GB10 tiếp tục trượt xa mức giá ban đầu

Nền tảng GB10 của Nvidia đã có dấu hiệu đội giá từ khá sớm. Khi còn xuất hiện dưới tên ý tưởng Project Digits tại CES năm ngoái, thiết bị từng được kỳ vọng có giá khoảng 3.000 USD. CES là hội chợ công nghệ tiêu dùng lớn diễn ra thường niên tại Mỹ, nơi nhiều hãng dùng để công bố sản phẩm mới. Tuy nhiên, sau đó hệ thống này lên kệ ở mức khoảng 4.000 USD, và nay tiếp tục leo thang. Điều đó phản ánh thực tế rằng phần cứng AI, đặc biệt là những hệ thống tích hợp nhiều bộ nhớ tốc độ cao, đang ngày càng đắt đỏ.

64 GB đủ cho suy luận AI cục bộ, nhưng không lý tưởng cho tinh chỉnh mô hình

So với bản 128 GB, phiên bản 64 GB sẽ kém phù hợp hơn với một số tác vụ AI nặng như fine-tuning, tức quá trình tinh chỉnh thêm một mô hình AI đã được huấn luyện sẵn để nó phù hợp hơn với dữ liệu hoặc nhu cầu riêng của doanh nghiệp. Dù vậy, Nvidia cho rằng nếu mục tiêu chính là chạy suy luận AI cục bộ, hay local AI inference, thì cấu hình mới vẫn đủ dùng. “Suy luận” là giai đoạn mô hình đã học xong và chỉ thực hiện trả lời, phân tích hoặc tạo nội dung; còn “cục bộ” nghĩa là chạy trực tiếp trên máy thay vì gửi dữ liệu lên đám mây. Nvidia cho biết các mô hình cỡ 26 đến 35 tỷ tham số, chẳng hạn Qwen 3.8 27B, hiện đã đủ mạnh để vận hành các trợ lý AI riêng tư. “Tham số” là các giá trị nội bộ quyết định khả năng học và suy luận của mô hình; số lượng càng lớn thì mô hình thường càng mạnh, nhưng cũng đòi hỏi nhiều bộ nhớ hơn.

Băng thông bộ nhớ giữ nguyên, hé lộ cách Nvidia cắt giảm chi phí

Dù dung lượng bộ nhớ giảm một nửa, Nvidia cho biết băng thông bộ nhớ vẫn giữ nguyên ở mức 273 GB/giây. Băng thông bộ nhớ là tốc độ dữ liệu có thể được truyền giữa bộ nhớ và bộ xử lý; với AI, đây là chỉ số rất quan trọng vì nó ảnh hưởng trực tiếp đến tốc độ xử lý mô hình. Việc băng thông không đổi cho thấy Nvidia nhiều khả năng dùng các mô-đun LPDDR5x dung lượng thấp hơn thay vì cắt giảm số lượng mô-đun. LPDDR5x là chuẩn bộ nhớ tiết kiệm điện, tốc độ cao, thường thấy trong thiết bị di động và các hệ thống nhỏ gọn cần hiệu năng tốt nhưng vẫn kiểm soát nhiệt và điện năng.

Phần còn lại của hệ thống gần như giữ nguyên

Ngoài thay đổi về RAM và lưu trữ, Nvidia cho biết cấu hình còn lại của DGX Spark 64 GB không đổi. Máy vẫn dùng bộ xử lý Arm 20 nhân do MediaTek tham gia phát triển. Arm là kiến trúc CPU nổi tiếng nhờ hiệu quả điện năng, hiện ngày càng xuất hiện nhiều hơn trong máy tính cá nhân và máy chủ AI. Hệ thống cũng tiếp tục tích hợp kết nối mạng ConnectX-7, cho phép ghép cụm tối đa 4 thiết bị GB10 với tốc độ 200 Gbps mỗi thiết bị. “Ghép cụm” hay clustering là cách nối nhiều máy lại để chúng hoạt động như một hệ thống lớn hơn, giúp tăng năng lực xử lý cho các tác vụ AI.

DGX OS sẽ có công cụ mới để triển khai cụm và suy luận dễ hơn

Nvidia cho biết trong tháng này họ sẽ bổ sung các công cụ phần mềm mới cho DGX OS nhằm đơn giản hóa việc cấu hình cụm và triển khai suy luận. DGX OS là hệ điều hành tối ưu riêng cho các hệ thống DGX của Nvidia. Trước đây, người dùng thường phải thao tác thủ công qua CLI, tức giao diện dòng lệnh, và chỉnh thêm tham số trong vLLM hoặc TensorRT-LLM. vLLM là một công cụ mã nguồn mở giúp chạy mô hình ngôn ngữ lớn hiệu quả hơn, còn TensorRT-LLM là bộ tối ưu của Nvidia để tăng tốc suy luận cho mô hình AI. Việc bổ sung công cụ mới có thể giúp giảm đáng kể độ phức tạp khi đưa AI vào vận hành thực tế.

Tín hiệu không mấy dễ chịu cho laptop và mini PC RTX Spark

Việc giá DGX Spark 128 GB tiến sát mốc 7.000 USD cũng làm dấy lên lo ngại về giá bán của các mẫu notebook và mini PC RTX Spark dự kiến ra mắt vào mùa thu năm nay. Những thiết bị này dùng cùng silicon GB10 nhưng hướng đến nhu cầu phổ thông hơn như chơi game AAA, lướt web và sáng tạo nội dung. “Silicon” trong ngữ cảnh này là cách gọi con chip xử lý nền tảng. Các tựa game AAA là những trò chơi bom tấn có ngân sách lớn, yêu cầu phần cứng mạnh. Trước đó, dòng RTX Spark đã được dự báo là không rẻ, đặc biệt ở các bản 128 GB; nay với diễn biến mới, giá thực tế có thể còn cao hơn đáng kể.

Nvidia có thể tung thêm cấu hình thấp hơn để giữ khách hàng phổ thông

Theo thông tin hiện có, Nvidia nhiều khả năng sẽ đưa ra các phiên bản GB10 với dung lượng bộ nhớ thấp hơn nữa cho nhóm người mua PC nhạy cảm về giá. Đây có thể là cách hãng mở rộng tệp khách hàng trong bối cảnh chi phí linh kiện tăng cao. Tuy nhiên, điều này cũng đồng nghĩa người dùng sẽ phải cân nhắc kỹ giữa giá tiền và nhu cầu thực tế, bởi dung lượng bộ nhớ là yếu tố then chốt nếu muốn chạy các mô hình AI lớn ngay trên thiết bị cá nhân.

AMD nổi lên như đối thủ đáng gờm với Gorgon Halo

Ở cả hai dòng DGX và RTX Spark, Nvidia sẽ phải đối mặt với cạnh tranh từ AMD và dòng SoC Gorgon Halo mới ra mắt. SoC, viết tắt của System on a Chip, là kiểu chip tích hợp nhiều thành phần như CPU, GPU và bộ điều khiển bộ nhớ trên cùng một đế bán dẫn để tăng hiệu quả và giảm độ trễ. Các cấu hình Gorgon Halo có mức bộ nhớ từ khoảng 32 GB đến 192 GB, trong đó bản Ryzen AI Max+ 495 cao cấp nhất còn cung cấp dung lượng tối đa lớn hơn cả DGX Spark. Đáng chú ý, các hệ thống dùng chip AMD hiện được bán với giá thấp hơn bản DGX Spark 128 GB của Nvidia. Dù vậy, theo các thử nghiệm được dẫn lại, GPU trong GB10 vẫn cho hiệu năng AI cao hơn đáng kể. GPU là bộ xử lý đồ họa, nhưng trong AI nó còn đóng vai trò then chốt nhờ khả năng xử lý song song khối lượng lớn phép toán.

Danh mục máy quét mã vạch

Máy quét mã vạch - Quét mã Qr - Quét mã vạch sản phẩm.

DÒNG MÁY CÓ DÂY

máy quét mã vạch không dây

DÒNG MÁY KHÔNG DÂY

DÒNG MÁY KIỂM KHO PDA

DÒNG MÁY FITMOUNT