Nvidia Vera ra mắt tham vọng lật đổ Intel và AMD ở trung tâm dữ liệu bằng CPU 88 nhân tùy biến cho kỷ nguyên AI View Larger Image Nvidia chính thức bước vào cuộc đua CPU máy chủSau nhiều năm thống trị mảng GPU tăng tốc AI, Nvidia đang mở mặt trận mới với Vera, bộ xử lý trung tâm (CPU) đầu tiên do hãng tự thiết kế sâu ở cấp lõi xử lý. Khác với Grace trước đây vốn dựa nhiều vào các nhân Arm có sẵn, Vera được định vị là một nền tảng CPU độc lập, không bắt buộc phải đi kèm GPU Nvidia. Điều này cho thấy tham vọng rõ ràng của hãng trong việc cạnh tranh trực tiếp với Intel Xeon và AMD Epyc tại các trung tâm dữ liệu quy mô lớn. Một loạt nhà cung cấp đám mây như Alibaba, ByteDance, Meta, Oracle, CoreWeave, Lambda, Nebius và NScale đã lên kế hoạch triển khai con chip này. Thông số của Vera vượt xa hình dung về một CPU máy chủ thông thườngVera sở hữu 88 nhân tùy biến tương thích kiến trúc Armv9.2, hỗ trợ 176 luồng xử lý. Trong điện toán, “luồng” là đơn vị công việc mà CPU có thể xử lý song song; càng nhiều luồng, chip càng có lợi thế khi chạy tác vụ phân tán hoặc đa nhiệm nặng. Điểm gây chú ý lớn hơn là bộ nhớ LPDDR5X tối đa 1,5 TB trên một socket. LPDDR5X là loại RAM tiết kiệm điện, thường thấy trên laptop cao cấp và thiết bị di động, nhưng Nvidia đã đưa nó vào máy chủ để giảm điện năng tiêu thụ. Ở cấu hình hai socket, còn gọi là Vera CPU Superchip, hệ thống đạt 176 nhân, 352 luồng và tới 3 TB bộ nhớ. Thiết kế lạ: một khối tính toán nguyên khối, bao quanh bởi chiplet bộ nhớ và I/OĐiểm khác biệt lớn của Vera nằm ở cách đóng gói silicon. Trong khi AMD phổ biến mô hình chiplet, tức chia CPU thành nhiều khuôn chip nhỏ để tăng hiệu suất sản xuất, Nvidia lại chọn một die tính toán nguyên khối, hay còn gọi là monolithic compute die, chứa toàn bộ 88 nhân trên cùng một mảnh silicon. Theo Nvidia, cách làm này giúp giảm độ trễ giữa các nhân và tăng băng thông giao tiếp nội bộ. Bao quanh khối tính toán là các chiplet chuyên trách điều khiển bộ nhớ LPDDR5X và kết nối I/O. I/O, viết tắt của input/output, là phần giao tiếp giữa CPU với thiết bị ngoại vi như ổ lưu trữ, card mạng hay bộ nhớ mở rộng. Olympus: lõi CPU mới với tham vọng tối ưu cho AI agentTrái tim của Vera là Olympus, lõi CPU Arm tùy biến đầu tiên của Nvidia. Theo tài liệu kỹ thuật, Olympus được tối ưu cho hai nhóm tác vụ chính: làm “head node” điều phối GPU trong các hệ thống AI lớn, và chạy AI agent. AI agent là các tác nhân phần mềm có thể tự thực hiện chuỗi hành động như gọi công cụ, viết mã, truy vấn dữ liệu hay điều phối quy trình, thay vì chỉ trả lời như mô hình ngôn ngữ lớn (LLM). Nvidia cho rằng nhiều AI agent thực chất chạy trên CPU nhiều hơn GPU, đặc biệt ở các bước điều phối, thực thi script hoặc quản lý container. Dự đoán nhánh bằng mạng nơ-ron: chiêu tăng tốc ít người dùng chú ýMột trong những thay đổi đáng chú ý nhất trên Olympus là bộ dự đoán nhánh kiểu neural branch predictor. Dự đoán nhánh là kỹ thuật CPU đoán trước đường đi tiếp theo của chương trình để thực thi sớm, từ đó giảm thời gian chờ. Nếu dự đoán sai, CPU phải quay lại và mất hiệu năng. Nvidia nói bộ dự đoán mới có thể theo dõi đồng thời hai nhánh lệnh, giúp giảm xác suất đoán sai trong những khối mã có nhiều điều kiện rẽ nhánh, chẳng hạn script Python do trợ lý AI sinh ra động. Đây là chi tiết quan trọng vì nhiều ứng dụng AI hiện đại không chỉ cần sức mạnh tính toán thô, mà còn cần CPU xử lý nhanh các luồng lệnh phức tạp và khó đoán. Nvidia còn dùng value prediction và memory renaming để giảm điểm nghẽnNgoài dự đoán nhánh, Olympus còn được bổ sung các kỹ thuật ít xuất hiện trong truyền thông phổ thông như memory renaming và value prediction. Memory renaming có thể hiểu là cơ chế giúp CPU xử lý trước các phụ thuộc dữ liệu giữa lệnh ghi và lệnh đọc, giảm nguy cơ “kẹt đường ống” xử lý. Value prediction là kỹ thuật dự đoán trước giá trị dữ liệu sắp được tạo ra, cho phép các lệnh phụ thuộc tiếp tục chạy tạm thời rồi xác minh độ đúng sau đó. Cả hai đều nhằm tăng IPC, tức số lệnh thực thi trong mỗi chu kỳ xung nhịp, một thước đo hiệu quả thực tế của vi kiến trúc CPU. SMT kiểu mới: không chỉ là Hyper-Threading phiên bản ArmOlympus hỗ trợ một dạng đa luồng đồng thời, thường gọi là SMT, nhưng Nvidia không triển khai theo kiểu truyền thống như Intel Hyper-Threading. SMT, hay simultaneous multithreading, là kỹ thuật cho phép một nhân CPU xử lý nhiều luồng để tận dụng các đơn vị thực thi đang rảnh. Nvidia gọi cách làm của mình là spatial multithreading, tức “đa luồng theo không gian”. Thay vì hai luồng cùng tranh tài nguyên trong một nhân, Olympus có xu hướng tách một nhân lớn thành hai nhân nhỏ hơn với mức chia sẻ tài nguyên khác biệt. Cách tiếp cận này được cho là phù hợp với môi trường container, nơi một phần tài nguyên chạy ứng dụng chính, phần còn lại lo runtime, mạng và lưu trữ. SCF là xa lộ nội bộ nối 88 nhân với băng thông 3,4 TB/giâyĐể 88 nhân không trở thành một đám đông chen chúc, Nvidia xây dựng SCF thế hệ hai, viết tắt của scalable coherency fabric. Đây là mạng liên kết nhất quán bộ nhớ bên trong chip, bảo đảm các nhân và bộ đệm cache luôn nhìn thấy dữ liệu theo trạng thái đồng bộ. SCF trên Vera đạt băng thông cắt ngang 3,4 TB/giây, đóng vai trò như “siêu xa lộ” nối các nhân, bộ nhớ đệm và bộ điều khiển RAM. Hệ thống bộ đệm cấp hệ thống, gọi là SLC (system level cache), dung lượng 164 MB cũng được phân mảnh dọc theo fabric này thay vì gom thành một khối duy nhất. Bộ nhớ LPDDR5X mang lại băng thông cao nhưng tiết kiệm điện hơn RDIMMVera dùng 8 bộ điều khiển bộ nhớ LPDDR5X và các mô-đun SOCAMM2, đạt tổng băng thông khoảng 1,2 TB/giây trên mỗi chip. Băng thông bộ nhớ là lượng dữ liệu có thể di chuyển giữa RAM và CPU trong một giây; với khối lượng AI và phân tích dữ liệu lớn, đây là chỉ số cực kỳ quan trọng. Nvidia nhấn mạnh LPDDR5X tiêu thụ điện thấp hơn nhiều so với RDIMM, loại RAM máy chủ truyền thống. Theo hãng, dưới tải liên tục, phần bộ nhớ của Vera chỉ tiêu thụ khoảng 30 đến 40 watt, so với 100 đến 200 watt trên nhiều nền tảng máy chủ dùng DIMM chuẩn. Đây có thể là lợi thế lớn trong các trung tâm dữ liệu đang bị áp lực bởi chi phí điện và làm mát. PCIe 6.4, CXL 3.1 và NVLink-C2C tạo thành bộ ba kết nối tốc độ caoKhông chỉ mạnh ở tính toán và bộ nhớ, Vera còn được Nvidia nhồi nhét nhiều công nghệ kết nối mới. Chip hỗ trợ PCIe 6.4, chuẩn giao tiếp tốc độ cao dùng để kết nối card mạng, SSD và các thiết bị tăng tốc khác. Với PCIe 6.x, băng thông mỗi lane tăng gấp đôi so với PCIe 5.0. Đi kèm là CXL 3.1, viết tắt của Compute Express Link, một chuẩn mở rộng cho phép chia sẻ bộ nhớ và xây dựng “fabric” kết nối tài nguyên giữa nhiều hệ thống. Điều này mở đường cho các thiết bị bộ nhớ dùng chung qua mạng, tức nhiều máy chủ có thể truy cập cùng một vùng RAM mở rộng. Cuối cùng là NVLink-C2C, liên kết chip-to-chip độc quyền của Nvidia, cho phép hai chip Vera giao tiếp với nhau ở mức 1,8 TB/giây hai chiều, giảm mạnh nút thắt thường thấy ở hệ thống hai socket. Vera CPU Superchip hướng tới rack AI agent mật độ cực caoTrong cấu hình tham chiếu cho AI agent, Nvidia cho biết một rack làm mát chất lỏng có thể chứa tới 128 Vera CPU Superchip, tương đương 256 CPU, 22.528 nhân xử lý và 384 TB bộ nhớ. Rack là tủ máy chủ tiêu chuẩn trong trung tâm dữ liệu, còn làm mát chất lỏng là phương pháp dùng chất lỏng dẫn nhiệt để giải nhiệt hiệu quả hơn quạt gió truyền thống. Cấu hình này cho thấy Nvidia không chỉ muốn bán chip đơn lẻ, mà còn đang định hình cả kiến trúc hạ tầng cho thế hệ dịch vụ AI tự động hóa quy mô lớn. Hiệu năng thực tế vẫn là dấu hỏi, nhưng Nvidia đã chọn đúng điểm đau của thị trườngNvidia tuyên bố Vera cho hiệu năng trên mỗi nhân cao hơn 1,8 lần so với AMD Epyc 9755 trong các bài thử đại diện cho tác vụ AI agent, và nhanh hơn tới 2,6 lần ở bài toán duyệt đồ thị. Dù vậy, giới quan sát vẫn tỏ ra thận trọng vì benchmark CPU rất dễ bị chọn lọc theo hướng có lợi. Lợi thế lớn nhất của Vera hiện chưa chắc nằm ở việc thắng tuyệt đối mọi bài kiểm tra, mà ở chỗ nó giải quyết đúng các điểm đau của hạ tầng AI hiện đại: độ trễ giữa nhân thấp, băng thông bộ nhớ cao, điện năng RAM thấp, và kết nối cực nhanh với GPU cũng như thiết bị ngoại vi. Cuộc chiến CPU cho AI đã bước sang giai đoạn mớiVera cho thấy Nvidia không còn hài lòng với vai trò chỉ cung cấp GPU cho cơn sốt AI. Hãng đang tiến tới kiểm soát toàn bộ ngăn xếp hạ tầng, từ CPU, GPU, liên kết nội bộ, bộ nhớ đến thiết kế rack tham chiếu. Trong bối cảnh AMD chuẩn bị tung Venice và Intel tiếp tục đẩy mạnh Xeon thế hệ mới, thị trường CPU máy chủ sắp bước vào giai đoạn cạnh tranh khốc liệt hơn nhiều. Nếu Vera chứng minh được hiệu quả trên phần cứng thương mại, đây có thể là bước ngoặt khiến Nvidia trở thành thế lực thực sự trong mảng CPU trung tâm dữ liệu, chứ không chỉ là ông vua GPU của kỷ nguyên AI. Mini PC – Máy Tính Công Nghiệp IPC AI PC – Máy tính AI Intel F1A | Intel Ultra 7 155H 14.500.000₫ Thêm vào giỏ hàng Details AI PC – Máy tính AI Intel F2A | Intel Ultra 7 155H 14.500.000₫ Thêm vào giỏ hàng Details Máy All In One cho văn phòng – PC Gaming – INTEL i5 12450H 8 lõi 12 luồng 15.500.000₫ Thêm vào giỏ hàng Details Máy all in one giá rẻ – PC Gaming – INTEL I5 10500H 6 lõi 12 luồng 13.700.000₫ Thêm vào giỏ hàng Details Máy tính AI – AI PC | Intel I9-12900H + Nvidia RTX3080 28.500.000₫ Thêm vào giỏ hàng Details Máy tính AI AMD AM18 | Ryzen 7 8845HS + Radeon 780M 14.500.000₫ Thêm vào giỏ hàng Details Máy tính AI PC M1A | Intel I9-13900H + Nvidia RTX-3080 28.500.000₫ Thêm vào giỏ hàng Details Máy tính All In One Optori G40 Pro – PC Gaming – INTEL i5 12450H 14.500.000₫ Thêm vào giỏ hàng Details Màn hình cảm ứng HMI – Panel PC Giải pháp HMI Panel PC chống cháy nổ cho nhà máy sản xuất hiện đại | HazardView HV-17EX-T Details Khi nào cần dùng Panel PC chống cháy nổ thay cho Panel PC công nghiệp thông thường? | HazardView HV-17EX Details Màn hình cảm ứng HMI – Touch Panel PC BE-PX09 15.6 Inch 19.500.000₫ Thêm vào giỏ hàng Details Máy tính công nghiệp – Fanless Mini PC Công Nghiệp B8000 10.900.000₫ Thêm vào giỏ hàng Details Máy tính công nghiệp màn hình cảm ứng – Touch Panel HMI QY-P8156 15.6 Inch Details So sánh máy tính công nghiệp chống cháy nổ và máy tính công nghiệp tiêu chuẩn | HazardView HV-238EX Details Xu hướng ứng dụng màn hình HMI chống cháy nổ trong nhà máy thông minh | HazardView HV-19EX-R Details Danh mục máy quét mã vạchDÒNG MÁY CÓ DÂYDÒNG MÁY KHÔNG DÂYDÒNG MÁY KIỂM KHO PDADÒNG MÁY FITMOUNT admin2026-08-01T16:06:57+07:00 Related Posts Vodafone chi 4,3 tỷ bảng thâu tóm hoàn toàn VodafoneThree, siết quyền kiểm soát nhà mạng di động lớn nhất Anh Vodafone chi 4,3 tỷ bảng thâu tóm hoàn toàn VodafoneThree, siết quyền kiểm soát nhà mạng di động lớn nhất Anh Tháng 7 31st, 2026 Anh đề xuất thu phí đặt cọc kết nối điện với trung tâm dữ liệu để chặn dự án “xí chỗ” trên lưới điện Anh đề xuất thu phí đặt cọc kết nối điện với trung tâm dữ liệu để chặn dự án “xí chỗ” trên lưới điện Tháng 7 31st, 2026 Người Mỹ ngày càng ủng hộ cấm điện thoại cả ngày ở trường học Người Mỹ ngày càng ủng hộ cấm điện thoại cả ngày ở trường học Tháng 7 31st, 2026 Khảo sát Databricks: Chứng chỉ kỹ năng dữ liệu và AI đang trở thành lợi thế chiến lược của đối tác công nghệ Khảo sát Databricks: Chứng chỉ kỹ năng dữ liệu và AI đang trở thành lợi thế chiến lược của đối tác công nghệ Tháng 7 31st, 2026 Công nghệ bộ nhớ mới lấy cảm hứng từ lưu trữ có thể đẩy GPU lên mức nhiều terabyte Công nghệ bộ nhớ mới lấy cảm hứng từ lưu trữ có thể đẩy GPU lên mức nhiều terabyte Tháng 7 31st, 2026