Bán chạy nhất
Bán chạy nhất
Bán chạy nhất
Bán chạy nhất
Bán chạy nhất
Bán chạy nhất
Bán chạy nhất
NVIDIA vừa công bố nền tảng điện toán AI thế hệ mới mang tên Vera Rubin đã chính thức bước vào giai đoạn sản xuất quy mô lớn. Đây được xem là bước nhảy vọt tiếp theo sau thế hệ Grace Blackwell, hướng đến mục tiêu tối ưu hiệu năng trên mỗi watt điện tiêu thụ và giảm mạnh chi phí xử lý mỗi triệu token cho các trung tâm dữ liệu AI trên toàn cầu.

Các rack Vera Rubin NVL72 hiện đã được đưa vào vận hành tại nhiều đối tác lớn của NVIDIA như CoreWeave, Google Cloud, Microsoft Azure và Oracle Cloud Infrastructure. Chuỗi cung ứng phục vụ cho việc sản xuất nền tảng này trải dài hơn 350 nhà máy tại 30 quốc gia, được NVIDIA mô tả là chuỗi cung ứng rack-scale lớn và trưởng thành nhất mà hãng từng xây dựng.

Kết quả benchmark đầu tiên do CoreWeave thực hiện trên mô hình DeepSeek-R1 cho thấy Vera Rubin NVL72 đạt thông lượng cao gấp 10 lần trên mỗi megawatt so với thế hệ Grace Blackwell NVL72 trước đó. Đây là chỉ số then chốt đối với các trung tâm dữ liệu AI đang bị giới hạn bởi nguồn cung điện năng, bởi càng nhiều token xử lý được trên mỗi đơn vị điện năng thì chi phí vận hành AI càng giảm.
Điểm khác biệt lớn nhất của Vera Rubin nằm ở triết lý thiết kế đồng bộ (extreme co-design), trong đó bảy loại chip và năm khay rack khác nhau, gồm Vera Rubin NVL72, Vera CPU rack, Groq 3 LPX, Spectrum-6 SPX và Vera BlueField-4 STX, được phát triển như một hệ thống thống nhất thay vì lắp ráp từ các linh kiện rời rạc.
Trung tâm của nền tảng là CPU Vera CPU mới, được xây dựng riêng cho kỷ nguyên AI tác tử (agentic AI). Với nhân Olympus tùy chỉnh, CPU này mang lại hiệu năng đơn luồng gấp đôi, băng thông giữa các nhân cao gấp ba lần và độ trễ truy xuất bộ nhớ thấp hơn 40% so với các thiết kế chiplet cạnh tranh, giúp nó trở thành lựa chọn hiệu quả cho các tác vụ AI dạng tác tử vốn đòi hỏi khả năng điều phối liên tục.

Về hạ tầng mạng, kết nối NVLink thế hệ thứ sáu cho thông lượng cao hơn gấp đôi, độ trễ thấp hơn ba lần và tốc độ xử lý gói tin cao gấp mười lần so với Ethernet thông thường trên các tác vụ phức tạp. Ở lớp mở rộng quy mô, hệ thống Spectrum-X Ethernet kết hợp switch Spectrum-6 tốc độ 102.4 Tb/s, SuperNIC ConnectX-9 tốc độ 1.6 Tb/s cùng các công nghệ định tuyến thích ứng, kiểm soát tắc nghẽn và giám sát mạng nâng cao, mang lại băng thông RDMA cao hơn 1.6 lần so với Ethernet thông thường.
Công nghệ quang học tích hợp trực tiếp trên switch (co-packaged optics) mà NVIDIA giới thiệu lần đầu ở quy mô sản xuất công nghiệp giúp giảm 5 lần điện năng tiêu thụ và tăng 10 lần độ bền so với các bộ chuyển đổi quang rời truyền thống. Ngoài ra, công nghệ Spectrum-XGS Ethernet còn cho phép mở rộng hiệu năng giữa nhiều địa điểm đặt trung tâm dữ liệu khác nhau, với thông lượng đa điểm cao hơn 1.9 lần.
Nhờ ba thế hệ thiết kế rack-scale liên tiếp, hệ thống Vera Rubin NVL72 loại bỏ hoàn toàn dây cáp, quạt và ống dẫn rời trong khay máy, giúp rút ngắn thời gian lắp ráp mỗi khay từ vài giờ xuống còn khoảng một phút.
Thiết kế làm mát bằng chất lỏng với nhiệt độ đầu vào lên tới 45 độ C cho phép vận hành theo cơ chế dry-cooler mà không cần đến hệ thống chiller truyền thống. Đối với các trung tâm dữ liệu AI mới xây dựng, giải pháp làm mát nhiệt độ cao kết hợp hệ thống tuần hoàn khép kín này giúp tiết kiệm hàng triệu gallon nước mỗi năm cho mỗi megawatt công suất vận hành.

Vera Rubin cũng là nền tảng tính toán cho một thỏa thuận hợp tác mở rộng giữa Microsoft và Mistral AI nhằm đưa AI tiên tiến đến khu vực châu Âu. Sự kết hợp giữa các mô hình mở do châu Âu phát triển với hạ tầng đám mây và môi trường do khách hàng tự kiểm soát cho phép các cơ quan chính phủ và ngành công nghiệp chịu quản lý chặt như tài chính, y tế triển khai AI theo đúng các tiêu chuẩn về chủ quyền dữ liệu của khu vực.
Theo NVIDIA, so với thế hệ GB200 NVL72 trước đó, Vera Rubin NVL72 mang lại thông lượng token cao hơn tới 10 lần trên mỗi megawatt trong khi chi phí xử lý mỗi triệu token chỉ còn bằng khoảng một phần mười.
Google Cloud đã cho ra mắt instance A5X đầu tiên chạy trên nền tảng Vera Rubin NVL72, hiện đang được startup Ineffable Intelligence có trụ sở tại London sử dụng để phát triển các hệ thống AI học tăng cường quy mô lớn, có khả năng tự học liên tục thông qua tương tác với môi trường mô phỏng thay vì chỉ dựa vào dữ liệu tĩnh.

Trong khi đó, nền tảng đám mây DeepInfra, đơn vị xử lý gần năm nghìn tỷ token mỗi tuần, đã tự thực hiện benchmark độc lập trên hạ tầng AI agent sản xuất thực tế của mình. Kết quả cho thấy Vera CPU hỗ trợ tới 1.6 lần số lượng AI agent hoạt động đồng thời ở cùng mức chất lượng dịch vụ, đồng thời tăng tốc độ điều phối tác vụ (orchestration) lên tới 2.2 lần so với các dòng CPU khác, qua đó cải thiện đáng kể hiệu quả sử dụng hạ tầng và chi phí vận hành.
Với việc đồng bộ hóa thiết kế từ chip xử lý, CPU, hệ thống mạng cho đến giải pháp làm mát, NVIDIA Vera Rubin đang đặt ra một chuẩn mực mới cho hạ tầng AI quy mô lớn, nơi hiệu năng trên mỗi watt điện và chi phí trên mỗi token trở thành thước đo quan trọng hàng đầu. Việc được hàng trăm đối tác lớn trên toàn cầu như CoreWeave, Google Cloud, Microsoft Azure, Oracle Cloud Infrastructure và Mistral AI đồng loạt triển khai cho thấy nền tảng này nhiều khả năng sẽ trở thành xương sống cho làn sóng AI tác tử và siêu học (superlearning) trong giai đoạn tới.
Nếu bạn cần tìm kiếm về PC AI High-end phục vụ các workstation nặng, đa nhiệm. Tham khảo ngay PC AI của Nguyễn Công PC, được phân loại theo nhiều nhu cầu sử dụng cho từng mục tiêu riêng biệt.
Nguồn tham khảo: NVIDIA Blog
XEM THÊM:
Cấu Hình PC Chạy AI : Hướng Dẫn Chọn Linh Kiện Theo Nhu Cầu Và Ngân Sách Thực Tế
Bài viết liên quan
21-07-2026, 11:39 am
Chạy Ollama tại nhà cần GPU đủ VRAM và RAM phù hợp. Bài viết phân tích cấu hình theo từng mức ngân sách để chạy mượt các model AI như Llama, Mistral ngay trên máy cá nhân.
18-07-2026, 9:55 am
Nhiệt độ máy không giảm sau khi vệ sinh, tra keo thường do kỹ thuật lắp đặt, luồng khí case chưa tối ưu hoặc tản nhiệt không đủ công suất so với mức tải hiện tại.
17-07-2026, 4:15 pm
Tản nhiệt khí và AIO có ưu nhược điểm riêng, khác biệt rõ nhất khi CPU tải nặng kéo dài. Bài viết phân loại theo mức TDP CPU để chọn loại tản nhiệt phù hợp, tránh dư thừa hoặc thiếu.
17-07-2026, 10:58 am
Palworld 1.0 ra mắt ngày 10/7/2026, bổ sung World Tree, Sky Islands và hơn 70 Pal mới, đánh dấu game chính thức rời Early Access.
15-07-2026, 4:48 pm
Tổng hợp các cấu hình PC Gaming và Đồ Họa đa dạng phân khúc giá, sử dụng CPU Intel, AMD đời mới kết hợp VGA RTX, phù hợp nhiều nhu cầu sử dụng khác nhau.
15-07-2026, 9:51 am
XeSS 3 là công nghệ upscaling mới của Intel với XeSS-MFG, tạo đa khung hình tối đa 4x, hỗ trợ card Arc A-series và B-series, cạnh tranh với DLSS 4.5 và FSR 4.
Khách cá nhân
0828.333.363
Mr Ngọc0989.336.366
Mr Hùng0707.08.6666
Mr Hoàng089.9999.191
Mr Lộc0812.666.665
Mr Tuấn Anh09.8888.2838
Mr. Trung08.66666.166
098.33333.88
Showroom TP. Hồ Chí Minh097.9999.191
Showroom TP. Hà Nội0865.264.818
Showroom TP. Hà Nội0705.666.668
17 Hà Kế Tấn, Phường Phương Liệt, Hà Nội0765.666.668
Số 10 ngõ 93 Trần Thái Tông, Phường Cầu Giấy, Hà Nội079.9999.191
249 Lý Thường Kiệt, phường Phú Thọ, TP. Hồ Chí Minh0332.101.130
0968.929.992
Khách doanh nghiệp
097.9999.191
Mr Lực0828.333.363
Mr Ngọc0707.08.6666
Mr Hoàng