NVIDIA thông báo rằng các nhà lãnh đạo công nghệ hàng đầu thế giới đang lên kế hoạch triển khai NVIDIA Vera, bộ xử lý trung tâm (CPU) đầu tiên được chế tạo riêng cho các đặc vụ AI (AI agents).
NVIDIA Ra Mắt Vera: Bộ Xử Lý Trung Tâm (CPU) Dành Riêng Cho Các Đặc Vụ AI (AI Agents)
Hiện đã được đưa vào sản xuất thương mại hàng loạt, NVIDIA Vera là một phân khúc bộ xử lý mới, cho phép hoàn thành tác vụ nhanh hơn 1.8 lần so với các CPU kiến trúc x86 truyền thống. Sự bứt phá này giúp thúc đẩy các khối lượng công việc đa dạng trên nhiều ngành công nghiệp — bao gồm AI dạng đặc vụ, học tăng cường và xử lý dữ liệu — từ đó tạo ra nhiều doanh thu token hơn cho các trung tâm dữ liệu.
Kế thừa thành công từ dòng CPU NVIDIA Grace™ (với gần 2.5 triệu đơn vị được xuất xưởng cho đến nay), Vera nâng hiệu năng CPU và hiệu quả năng lượng lên những tầm cao mới nhằm đáp ứng các khối lượng công việc AI khắt khe nhất trong các trung tâm dữ liệu hiện đại — nơi các đặc vụ AI đang dịch chuyển từ việc trả lời các câu hỏi cơ bản sang chủ động thực hiện hành động, chạy mã nguồn, sử dụng công cụ và đánh giá kết quả.
Các khách hàng đang tiên phong khám phá CPU Vera bao gồm gã khổng lồ tài chính NYSE (Sở giao dịch chứng khoán New York), các phòng thí nghiệm AI toàn cầu như Anthropic, OpenAI và SpaceXAI, cùng các đơn vị cung cấp dịch vụ đám mây quy mô siêu lớn như ByteDance, CoreWeave, Lambda, Nebius, Nscale và Oracle Cloud Infrastructure (OCI). Vera cũng đang được tích hợp vào hạ tầng AI của các nhà sản xuất hệ thống hàng đầu thế giới như Dell Technologies, HPE, Lenovo, Supermicro, cùng các nhà xây dựng hệ thống tại Đài Loan.
"Các đặc vụ AI sẽ là những thực thể tiêu thụ tài nguyên điện toán lớn nhất," Jensen Huang, nhà sáng lập kiêm CEO của NVIDIA cho biết. "Vera là CPU đầu tiên được thiết kế cho tương lai đó — được xây dựng để vận hành agentic AI ở quy mô siêu lớn với hiệu năng, hiệu suất và khả năng lập trình phi thường."
"Tại NYSE, trọng tâm của chúng tôi là tối ưu hóa độ trễ, băng thông và độ tin cậy của các hệ thống nền tảng cho cơ sở hạ tầng vô song của mình," Lynn Martin, Chủ tịch NYSE Group chia sẻ. "NYSE xử lý hơn 1.1 nghìn tỷ thông điệp mỗi ngày. Thông qua sự hợp tác với Redpanda và HPE để sử dụng CPU NVIDIA Vera, chúng tôi sẽ mở rộng quy mô năng lực xử lý, đồng thời tối ưu hóa hơn nữa độ trễ để vận hành một hạ tầng thị trường hiệu năng cao, kiên cường và sẵn sàng cho AI."
Anthropic, công ty đổi mới sáng tạo AI đứng sau trợ lý Claude, đang đánh giá việc tích hợp Vera nhằm mở rộng quy mô cho các khối lượng công việc dạng đặc vụ vốn tiêu tốn rất nhiều tài nguyên CPU.
"Mở rộng quy mô điện toán là một chất xúc tác quan trọng cho sự phát triển của các mô hình," James Bradbury, trưởng bộ phận điện toán tại Anthropic nhận định. "Chúng tôi rất hào hứng khi thấy Vera nổi lên như một phần đầy hứa hẹn của hệ sinh thái khi giải quyết các khối lượng công việc dạng đặc vụ."
Hệ siêu máy tính OCI Supercluster được vận hành bởi NVIDIA Vera đại diện cho ranh giới tiếp theo trong lĩnh vực siêu máy tính AI quy mô siêu lớn.
"Oracle Cloud Infrastructure đang nhanh chóng mở rộng quy mô hạ tầng AI để đáp ứng nhu cầu tăng vọt về huấn luyện (training), suy luận (inference) và AI dạng đặc vụ," Mahesh Thiagarajan, Phó chủ tịch điều hành của Oracle Cloud Infrastructure cho biết. "Bằng cách triển khai CPU NVIDIA Vera, OCI sẽ hỗ trợ các khối lượng công việc suy luận và xử lý dữ liệu có băng thông cao trên khắp các môi trường AI thế hệ mới."
Theo Phoronix, đơn vị cung cấp bộ công cụ chấm điểm hiệu năng (benchmarking) mã nguồn mở toàn diện, NVIDIA Vera đã mang lại hiệu năng tổng thể nhanh nhất trên các khối lượng công việc dạng đặc vụ, bao gồm biên dịch mã (code compilation), xử lý Python, Java và cơ sở dữ liệu. Các khối lượng công việc này nằm trên lộ trình trọng yếu (critical path) của các nhà máy AI hiện đại, bao gồm việc sử dụng công cụ của đặc vụ và thực thi trong môi trường cô lập (sandbox execution) — nơi hiệu năng CPU nhanh hơn sẽ mang lại hiệu suất xử lý (throughput) và tính tương tác cao hơn cho đặc vụ.
Một CPU Tùy Biến Cho Kỷ Nguyên Của Các Đặc Vụ AI (Agentic Era)
Tính kinh tế của các nhà máy AI đang dịch chuyển từ "số lõi trên mỗi đô-la" (cores per dollar) sang "số token trên mỗi đô-la" (tokens per dollar). Điều này đòi hỏi các CPU phải hoàn thành công việc điều phối, xử lý dữ liệu và vận hành đặc vụ một cách nhanh chóng và hiệu quả hơn.
Vera được cung cấp sức mạnh bởi Olympus — một lõi CPU tùy biến do NVIDIA thiết kế nhằm xử lý các tác vụ của CPU đằng sau sự dịch chuyển đó, từ môi trường thực thi Python, thực thi mã nguồn trong sandbox cho đến logic điều phối và các đường ống phân tích dữ liệu (analytics pipelines).
Vera được xây dựng để xử lý nhiều chỉ thị hơn, dự đoán hành vi của ứng dụng và luân chuyển dữ liệu qua số lượng lớn các môi trường đồng thời, các truy vấn và tác vụ xử lý dữ liệu. Chip sở hữu 88 lõi Olympus, công nghệ Đa luồng Không gian (Spatial Multithreading) và hệ thống phụ bộ nhớ LPDDR5X cung cấp băng thông lên tới 1.2TB/s. Điều này giúp các đặc vụ giảm bớt thời gian chờ đợi ở các bước nghẽn do CPU (CPU-bound) và giúp các bộ tăng tốc (accelerators/GPUs) trong nhà máy AI luôn được vận hành liên tục.
CPU Vera cũng có thể được triển khai trên toàn bộ nhà máy AI — từ hạ tầng CPU độc lập cho đến các hệ thống tăng tốc liên kết chặt chẽ. Vera giúp các nhà máy AI đạt được hiệu suất tổng thể (end-to-end throughput) cao hơn và thời gian đưa ra giải pháp (time to solution) nhanh hơn cho người dùng, cải thiện tốc độ phản hồi và hiệu quả trên khắp các khâu huấn luyện, suy luận và thực thi đặc vụ.
Vera đóng vai trò là CPU máy chủ (host CPU) cho các nền tảng NVIDIA Vera Rubin thông qua công nghệ kết nối NVIDIA NVLink™-C2C thế hệ thứ hai, cung cấp băng thông đồng nhất (coherent bandwidth) lên đến 1.8TB/s giữa CPU và GPU. Nó cũng mở rộng giải pháp Điện toán Bảo mật (NVIDIA Confidential Computing) ở quy mô dạng tủ rack (rack scale), giúp bảo vệ an toàn cho các khối lượng công việc của đặc vụ.
Bộ xử lý NVIDIA Vera BlueField-4 STX tích hợp Vera với hệ thống mạng hiệu năng cao, tăng tốc lưu trữ và bảo mật trực tiếp trên chip (in-silicon security) để tạo ra các nền tảng dữ liệu thuần AI bảo mật ngay từ thiết kế (secure-by-design).
Sự Hỗ Trợ Rộng Rãi Từ Hệ Sinh Thái
CPU Vera hiện có sẵn trong các cấu hình tủ rack tản nhiệt chất lượng cao (liquid-cooled) mật độ dày, dành cho các môi trường học tăng cường và AI dạng đặc vụ quy mô lớn; cũng như các hệ thống tản nhiệt khí hai socket (two-socket air-cooled) linh hoạt dành cho doanh nghiệp, đám mây, xử lý dữ liệu và triển khai nhà máy AI.
Các nhà cung cấp hạ tầng hàng đầu mở bán các hệ thống dựa trên CPU Vera bao gồm: Aivres, ASRock Rack, ASUS, Compal, Dell, Foxconn, GIGABYTE, HPE, Hyve Solutions, Inventec, Lenovo, MiTAC Computing, MSI, Pegatron, Quanta Cloud Technology (QCT), Supermicro, Wistron và Wiwynn. Các nhà sản xuất thiết bị gốc (OEM) lớn — Dell, HPE, Lenovo và Supermicro — sẽ cung cấp Vera trong các cấu hình máy chủ CPU độc lập, đánh dấu tùy chọn CPU tiêu chuẩn đầu tiên vượt ra ngoài giới hạn của kiến trúc x86.
Các nhà cung cấp dịch vụ đám mây lớn có kế hoạch triển khai CPU Vera bao gồm: Akamai, ByteDance, Cloudflare, CoreWeave, Crusoe, Lambda, Nebius, Nscale, Oracle Cloud Infrastructure, Redpanda, Starburst, Together AI và Vultr.