19/05/2026 – (TinAI.vn) – Ngày 18/05/2026, NVIDIA cho biết các hệ thống CPU Vera đầu tiên đã được bàn giao cho những tổ chức AI hàng đầu gồm Anthropic, OpenAI, SpaceXAI và Oracle Cloud Infrastructure. Động thái này đánh dấu thời điểm Vera — CPU đầu tiên do NVIDIA thiết kế riêng cho kỷ nguyên AI tác nhân — chuyển từ giai đoạn công bố sang tay khách hàng để triển khai trong các môi trường sản xuất quy mô lớn [1].
Từ GPU sang “AI factory”: Vì sao CPU lại trở thành tâm điểm?
Trong nhiều năm, GPU là trung tâm của cuộc đua trí tuệ nhân tạo. Tuy nhiên, khi AI bước sang giai đoạn agentic AI — nơi mô hình không chỉ trả lời mà còn lập kế hoạch, gọi công cụ, chạy mã, truy xuất dữ liệu, điều phối tác vụ và tự kiểm tra kết quả — vai trò của CPU trở nên quan trọng hơn nhiều.
Theo NVIDIA, các tác vụ như sandbox cho AI agent, gọi công cụ, điều phối luồng làm việc, truy xuất ngữ cảnh dài, phân tích dữ liệu và chạy mã đều là những phần việc nặng về CPU [1]. Nói cách khác, GPU vẫn là động cơ tăng tốc tính toán AI, nhưng CPU đang trở thành “bộ điều phối sản xuất” trong các AI factory — những trung tâm hạ tầng vận hành AI ở quy mô công nghiệp.
Vera được thiết kế nhằm giải quyết nút thắt đó. NVIDIA cho biết CPU này có 88 nhân Olympus do NVIDIA tự thiết kế, băng thông bộ nhớ 1,2 TB/s và hiệu năng mỗi nhân nhanh hơn 50% khi chịu tải đầy đủ [1]. Trên trang sản phẩm, NVIDIA mô tả Vera là CPU được xây dựng cho học tăng cường, AI tác nhân, xử lý dữ liệu, điều phối hệ thống và các quy trình vượt ra ngoài bản thân mô hình AI [2].
Những khách hàng đầu tiên: Anthropic, OpenAI, SpaceXAI và Oracle Cloud
Theo bài công bố của NVIDIA, Phó Chủ tịch Hyperscale và High-Performance Computing Ian Buck đã trực tiếp bàn giao các hệ thống Vera CPU đầu tiên. Điểm đến đầu tiên là Anthropic tại San Francisco, sau đó là OpenAI ở Mission Bay, SpaceXAI tại Palo Alto và Oracle Cloud Infrastructure ở Santa Clara [1].
Tại Anthropic, James Bradbury — lãnh đạo mảng compute của công ty — cho rằng mở rộng năng lực tính toán là yếu tố quan trọng thúc đẩy sự phát triển của các mô hình AI, đồng thời đánh giá Vera là một phần hứa hẹn trong hệ sinh thái xử lý các khối lượng công việc AI tác nhân [1].
Ở OpenAI, NVIDIA cho biết hệ thống Vera được giới thiệu trực tiếp cho Sachin Katti, người phụ trách hạ tầng tính toán của OpenAI. Trong khi đó, tại SpaceXAI, Elon Musk đã xem xét cấu trúc hệ thống và đặt câu hỏi về số nhân, bố trí bộ nhớ và khả năng làm mát. NVIDIA cho biết SpaceXAI đang đánh giá Vera cho các khối lượng công việc học tăng cường và các pipeline mô phỏng dựa trên agent [1].
Đáng chú ý, Oracle Cloud Infrastructure là nhà cung cấp đám mây đầu tiên triển khai Vera ở quy mô hyperscale. NVIDIA dẫn lời Karan Batta, lãnh đạo quản lý sản phẩm của OCI, cho biết OCI dự kiến triển khai hàng trăm nghìn CPU NVIDIA Vera từ năm 2026 để đáp ứng nhu cầu hiệu năng bền vững ở quy mô rất lớn cho AI tác nhân [1].
Vera CPU có gì đặc biệt?
NVIDIA mô tả Vera là CPU được tối ưu cho các tác vụ vốn ngày càng phổ biến trong AI hiện đại: điều phối agent, gọi công cụ, chạy mã, phân tích dữ liệu, quản lý trạng thái ngữ cảnh dài, học tăng cường và vận hành sandbox cho agent [1].
Một số thông số đáng chú ý của NVIDIA Vera gồm:
- 88 nhân Olympus tùy biến do NVIDIA thiết kế [1], [2].
- 176 luồng nhờ công nghệ Spatial Multithreading [2].
- Băng thông bộ nhớ lên đến 1,2 TB/s, dùng LPDDR5X tiết kiệm năng lượng [2].
- Hỗ trợ bộ nhớ lên đến 1,5 TB, cao hơn thế hệ trước [2].
- NVLink-C2C thế hệ thứ hai đạt 1,8 TB/s, cho phép chia sẻ dữ liệu nhất quán giữa CPU và GPU [2].
- Có thể hoạt động như CPU độc lập hoặc đóng vai trò host processor trong hệ thống Vera Rubin NVL72, kết hợp với GPU Rubin [1], [2].
Theo NVIDIA, trong hệ Vera Rubin, Vera và Rubin chia sẻ kiến trúc bộ nhớ thống nhất, giúp CPU và GPU phối hợp hiệu quả hơn trong các khối lượng công việc AI, HPC và suy luận ngữ cảnh dài [1], [2].
Tín hiệu chiến lược: NVIDIA không chỉ bán GPU
Việc Vera được bàn giao cho Anthropic, OpenAI, SpaceXAI và OCI cho thấy NVIDIA đang mở rộng vai trò từ nhà cung cấp GPU sang nhà cung cấp hạ tầng AI toàn diện. Trong bài kỹ thuật về Vera Rubin, NVIDIA nhấn mạnh triết lý extreme co-design: CPU, GPU, mạng, bảo mật, phần mềm, cấp nguồn và làm mát được thiết kế như một hệ thống thống nhất, thay vì tối ưu từng linh kiện riêng lẻ [3].
Đây là điểm quan trọng. Trong kỷ nguyên AI tác nhân, hiệu năng không còn chỉ được đo bằng số phép tính trên GPU. Hạ tầng AI phải xử lý đồng thời mô hình, dữ liệu, bộ nhớ, công cụ, mã nguồn, bảo mật, độ trễ, chi phí năng lượng và khả năng mở rộng. Vì vậy, CPU không còn là thành phần phụ trợ; nó trở thành một phần trung tâm của dây chuyền sản xuất trí tuệ nhân tạo.
Điều này có ý nghĩa gì với doanh nghiệp?
Đối với doanh nghiệp, tin tức về Vera không chỉ là câu chuyện phần cứng. Nó phản ánh xu hướng AI đang chuyển từ “chatbot trả lời câu hỏi” sang “agent xử lý công việc”. Khi agent có thể viết mã, phân tích dữ liệu, gọi API, chạy mô phỏng, kiểm tra kết quả và phối hợp nhiều bước, hạ tầng phía sau phải mạnh hơn, ổn định hơn và tối ưu hơn.
Các doanh nghiệp đang xây dựng trợ lý AI nội bộ, hệ thống tự động hóa, tổng đài AI, AI phân tích dữ liệu, AI hỗ trợ lập trình hoặc AI vận hành quy trình sẽ ngày càng phụ thuộc vào hạ tầng có khả năng xử lý tác vụ đa bước. Vera cho thấy các nhà cung cấp hạ tầng lớn đang chuẩn bị cho giai đoạn AI vận hành ở quy mô sản xuất, thay vì chỉ thử nghiệm trong phòng lab.
Góc nhìn của TinAI.vn
Vera CPU là một dấu mốc đáng chú ý vì nó cho thấy cuộc đua AI đã đi sâu vào tầng hạ tầng. Nếu giai đoạn đầu của AI tạo sinh tập trung vào mô hình và GPU, thì giai đoạn tiếp theo sẽ là cuộc đua về AI factory, hiệu quả năng lượng, độ trễ, băng thông bộ nhớ, khả năng điều phối agent và chi phí trên mỗi tác vụ.
Việc NVIDIA đưa Vera đến tay Anthropic, OpenAI, SpaceXAI và Oracle Cloud Infrastructure cho thấy các phòng thí nghiệm AI hàng đầu và nhà cung cấp đám mây đang chuẩn bị cho một thế hệ ứng dụng AI mới: không chỉ trả lời, mà còn hành động.
Với doanh nghiệp Việt Nam, bài học quan trọng không nằm ở việc phải sở hữu ngay phần cứng như Vera, mà là cần chuẩn bị tư duy hạ tầng, dữ liệu và quy trình để khai thác AI tác nhân trong tương lai gần. AI sẽ không dừng ở công cụ hỏi đáp; nó sẽ trở thành lớp vận hành mới của doanh nghiệp số.
Bạn đang quan tâm đến ứng dụng AI trong doanh nghiệp, giáo dục, truyền thông hoặc tự động hóa quy trình? Hãy theo dõi TinAI.vn để cập nhật các xu hướng AI mới nhất và liên hệ TS. Nguyễn Trung Hòa để được tư vấn định hướng triển khai AI phù hợp với tổ chức của bạn.
Tài liệu tham khảo
[1] Finder, I. (2026, May 18). Vera arrives: NVIDIA’s first CPU built for agents lands at top AI labs. NVIDIA Blog. https://blogs.nvidia.com/blog/vera-cpu-delivery/
[2] NVIDIA. (n.d.). NVIDIA Vera CPU for the age of AI. NVIDIA. https://www.nvidia.com/en-us/data-center/vera-cpu/
[3] Aubrey, K. (2026, January 5). Inside the NVIDIA Vera Rubin platform: Six new chips, one AI supercomputer. NVIDIA Technical Blog. https://developer.nvidia.com/blog/inside-the-nvidia-rubin-platform-six-new-chips-one-ai-supercomputer/
Please select a valid form
