$NVDAB *NVIDIA's Current Progress - 2026* NVIDIA hiện đang ở giai đoạn “AI tác nhân (Agentic AI)” và hạ tầng AI quy mô nhà máy. Công ty không còn chỉ bán GPU nữa; họ đã phát triển thành một công ty hệ thống AI toàn diện. Dưới đây là tóm tắt: *1. Phần cứng mới: Thời đại Vera Rubin & Agentic AI* - *Kiến trúc Vera Rubin*: Một kiến trúc mới kế nhiệm Blackwell. Nó đã đi vào sản xuất và đang chạy sớm hơn hơn sáu tháng so với kế hoạch. - *Lợi thế chính*: Chi phí suy luận (inference) trên mỗi token giảm tới 10 lần, và nhu cầu GPU để huấn luyện mô hình giảm 4 lần so với Blackwell. Nó hướng tới các “nhà máy AI” vận hành liên tục không ngừng. - *Vera CPU*: CPU mới của NVIDIA được thiết kế để cạnh tranh với Intel và AMD. Nó được tinh chỉnh đặc biệt cho các tác nhân AI hoạt động liên tục mà không có thời gian nghỉ. Perplexity cho biết Vera nhanh hơn 1,5 lần đối với các tác vụ viết mã AI (AI agent coding). NVIDIA đặt mục tiêu doanh số 20 tỷ USD từ việc bán Vera trong năm tài khóa này. - *LPU - Bộ xử lý suy luận (Inference Processing Unit)*: Một thành phần mới cho các rack AI, được thiết kế cho suy luận độ trễ thấp. *2. PC & Laptop: RTX Spark + N1X* - *RTX Spark*: “Superchip” mới dành cho laptop Windows. Nó tuyên bố hiệu năng AI đạt 1 Petaflop, hỗ trợ tới 128GB RAM hợp nhất (unified RAM) và có thể chạy các LLM 120B tham số cục bộ. Các đối tác gồm Microsoft, Lenovo, HP, Dell và Asus. - *N1X*: Chip laptop ARM với 20 lõi và GPU tương đương RTX 5070, với 6.144 CUDA cores. Nó tập trung vào việc giúp laptop chạy các mô hình AI với hơn 100 tỷ tham số. - *DLSS 4.5 Ray Reconstruction*: Dự kiến ra mắt vào tháng 8/2026. Nó sử dụng một mô hình transformer mới cho khả năng dò tia (ray tracing) và tăng tỉ lệ (upscaling) vượt trội. Tính năng này đã được hỗ trợ bởi 11 tựa game mới. - *G-SYNC Pulsar*: Màn hình mới cung cấp độ rõ chuyển động 1000Hz cho game thủ thi đấu. *3. AI & Phần mềm* - *Agentic AI*: Tầm nhìn là để AI không chỉ đơn thuần trả lời câu hỏi, mà thay vào đó tự thực hiện nhiệm vụ—chẳng hạn như viết mã, truy cập cơ sở dữ liệu và tạo báo cáo. Jensen tuyên bố rằng “kỷ nguyên bấm và gõ đã kết thúc”. - *OpenShell runtime*: Cho phép tạo các tác nhân AI cục bộ trên hệ thống RTX và DGX với tốc độ gấp đôi