Nvidia đã ra mắt nền tảng Blackwell Ultra của mình, nhằm mục tiêu tăng hiệu suất lên 50 lần và giảm chi phí 35 lần cho các khối lượng công việc AI tác nhân. Giai đoạn mới trong phần cứng AI này tập trung vào suy luận tác nhân, nơi các hệ thống AI tự động lý luận, lập kế hoạch và thực hiện các nhiệm vụ, đòi hỏi cơ sở hạ tầng tính toán tiên tiến. Khác với các mô hình suy luận truyền thống, AI tác nhân yêu cầu bộ nhớ ngữ cảnh liên tục và sự cân bằng giữa sức mạnh xử lý, băng thông bộ nhớ và truy cập dữ liệu độ trễ thấp. Sự hợp tác của Nvidia với VAST Data làm nổi bật chiến lược của họ nhằm hỗ trợ các triển khai AI tác nhân kéo dài với bộ nhớ ngữ cảnh tinh vi. Khi các nhà cung cấp đám mây như DigitalOcean nâng cấp cơ sở hạ tầng cho suy luận tác nhân, nhu cầu về các giải pháp tính toán chuyên biệt, tích hợp chặt chẽ ngày càng tăng. Sự chuyển dịch này đặt ra thách thức cho các mạng GPU phi tập trung, vốn gặp khó khăn với các yêu cầu độ trễ thấp của các khối lượng công việc tác nhân, đánh dấu một bước tiến quan trọng trong chiến lược triển khai AI.