TradingKey - Nvidia (NVDA) đã thông báo vào thứ Hai rằng NVIDIA Groq 3 LPX, được xây dựng trên công nghệ của Groq, đã bước vào giai đoạn sản xuất quy mô lớn, với các hệ thống tủ rack liên quan dự kiến sẽ đi vào hoạt động trong năm nay. Đóng vai trò là một thành phần quan trọng của nền tảng Vera Rubin, Groq 3 LPX chủ yếu hướng tới thị trường suy luận AI đang tăng trưởng nhanh chóng, tiếp tục hoàn thiện bố cục tính toán của Nvidia từ huấn luyện mô hình AI đến triển khai trong thực tế.
Theo thông tin do Nvidia công bố, mỗi tủ rack Groq 3 LPX chứa 256 LPU Groq 3. Nvidia cho biết trong một số tác vụ suy luận mô hình AI lớn nhất định, việc kết hợp Groq 3 LPX với Vera Rubin có thể tăng năng suất suy luận trên mỗi megawatt lên tới khoảng 35 lần, đồng thời nâng cao khối lượng công việc mà các trung tâm dữ liệu AI có thể xử lý trong cùng điều kiện năng lượng.
Vào cuối năm 2025, Nvidia đã ký một thỏa thuận cấp phép công nghệ không độc quyền với Groq và chiêu mộ nhà sáng lập Groq Jonathan Ross cùng một số thành viên nòng cốt trong đội ngũ. Bản thân Groq vẫn hoạt động độc lập và tiếp tục phát triển mảng kinh doanh GroqCloud. Vào tháng 8 năm nay, Groq đã chính thức trở thành Đối tác đám mây của Nvidia.
Trong khi đó, bản thân Groq đang đẩy nhanh việc áp dụng nền tảng mới của Nvidia. Công ty đã thông báo vào ngày 24 tháng 8 rằng họ sẽ là một trong những nhà cung cấp dịch vụ đám mây đầu tiên đưa NVIDIA Groq 3 LPX và Vera Rubin NVL72 ra thị trường. Cùng với xác nhận của Nvidia rằng Groq 3 LPX đã bước vào giai đoạn sản xuất quy mô lớn, điều này cho thấy sự hợp tác giữa hai bên đã dần chuyển từ cấp phép công nghệ sang triển khai sản phẩm và thương mại hóa.
Đối với Nvidia, ý nghĩa của việc Groq 3 LPX đi vào hoạt động trong năm nay nằm ở việc tăng cường hơn nữa khả năng cạnh tranh trên thị trường suy luận AI. Trong quá khứ, nhu cầu tính toán AI chủ yếu được thúc đẩy bởi việc huấn luyện mô hình lớn; tuy nhiên, khi cơ sở người dùng ChatGPT, Claude và các đại lý AI khác mở rộng, nhu cầu suy luận được tạo ra từ các mô hình vận hành hàng ngày đang tăng trưởng nhanh chóng. Do đó, Nvidia đang mở rộng Vera Rubin từ một nền tảng GPU thuần túy thành một hạ tầng AI toàn diện bao gồm GPU, CPU, LPU Groq, mạng và lưu trữ.
Khi Groq 3 LPX bước vào giai đoạn sản xuất quy mô lớn và dự kiến ra mắt trong năm nay, quan hệ hợp tác giữa Nvidia và Groq chính thức bước vào giai đoạn thương mại hóa. Nếu trọng tâm tăng trưởng tính toán trong giai đoạn tiếp theo của ngành AI chuyển dịch mạnh mẽ hơn từ "huấn luyện mô hình" sang "vận hành mô hình", công nghệ suy luận độ trễ thấp của Groq sẽ là sự bổ sung quan trọng giúp Nvidia mở rộng phạm vi bao phủ thị trường chip AI.