TradingKey - OpenAI cho biết hôm thứ Tư rằng các mẫu thử nghiệm kỹ thuật của Jalapeno, chip tùy chỉnh đầu tiên được hợp tác phát triển với Broadcom (AVGO), đã được bàn giao và hiện đang trải qua quá trình thử nghiệm trong phòng thí nghiệm. CEO Hock Tan của Broadcom cho biết các kết quả ban đầu cho thấy trong các khối lượng công việc AI thông thường, chi phí vận hành của Jalapeno có thể giảm khoảng 50% so với các GPU AI phổ biến.
Jalapeno chủ yếu được thiết kế cho quá trình suy luận mô hình ngôn ngữ lớn, giai đoạn diễn ra sau khi huấn luyện mô hình khi các hệ thống phản hồi yêu cầu của người dùng và thực thi nhiệm vụ. Richard Ho, Trưởng bộ phận phần cứng tại OpenAI, cho biết chip này đạt được sự cân bằng giữa lưu lượng xử lý và tốc độ phản hồi, cho phép phục vụ nhiều người dùng hơn với chi phí thấp hơn đồng thời giảm thời gian chờ đợi cho các tác vụ có yêu cầu cao về thời gian thực. Chip này có công suất khoảng 700 watt, dự kiến sẽ giúp giảm chi phí điện năng cho trung tâm dữ liệu.
OpenAI cho biết Jalapeno đã thể hiện hiệu suất cao trên mỗi watt trong các đợt thử nghiệm nội bộ và vượt trội so với các sản phẩm hiện có của Nvidia trong một số bài kiểm tra. Tuy nhiên, những kết quả này vẫn chỉ là công bố thử nghiệm nội bộ ban đầu và chưa được xác minh thông qua việc triển khai thương mại quy mô lớn. Chip này không được thử nghiệm so sánh với thế hệ mới nhất Vera Rubin của Nvidia, cũng như không được sử dụng để huấn luyện mô hình AI, vì vậy nó sẽ không thay thế các sản phẩm của Nvidia trong mảng huấn luyện trong ngắn hạn.
Sau thông tin này, cổ phiếu của Broadcom đã tăng hơn 1% vào đầu phiên trước khi thu hẹp đà tăng xuống 0,66%, giao dịch ở mức 361,13 USD.

Biểu đồ giá cổ phiếu Broadcom, Nguồn: TradingView
Theo kế hoạch, phiên bản chính thức của Jalapeno sẽ được triển khai tới các trung tâm dữ liệu của Microsoft và các đối tác khác bắt đầu từ cuối năm nay. Broadcom trước đó dự kiến sẽ triển khai khoảng 1,3 gigawatt chip này vào năm tới, và ông Tan cho biết khi nhu cầu tiếp tục tăng, quy mô thực tế có thể vượt mục tiêu đó. Hai công ty cũng đã thiết lập một lộ trình phát triển chip qua nhiều thế hệ, với sản phẩm thế hệ tiếp theo dự kiến sẽ ra mắt vào năm 2028 và tiếp tục được cải tiến liên tục sau đó.
Hợp tác này là một bước đi quan trọng để OpenAI mở rộng nguồn cung cấp chip và giảm chi phí hạ tầng. Bên cạnh việc tiếp tục mua các sản phẩm của Nvidia với quy mô lớn, OpenAI cũng đã hợp tác với các nhà sản xuất chip như AMD và Cerebras, đồng thời có kế hoạch tăng cường kiểm soát trên toàn bộ các hệ thống chip, bộ nhớ, mạng và trung tâm dữ liệu. Công ty đã huy động khoảng 122 tỷ USD vào đầu năm nay để đầu tư vào chip, trung tâm dữ liệu và nhân tài. Tuy nhiên, việc OpenAI sẽ thanh toán cho các đơn đặt hàng chip quy mô lớn như thế nào vẫn phụ thuộc vào các phương án huy động vốn tiếp theo.