TradingKey - Meta Platforms (META) lên kế hoạch bắt đầu triển khai các chip AI tự phát triển thế hệ tiếp theo tới các trung tâm dữ liệu trong nửa đầu năm 2027, động thái mà công ty cho biết sẽ giúp tiết kiệm chi phí và năng lượng khi vận hành các mô hình AI, đồng thời giảm sự phụ thuộc vào các bộ xử lý của Nvidia.
Meta được cho là đã công bố kế hoạch chip AI tự phát triển từ năm 2023 và hiện đang thử nghiệm nội bộ sản phẩm thế hệ thứ ba trong dòng chip này là MTIA 450, có tên mã nội bộ là Arke. Công việc thiết kế cho chip thế hệ tiếp theo MTIA 500 (tên mã Astrid) dự kiến sẽ hoàn thành trong khoảng một tháng tới, với kế hoạch triển khai tới các trung tâm dữ liệu dự kiến vào cuối năm 2027. Meta có kế hoạch triển khai chip này rộng rãi hơn so với các thế hệ trước.
Ông Yee Jiun Song, Phó chủ tịch phụ trách kỹ thuật của Meta, cho biết trong một cuộc phỏng vấn rằng mỗi thế hệ chip chấp nhận rủi ro kỹ thuật cao hơn một chút để đổi lấy hiệu suất tốt hơn, bao gồm mức tăng hiệu suất trên mỗi đơn vị năng lượng và trên mỗi đơn vị đầu tư. Theo ông Song, các chip này do Meta và Broadcom hợp tác thiết kế và do TSMC sản xuất. TSMC đã giao lô 12 chip mới đầu tiên vào ngày 1 tháng 9, với hiệu suất thực tế chỉ sai lệch trong khoảng 2% đến 3% so với kết quả mô phỏng trước đó. Đội ngũ kỹ thuật đã sử dụng các chip này để chạy các mô hình của riêng Meta ngay trong ngày hôm đó. Thử nghiệm ban đầu cho thấy không có lỗi thiết kế, nhưng vẫn cần vài tháng để tinh chỉnh và tối ưu hóa, trong khi tỷ lệ thành phẩm tại nhà máy gia công đang tăng lên.
Dựa trên mức tiêu thụ điện năng — chỉ số cốt lõi trong ngành trung tâm dữ liệu — Meta cam kết triển khai hơn 1 gigawatt chip tự phát triển trong vòng 12 tháng, sau đó "dự kiến sẽ tăng tốc hơn nữa". Ông Song cũng lưu ý rằng dự báo này dựa trên giả định thị trường AI và nhu cầu liên quan không sụt giảm mạnh.
Phòng thí nghiệm Siêu trí tuệ (Superintelligence Lab) của Meta đang tham gia vào quá trình tinh chỉnh chip, cung cấp cho đội ngũ phần cứng những hiểu biết chuyên sâu về các mô hình AI trong tương lai và các yêu cầu ở giai đoạn suy luận của chúng. Ông Song cho biết vì Meta tự thực hiện một lượng lớn công việc kỹ thuật, các chip tự phát triển của hãng có thể chạy các mô hình AI riêng hiệu quả hơn "bất kỳ sản phẩm nào Nvidia đang cung cấp hiện nay".
Về định hướng chiến lược, Meta trước đây từng lên kế hoạch phát triển một chip có tên mã Olympus có khả năng xử lý cả nhiệm vụ huấn luyện và suy luận, nhưng dự án đó đã bị hủy bỏ để tập trung vào các chip suy luận. Ông Song tuyên bố rằng khi quy mô triển khai đạt đến mức nhiều gigawatt, chi phí trở nên cực kỳ quan trọng; nếu một chip xử lý cả huấn luyện và suy luận đắt hơn khoảng 30%, điều đó là "hoàn toàn không thể chấp nhận được" khi triển khai trên quy mô lớn. Meta vẫn sẽ tiếp tục mua số lượng lớn GPU từ Nvidia và AMD.