TradingKey - OpenAI đã ra mắt GPT-6 Sol và GPT-6 Luna với mục tiêu rõ ràng: giúp dòng GPT-6 có mức giá dễ tiếp cận hơn cho nhiều người dùng. Trong khi GPT-6 Astra vẫn là mô hình mạnh mẽ nhất, Sol và Luna sẽ đảm nhận các tác vụ văn phòng, lập trình và vận hành máy tính hàng ngày với chi phí thấp hơn. OpenAI cho biết các mô hình mới tập trung vào việc tối ưu hóa tốc độ và chi phí, giảm giá API xuống còn một nửa so với giá khuyến mãi của GPT-5.6.
Đáng chú ý, khoảng một giờ trước khi OpenAI ra mắt GPT-6 Sol, Anthropic đã phát hành Claude Opus 5.5.
GPT-6 Astra có thể được coi là "phiên bản chủ lực toàn diện", GPT-6 Sol là "phiên bản làm việc hiệu năng cao", trong khi GPT-6 Luna phù hợp hơn với các tác vụ hàng ngày thường xuyên và có khối lượng lớn.
Sol chủ yếu hướng tới các tác vụ phức tạp. Phiên bản này có thể xử lý quy trình công việc doanh nghiệp, lập trình kéo dài và các thao tác trên máy tính, đồng thời cung cấp cho người dùng hạn mức sử dụng cao hơn. Luna được định vị là một lựa chọn nhẹ hơn, phù hợp với các cá nhân tối ưu ngân sách và các nhóm có khối lượng lượt gọi lớn.
Kết quả thử nghiệm do OpenAI công bố cho thấy Sol đã đạt điểm số cao nhất là 56,4% trên AutomationBench, với chi phí thấp hơn 60% so với Claude Opus 5 khi thực hiện các tác vụ tương tự. Đối với cùng loại công việc, Luna đã cải thiện 5,4 điểm phần trăm so với thế hệ trước, trong khi chi phí cho mỗi tác vụ giảm 58%.
Đối với các nhà phát triển, những thay đổi về giá là đặc biệt quan trọng. Các trợ lý lập trình ngày nay không chỉ viết vài dòng mã; chúng còn kiểm tra toàn bộ dự án, chỉnh sửa nhiều tệp và thậm chí làm việc liên tục trong nhiều giờ. Mô hình càng mạnh và nhiệm vụ càng phức tạp, chi phí càng dễ tích tụ.
OpenAI cho biết GPT-6 Sol đạt 68,8% trên điểm chuẩn DeepSWE, chỉ kém 1,1 điểm phần trăm so với mức 69,9% của Claude Fable 5, nhưng chi phí cho mỗi nhiệm vụ thấp hơn khoảng 80%. GPT-6 Luna đạt 66,6%, thể hiện hiệu suất gần tương đương với các thiết lập trung bình của một số mô hình đối thủ, nhưng chi phí thấp hơn hơn 93%.
Một trong những vấn đề đáng lo ngại nhất đối với AI là các câu trả lời nghe có vẻ hợp lý nhưng lại sai thực tế. OpenAI cho biết trong các thử nghiệm hội thoại thực tế nội bộ, GPT-6 Sol mắc số lỗi chỉ bằng khoảng một nửa so với thế hệ trước, với độ tin cậy tiệm cận mức của GPT-6 Astra.
GPT-6 Luna cũng đã có những tiến bộ rõ rệt. Khi xử lý khối lượng công việc cao hơn, mô hình này có thể đạt hiệu suất tương đương với GPT-5.6 Sol, nhưng chi phí chỉ bằng khoảng 1% so với chi phí của GPT-5.6 Sol.