~/ARTIFICIAL I/openai-cuts-gpt-5-6-prices-via-autonomous-model-optimization

OpenAI giảm giá GPT-5.6 nhờ tối ưu hóa mô hình tự động

OpenAI đã công bố đợt giảm giá sâu cho các mô hình GPT-5.6 Terra và Luna, với mức giảm lần lượt là 20% và 80%. Việc giảm chi phí này đạt được nhờ sử dụng chính mô hình GPT-5.6 Sol của họ để tự động tối ưu hóa tính toán suy luận và hiệu suất sử dụng GPU. Mức giảm giá sâu 80% giúp GPT-5.6 Luna trở nên cực kỳ cạnh tranh, vượt qua các đối thủ như Claude Haiku 4.5 của Anthropic và Gemini 3.1 Flash-Lite của Google ở một số chỉ số giá quan trọng. Điều này chứng minh xu hướng ngày càng tăng của việc sử dụng các mô hình AI để tự tối ưu hóa mã nguồn và hạ tầng vận hành của chính chúng. GPT-5.6 Sol đã tối ưu hóa quá trình lan truyền xuôi (forward pass) bằng cách viết lại các nhân GPU (GPU kernels) vận hành thực tế bằng ngôn ngữ Triton và Gluon, giúp giảm 20% chi phí vận hành đầu cuối. Mức giá mới của Luna hiện là 0,20 USD cho mỗi triệu token đầu vào và 1,20 USD cho mỗi triệu token đầu ra.

## KIẾN THỨC NỀN

Trong học sâu, quá trình lan truyền xuôi (forward pass) là giai đoạn tính toán mà dữ liệu đầu vào đi qua các lớp của mạng thần kinh để tạo ra dự đoán hoặc token đầu ra. Tối ưu hóa suy luận (inference optimization) tập trung vào việc cải thiện tốc độ và hiệu quả sử dụng tài nguyên khi chạy các mô hình này, thường bằng cách giảm thiểu thời gian GPU nhàn rỗi do nghẽn truyền tải bộ nhớ và đồng bộ hóa.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#Artificial Intelligence#LLMs#OpenAI#Model Optimization#GPU Computing

$ subscribe --daily

OpenAI giảm giá GPT-5.6 nhờ tối ưu hóa mô hình tự động | Daily News