~/AI/openai-launches-gpt-6-1-sol-with-reduced-api-caching-costs-and

OpenAI Ra Mắt GPT 6.1 Sol Cùng Chi Phí Caching Giảm 50% Và Điều Chỉnh Các Gói Dịch Vụ

OpenAI đã giới thiệu mô hình GPT 6.1 Sol trên Codex và ChatGPT Work, mang lại hiệu năng gần tương đương với mô hình cao cấp Astra nhưng với chi phí vận hành thấp hơn. Cùng với việc ra mắt mô hình mới, OpenAI cũng cập nhật giới hạn các gói dịch vụ và giảm 50% chi phí cached input xuống còn 0,10 USD cho mỗi triệu token. Việc cắt giảm mạnh giá prompt caching giúp giảm đáng kể chi phí vận hành các luồng công việc lặp đi lặp lại và ứng dụng ngữ cảnh dài trên các công cụ như Codex. Tuy nhiên, việc điều chỉnh các gói dịch vụ và giảm giá đồng thời cho thấy kinh tế token đang trở thành chiến trường chính giữa các nhà cung cấp AI lớn. Giá cho cached input giảm xuống còn 0,10 USD trên mỗi triệu token, giảm 50% so với giá cache của GPT-6 Sol và giảm 95% so với giá đầu vào tiêu chuẩn. Về gói dịch vụ, OpenAI đã ra mắt gói Pro 500 mới trị giá 500 USD/tháng, đồng thời giảm mức sử dụng đi kèm cho người dùng gói Pro 200 USD/tháng trong Codex và Work từ 20 lần xuống còn 10 lần.

## KIẾN THỨC NỀN

Prompt caching trong các mô hình ngôn ngữ lớn (LLM) là kỹ thuật tối ưu hóa giúp lưu trữ các token đầu vào đã xử lý trước đó, nhờ đó các yêu cầu API tiếp theo có cùng đoạn đầu không cần phải tính toán lại. Bằng cách tái sử dụng token đã lưu bộ nhớ tạm, các nhà cung cấp AI giúp lập trình viên chạy các ứng dụng ngữ cảnh dài với độ trễ thấp hơn và chi phí đầu vào giảm đáng kể.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#AI#OpenAI#LLM#Machine Learning#Developer Tools

$ subscribe --daily

OpenAI Ra Mắt GPT 6.1 Sol Cùng Chi Phí Caching Giảm 50% Và Điều Chỉnh Các Gói Dịch Vụ | Daily News