Cựu nhà nghiên cứu OpenAI Barret Zoph trở lại Google để dẫn dắt nghiên cứu Gemini
Barret Zoph, một nhà nghiên cứu AI nổi tiếng chuyên về học tăng cường và hậu đào tạo (post-training), đã trở lại Google với tư cách là Phó Chủ tịch Nghiên cứu để hỗ trợ phát triển mô hình Gemini. Quyết định này được đưa ra sau khi ông rời Thinking Machines Lab và OpenAI gần đây. Sự trở lại của Zoph giúp củng cố năng lực của đội ngũ Gemini trong lĩnh vực hậu đào tạo và học tăng cường, vốn là những yếu tố then chốt để căn chỉnh và tối ưu hóa các mô hình ngôn ngữ lớn. Điều này cũng làm nổi bật cuộc cạnh tranh gay gắt giành nhân tài AI hàng đầu giữa các gã khổng lồ công nghệ như Google và OpenAI. Trước đây, Zoph từng quản lý đội ngũ hậu đào tạo và triển khai sản phẩm cho ChatGPT tại OpenAI trước khi đồng sáng lập Thinking Machines Lab cùng Mira Murati. Ông trở lại Google cùng với các nhà nghiên cứu chủ chốt khác nhằm áp dụng chuyên môn của mình vào các mô hình Gemini hàng đầu của Google.
## KIẾN THỨC NỀN
Hậu đào tạo (post-training) trong các mô hình ngôn ngữ lớn (LLM) bao gồm các kỹ thuật như tinh chỉnh (fine-tuning) và Học tăng cường từ phản hồi của con người (RLHF) để chuyển đổi các mô hình thô được đào tạo trước thành các trợ lý an toàn và biết tuân thủ hướng dẫn. Thinking Machines Lab là một startup AI được thành lập bởi cựu CTO OpenAI Mira Murati, tập trung vào các mô hình trọng số mở như Inkling.