~/CHATGPT/openai-launches-advanced-voice-mode-on-chatgpt-desktop-app

OpenAI ra mắt chế độ giọng nói nâng cao trên ứng dụng ChatGPT cho máy tính

OpenAI đã chính thức triển khai Chế độ giọng nói nâng cao (Advanced Voice Mode - AVM) trên ứng dụng ChatGPT dành cho máy tính. Bản cập nhật này cho phép người dùng thực hiện các cuộc trò chuyện bằng giọng nói trực tiếp, rảnh tay và theo thời gian thực ngay trên máy tính của họ. Việc đưa khả năng thoại nâng cao lên máy tính giúp người dùng có thể làm nhiều việc cùng lúc và tương tác với trợ lý AI mà không cần bàn phím, tiến gần hơn đến các trợ lý ảo trong phim viễn tưởng. Tính năng này nâng cao hiệu suất bằng cách cho phép điều khiển bằng giọng nói mượt mà, độ trễ thấp trong các quy trình làm việc hàng ngày trên máy tính. Tính năng này tận dụng công nghệ xử lý giọng nói sang giọng nói đa phương thức gốc (native multimodal speech-to-speech), giúp giảm độ trễ và giữ nguyên các sắc thái cảm xúc so với các quy trình chuyển văn bản thành giọng nói truyền thống. Người dùng có thể truy cập tính năng này trực tiếp trên các ứng dụng máy tính dành cho macOS và Windows.

## KIẾN THỨC NỀN

Chế độ giọng nói nâng cao của OpenAI được hỗ trợ bởi GPT-4o, một mô hình đa phương thức gốc có khả năng xử lý âm thanh, hình ảnh và văn bản theo thời gian thực. Khác với các hệ thống cũ chuyển giọng nói thành văn bản, xử lý rồi mới tổng hợp lại thành giọng nói, GPT-4o xử lý âm thanh một cách trực tiếp. Kiến trúc này giúp thời gian phản hồi nhanh hơn nhiều và luồng trò chuyện tự nhiên hơn, bao gồm cả khả năng nhận diện tông giọng và phản hồi bằng cảm xúc phù hợp.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#ChatGPT#Voice Assistant#OpenAI#Artificial Intelligence#Product Release

$ subscribe --daily