Trung Quốc cảnh báo rủi ro từ công nghệ nhân bản giọng nói AI
Bộ Quốc an Trung Quốc đã phát đi cảnh báo chỉ ra ba rủi ro lớn của công nghệ nhân bản giọng nói bằng AI, bao gồm lừa đảo người thân, giả mạo giọng nói của người nổi tiếng và phát tán thông tin sai lệch bằng cách giả danh công chức. Cơ quan này nhấn mạnh rằng các nền tảng thương mại hiện nay có thể sao chép giọng nói chỉ với 3 đến 5 giây âm thanh mẫu, khiến người dân rất khó phát hiện. Lời cảnh báo này nhấn mạnh sự giám sát ngày càng chặt chẽ của các cơ quan quản lý Trung Quốc đối với công nghệ tổng hợp chuyên sâu (deep synthesis) khi các hành vi lừa đảo và giả mạo danh tính bằng AI ngày càng tinh vi. Điều này báo hiệu việc thực thi nghiêm ngặt hơn các luật hiện hành, như Bộ luật Dân sự và các quy định về AI tạo sinh, nhằm bảo vệ quyền cá nhân và duy trì ổn định xã hội. Bộ Quốc an lưu ý rằng tỷ lệ người bình thường nhận diện chính xác giọng nói tổng hợp chất lượng cao là dưới 50% nếu không có gợi ý trước. Theo các quy định của Trung Quốc, việc tự ý nhân bản giọng nói của người khác khi chưa được phép là hành vi vi phạm dân sự, và các nền tảng cung cấp dịch vụ tổng hợp chuyên sâu phải thực hiện đăng ký tên thật và gắn nhãn truy xuất nguồn gốc.
## KIẾN THỨC NỀN
Công nghệ tổng hợp chuyên sâu (deep synthesis) đề cập đến việc sử dụng các thuật toán học sâu và thực tế ảo để tạo ra hoặc sửa đổi văn bản, hình ảnh, âm thanh và video. Nhân bản giọng nói, một nhánh của công nghệ này, đã phát triển nhanh chóng với các công cụ như OpenVoice, có khả năng tái tạo các đặc trưng giọng nói của người nói chỉ bằng vài giây âm thanh tham chiếu.