~/NVIDIA/dlss-5-mixed-precision-mod-shows-only-1-2-performance-gain-on

Thử nghiệm Mod DLSS 5 độ chính xác hỗn hợp chỉ tăng 1-2% hiệu năng trên GPU RTX 50

Các nhà phát triển Mod khi thử nghiệm tối ưu hóa độ chính xác hỗn hợp FP8 và NVFP4 trên mô hình DLSS 5 bị rò rỉ cho GPU RTX 50-series nhận thấy thời gian thực thi dựng hình thần kinh (neural rendering) chỉ giảm khoảng 1% đến 2%. Được triển khai trong phiên bản 0.7.1 và 0.7.2 của dự án OptiScaler, bản chỉnh sửa này cố gắng tận dụng Tensor Core trên kiến trúc Blackwell để chuyển một phần tính toán từ FP8 sang định dạng 4-bit NVFP4. Mặc dù kiến trúc Blackwell của NVIDIA hỗ trợ chuẩn NVFP4 nguyên bản ở cấp độ phần cứng, việc lượng hóa đơn thuần các mô hình DLSS 5 hiện có không mang lại mức tăng hiệu năng lớn như kỳ vọng. Điều này cho thấy để đạt được mức tăng tốc đáng kể trong dựng hình thần kinh thời gian thực, hệ thống đòi hỏi những thay đổi sâu hơn về cấu trúc mô hình, lượng hóa và tối ưu hóa ở cấp độ trình điều khiển. Trong bài kiểm tra kéo dài 120 giây trên tựa game Baldur's Gate 3, tốc độ khung hình chỉ tăng nhẹ từ 54,57 FPS (dùng FP8) lên 55,16 FPS (dùng hỗn hợp NVFP4), tương đương mức tăng 1,08%. Bên cạnh đó, những dạng mô hình chưa hỗ trợ NVFP4 sẽ tự động quay về sử dụng FP8, khiến giải pháp độ chính xác hỗn hợp chưa thể áp dụng trên toàn bộ quá trình tính toán.

## KIẾN THỨC NỀN

Dựng hình thần kinh (neural rendering) tích hợp các mô hình học sâu trực tiếp vào quy trình dựng hình đồ họa để cải thiện chất lượng hình ảnh và hiệu năng. Kiến trúc GPU Blackwell của NVIDIA ra mắt Tensor Core thế hệ thứ 5 hỗ trợ nguyên bản NVFP4, một định dạng độ chính xác số thực dấu phẩy động 4-bit được thiết kế để giảm băng thông bộ nhớ và chi phí suy luận so với FP8.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#NVIDIA#DLSS 5#Graphics Hardware#AI Inference#Quantization

$ subscribe --daily

Thử nghiệm Mod DLSS 5 độ chính xác hỗn hợp chỉ tăng 1-2% hiệu năng trên GPU RTX 50 | Daily News