~/AUTONOMOUS D/xpeng-upgrades-second-gen-vla-model-with-3x-faster-response-debuting-on

XPeng nâng cấp mô hình VLA thế hệ hai nhanh gấp 3 lần, ra mắt trên G9L

XPeng đã công bố bản nâng cấp lớn đầu tiên cho mô hình Vision-Language-Action (VLA) thế hệ thứ hai, phiên bản 630, sẽ được ra mắt toàn cầu trên dòng xe XPeng G9L. Bản nâng cấp này tăng số lượng tham số mô hình trên thiết bị lên 3,5 lần và tăng tốc độ phản hồi đầu-cuối (end-to-end) thêm 300%. Bản nâng cấp này cải thiện đáng kể khả năng ra quyết định và độ an toàn của hệ thống tự lái bằng cách triển khai các mô hình lớn hơn, mạnh mẽ hơn trực tiếp trên phần cứng biên của xe. Việc cải thiện 300% tốc độ phản hồi giúp giải quyết nút thắt cổ chai về độ trễ trong lái xe tự động end-to-end, cho phép thực hiện các thao tác thời gian thực mượt mà và an toàn hơn. XPeng tuyên bố rằng kích thước tham số của mô hình trên thiết bị được nâng cấp lớn gấp 15 lần so với các mô hình VLA phổ biến trong ngành. Tốc độ phản hồi tăng lên được kỳ vọng sẽ giúp các hoạt động giảm tốc và xử lý tình huống an toàn trở nên mượt mà hơn trong các kịch bản lái xe phức tạp.

## KIẾN THỨC NỀN

Mô hình Vision-Language-Action (VLA) là một mô hình nền tảng đa phương thức tích hợp khả năng nhận thức thị giác, hiểu ngôn ngữ tự nhiên và các hành động vật lý. Ban đầu được phổ biến trong lĩnh vực robot, các mô hình VLA đang ngày càng được áp dụng nhiều vào xe tự lái để chuyển đổi trực tiếp dữ liệu camera và mục tiêu lái xe thành các lệnh điều khiển phương tiện. Bằng cách xử lý các mô hình này trực tiếp trên thiết bị (tại biên), xe tự hành có thể đưa ra quyết định nhanh hơn và an toàn hơn mà không cần phụ thuộc vào kết nối đám mây.

## TÀI LIỆU THAM KHẢO

## TỪ KHÓA

#Autonomous Driving#VLA Models#Edge AI#XPeng

$ subscribe --daily

XPeng nâng cấp mô hình VLA thế hệ hai nhanh gấp 3 lần, ra mắt trên G9L | Daily News