Chạy cục bộ mô hình GLM 5.3 để dựng cảnh 3D trong Blender qua BlenderMCP
Một nhà phát triển đã chạy thành công các phiên bản lượng tử hóa của mô hình GLM 5.3 và GLM 5.3 Flash cục bộ bằng hệ thống đa GPU để tạo ra một cảnh căn hộ áp mái 3D chi tiết trong Blender thông qua BlenderMCP. Thử nghiệm so sánh hiệu suất của cả hai mô hình cho thấy phiên bản Flash bắt đầu tạo vật thể nhanh hơn nhiều và tuân thủ chính xác hơn các kích thước phòng được yêu cầu. Thử nghiệm này làm nổi bật khả năng ngày càng tăng của các mô hình ngôn ngữ lớn (LLM) mã nguồn mở chạy cục bộ trong vai trò trợ lý tự trị cho các quy trình dựng hình 3D phức tạp. Nó cho thấy cách các tích hợp Giao thức Bối cảnh Mô hình (MCP) như BlenderMCP có thể kết nối khả năng suy luận của AI với các phần mềm sáng tạo chuyên nghiệp. Việc chạy cục bộ các mô hình lượng tử hóa Q4 đòi hỏi cấu hình phần cứng cực khủng, sử dụng 4 GPU RTX PRO 6000 WS cho mô hình Flash (nặng khoảng 190-200GB) và 6 GPU cho mô hình cơ bản (nặng khoảng 450-470GB). Trong khi mô hình GLM 5.3 cơ bản mất gần 22 phút suy nghĩ trước khi đặt vật thể đầu tiên, GLM 5.3 Flash đã bắt đầu hoạt động chỉ sau 10 giây và hoàn thành nhiệm vụ với ít token đầu ra hơn.
## KIẾN THỨC NỀN
GLM 5.3 là một mô hình ngôn ngữ lớn mã nguồn mở tiên tiến, đạt hiệu suất cao trong các tác vụ tự trị nhờ quá trình hậu đào tạo (post-training) chuyên sâu trên nền mô hình cơ sở GLM-5.2. BlenderMCP là một bản triển khai của Giao thức Bối cảnh Mô hình (MCP) cho phép các LLM tương tác trực tiếp với môi trường 3D của Blender để thực thi các lệnh dựng hình.