01Người dùng LLM phản ánh sự suy giảm cá tính agent do nén cửa sổ ngữ cảnhREDDIT · /u/FoxDeFleurs · reddit.com · 15:26 04 thg 95h
02IFM Phát Hành Mô Hình GGUF K2-Horizon-MoVA-36B-A4B Với Cửa Sổ Ngữ Cảnh 512KREDDIT · /u/jacek2023 · reddit.com · 13:47 03 thg 91d
03KV Cache Đang Trở Thành Điểm Nghẽn VRAM Lớn Hơn Cả Số Lượng Tham SốREDDIT · /u/jonejy · reddit.com · 06:04 03 thg 91d
04Cộng Đồng Thảo Luận Về Sự Thay Đổi Trong Chiến Lược Phát Hành Mô Hình Qwen Của AlibabaREDDIT · /u/chocofoxy · reddit.com · 14:14 02 thg 92d
05Cộng đồng thảo luận về triển vọng của Qwen 4, suy luận mở rộng và kiến trúc EngramREDDIT · /u/LegacyRemaster · reddit.com · 07:53 02 thg 92d
06Cộng đồng LocalLLaMA dự đoán về kích thước tham số của các mô hình AI sắp ra mắtREDDIT · /u/Porespellar · reddit.com · 18:54 01 thg 93d
07Người dùng Reddit phát hiện AtomicChat có thể dán nhãn sai bản lượng hóa mô hình GGUFREDDIT · /u/po_stulate · reddit.com · 15:27 01 thg 93d
08llama.cpp Phát Hành Bản b10730 Tối Ưu Tốc Độ Xử Lý Prompt Cho QwenGITHUB · github-actions[bot] · github.com · 05:08 01 thg 93d
09Tencent mở mã nguồn phiên bản nén Hy4 MoE 770B, giảm dung lượng xuống 214GBRSS · IT HOME · ithome.com · 04:31 01 thg 93d
10iFLYTEK mở nguồn hai mô hình LLM Spark X2.5 cho thiết bị đầu cuối với ngữ cảnh 1 triệu tokenRSS · IT HOME · ithome.com · 03:20 01 thg 93d
11Thắc mắc về việc chạy cục bộ Qwen 3.8 Flash bằng llama.cppREDDIT · /u/No_Algae1753 · reddit.com · 18:36 31 thg 84d
12Phát hành các mô hình GGUF không kiểm duyệt gồm LongCat-Flash-Lite-Sparse ngữ cảnh 1MREDDIT · /u/LLMFan46 · reddit.com · 14:16 30 thg 85d
13Tencent nén mô hình Hy4-preview từ 1,5TB xuống còn 200GB GGUF nhưng vẫn giữ 98% hiệu năngREDDIT · /u/RedditUsr2 · reddit.com · 14:31 29 thg 86d
14Đánh giá việc chạy Qwen 3.8 Flash Next trên hệ thống 4x RTX 3090REDDIT · /u/Acceptable_Adagio_91 · reddit.com · 23:38 28 thg 86d
15Tencent ra mắt mô hình mã nguồn mở Hunyuan Hy4 preview với 770 tỷ tham sốRSS · IT HOME · ithome.com · 06:15 28 thg 87d
16Ant Group ra mắt mô hình tài chính Ling-3.0-flash-Fin, sẽ mở nguồn mở tuần tớiRSS · IT HOME · ithome.com · 02:41 28 thg 87d
17Bản lượng hóa GGUF của GLM-5.3 Flash đã phát hành qua Unsloth để chạy cục bộREDDIT · /u/ElementNumber6 · reddit.com · 14:55 27 thg 88d
18Zhipu AI Sắp Phát Hành Trọng Số Mô Hình GLM-5.3 Mã Nguồn MởREDDIT · /u/serige · reddit.com · 04:12 27 thg 88d
19Phát hành mã nguồn mở GLM-5.3-Flash với kiến trúc chú ý lai Sparse-LinearREDDIT · /u/No_Afternoon_4260 · reddit.com · 15:17 26 thg 89d
20Người Dùng Cho Rằng Mô Hình 27B Vượt Trội Hơn Các Mô Hàng Đầu Trong Tác Vụ Tự ChủREDDIT · /u/Gohab2001 · reddit.com · 08:45 26 thg 89d