41Liệu GLM 5.2 và Kimi 2.7 còn đáng dùng cho tác vụ lập trình?REDDIT · /u/Hannibalj2ca · reddit.com · 08:07 07 thg 828d
42Tranh luận về tính khả thi khi tái tạo mức giá API của DeepSeek V4 Flash trên GPU thuêREDDIT · /u/t4a8945 · reddit.com · 08:43 07 thg 828d
43Mô hình Mixture of Experts 7.9B mới phục vụ sử dụng công cụ và tự động hóaREDDIT · /u/AcanthisittaOk1699 · reddit.com · 18:53 06 thg 828d
44Bài đăng Reddit cảnh báo việc quá phụ thuộc vào ChatGPT thay vì tư duy phản biệnREDDIT · /u/IngwiePhoenix · reddit.com · 09:45 06 thg 829d
45Alibaba sẽ phát hành mô hình mã nguồn mở Qwen3.8-Max vào thứ Tư tớiREDDIT · /u/HugeConsideration211 · reddit.com · 07:23 06 thg 829d
46Maple-Preview: Mô hình LLM suy luận mã nguồn mở 20B-A1B sử dụng trọng số tam phânREDDIT · /u/cafedude · reddit.com · 00:19 05 thg 830d
47Liquid AI Ra Mắt Mô Hình LFM2.5-2.6B Tối Ưu Hóa Cho Thiết Bị Di Động Và EdgeREDDIT · /u/BTA_Labs · reddit.com · 21:15 04 thg 830d
48Chạy mô hình ngôn ngữ Gemma cục bộ chỉ với 500MB bộ nhớREDDIT · /u/jacek2023 · reddit.com · 16:01 04 thg 830d
49Bài đăng Reddit tuyên bố các LLM giả định đã vượt qua benchmark "Aquarium Break"REDDIT · /u/kms_dev · reddit.com · 00:54 04 thg 831d
50Thêm nhiều kích thước mô hình mới sắp ra mắt cho dòng Qwen của AlibabaREDDIT · /u/appakaradi · reddit.com · 01:05 04 thg 831d
51Sự phát triển nhanh chóng của Hermes Agent từ Nous Research thu hút sự chú ýREDDIT · /u/No_Afternoon_4260 · reddit.com · 23:02 03 thg 831d
52LMSYS Nhá Hàng Phiên Bản GLM Tiếp Theo và Hiệu Suất Lập Trình Của GLM-5.2 MaxTWITTER · arena · x.com · 21:03 03 thg 831d
53G9v3-39A5B: Mô hình MoE hướng tác nhân mới với tỷ lệ ảo tưởng thấpREDDIT · /u/axseem · reddit.com · 21:26 03 thg 831d
54Công Bố Dòng Mô Hình Qwen 3 Với Qwen3.8-Max Và Trọng Số MởREDDIT · /u/davidthesong · reddit.com · 18:25 03 thg 831d
55Người trong cuộc tiết lộ chiến lược khác biệt của các phòng lab AI Trung QuốcREDDIT · /u/AcanthisittaOk1699 · reddit.com · 16:42 03 thg 831d
56Rò rỉ mô hình GLM 5.3 sắp ra mắt của Zhipu AI qua commit trên GitHubREDDIT · /u/Few_Painter_5588 · reddit.com · 10:27 03 thg 832d
57Các mô hình AI open-weight tiệm cận hiệu năng đỉnh cao với chi phí thấp hơnREDDIT · /u/Specialized-Trap404 · reddit.com · 04:01 03 thg 832d
58Qwen3.8-Max của Alibaba thiết lập chuẩn mực hiệu năng - chi phí mới trong Frontend Code ArenaTWITTER · arena · x.com · 03:12 03 thg 832d
59Chế độ suy luận 'Low' của DeepSeek-V4-Flash-0731 bất ngờ dùng nhiều token hơn 'High'REDDIT · /u/coder543 · reddit.com · 19:16 02 thg 832d
60Lỗi bộ nhớ đệm prompt trên DeepSeek-V4-Flash-0731 và cách khắc phục bằng 'latest_reminder'REDDIT · /u/CharlesStross · reddit.com · 07:24 02 thg 833d