Qwen 3.6
TrialNền tảng
Dòng mô hình ngôn ngữ lớn mã trọng số mở của Alibaba dành cho AI cục bộ và tác vụ agent.
Vì sao ở đây
Xếp vào Trial: 10 bài bằng chứng từ 6 nguồn, chủ yếu là phát hành mô hình, 6 bài trong 30 ngày qua. Độ tin cậy 88%.
Bằng chứng (10)
- 5Hacker News·24/7/2026product_launchHetzner thử nghiệm suy luận LLM tương thích OpenAI
Hetzner đã đưa vào thử nghiệm một dịch vụ suy luận LLM chạy trên hạ tầng của chính hãng, cung cấp qua API tương thích OpenAI. Hiện dịch vụ mới chỉ có một mô hình là Qwen/Qwen3.6-35B-A3B-FP8, và Hetzner cho biết mục tiêu là đánh giá nhu cầu, khả năng mở rộng, các tính năng quan trọng và mức tải trước khi cân nhắc phát hành sản phẩm chính thức.
- 7Simon Willison·20/7/2026regulationTranh luận về sử dụng hợp lý và mô hình mở Qwen 3.8 Max
Bài viết nêu một đề xuất thay đổi chính sách bản quyền của Mỹ theo hướng xác nhận rõ việc dùng dữ liệu để huấn luyện mô hình là sử dụng hợp lý và hạn chế các điều khoản cấm distillation. Bài cũng đề cập việc Alibaba phát hành Qwen 3.8 Max dưới dạng open weights, cùng nhận định về một bài phát biểu gần đây của Tập Cận Bình kêu gọi thúc đẩy mã nguồn mở, hợp tác và chia sẻ.
- 8The New Stack·20/7/2026model_releaseKimi K3 và Qwen 3.8 tạo sức ép lên các nhà dẫn đầu mô hình biên
Bài viết cho biết Moonshot Labs đã ra mắt Kimi K3 và Alibaba đã ra mắt Qwen 3.8, cả hai được cho là tiệm cận hiệu năng của Anthropic Fable 5 và dự kiến sẽ sớm công bố trọng số mô hình. Tác giả lập luận rằng việc các mô hình mở thu hẹp khoảng cách với hệ thống độc quyền hàng đầu có thể gia tăng áp lực về giá và khác biệt hóa đối với các công ty như Anthropic.
- 6Hacker News·20/7/2026securityOpenCode bị chỉ trích vì các vấn đề bảo mật và hiệu năng
Một bài viết trên Hacker News cho rằng OpenCode, một tác nhân lập trình AI mã nguồn mở, có nhiều lỗi nghiêm trọng về trải nghiệm sử dụng lẫn bảo mật. Tác giả nêu các vấn đề như liên tục làm mất cache prompt, đánh giá lại ngữ cảnh không cần thiết và những thiết kế có thể khiến công cụ vừa chậm vừa tiềm ẩn rủi ro khi kết nối với shell.
- 4Hacker News·19/7/2026model_releaseQwen 3.8 Max Preview được đưa vào Token Plan
Qwen Cloud đang quảng bá mô hình Qwen3.8-Max-Preview thông qua Token Plan, đồng thời điều chỉnh giá và hạn mức cho người dùng cá nhân và nhóm. Thông báo này cũng nhấn mạnh khả năng hỗ trợ nhiều công cụ AI và tích hợp với Qwen Code cùng các ứng dụng dành cho nhà phát triển khác.
- 8Hacker News·14/7/2026breakthroughBonsai 27B đưa mô hình 27B lên điện thoại
PrismML công bố Bonsai 27B, một mô hình đa phương thức dựa trên Qwen3.6 27B có thể chạy ở dạng low-bit trên điện thoại và laptop. Bản phát hành gồm biến thể ternary và 1-bit, được cho là giữ được phần lớn chất lượng so với bản đầy đủ và được phát hành theo giấy phép Apache 2.0.
- 5Ars Technica AI·8/7/2026framework_updateGoogle mở rộng Android Bench với các LLM mới
Google đã cập nhật Android Bench, bộ tiêu chuẩn đánh giá khả năng của các mô hình ngôn ngữ lớn trong các tác vụ phát triển ứng dụng Android, bằng cách bổ sung tám mô hình mới và một khung đánh giá được cải tiến. Bản cập nhật cũng thêm các chỉ số về chi phí và hiệu quả, đồng thời mời các nhà phát triển tự chạy thử nghiệm và gửi phản hồi.
- 4Martin Fowler·8/7/2026researchTrải nghiệm chạy mô hình lập trình cục bộ
Birgitta Böckeler chia sẻ việc thử nghiệm các mô hình ngôn ngữ nhỏ chạy cục bộ trên máy lập trình cho tác vụ coding dạng agent, tập trung vào tốc độ, khả năng dùng công cụ, xử lý ngữ cảnh và chất lượng mã. Bà so sánh đánh giá thủ công với đánh giá tự động, rồi dùng mô hình hứa hẹn nhất trong công việc hằng ngày để kiểm tra tính khả thi thực tế.
- 6Hacker News·29/6/2026model_releaseQwen 3.6 27B được xem là mô hình phù hợp để phát triển cục bộ
Bài viết cho rằng Qwen 3.6 27B là mô hình chạy cục bộ thuyết phục nhất mà tác giả từng thử, cho thấy kết quả tốt hơn các lựa chọn local trước đây trong các bài kiểm tra viết có ràng buộc và lập trình. Bài cũng hướng dẫn cách chạy mô hình trên máy cá nhân bằng llama.cpp và bản GGUF đã lượng tử hóa từ Hugging Face để chat tương tác và làm việc theo kiểu agent.
- 7NVIDIA GenAI·13/5/2026framework_updateHermes Agent bổ sung quy trình AI cục bộ tự cải thiện trên phần cứng NVIDIA
Hermes Agent của Nous Research là một framework tác nhân nguồn mở, được thiết kế để chạy cục bộ liên tục với độ tin cậy cao và khả năng tự cải thiện. Bài viết nhấn mạnh việc tối ưu cho PC NVIDIA RTX, máy trạm RTX PRO và DGX Spark, cùng khả năng triển khai cục bộ các mô hình Qwen 3.6 của Alibaba để tăng tốc thực thi tác vụ trên thiết bị.