Alibaba ra mắt Qwen 3.8 27B hỗ trợ FP8 chạy local

Alibaba ra mắt Qwen 3.8 27B hỗ trợ FP8 chạy local

Đội ngũ Qwen của Alibaba vừa tung ra Qwen 3.8 27B, mang khả năng lập trình và xử lý hình ảnh cao cấp lên phần cứng local.

Bản ra mắt này đi kèm weight FP8 chính chủ trên Hugging Face, chạy trực tiếp được với vLLM, SGLang và TokenSpeed. Model hỗ trợ hiểu ảnh và video native, context window 262k token (có thể mở rộng lên 1 triệu) và tích hợp sẵn bộ điều khiển chế độ suy nghĩ (thinking controls).

Vì sao lại quan trọng: Các model mở tầm trung thường hay hụt hơi ở những tác vụ dạng agent kéo dài. Trên benchmark SWE-bench Pro, Qwen 3.8 27B đạt 61,7 điểm—vượt xa mức 51,2 của Muse Glimmer-30B—mà vẫn đủ gọn nhẹ để tự chạy trên GPU local.

Nói ngắn gọn về cách điều khiển: chế độ suy nghĩ (thinking mode) được bật mặc định, nhưng bạn có thể tắt theo từng request hoặc điều chỉnh độ sâu bằng tham số reasoning_effort.

Thuê GPU cloud vẫn đắt đỏ, nhưng model chạy local thì vừa thông minh lên trông thấy.

Nguồn