Meta ra mắt Muse Glimmer, mô hình mở 30B cho AI agent chạy máy nhà

Meta ra mắt Muse Glimmer, mô hình mở 30B cho AI agent chạy máy nhà

Meta vừa tung ra một mô hình mã nguồn mở 30 tỷ tham số, thiết kế riêng để chạy các AI agent liên tục ngay trên một card đồ họa máy tính.

Meta Superintelligence Labs đã mở mã nguồn Muse Glimmer theo giấy phép Apache 2.0. Mô hình đa phương thức 30B này tập trung vào các tác vụ chạy ngầm, liên tục tại máy local như viết code, xử lý tài liệu và gọi hàm (function calling). Nhờ kỹ thuật quantization 4-bit, mô hình thu gọn xuống dưới 20 GB, chạy tốt trong mức RAM 24 GB hoặc 32 GB. Nó cũng đi kèm một mô hình phụ nhỏ tên DFlash giúp tăng tốc speculative decoding, đẩy nhanh các chuỗi suy luận dài.

Vì sao cần quan tâm: Các AI agent tự vận hành thường đòi hỏi máy chủ đám mây và kết nối mạng liên tục để chạy tác vụ dài. Glimmer chuyển toàn bộ khối lượng công việc đó về máy bạn, cho phép gọi công cụ, xử lý hình ảnh và tự sửa lỗi hoàn toàn offline mà không gửi dữ liệu riêng tư lên API. Benchmark của Meta cho thấy hiệu năng agent của Glimmer vượt trội so với các đối thủ cùng tầm dung lượng như Gemma4-31B hay Qwen3.6-27B.

Bộ trọng số (open weights) hiện đã có trên Hugging Face. Các bản tích hợp tối ưu cho llama.cpp, MLX và ExecuTorch sẽ ra mắt trong vài ngày tới.

Chạy AI tại máy nhà vừa trở nên thực tế hơn rất nhiều — và hóa đơn API của bạn cuối cùng cũng có cơ hội xả hơi.