Bên trong con chip mở màn cuộc chơi AI của Apple

Một chuyên gia bảo mật vừa giải mã toàn bộ kiến trúc bên trong Neural Engine trên chip M1, giải thích vì sao phần cứng AI đời đầu đụng trần trước các mô hình ngôn ngữ hiện đại.

Nhà nghiên cứu độc lập eiln vừa xuất bản bài phân tích về Apple Neural Engine (ANE) trên M1, dựng lại toàn bộ luồng tính toán, đường truyền dữ liệu và cơ chế xử lý bộ nhớ. Kết quả cho thấy cụm 16 nhân của Apple chứa 2.048 luồng nhân-cộng (multiply-accumulate) song song, được thiết kế chủ yếu cho các thuật toán xử lý hình ảnh từ thời 2017. Ngay cả macOS cũng hiếm khi đụng tới con chip này, ngoại trừ việc tạo ảnh xem trước trong Finder.

Tại sao điều này lại quan trọng: Các NPU đời đầu sống nhờ vào cách truy xuất bộ nhớ có tính dự đoán trước của các mô hình thị giác máy tính. Khối lượng tính toán của các mô hình transformer hiện đại đã phá vỡ hoàn toàn thiết kế phần cứng đó. Đây chính là lý do Apple quyết định gộp thẳng các nhân ANE vào GPU kể từ dòng chip M5.

Bài phân tích cũng cho thấy các thanh ghi phần cứng giới hạn phép tính và đẩy trực tiếp kết quả ma trận vào khối kích hoạt (activation block) mà không cần ghi tạm qua bộ nhớ trung gian.

Hóa ra, con chip NPU độc lập không lỗi thời vì thiếu sức mạnh — nó chỉ đơn giản được sinh ra cho một thế hệ AI khác.

Nguồn