OpenAI tự làm chip riêng — tiết kiệm điện hơn cả Nvidia Blackwell
OpenAI vừa tự thiết kế một con chip suy luận AI chỉ trong 16 tháng, và thử nghiệm ban đầu cho thấy nó vượt mặt Nvidia Blackwell về hiệu suất tiêu thụ điện.
Tại hội nghị Hot Chips, OpenAI đã công bố chi tiết về "Jalapeño" — con chip tùy chỉnh được thiết kế mới từ đầu cùng Broadcom. SemiAnalysis đã đến tận phòng lab của OpenAI để kiểm chứng các bài benchmark, cho biết phần cứng này đạt hơn 700 token/giây cho mỗi người dùng với DeepSeek R1 và 1.400 token/giây với GPT-OSS. Nó đánh bại Blackwell của Nvidia về số token tạo ra trên mỗi watt điện ở hầu hết kịch bản thử nghiệm — và thậm chí còn chạy được cả trò Doom bằng prompt từ Codex.
Vì sao việc này quan trọng: Các trung tâm dữ liệu hiện nay bị giới hạn bởi nguồn điện chứ không phải tiền bạc. Tối ưu số lượng token trên mỗi megawatt sẽ trực tiếp kéo giảm chi phí vận hành, giúp OpenAI chạy các mô hình suy luận tốc độ cao ở quy mô lớn mà không bị phụ thuộc vào mức giá đắt đỏ từ Nvidia.
Cần biết: Các bài kiểm tra này mới dùng bản mẫu kỹ thuật (engineering sample) do OpenAI cung cấp chứ chưa phải chip thương mại hoàn chỉnh. Thêm vào đó, thế hệ chip Rubin tiếp theo của Nvidia — cũng dùng bộ nhớ băng thông cao HBM4 — đã bắt đầu giao tới khách hàng, hứa hẹn sẽ là một đối thủ đáng gờm hơn nhiều khi Jalapeño ra bản chính thức.
Chip tự làm thế hệ đầu thường hay xịt, nhưng quy trình thiết kế có AI hỗ trợ rõ ràng đang làm thay đổi toàn bộ bài toán này.
Nguồn
- SemiAnalysis Report — https://newsletter.semianalysis.com/p/openai-jalapeno-better-than-nvidia
- Hacker News Discussion — https://news.ycombinator.com/item?id=49434378

