Qwen 4 là gì? Alibaba hé lộ 4 phiên bản AI mới, chưa công bố giá
Qwen 4 là gì? Alibaba vừa hé lộ 4 phiên bản Qwen 4 Max, Flash, Plus, 27B tại Hội nghị Apsara 2026 nhưng chưa công bố giá, ngày ra mắt hay benchmark chính thức.
Qwen 4 là thế hệ model AI tiếp theo của Alibaba, vừa được hé lộ tại Hội nghị Apsara 2026 ở Hàng Châu ngày 22/9/2026. Khác với kiểu ra mắt “bấm nút là chạy” như nhiều model khác, Alibaba chỉ xác nhận Qwen 4 “đang trong quá trình huấn luyện” (currently in training) và chưa công bố giá, ngày phát hành hay model card chính thức. Bài viết này tổng hợp những gì đã được xác nhận về Qwen 4: 4 phiên bản được giới thiệu trên sân khấu, kiến trúc mới, lộ trình Qwen 4.5/Qwen 5, và thời điểm bạn có thể thực sự dùng được model này.
Qwen 4 là gì, ra mắt khi nào?
Tại Hội nghị Apsara 2026, Alibaba công bố một loạt động thái trong chiến lược “full-stack AI”: chip AI tự thiết kế mới, hạ tầng cloud chuyên cho tác nhân AI (agentic cloud), nền tảng AI agent cho điện thoại, và quan trọng nhất với người dùng phổ thông — thế hệ model Qwen 4. Thông cáo chính thức của Alibaba chỉ nói ngắn gọn rằng Qwen 4 “đang được huấn luyện” và đi kèm lộ trình cho Qwen 4.5, Qwen 5 với quy mô dự kiến lên tới 5-10 nghìn tỷ tham số.
Điều này có nghĩa là tính đến đầu tháng 10/2026, Qwen 4 mới ở giai đoạn giới thiệu khái niệm (preview), chưa có API, chưa có trọng số mở (open weights), chưa có điểm benchmark chính thức và chưa có giá bán. Đây là điểm khác biệt lớn so với cách Kimi K3 hay Beam của Reflection AI ra mắt gần đây — các model đó mở quyền dùng thử ngay trong ngày công bố, còn Qwen 4 vẫn đang “nằm trong lò”.
4 phiên bản Qwen 4 được giới thiệu trên sân khấu Apsara
Theo các bài tường thuật từ sự kiện, Alibaba trình chiếu 4 cái tên thuộc dòng Qwen 4, mỗi tên nhắm vào một nhóm nhu cầu sử dụng khác nhau. Cần lưu ý đây là tên gọi xuất hiện trên slide/sân khấu, chưa nằm trong thông cáo chính thức dạng văn bản của Alibaba, nên thông số cụ thể (số tham số, context window, giá) hiện vẫn chưa có.
| Phiên bản | Định hướng sử dụng | Trạng thái |
|---|---|---|
| Qwen 4 Max | Model chủ lực (flagship), tác vụ phức tạp | Đang huấn luyện, chưa có benchmark |
| Qwen 4 Flash | Độ trễ thấp, phục vụ khối lượng request lớn | Đang huấn luyện, chưa có giá |
| Qwen 4 Plus | Phiên bản cân bằng giữa tốc độ và chất lượng | Đang huấn luyện |
| Qwen 4 27B | Triển khai cục bộ (local), chạy trên máy cá nhân | Đang huấn luyện, chưa có trọng số mở |
So với cách Alibaba từng chia tier cho Qwen3.8 (bản 27B gọn nhẹ và bản 2.4T-A95B mạnh hơn), cấu trúc 4 tier của Qwen 4 cho thấy hãng tiếp tục chiến lược phục vụ cả nhóm chạy AI cục bộ (local) và nhóm cần model mạnh nhất qua API, chứ không dồn hết vào một bản duy nhất.
Kiến trúc mới: xem trước qua Qwen3.8-Flash-Next
Alibaba chưa công bố chi tiết kiến trúc của Qwen 4, nhưng ngày 26/8/2026 nhóm Qwen đã mở nguồn model Qwen3.8-Flash-Next và mô tả đây là “bản xem trước sớm của kiến trúc dùng cho Qwen 4”. Ba điểm kỹ thuật đáng chú ý của kiến trúc này:
- Kích hoạt rất thưa (sparse activation): chỉ một phần nhỏ tham số được dùng cho mỗi lượt suy luận, giúp giảm chi phí tính toán.
- Lớp embedding dạng n-gram: lưu một phần lớn số tham số dưới dạng bảng tra cứu (lookup) rẻ, thay vì tính toán ma trận đầy đủ.
- Sparse attention: cơ chế attention thưa giúp xử lý ngữ cảnh dài hiệu quả hơn mà không tốn quá nhiều bộ nhớ.
Alibaba cũng cho biết họ đã thử nghiệm quy trình huấn luyện tự cải tiến: trong hơn một tháng chạy hoàn toàn tự động — từ thiết kế pipeline, kiểm định dữ liệu, thử nghiệm lặp đến tự chẩn đoán lỗi — model Qwen3.8-Max đã hoàn thành 33 vòng lặp cải tiến liên tục. Đây là tín hiệu cho thấy Alibaba đang đẩy mạnh tự động hoá chính quá trình huấn luyện AI, không chỉ cải thiện model đầu ra.
Qwen 4 đọ sức ra sao với DeepSeek, Kimi K3, Claude, Gemini?
Vì Qwen 4 chưa có benchmark chính thức, chưa thể so điểm số trực tiếp. Nhưng bối cảnh cạnh tranh đáng để nhìn qua: nhóm model mã nguồn mở Trung Quốc đang chạy đua rất gắt trong năm 2026, từ DeepSeek-V4-Flash, Kimi K3, đến Beam 501 tỷ tham số của Reflection AI. Việc Alibaba công bố lộ trình Qwen 4.5 và Qwen 5 với quy mô 5-10 nghìn tỷ tham số cho thấy hãng không muốn đứng ngoài cuộc đua quy mô tham số, dù Qwen 4 bản đầu tiên có vẻ vẫn ở tầm vài trăm tỷ đến dưới 1 nghìn tỷ tham số (dựa theo định hướng các tier Max/Flash/Plus/27B).
Ở phía model đóng (closed), GPT-6 Astra/Sol/Luna của OpenAI, Claude Opus 5.5 của Anthropic và Gemini 4 Argon của Google vẫn đang dẫn đầu các benchmark coding và agent tính đến đầu tháng 10/2026. Qwen 4 nhiều khả năng sẽ cạnh tranh ở phân khúc giá rẻ, mã nguồn mở và triển khai cục bộ hơn là so kè trực tiếp điểm benchmark cao nhất với nhóm dẫn đầu.
Có nên chờ Qwen 4 không?
Nếu bạn cần một model AI để dùng ngay cho công việc, câu trả lời thực tế là: đừng chờ. Qwen 4 chưa có ngày phát hành, giá hay API cụ thể, nên không có gì đảm bảo nó sẽ sẵn sàng trong vài tuần tới. Bản mạnh nhất bạn có thể dùng ngay lúc này trong dòng Qwen vẫn là Qwen3.8-Max qua Alibaba Cloud Model Studio hoặc các nền tảng trung gian.
Nếu bạn quan tâm đến AI mã nguồn mở để chạy cục bộ, các lựa chọn đã sẵn sàng như Qwen3.8 bản 27B, DeepSeek-V4-Flash hay Kimi K3 vẫn là phương án chắc tay hơn ở thời điểm hiện tại. Khi Qwen 4 có bản phát hành chính thức kèm benchmark độc lập, đây mới là lúc nên so sánh chi tiết để quyết định chuyển đổi.
Câu hỏi thường gặp
Qwen 4 đã dùng được chưa?
Chưa. Tính đến đầu tháng 10/2026, Alibaba chỉ xác nhận Qwen 4 đang trong quá trình huấn luyện, chưa có API, trọng số mở hay ngày phát hành cụ thể.
Qwen 4 có mã nguồn mở không?
Chưa rõ với toàn bộ dòng Qwen 4. Alibaba có truyền thống mở nguồn một số phiên bản Qwen (như Qwen3.8), nhưng với Qwen 4, hãng chưa công bố model nào sẽ có trọng số mở.
Qwen 4 Max khác gì Qwen 4 27B?
Theo các tên gọi được giới thiệu tại Apsara, Qwen 4 Max là bản chủ lực cho tác vụ phức tạp, trong khi Qwen 4 27B nhắm tới triển khai cục bộ trên máy cá nhân. Thông số và điểm benchmark cụ thể của cả hai vẫn chưa được công bố.
Kết luận
Qwen 4 hiện vẫn là một lời hứa hẹn hơn là một sản phẩm có thể dùng ngay: 4 phiên bản Max, Flash, Plus, 27B mới chỉ xuất hiện trên sân khấu Apsara, đi kèm lộ trình tham vọng hướng tới Qwen 4.5 và Qwen 5 ở quy mô 5-10 nghìn tỷ tham số. Với người dùng Việt Nam đang cần AI để làm việc ngay, tốt nhất nên tiếp tục dùng các model đã có mặt (Qwen3.8, DeepSeek-V4-Flash, Kimi K3…) và theo dõi thêm tin chính thức từ Alibaba trước khi lên kế hoạch chuyển sang Qwen 4.