Qwen Team (Alibaba Cloud)
Known forCoding, reasoning and tool use
596M – 235B parametersHow many numbers the model learned during training — the usual rough measure of its size.Dense and mixture of expertsA model split into parts where only a few run for each word, so it answers faster than its size suggests.Newest release 5 Aug 2026
Known forImages, long documents and many languages
9.24B – 27.4B parametersHow many numbers the model learned during training — the usual rough measure of its size.DenseNewest release 12 Mar 2025
Known forTool use and many languages
7.25B – 23.6B parametersHow many numbers the model learned during training — the usual rough measure of its size.DenseNewest release 30 Jan 2025
Known forCoding, reasoning and long documents
671B parametersHow many numbers the model learned during training — the usual rough measure of its size.Mixture of expertsA model split into parts where only a few run for each word, so it answers faster than its size suggests.Newest release 20 Jan 2025
Known forCoding and reasoning
14.7B parametersHow many numbers the model learned during training — the usual rough measure of its size.DenseNewest release 12 Dec 2024
Known forCoding, tool use and long documents
8.03B – 70.6B parametersHow many numbers the model learned during training — the usual rough measure of its size.DenseNewest release 6 Dec 2024