AI Agent Hub

LLM Models

Browse the world's large language models. Compare parameters, benchmarks, VRAM and more.

377 models for "MoE" Compare
🤖
Qwen3-0.6B
Qwen

Qwen3 is the latest generation of large language models in Qwen series, offering a comprehensive suite of dense and mixture-of-experts (MoE) models. Built upon extensive training, Qwen3 delivers groundbreaking advancements in reasoning, instruction-following, agent capabilities,…

Open Source 0.6B ↓ 22.7M
🤖
Qwen3-8B
Qwen

Qwen3 is the latest generation of large language models in Qwen series, offering a comprehensive suite of dense and mixture-of-experts (MoE) models. Built upon extensive training, Qwen3 delivers groundbreaking advancements in reasoning, instruction-following, agent capabilities,…

Open Source 8.0B ↓ 13.6M
🤖
Qwen3-VL-8B-Instruct
Qwen

Meet Qwen3-VL — the most powerful vision-language model in the Qwen series to date.

Multimodal 8.0B ↓ 9.6M
🤖
Qwen3-4B
Qwen

Qwen3 is the latest generation of large language models in Qwen series, offering a comprehensive suite of dense and mixture-of-experts (MoE) models. Built upon extensive training, Qwen3 delivers groundbreaking advancements in reasoning, instruction-following, agent capabilities,…

Reasoning 4.0B ↓ 6.4M
🤖
Qwen3-32B
Qwen

Qwen3 is the latest generation of large language models in Qwen series, offering a comprehensive suite of dense and mixture-of-experts (MoE) models. Built upon extensive training, Qwen3 delivers groundbreaking advancements in reasoning, instruction-following, agent capabilities,…

Open Source 32.0B ↓ 4.9M
🤖
Qwen3-VL-4B-Instruct
Qwen

Meet Qwen3-VL — the most powerful vision-language model in the Qwen series to date.

Multimodal 4.0B ↓ 4M
🤖
Qwen3-1.7B
Qwen

Qwen3 is the latest generation of large language models in Qwen series, offering a comprehensive suite of dense and mixture-of-experts (MoE) models. Built upon extensive training, Qwen3 delivers groundbreaking advancements in reasoning, instruction-following, agent capabilities,…

Open Source 1.7B ↓ 3.7M
🤖
Unlimited-OCR
baidu

Welcome the Era of One-shot Long-horizon Parsing.

Multimodal 3.336B ↓ 3.1M
🤖
Qwen3-VL-2B-Instruct
Qwen

Meet Qwen3-VL — the most powerful vision-language model in the Qwen series to date.

Multimodal 2.0B ↓ 2.9M
🤖
DeepSeek-OCR
deepseek-ai

🌟 Github 📥 Model Download 📄 Paper Link 📄 Arxiv Paper Link DeepSeek-OCR: Contexts Optical Compression Explore the boundaries of visual-text compression.

Multimodal 3.0B ↓ 2.5M
🤖
Qwen3-30B-A3B
Qwen

Qwen3 is the latest generation of large language models in Qwen series, offering a comprehensive suite of dense and mixture-of-experts (MoE) models. Built upon extensive training, Qwen3 delivers groundbreaking advancements in reasoning, instruction-following, agent capabilities,…

Reasoning 30.5B ↓ 2.4M
🤖
Qwen3-14B-AWQ
Qwen

Qwen3 is the latest generation of large language models in Qwen series, offering a comprehensive suite of dense and mixture-of-experts (MoE) models. Built upon extensive training, Qwen3 delivers groundbreaking advancements in reasoning, instruction-following, agent capabilities,…

Reasoning 14.8B ↓ 2.3M