AI Agent Hub

LLM Models

Browse the world's large language models. Compare parameters, benchmarks, VRAM and more.

1,299 models for "Transformer" Compare
🤖
Qwen3-8B
Qwen

Qwen3 is the latest generation of large language models in Qwen series, offering a comprehensive suite of dense and mixture-of-experts (MoE) models. Built upon extensive training, Qwen3 delivers groundbreaking advancements in reasoning, instruction-following, agent capabilities,…

Open Source 8.0B ↓ 13.6M
🤖
opt-125m
facebook

OPT : Open Pre-trained Transformer Language Models

Open Source ↓ 11.1M
🤖
Qwen2.5-7B-Instruct
Qwen

Qwen2.5 is the latest series of Qwen large language models. For Qwen2.5, we release a number of base language models and instruction-tuned language models ranging from 0.5 to 72 billion parameters. Qwen2.5 brings the following improvements upon Qwen2:

Open Source 7.0B ↓ 10.6M
🤖
Qwen3-VL-8B-Instruct
Qwen

Meet Qwen3-VL — the most powerful vision-language model in the Qwen series to date.

Multimodal 8.0B ↓ 9.6M
🤖
Qwen2.5-VL-7B-Instruct
Qwen

--- license: apache-2.0 language: - en pipeline tag: image-text-to-text tags: - multimodal library name: transformers ---

Multimodal 7.0B ↓ 8M
🤖
Qwen2.5-1.5B-Instruct
Qwen

Qwen2.5 is the latest series of Qwen large language models. For Qwen2.5, we release a number of base language models and instruction-tuned language models ranging from 0.5 to 72 billion parameters. Qwen2.5 brings the following improvements upon Qwen2:

Open Source 1.54B ↓ 7.7M
🤖
Qwen2.5-3B-Instruct
Qwen

Qwen2.5 is the latest series of Qwen large language models. For Qwen2.5, we release a number of base language models and instruction-tuned language models ranging from 0.5 to 72 billion parameters. Qwen2.5 brings the following improvements upon Qwen2:

Open Source 3.0B ↓ 7.6M
🤖
Llama-3.2-1B-Instruct
meta-llama

Open Source 1.23B ↓ 6.7M
🤖
Qwen3-4B
Qwen

Qwen3 is the latest generation of large language models in Qwen series, offering a comprehensive suite of dense and mixture-of-experts (MoE) models. Built upon extensive training, Qwen3 delivers groundbreaking advancements in reasoning, instruction-following, agent capabilities,…

Reasoning 4.0B ↓ 6.4M
🤖
Qwen2.5-0.5B-Instruct
Qwen

Qwen2.5 is the latest series of Qwen large language models. For Qwen2.5, we release a number of base language models and instruction-tuned language models ranging from 0.5 to 72 billion parameters. Qwen2.5 brings the following improvements upon Qwen2:

Open Source 0.5B ↓ 6M
🤖
Llama-3.1-8B-Instruct
meta-llama

Open Source 8.0B ↓ 5.9M
🤖
Qwen3-32B
Qwen

Qwen3 is the latest generation of large language models in Qwen series, offering a comprehensive suite of dense and mixture-of-experts (MoE) models. Built upon extensive training, Qwen3 delivers groundbreaking advancements in reasoning, instruction-following, agent capabilities,…

Open Source 32.0B ↓ 4.9M