AI Agent Hub

LLM Models

Browse the world's large language models. Compare parameters, benchmarks, VRAM and more.

1,294 models for "Transformer" Compare
🤖
deepseek-r1-distill-qwen2.5-bakeneko-32b-gptq-int4
rinna

DeepSeek R1 Distill Qwen2.5 Bakeneko 32B GPTQ int4 (rinna/deepseek-r1-distill-qwen2.5-bakeneko-32b-gptq-int4)

Reasoning 32.0B ★ 31.0 ↓ 18
🤖
qwen2.5-bakeneko-32b-instruct-v2-awq
rinna

Qwen2.5 Bakeneko 32B Instruct V2 AWQ (rinna/qwen2.5-bakeneko-32b-instruct-v2-awq)

Open Source 32.0B ★ 31.0 ↓ 17
🤖
deepseek-r1-distill-qwen2.5-bakeneko-32b-gptq-int8
rinna

DeepSeek R1 Distill Qwen2.5 Bakeneko 32B GPTQ int8 (rinna/deepseek-r1-distill-qwen2.5-bakeneko-32b-gptq-int8)

Reasoning 32.0B ★ 31.0 ↓ 16
🤖
qwq-bakeneko-32b-gptq-int4
rinna

QwQ Bakeneko 32B GPTQ int4 (rinna/qwq-bakeneko-32b-gptq-int4)

Open Source 32.0B ★ 31.0 ↓ 15
🤖
qwq-bakeneko-32b-gptq-int8
rinna

QwQ Bakeneko 32B GPTQ int8 (rinna/qwq-bakeneko-32b-gptq-int8)

Open Source 32.0B ★ 31.0 ↓ 13
🤖
qwen2.5-bakeneko-32b-instruct-v2-gptq-int4
rinna

Qwen2.5 Bakeneko 32B Instruct V2 GPTQ int4 (rinna/qwen2.5-bakeneko-32b-instruct-v2-gptq-int4)

Open Source 32.0B ★ 31.0 ↓ 13
🤖
qwen2.5-bakeneko-32b-instruct-gptq-int8
rinna

Qwen2.5 Bakeneko 32B Instruct GPTQ int8 (rinna/qwen2.5-bakeneko-32b-instruct-gptq-int8)

Open Source 32.0B ★ 31.0 ↓ 13
🤖
qwq-bakeneko-32b-awq
rinna

QwQ Bakeneko 32B AWQ (rinna/qwq-bakeneko-32b-awq)

Open Source 32.0B ★ 31.0 ↓ 12
🤖
qwen2.5-bakeneko-32b-instruct-gptq-int4
rinna

Qwen2.5 Bakeneko 32B Instruct GPTQ int4 (rinna/qwen2.5-bakeneko-32b-instruct-gptq-int4)

Open Source 32.0B ★ 31.0 ↓ 9
🤖
qwen2.5-bakeneko-32b-instruct-v2-gptq-int8
rinna

Qwen2.5 Bakeneko 32B Instruct V2 GPTQ int8 (rinna/qwen2.5-bakeneko-32b-instruct-v2-gptq-int8)

Open Source 32.0B ★ 31.0 ↓ 9
🤖
gemma-4-31B-it
google

Hugging Face GitHub Launch Blog Documentation Technical Report License : Apache 2.0 Authors : Google DeepMind

Open Source 31.0B ★ 30.0 ↓ 8.3M
🤖
Gemma-4-31B-IT-NVFP4
nvidia

Description: Gemma 4 31B IT is an open multimodal model built by Google DeepMind that handles text and image inputs, can process video as sequences of frames, and generates text output. It is designed to deliver frontier-level performance for reasoning, agentic workflows, coding,…

Open Source 31.0B ★ 30.0 ↓ 2M