LLM Models
Browse the world's large language models. Compare parameters, benchmarks, VRAM and more.
DeepSeek R1 Distill Qwen2.5 Bakeneko 32B GPTQ int4 (rinna/deepseek-r1-distill-qwen2.5-bakeneko-32b-gptq-int4)
Qwen2.5 Bakeneko 32B Instruct V2 AWQ (rinna/qwen2.5-bakeneko-32b-instruct-v2-awq)
DeepSeek R1 Distill Qwen2.5 Bakeneko 32B GPTQ int8 (rinna/deepseek-r1-distill-qwen2.5-bakeneko-32b-gptq-int8)
QwQ Bakeneko 32B GPTQ int4 (rinna/qwq-bakeneko-32b-gptq-int4)
QwQ Bakeneko 32B GPTQ int8 (rinna/qwq-bakeneko-32b-gptq-int8)
Qwen2.5 Bakeneko 32B Instruct V2 GPTQ int4 (rinna/qwen2.5-bakeneko-32b-instruct-v2-gptq-int4)
Qwen2.5 Bakeneko 32B Instruct GPTQ int8 (rinna/qwen2.5-bakeneko-32b-instruct-gptq-int8)
QwQ Bakeneko 32B AWQ (rinna/qwq-bakeneko-32b-awq)
Qwen2.5 Bakeneko 32B Instruct GPTQ int4 (rinna/qwen2.5-bakeneko-32b-instruct-gptq-int4)
Qwen2.5 Bakeneko 32B Instruct V2 GPTQ int8 (rinna/qwen2.5-bakeneko-32b-instruct-v2-gptq-int8)
Hugging Face GitHub Launch Blog Documentation Technical Report License : Apache 2.0 Authors : Google DeepMind
Description: Gemma 4 31B IT is an open multimodal model built by Google DeepMind that handles text and image inputs, can process video as sequences of frames, and generates text output. It is designed to deliver frontier-level performance for reasoning, agentic workflows, coding,…