gemma-4-31B-it-GGUF
31B open-weight model from Google for local AI inference. Run gemma-4-31B-it-GGUF locally with Ollama: ollama pull gemma-4-31b-it:31b Minimum 24GB RAM.…
31B open-weight model from Google for local AI inference. Run gemma-4-31B-it-GGUF locally with Ollama: ollama pull gemma-4-31b-it:31b Minimum 24GB RAM.…
27B open-weight model from Jackrong for local AI inference. Run Qwopus3.6-27B-Coder-Compat-MTP-GGUF locally with Ollama: ollama pull qwopus3.6-27b-coder-compat-mtp:27b Minimum 24GB RAM.…
12B open-weight model from Google for local AI inference. Run gemma-4-12B-it-QAT-GGUF locally with Ollama: ollama pull gemma-4-12b-it-qat:12b Minimum 16GB RAM.…
27B open-weight model from prism-ml for local AI inference. Run Ternary-Bonsai-27B-gguf locally with Ollama: ollama pull ternary-bonsai-27b:27b Minimum 24GB RAM.…
12B open-weight model from Mia-AiLab for local AI inference. Run Gemmable-4-12B-MTP-GGUF locally with Ollama: ollama pull gemmable-4-12b-mtp:12b Minimum 16GB RAM.…
12B open-weight model from Google for local AI inference. Run gemma-4-12b-it-GGUF locally with Ollama: ollama pull gemma-4-12b-it:12b Minimum 16GB RAM.…
30B open-weight model from Qwen for local AI inference. Run Qwen3-VL-30B-A3B-Instruct-GGUF locally with Ollama: ollama pull qwen3-vl-30b-a3b:30b Minimum 24GB RAM.…
8B open-weight model from lmg-anon for local AI inference. Run vntl-llama3-8b-v2-gguf locally with Ollama: ollama pull vntl-llama3-8b-v2:8b Minimum 16GB RAM.…
27B open-weight model from Alibaba for local AI inference. Run Qwen3.6-27B-GGUF locally with Ollama: ollama pull qwen3.6-27b:27b Minimum 24GB RAM.…
9B open-weight model from Alibaba for local AI inference. Run Qwen3.5-9B-GGUF locally with Ollama: ollama pull qwen3.5-9b:9b Minimum 16GB RAM.…