gemma-4-12b-it-GGUF

12B open-weight model from Google for local AI inference.

Run gemma-4-12b-it-GGUF locally with Ollama: ollama pull gemma-4-12b-it:12b

Minimum 16GB RAM. Context length: 4096 tokens.