Qwen3.5-4B-GGUF

4B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.

Run Qwen3.5-4B-GGUF locally with Ollama: ollama pull qwen3.5-4b:4b

Mindestens 8 GB RAM erforderlich. Kontextlänge: 4096 Tokens.