Qwen3.5-4B-GGUF

Modèle à poids ouvert 4B d'Alibaba pour l'inférence IA locale.

Run Qwen3.5-4B-GGUF locally with Ollama: ollama pull qwen3.5-4b:4b

8 Go de RAM minimum. Longueur du contexte : 4096 jetons.