Contenuti
- 1 Modelli di intelligenza artificiale per Ollam
- 1.0.1 Mistral-Small-24B-Instruct-2501-GGUF
- 1.0.2 Llama-3-8B-Instruct-32k-v0.1-GGUF
- 1.0.3 SmolLM2-135M-GGUF
- 1.0.4 Qwen3.6-35B-A3B-NVFP4-MTP-GGUF
- 1.0.5 Llama-3.3-70B-Instruct-GGUF
- 1.0.6 gemma-3-4b-it-GGUF
- 1.0.7 Mistral-7B-Istruzioni-v0.3-GGUF
- 1.0.8 Mixtral-8x22B-v0.1-GGUF
- 1.0.9 Qwen3.8_4B_Distilled_GGUF
- 1.0.10 Meta-Llama-3-8B-Instruct-GGUF
- 1.0.11 Melody1437-26B-A4B-v2.0-GGUF
- 1.0.12 Serenity-26B-A4B-GGUF
- 1.0.13 Scarlatto Scuro v0.3-26B-A4B-GGUF
- 1.0.14 XYZAILab_XYZ-Aquila-mini-GGUF
- 1.0.15 Qwen3.5-4B-Claude-4.6-Opus-Reasoning-Distilled-GGUF
- 1.0.16 Parabola-Granito-4.1-8B-Claude-Favola-5-GGUF
- 1.0.17 Qwen3.6-14B-A3B-FableVibes-GGUF
- 1.0.18 MiniMax-H3-Potato-GGUF
- 1.0.19 Qwen_Qwen3.5-0.8B-GGUF
- 1.0.20 Qwen3.6-35B-A3B-APEX-GGUF
- 1.0.21 supergemma4-26b-non censurato-gguf-v2
- 1.0.22 gemma-4-26B-A4B-it-APEX-GGUF
- 1.0.23 Qwopus3.6-27B-Coder-MTP-GGUF
- 1.0.24 Qwen_Qwen3.5-2B-GGUF
- 1.0.25 Qwen3.5-397B-A17B-GGUF
- 1.0.26 Qwen3-4B-Instruct-2507-GGUF
- 1.0.27 Bonsai ternario-8B-gguf
- 1.0.28 PinkCherry_NSFW_LTX23
- 1.0.29 Parabola-Granito-4.1-3B-Claude-Favola-5-GGUF
- 1.0.30 Qwen_Qwen3.5-35B-A3B-GGUF
- 1.0.31 Infinity Frontier Big Bang v1 GGUF
- 1.0.32 Qwen_Qwen3.5-4B-GGUF
- 1.0.33 Qwen3.6-27B-Heretic-Uncensored-FINETUNE-NEO-CODE-Di-IMatrix-MAX-GGUF
- 1.0.34 Qwen3.5-9B-DeepSeek-V4-Flash-GGUF
- 1.0.35 Parabola-Qwen3-8B-Claude-Favola-5-GGUF
- 1.0.36 grug-27b-gguf
- 1.0.37 GLM-4.7-Flash-GGUF
- 1.0.38 gemma-4-31B-it-qat-q4_0-gguf
- 1.0.39 Qwen3.5-27B-GGUF
- 1.0.40 Kwaipilot_KAT-Coder-V2.5-Dev-GGUF
- 1.0.41 Parabola-Qwen3-4B-Claude-Favola-5-GGUF
- 1.0.42 gemma-4-E2B-it-qat-GGUF
- 1.0.43 ACE-Step-1.5-GGUF
- 1.0.44 Huihui-DeepSeek-V4-Flash-0731-abliterated-GGUF
- 1.0.45 POCKET-35B-GGUF
- 1.0.46 gemma-4-26B-A4B-it-qat-q4_0-gguf
- 1.0.47 gemma-4-E2B-it-qat-q4_0-gguf
- 1.0.48 gemma-4-E4B-it-qat-q4_0-gguf
- 1.0.49 settore automobilistico
- 1.0.50 DeepSeek-V4-Flash-0731-GGUF
- 1.0.51 LFM2.5-2.6B-GGUF
- 1.0.52 Qwen3.5-122B-A10B-GGUF
- 1.0.53 Qwen3.8-27B-Non censurato-GGUF
- 1.0.54 MiniMax-H3
- 1.0.55 MiniMax-H3_GGUFs
- 1.0.56 audio.cpp-gguf
- 1.0.57 Inkling-Small-GGUF
- 1.0.58 maple-preview-GGUF
- 1.0.59 KAT-Coder-V2.5-Dev-APEX-GGUF
- 1.0.60 Qwen3-TTS-GGUF
- 1.0.61 MiniMax-H3-GGUF
- 1.0.62 Muse-Glimmer-30B-GGUF
- 1.0.63 Laguna-XS-2.1-APEX-GGUF
- 1.0.64 Qwen3-30B-A3B-Thinking-2507-GGUF
- 1.0.65 Qwen3.8-27B-GGUF
- 1.0.66 Higgs Audio v3 Studio
- 1.0.67 DeepSeek-V4-Flash-GGUF
- 1.0.68 Qwen3.5-2B-GGUF
- 1.0.69 Qwen3.5-4B-Non censurato-HauhauCS-Aggressivo
- 1.0.70 Qwen3.5-35B-A3B-GGUF
- 1.0.71 Llama-3.2-3B-Instruct-GGUF
- 1.0.72 gemma-3-1b-it-GGUF
- 1.0.73 Qwen3.5-122B-A10B-MTP-GGUF
- 1.0.74 FLUX.2-klein-4B-GGUF
- 1.0.75 Qwen2.5-7B-Istruzione-GGUF
- 1.0.76 Qwen3-30B-A3B-GGUF
- 1.0.77 Qwen3-32B-GGUF
- 1.0.78 Qwen3-1.7B-GGUF
- 1.0.79 Kimi-K3-GGUF
- 1.0.80 Qwen2.5-0.5B-Istruzione-GGUF
- 1.0.81 Qwen3-14B-GGUF
- 1.0.82 Qwen3-0.6B-GGUF
- 1.0.83 Laguna-S-2.1-GGUF
- 1.0.84 Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V7-GGUF
- 1.0.85 gemma-gguf
- 1.0.86 Qwen2.5-VL-7B-Istruzione-GGUF
- 1.0.87 Qwen3-235B-A22B-GGUF
- 1.0.88 Voxtral-Small-24B-2507-gguf
- 1.0.89 Sugoi-14B-Ultra-GGUF
- 1.0.90 Qwen3-ASR-1.7B-gguf
- 1.0.91 Qwen3-30B-A3B-Istruzioni-2507-GGUF
- 1.0.92 Qwen2.5-3B-Istruzione-GGUF
- 1.0.93 gemma-4-12b-eretico-abliterato-GGUF
- 1.0.94 Qwen3.5-122B-A10B-Non censurato-HauhauCS-Aggressivo
- 1.0.95 Qwen2.5-Coder-7B-Instruct-GGUF
- 1.0.96 Qwen-Image-Edit-2511-GGUF
- 1.0.97 Qwen3-Coder-Next-GGUF
- 1.0.98 Qwen2.5-1.5B-Istruzione-GGUF
- 1.0.99 Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V6-GGUF
- 1.0.100 programmi per zampe
- 1.0.101 Qwen2.5-Coder-32B-Instruct-GGUF
- 1.0.102 gemma-4-31B-it-qat-GGUF
- 1.0.103 gemma-4-26B-A4B-it-ultra-uncensored-heretic-i1-GGUF
- 1.0.104 gemma-4-12B-coder-fable5-composer2.5-v1-GGUF
- 1.0.105 inkling-GGUF
- 1.0.106 granite-4.1-3b-GGUF
- 1.0.107 Sugoi-32B-Ultra-GGUF
- 1.0.108 Qwen3-VL-4B-Istruzione-GGUF
- 1.0.109 madlad400-3b-mt
- 1.0.110 MiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking-GGUF
- 1.0.111 svara-tts-v1
- 1.0.112 Qwen3.6-40B-Claude-4.6-Opus-Deckard-Heretic-Uncensored-Thinking-NEO-CODE-Di-IMatrix-MAX-GGUF
- 1.0.113 Holo-3.1-35B-A3B-GGUF
- 1.0.114 gemma-4-12B-it-qat-q4_0-gguf
- 1.0.115 Qwen3.5-9B-The-Defiant-Fable-Uncensored-Heretic-NEO-IMATRIX-MAX-MTP-GGUF
- 1.0.116 LTX-2.3-GGUF
- 1.0.117 gemma-4-E4B-it-qat-GGUF
- 1.0.118 whisper-large-v3-turbo-gguf
- 1.0.119 LTX-2
- 1.0.120 Qwen3-4B-GGUF
- 1.0.121 Qwen3.5-0.8B-GGUF
- 1.0.122 Meta-Llama-3.1-8B-Instruct-GGUF
- 1.0.123 LFM2.5-1.2B-Istruzione-GGUF
- 1.0.124 GLM-5.2-GGUF
- 1.0.125 canary-180m-flash-gguf
- 1.0.126 whisper-large-v3-gguf
- 1.0.127 Qwen3-8B-GGUF
- 1.0.128 Jan-v3.5-4B-gguf
- 1.0.129 Kimi-K2.7-Code-GGUF
- 1.0.130 MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF
- 1.0.131 Llama-3.2-1B-Instruct-Q8_0-GGUF
- 1.0.132 Bielik-11B-v3.0-Instruct-awq
- 1.0.133 Wan2.2-I2V-A14B-GGUF
- 1.0.134 Gemma-4-31B-è-cancellata
- 1.0.135 Qwen3.6-27B-Non censurato-HauhauCS-Aggressivo
- 1.0.136 ThinkingCap-Qwen3.6-27B-GGUF
- 1.0.137 Wan2.1
- 1.0.138 Voxtral-Mini-4B-Realtime-2602-gguf
- 1.0.139 Qwen_Qwen3.6-35B-A3B-GGUF
- 1.0.140 Qwythos-9B-v2-GGUF
- 1.0.141 gemma-4-12B-agentic-fable5-composer2.5-v2-3.5x-tau2-GGUF
- 1.0.142 Zolfo-2-base
- 1.0.143 sussurro medio-gguf
- 1.0.144 gemma-4-E2B-it-GGUF
- 1.0.145 parakeet-tdt-0.6b-v3-gguf
- 1.0.146 Qwen3.5-9B-Non censurato-HauhauCS-Aggressivo
- 1.0.147 gemma-4-26B-A4B-it-qat-GGUF
- 1.0.148 gpt-oss-20b-GGUF
- 1.0.149 Qwen3-VL-8B-Istruzione-eliminata-GGUF
- 1.0.150 Flux2-Klein-9B-True-V2
- 1.0.151 Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF
- 1.0.152 Qwen3-Coder-30B-A3B-Instruct-GGUF
- 1.0.153 gemma-4-31B-it-GGUF
- 1.0.154 Gemma-4-E4B-Non censurato-HauhauCS-Aggressivo
- 1.0.155 Qwopus3.6-27B-Coder-Compat-MTP-GGUF
- 1.0.156 UI-TARS-1.5-7B-GGUF
- 1.0.157 Huihui-DeepSeek-V4-Flash-abliterated-ds4-GGUF
- 1.0.158 gemma-4-12B-it-QAT-GGUF
- 1.0.159 Bonsai ternario-27B-gguf
- 1.0.160 Gemmable-4-12B-MTP-GGUF
- 1.0.161 Qwopus3.6-35B-A3B-Coder-MTP-GGUF
- 1.0.162 Qwen3.6-35B-A3B-MTP-GGUF
- 1.0.163 gemma-4-12b-it-GGUF
- 1.0.164 Qwen3-VL-30B-A3B-Istruzione-GGUF
- 1.0.165 modelli spostati
- 1.0.166 cohere-transcribe-03-2026-gguf
- 1.0.167 Qwen-AgentWorld-35B-A3B-GGUF
- 1.0.168 vntl-llama3-8b-v2-gguf
- 1.0.169 gemma-4-E4B-it-GGUF
- 1.0.170 Qwen3.6-27B-GGUF
- 1.0.171 Qwen3.6-35B-A3B-GGUF
- 1.0.172 Hy3-GGUF
- 1.0.173 HyperCLOVAX-SEED-Text-Instruct-1.5B-Q4_K_M-GGUF
- 1.0.174 Qwen3.5-9B-GGUF
- 1.0.175 Qwen3.5-4B-GGUF
- 1.0.176 parakeet-unified-en-0.6b-gguf
- 1.0.177 nemotron-3.5-asr-streaming-0.6b-gguf
- 1.0.178 gemma-4-26B-A4B-it-GGUF
- 1.0.179 Bonsai-27B-gguf
- 1.0.180 Qwen3.6-35B-A3B-Non censurato-HauhauCS-Aggressivo
- 1.0.181 Qwythos-9B-Claude-Mythos-5-1M-GGUF
- 1.0.182 Ornith-1.0-35B-GGUF
- 1.0.183 Qwen3.6-27B-MTP-GGUF
- 1.0.184 ricerca profonda v4-gguf
- 1.0.185 Ornith-1.0-9B-GGUF
- 1.1 Ciao, piacere di conoscerti!
Modelli di intelligenza artificiale per Ollam
Ogni modello in questa directory è in formato GGUF, quindi funziona direttamente in Ollama. Ecco il catalogo completo con i comandi di pull pronti per essere copiati.
Mistral-Small-24B-Instruct-2501-GGUF
Modello open-weight a 24 bit di MaziyarPanahi per l'inferenza AI locale.
ollama pull mistral-small-24b-instruct-2501:24bLlama-3-8B-Instruct-32k-v0.1-GGUF
Modello open-weight a 8 bit di MaziyarPanahi per l'inferenza AI locale.
ollama pull llama-3-8b-instruct-32k-v0.1:8bSmolLM2-135M-GGUF
Modello open-weight sconosciuto di QuantFactory per l'inferenza AI locale.
ollama pull smollm2-135m:latestQwen3.6-35B-A3B-NVFP4-MTP-GGUF
Modello open-weight 35B di michaelw9999 per l'inferenza AI locale.
ollama pull qwen3.6-35b-a3b-nvfp4-mtp:35bLlama-3.3-70B-Instruct-GGUF
Modello open-weight a 70 bit di MaziyarPanahi per l'inferenza AI locale.
ollama pull llama-3.3-70b:70bgemma-3-4b-it-GGUF
Modello open-weight a 4 bit di MaziyarPanahi per l'inferenza AI locale.
ollama pull gemma-3-4b-it:4bMistral-7B-Istruzioni-v0.3-GGUF
Modello open-weight a 7 bit di MaziyarPanahi per l'inferenza AI locale.
ollama pull mistral-7b-instruct-v0.3:7bMixtral-8x22B-v0.1-GGUF
Modello open-weight a 22 bit di MaziyarPanahi per l'inferenza AI locale.
ollama pull mixtral-8x22b-v0.1:22bQwen3.8_4B_Distilled_GGUF
Modello a pesi aperti 4B di Ma7ee7 per l'inferenza AI locale.
ollama pull qwen3.8-4b-distilled-gguf:4bMeta-Llama-3-8B-Instruct-GGUF
Modello open-weight a 8 bit di MaziyarPanahi per l'inferenza AI locale.
ollama pull meta-llama-3-8b:8bMelody1437-26B-A4B-v2.0-GGUF
Modello open-weight a 26 bit di ReadyArt per l'inferenza AI locale.
ollama pull melody1437-26b-a4b-v2.0:26bSerenity-26B-A4B-GGUF
Modello open-weight a 26 bit di ReadyArt per l'inferenza AI locale.
ollama pull serenity-26b-a4b:26bScarlatto Scuro v0.3-26B-A4B-GGUF
Modello open-weight a 26 bit di ReadyArt per l'inferenza AI locale.
ollama pull dark-scarlett-v0.3-26b-a4b:26bXYZAILab_XYZ-Aquila-mini-GGUF
Modello di pesi aperti sconosciuto di Bartowski per l'inferenza AI locale.
ollama pull xyzailab-xyz-aquila-mini:latestQwen3.5-4B-Claude-4.6-Opus-Reasoning-Distilled-GGUF
Modello open-weight a 4 bit di Jackrong per l'inferenza AI locale.
ollama pull qwen3.5-4b-claude-4.6-opus-reasoning-distilled:4bParabola-Granito-4.1-8B-Claude-Favola-5-GGUF
Modello open-weight 8B di AnkitAI per l'inferenza AI locale.
ollama pull parable-granite-4.1-8b-claude-fable-5:8bQwen3.6-14B-A3B-FableVibes-GGUF
Modello open-weight a 14 bit di tvall43 per l'inferenza AI locale.
ollama pull qwen3.6-14b-a3b-fablevibes:14bMiniMax-H3-Potato-GGUF
Modello di pesi aperti sconosciuto di Abiray per l'inferenza AI locale.
ollama pull minimax-h3-pruned:latestQwen_Qwen3.5-0.8B-GGUF
Modello open-weight 0.8B di Alibaba per l'inferenza AI locale.
ollama pull qwen-qwen3.5-0.8b:0.8bQwen3.6-35B-A3B-APEX-GGUF
Modello open-weight 35B di Mudler per l'inferenza AI locale.
ollama pull qwen3.6-35b-a3b-apex:35bsupergemma4-26b-non censurato-gguf-v2
Modello open-weight a 26 bit di Jiunsong per l'inferenza AI locale.
ollama pull supergemma4-26b-uncensored-gguf-v2:26bgemma-4-26B-A4B-it-APEX-GGUF
Modello open-weight 26B di Mudler per l'inferenza AI locale.
ollama pull gemma-4-26b-a4b-it-apex:26bQwopus3.6-27B-Coder-MTP-GGUF
Modello open-weight a 27 bit di Jackrong per l'inferenza AI locale.
ollama pull qwopus3.6-27b-coder-mtp:27bQwen_Qwen3.5-2B-GGUF
Modello open-weight 2B di Alibaba per l'inferenza AI locale.
ollama pull qwen-qwen3.5-2b:2bQwen3.5-397B-A17B-GGUF
Modello open-weight 397B di Alibaba per l'inferenza AI locale.
ollama pull qwen3.5-397b-a17b:397bQwen3-4B-Instruct-2507-GGUF
Modello open-weight a 4 bit di MaziyarPanahi per l'inferenza AI locale.
ollama pull qwen3-4b-instruct-2507:4bBonsai ternario-8B-gguf
Modello open-weight 8B di prism-ml per l'inferenza AI locale.
ollama pull ternary-bonsai-8b:8bPinkCherry_NSFW_LTX23
Modello di pesi aperti sconosciuto di SexGod1979 per l'inferenza AI locale.
ollama pull pinkcherry-nsfw-ltx23:latestParabola-Granito-4.1-3B-Claude-Favola-5-GGUF
Modello open-weight 3B di AnkitAI per l'inferenza AI locale.
ollama pull parable-granite-4.1-3b-claude-fable-5:3bQwen_Qwen3.5-35B-A3B-GGUF
Modello open-weight 35B di Alibaba per l'inferenza AI locale.
ollama pull qwen-qwen3.5-35b-a3b:35bInfinity Frontier Big Bang v1 GGUF
Modello di pesi aperti sconosciuto di Bartowski per l'inferenza AI locale.
ollama pull endless-frontier-bigbang-v1:latestQwen_Qwen3.5-4B-GGUF
Modello open-weight 4B di Alibaba per l'inferenza AI locale.
ollama pull qwen-qwen3.5-4b:4bQwen3.6-27B-Heretic-Uncensored-FINETUNE-NEO-CODE-Di-IMatrix-MAX-GGUF
Modello open-weight a 27 bit di DavidAU per l'inferenza AI locale.
ollama pull qwen3.6-27b-heretic-uncensored-finetune-neo-code-di-imatrix-max:27bQwen3.5-9B-DeepSeek-V4-Flash-GGUF
Modello open-weight a 9 bit di Jackrong per l'inferenza AI locale.
ollama pull qwen3.5-9b-deepseek-v4-flash:9bParabola-Qwen3-8B-Claude-Favola-5-GGUF
Modello open-weight 8B di AnkitAI per l'inferenza AI locale.
ollama pull parable-qwen3-8b-claude-fable-5:8bgrug-27b-gguf
Modello open-weight a 27 bit di ProCreations per l'inferenza AI locale.
ollama pull grug-27b:27bGLM-4.7-Flash-GGUF
Modello di pesi aperti sconosciuto da unsloth per l'inferenza AI locale.
ollama pull glm-4.7-flash:latestgemma-4-31B-it-qat-q4_0-gguf
Modello open-weight a 31 bit di Google per l'inferenza AI locale.
ollama pull gemma-4-31b-it-qat-q4-0:31bQwen3.5-27B-GGUF
Modello open-weight 27B di Alibaba per l'inferenza AI locale.
ollama pull qwen3.5-27b:27bKwaipilot_KAT-Coder-V2.5-Dev-GGUF
Modello di pesi aperti sconosciuto di Bartowski per l'inferenza AI locale.
ollama pull kwaipilot-kat-coder-v2.5-dev:latestParabola-Qwen3-4B-Claude-Favola-5-GGUF
Modello open-weight 4B di AnkitAI per l'inferenza AI locale.
ollama pull parable-qwen3-4b-claude-fable-5:4bgemma-4-E2B-it-qat-GGUF
Modello open-weight 2B di Google per l'inferenza AI locale.
ollama pull gemma-4-e2b-it-qat:2bACE-Step-1.5-GGUF
Modello open-weight sconosciuto di Serveurperso per l'inferenza AI locale.
ollama pull ace-step-1.5:latestHuihui-DeepSeek-V4-Flash-0731-abliterated-GGUF
Modello di pesi aperti sconosciuto da huihui-ai per l'inferenza AI locale.
ollama pull huihui-deepseek-v4-flash-0731-abliterated:latestPOCKET-35B-GGUF
Modello open-weight 35B di FINAL-Bench per l'inferenza AI locale.
ollama pull pocket-35b:35bgemma-4-26B-A4B-it-qat-q4_0-gguf
Modello open-weight a 26 bit di Google per l'inferenza AI locale.
ollama pull gemma-4-26b-a4b-it-qat-q4-0:26bgemma-4-E2B-it-qat-q4_0-gguf
Modello open-weight a 2 bit di Google per l'inferenza AI locale.
ollama pull gemma-4-e2b-it-qat-q4-0:2bgemma-4-E4B-it-qat-q4_0-gguf
Modello open-weight a 4 bit di Google per l'inferenza AI locale.
ollama pull gemma-4-e4b-it-qat-q4-0:4bsettore automobilistico
Modello di pesi aperti sconosciuto da flywheel-ai per l'inferenza AI locale.
ollama pull automotive:latestDeepSeek-V4-Flash-0731-GGUF
Modello open-weight sconosciuto di DeepSeek per l'inferenza AI locale.
ollama pull deepseek-v4-flash-0731:latestLFM2.5-2.6B-GGUF
Modello open-weight da 2.6 miliardi di LiquidAI per l'inferenza AI locale.
ollama pull lfm2.5-2.6b:2.6bQwen3.5-122B-A10B-GGUF
Modello open-weight 122B di Alibaba per l'inferenza AI locale.
ollama pull qwen3.5-122b-a10b:122bQwen3.8-27B-Non censurato-GGUF
Modello open-weight a 27 bit di JonathanColetti per l'inferenza AI locale.
ollama pull qwen3.8-27b-uncensored:27bMiniMax-H3
Modello di pesi aperti sconosciuto da DeepBeepMeep per l'inferenza AI locale.
ollama pull minimax-h3:latestMiniMax-H3_GGUFs
Modello open-weight sconosciuto da realrebelai per l'inferenza AI locale.
ollama pull minimax-h3-ggufs:latestaudio.cpp-gguf
Modello di pesi aperti sconosciuto da audio-cpp per l'inferenza AI locale.
ollama pull audio.cpp:latestInkling-Small-GGUF
Modello di pesi aperti sconosciuto da unsloth per l'inferenza AI locale.
ollama pull inkling-small:latestmaple-preview-GGUF
Modello open-weight sconosciuto di deepgrove per l'inferenza AI locale.
ollama pull maple-preview:latestKAT-Coder-V2.5-Dev-APEX-GGUF
Modello di pesi aperti sconosciuto da Mudler per l'inferenza AI locale.
ollama pull kat-coder-v2.5-dev-apex:latestQwen3-TTS-GGUF
Modello open-weight sconosciuto di Serveurperso per l'inferenza AI locale.
ollama pull qwen3-tts:latestMiniMax-H3-GGUF
Modello di pesi aperti sconosciuto di Abiray per l'inferenza AI locale.
ollama pull minimax-h3:latestMuse-Glimmer-30B-GGUF
Modello open-weight a 30 bit di Unsloth per l'inferenza AI locale.
ollama pull muse-glimmer-30b:30bLaguna-XS-2.1-APEX-GGUF
Modello di pesi aperti sconosciuto da Mudler per l'inferenza AI locale.
ollama pull laguna-xs-2.1-apex:latestQwen3-30B-A3B-Thinking-2507-GGUF
Modello open-weight 30B di Alibaba per l'inferenza AI locale.
ollama pull qwen3-30b-a3b-thinking-2507:30bQwen3.8-27B-GGUF
Modello open-weight 27B di Alibaba per l'inferenza AI locale.
ollama pull qwen3.8-27b:27bHiggs Audio v3 Studio
Modello open-weight sconosciuto da drbaph per l'inferenza AI locale.
ollama pull higgs-audio-v3-studio:latestDeepSeek-V4-Flash-GGUF
Modello open-weight sconosciuto di DeepSeek per l'inferenza AI locale.
ollama pull deepseek-v4-flash:latestQwen3.5-2B-GGUF
Modello open-weight 2B di Alibaba per l'inferenza AI locale.
ollama pull qwen3.5-2b:2bQwen3.5-4B-Non censurato-HauhauCS-Aggressivo
Modello a pesi aperti 4B di HauhauCS per l'inferenza AI locale.
ollama pull qwen3.5-4b-uncensored-hauhaucs-aggressive:4bQwen3.5-35B-A3B-GGUF
Modello open-weight 35B di Alibaba per l'inferenza AI locale.
ollama pull qwen3.5-35b-a3b:35bLlama-3.2-3B-Instruct-GGUF
Modello open-weight 3B di Meta per l'inferenza AI locale.
ollama pull llama-3.2-3b:3bgemma-3-1b-it-GGUF
Modello open-weight 1B di ggml-org per l'inferenza AI locale.
ollama pull gemma-3-1b-it:1bQwen3.5-122B-A10B-MTP-GGUF
Modello open-weight 122B di Alibaba per l'inferenza AI locale.
ollama pull qwen3.5-122b-a10b-mtp:122bFLUX.2-klein-4B-GGUF
Modello open-weight a 4 bit di Unsloth per l'inferenza AI locale.
ollama pull flux.2-klein-4b:4bQwen2.5-7B-Istruzione-GGUF
Modello open-weight 7B di Alibaba per l'inferenza AI locale.
ollama pull qwen2.5-7b:7bQwen3-30B-A3B-GGUF
Modello open-weight a 30 bit di MaziyarPanahi per l'inferenza AI locale.
ollama pull qwen3-30b-a3b:30bQwen3-32B-GGUF
Modello open-weight a 32 bit di MaziyarPanahi per l'inferenza AI locale.
ollama pull qwen3-32b:32bQwen3-1.7B-GGUF
Modello open-weight a 1.7 bit di MaziyarPanahi per l'inferenza AI locale.
ollama pull qwen3-1.7b:1.7bKimi-K3-GGUF
Modello di pesi aperti sconosciuto da unsloth per l'inferenza AI locale.
ollama pull kimi-k3:latestQwen2.5-0.5B-Istruzione-GGUF
Modello open-weight a 0.5 bit di Qwen per l'inferenza AI locale.
ollama pull qwen2.5-0.5b:0.5bQwen3-14B-GGUF
Modello open-weight a 14 bit di MaziyarPanahi per l'inferenza AI locale.
ollama pull qwen3-14b:14bQwen3-0.6B-GGUF
Modello open-weight a 0.6 bit di MaziyarPanahi per l'inferenza AI locale.
ollama pull qwen3-0.6b:0.6bLaguna-S-2.1-GGUF
Modello di pesi aperti sconosciuto da unsloth per l'inferenza AI locale.
ollama pull laguna-s-2.1:latestQwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V7-GGUF
Modello open-weight 35B di LuffyTheFox per l'inferenza AI locale.
ollama pull qwen3.6-35b-a3b-uncensored-genesis-hermes-v7:35bgemma-gguf
Modello open-weight sconosciuto di rahul7star per l'inferenza AI locale.
ollama pull gemma:latestQwen2.5-VL-7B-Istruzione-GGUF
Modello open-weight 7B di Alibaba per l'inferenza AI locale.
ollama pull qwen2.5-vl-7b:7bQwen3-235B-A22B-GGUF
Modello open-weight 235B di Alibaba per l'inferenza AI locale.
ollama pull qwen3-235b-a22b:235bVoxtral-Small-24B-2507-gguf
Modello open-weight da 24 miliardi di Handy-Computer per l'inferenza AI locale.
ollama pull voxtral-small-24b-2507:24bSugoi-14B-Ultra-GGUF
Modello open-weight a 14 bit di sugoitoolkit per l'inferenza AI locale.
ollama pull sugoi-14b-ultra:14bQwen3-ASR-1.7B-gguf
Modello open-weight da 1.7 miliardi di Handy-Computer per l'inferenza AI locale.
ollama pull qwen3-asr-1.7b:1.7bQwen3-30B-A3B-Istruzioni-2507-GGUF
Modello open-weight 30B di Alibaba per l'inferenza AI locale.
ollama pull qwen3-30b-a3b-instruct-2507:30bQwen2.5-3B-Istruzione-GGUF
Modello open-weight a 3 bit di Qwen per l'inferenza AI locale.
ollama pull qwen2.5-3b:3bgemma-4-12b-eretico-abliterato-GGUF
Modello open-weight a 12 bit di CultureRevolt per l'inferenza AI locale.
ollama pull gemma-4-12b-heretic-abliterated:12bQwen3.5-122B-A10B-Non censurato-HauhauCS-Aggressivo
Modello a pesi aperti 122B di HauhauCS per l'inferenza AI locale.
ollama pull qwen3.5-122b-a10b-uncensored-hauhaucs-aggressive:122bQwen2.5-Coder-7B-Instruct-GGUF
Modello open-weight a 7 bit di Qwen per l'inferenza AI locale.
ollama pull qwen2.5-coder-7b:7bQwen-Image-Edit-2511-GGUF
Modello open-weight sconosciuto di Alibaba per l'inferenza AI locale.
ollama pull qwen-image-edit-2511:latestQwen3-Coder-Next-GGUF
Modello open-weight sconosciuto di Alibaba per l'inferenza AI locale.
ollama pull qwen3-coder-next:latestQwen2.5-1.5B-Istruzione-GGUF
Modello open-weight a 1.5 bit di Qwen per l'inferenza AI locale.
ollama pull qwen2.5-1.5b:1.5bQwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V6-GGUF
Modello open-weight 35B di LuffyTheFox per l'inferenza AI locale.
ollama pull qwen3.6-35b-a3b-uncensored-genesis-hermes-v6:35bprogrammi per zampe
Modello di pesi aperti sconosciuto da programasweights per l'inferenza AI locale.
ollama pull paw-programs:latestQwen2.5-Coder-32B-Instruct-GGUF
Modello open-weight a 32 bit di Qwen per l'inferenza AI locale.
ollama pull qwen2.5-coder-32b:32bgemma-4-31B-it-qat-GGUF
Modello open-weight 31B di Google per l'inferenza AI locale.
ollama pull gemma-4-31b-it-qat:31bgemma-4-26B-A4B-it-ultra-uncensored-heretic-i1-GGUF
Modello open-weight 26B di Google per l'inferenza AI locale.
ollama pull gemma-4-26b-a4b-it-ultra-uncensored-heretic-i1:26bgemma-4-12B-coder-fable5-composer2.5-v1-GGUF
Modello a 12 pesi aperti da yuxinlu1 per l'inferenza AI locale.
ollama pull gemma-4-12b-coder-fable5-composer2.5-v1:12binkling-GGUF
Modello di pesi aperti sconosciuto da unsloth per l'inferenza AI locale.
ollama pull inkling:latestgranite-4.1-3b-GGUF
Modello a pesi aperti 3B di ibm-granite per l'inferenza AI locale.
ollama pull granite-4.1-3b:3bSugoi-32B-Ultra-GGUF
Modello open-weight a 32 bit di sugoitoolkit per l'inferenza AI locale.
ollama pull sugoi-32b-ultra:32bQwen3-VL-4B-Istruzione-GGUF
Modello open-weight 4B di Alibaba per l'inferenza AI locale.
ollama pull qwen3-vl-4b:4bmadlad400-3b-mt
Modello open-weight a 3 bit di Google per l'inferenza AI locale.
ollama pull madlad400-3b-mt:3bMiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking-GGUF
Modello open-weight 1B di GnLOLot per l'inferenza AI locale.
ollama pull minicpm5-1b-claude-opus-fable5-v2-thinking:1bsvara-tts-v1
Modello open-weight sconosciuto da kenpath per l'inferenza AI locale.
ollama pull svara-tts-v1:latestQwen3.6-40B-Claude-4.6-Opus-Deckard-Heretic-Uncensored-Thinking-NEO-CODE-Di-IMatrix-MAX-GGUF
Modello open-weight a 40 bit di DavidAU per l'inferenza AI locale.
ollama pull qwen3.6-40b-claude-4.6-opus-deckard-heretic-uncensored-thinking-neo-code-di-imatrix-max:40bHolo-3.1-35B-A3B-GGUF
Modello open-weight 35B di Hcompany per l'inferenza AI locale.
ollama pull holo-3.1-35b-a3b:35bgemma-4-12B-it-qat-q4_0-gguf
Modello open-weight a 12 bit di Google per l'inferenza AI locale.
ollama pull gemma-4-12b-it-qat-q4-0:12bQwen3.5-9B-The-Defiant-Fable-Uncensored-Heretic-NEO-IMATRIX-MAX-MTP-GGUF
Modello open-weight a 9 bit di DavidAU per l'inferenza AI locale.
ollama pull qwen3.5-9b-the-defiant-fable-uncensored-heretic-neo-imatrix-max-mtp:9bLTX-2.3-GGUF
Modello di pesi aperti sconosciuto da unsloth per l'inferenza AI locale.
ollama pull ltx-2.3:latestgemma-4-E4B-it-qat-GGUF
Modello open-weight 4B di Google per l'inferenza AI locale.
ollama pull gemma-4-e4b-it-qat:4bwhisper-large-v3-turbo-gguf
Modello di pesi aperti sconosciuto da handy-computer per inferenza AI locale.
ollama pull whisper-large-v3-turbo:latestLTX-2
Modello di pesi aperti sconosciuto da DeepBeepMeep per l'inferenza AI locale.
ollama pull ltx-2:latestQwen3-4B-GGUF
Modello open-weight a 4 bit di Qwen per l'inferenza AI locale.
ollama pull qwen3-4b:4bQwen3.5-0.8B-GGUF
Modello open-weight 0.8B di Alibaba per l'inferenza AI locale.
ollama pull qwen3.5-0.8b:0.8bMeta-Llama-3.1-8B-Instruct-GGUF
Modello open-weight 8B di Meta per l'inferenza AI locale.
ollama pull meta-llama-3.1-8b:8bLFM2.5-1.2B-Istruzione-GGUF
Modello open-weight da 1.2 miliardi di LiquidAI per l'inferenza AI locale.
ollama pull lfm2.5-1.2b:1.2bGLM-5.2-GGUF
Modello di pesi aperti sconosciuto da unsloth per l'inferenza AI locale.
ollama pull glm-5.2:latestcanary-180m-flash-gguf
Modello di pesi aperti sconosciuto da handy-computer per inferenza AI locale.
ollama pull canary-180m-flash:latestwhisper-large-v3-gguf
Modello di pesi aperti sconosciuto da handy-computer per inferenza AI locale.
ollama pull whisper-large-v3:latestQwen3-8B-GGUF
Modello open-weight 8B di Alibaba per l'inferenza AI locale.
ollama pull qwen3-8b:8bJan-v3.5-4B-gguf
Modello a pesi aperti 4B di janhq per l'inferenza AI locale.
ollama pull jan-v3.5-4b:4bKimi-K2.7-Code-GGUF
Modello di pesi aperti sconosciuto da unsloth per l'inferenza AI locale.
ollama pull kimi-k2.7-code:latestMiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF
Modello open-weight 1B di GnLOLot per l'inferenza AI locale.
ollama pull minicpm5-1b-claude-opus-fable5-thinking:1bLlama-3.2-1B-Instruct-Q8_0-GGUF
Modello open-weight 1B da huging-quants per l'inferenza AI locale.
ollama pull llama-3.2-1b-instruct-q8-0:1bBielik-11B-v3.0-Instruct-awq
Modello open-weight 11B di speakleash per l'inferenza AI locale.
ollama pull bielik-11b-v3.0-instruct-awq:11bWan2.2-I2V-A14B-GGUF
Modello open-weight a 14 bit di QuantStack per l'inferenza AI locale.
ollama pull wan2.2-i2v-a14b:14bGemma-4-31B-è-cancellata
Modello open-weight 31B di paperscarecrow per l'inferenza AI locale.
ollama pull gemma-4-31b-it-abliterated:31bQwen3.6-27B-Non censurato-HauhauCS-Aggressivo
Modello a pesi aperti 27B di HauhauCS per l'inferenza AI locale.
ollama pull qwen3.6-27b-uncensored-hauhaucs-aggressive:27bThinkingCap-Qwen3.6-27B-GGUF
Modello open-weight 27B di bottlecapai per l'inferenza AI locale.
ollama pull thinkingcap-qwen3.6-27b:27bWan2.1
Modello di pesi aperti sconosciuto da DeepBeepMeep per l'inferenza AI locale.
ollama pull wan2.1:latestVoxtral-Mini-4B-Realtime-2602-gguf
Modello open-weight da 4 miliardi di Handy-Computer per l'inferenza AI locale.
ollama pull voxtral-mini-4b-realtime-2602:4bQwen_Qwen3.6-35B-A3B-GGUF
Modello open-weight 35B di Alibaba per l'inferenza AI locale.
ollama pull qwen-qwen3.6-35b-a3b:35bQwythos-9B-v2-GGUF
Modello open-weight 9B di empero-ai per l'inferenza AI locale.
ollama pull qwythos-9b-v2:9bgemma-4-12B-agentic-fable5-composer2.5-v2-3.5x-tau2-GGUF
Modello a 12 pesi aperti da yuxinlu1 per l'inferenza AI locale.
ollama pull gemma-4-12b-agentic-fable5-composer2.5-v2-3.5x-tau2:12bZolfo-2-base
Modello di pesi aperti sconosciuto da SulfurAI per l'inferenza AI locale.
ollama pull sulphur-2-base:latestsussurro medio-gguf
Modello di pesi aperti sconosciuto da handy-computer per inferenza AI locale.
ollama pull whisper-medium:latestgemma-4-E2B-it-GGUF
Modello open-weight 2B di Google per l'inferenza AI locale.
ollama pull gemma-4-e2b-it:2bparakeet-tdt-0.6b-v3-gguf
Modello open-weight da 0.6 miliardi di Handy-Computer per l'inferenza AI locale.
ollama pull parakeet-tdt-0.6b-v3:0.6bQwen3.5-9B-Non censurato-HauhauCS-Aggressivo
Modello a pesi aperti 9B di HauhauCS per l'inferenza AI locale.
ollama pull qwen3.5-9b-uncensored-hauhaucs-aggressive:9bgemma-4-26B-A4B-it-qat-GGUF
Modello open-weight 26B di Google per l'inferenza AI locale.
ollama pull gemma-4-26b-a4b-it-qat:26bgpt-oss-20b-GGUF
Modello open-weight a 20 bit di Unsloth per l'inferenza AI locale.
ollama pull gpt-oss-20b:20bQwen3-VL-8B-Istruzione-eliminata-GGUF
Qwen3-VL-8B-Instruct-abliterated-GGUF è un modello di linguaggio visivo con 8 miliardi di parametri, sviluppato da Alibaba e completamente ottimizzato per rimuovere i vincoli proprietari, pur mantenendo le funzionalità principali. Questo modello eccelle nella gestione di ragionamenti visivi complessi e attività a più fasi all'interno di un framework conversazionale, risultando ideale per analisi aperte e generazione creativa nella regione degli Stati Uniti. L'esecuzione locale di questa versione quantizzata di GGUF è estremamente pratica per gli utenti con GPU di fascia media, offrendo velocità di inferenza elevate senza richiedere hardware aziendale specializzato.
ollama pull qwen3-vl-8b-instruct-abliterated:8bFlux2-Klein-9B-True-V2
Modello open-weight 9B di wikieyang per l'inferenza AI locale.
ollama pull flux2-klein-9b-true-v2:9bQwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF
Il modello linguistico Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF, con 27 miliardi di parametri, è stato creato da DavidAU e combina diverse tecniche di fine-tuning, tra cui i metodi Unsloth ed Heretic. Questo modello eccelle nella generazione di contenuti non censurati, altamente creativi e senza restrizioni su svariati argomenti, risultando ideale per gli utenti che cercano un assistente virtuale completo, capace di fornire risposte personalizzate a più livelli senza filtri di sicurezza. L'esecuzione locale di questa versione quantizzata GGUF richiede una GPU potente con un'ampia VRAM per gestire in modo efficiente i 27 miliardi di parametri, offrendo prestazioni ottimali su sistemi dotati di hardware di fascia alta per velocità di inferenza elevate.
ollama pull qwen3.6-27b-fable-fusion-711-uncensored-heretic-nm-dau-neo-max-mtp:27bQwen3-Coder-30B-A3B-Instruct-GGUF
Qwen3-Coder-30B-A3B-Instruct-GGUF è un modello di codifica con 30 miliardi di parametri sviluppato da Alibaba che integra un'ottimizzazione avanzata delle istruzioni per attività specializzate. Eccelle nella generazione di codice complesso, nel debug e nell'assistenza alla programmazione conversazionale, risultando ideale per gli sviluppatori che cercano soluzioni ad alte prestazioni nella regione degli Stati Uniti. L'esecuzione locale di questo modello richiede una notevole quantità di memoria GPU per gestire l'elevato numero di parametri, pertanto è più adatto agli utenti con hardware potente che privilegiano la pura capacità di codifica rispetto alla velocità.
ollama pull qwen3-coder-30b-a3b:30bgemma-4-31B-it-GGUF
Modello open-weight 31B di Google per l'inferenza AI locale.
ollama pull gemma-4-31b-it:31bGemma-4-E4B-Non censurato-HauhauCS-Aggressivo
Gemma-4-E4B-Uncensored-HauhauCS-Aggressive è un modello multimodale a 4 miliardi di parametri sviluppato da HauhauCS che integra funzionalità avanzate di Gemma 4 con filtri di sicurezza rimossi. Questa variante aggressiva eccelle nella generazione di testo senza restrizioni, nell'analisi visiva e nell'elaborazione audio, risultando ideale per attività creative che richiedono un output grezzo senza moderazione dei contenuti. L'esecuzione locale di questo modello richiede una notevole quantità di memoria GPU per gestire gli input multimodali e gli utenti devono aspettarsi elevati costi computazionali durante l'elaborazione di flussi audio o video complessi.
ollama pull gemma-4-e4b-uncensored-hauhaucs-aggressive:4bQwopus3.6-27B-Coder-Compat-MTP-GGUF
Modello open-weight a 27 bit di Jackrong per l'inferenza AI locale.
ollama pull qwopus3.6-27b-coder-compat-mtp:27bUI-TARS-1.5-7B-GGUF
Modello open-weight 7B di mradermacher per l'inferenza AI locale.
ollama pull ui-tars-1.5-7b:7bHuihui-DeepSeek-V4-Flash-abliterated-ds4-GGUF
Modello di pesi aperti sconosciuto da huihui-ai per l'inferenza AI locale.
ollama pull huihui-deepseek-v4-flash-abliterated-ds4:latestgemma-4-12B-it-QAT-GGUF
Modello open-weight 12B di Google per l'inferenza AI locale.
ollama pull gemma-4-12b-it-qat:12bBonsai ternario-27B-gguf
Modello open-weight 27B di prism-ml per l'inferenza AI locale.
ollama pull ternary-bonsai-27b:27bGemmable-4-12B-MTP-GGUF
Modello open-weight a 12 bit di Mia-AiLab per l'inferenza AI locale.
ollama pull gemmable-4-12b-mtp:12bQwopus3.6-35B-A3B-Coder-MTP-GGUF
Modello open-weight a 35 bit di Jackrong per l'inferenza AI locale.
ollama pull qwopus3.6-35b-a3b-coder-mtp:35bQwen3.6-35B-A3B-MTP-GGUF
Modello open-weight 35B di Alibaba per l'inferenza AI locale.
ollama pull qwen3.6-35b-a3b-mtp:35bgemma-4-12b-it-GGUF
Modello open-weight 12B di Google per l'inferenza AI locale.
ollama pull gemma-4-12b-it:12bQwen3-VL-30B-A3B-Istruzione-GGUF
Modello open-weight a 30 bit di Qwen per l'inferenza AI locale.
ollama pull qwen3-vl-30b-a3b:30bmodelli spostati
La collezione models-moved è fornita da ggml-org e attualmente elenca un numero sconosciuto di parametri per i suoi vari file di modello. Questi modelli eccellono in attività generiche nella regione degli Stati Uniti e sono più adatti agli utenti che cercano opzioni di inferenza accessibili da questo specifico fornitore. L'esecuzione in locale richiede il download dei file di quantizzazione GGUF appropriati, con prestazioni che variano significativamente in base alle capacità hardware della GPU o della CPU.
ollama pull models-moved:latestcohere-transcribe-03-2026-gguf
Modello di pesi aperti sconosciuto da handy-computer per inferenza AI locale.
ollama pull cohere-transcribe-03-2026:latestQwen-AgentWorld-35B-A3B-GGUF
Modello open-weight 35B di Alibaba per l'inferenza AI locale.
ollama pull qwen-agentworld-35b-a3b:35bvntl-llama3-8b-v2-gguf
Il modello linguistico vntl-llama3-8b-v2-gguf, con 8 miliardi di parametri, è stato sviluppato da lmg-anon ed è specializzato in traduzioni di alta qualità e attività conversazionali. Eccelle nell'elaborazione del dataset VNTL-v5-1k per fornire risposte fluide, risultando ideale per applicazioni di chat multilingue e generazione di contenuti localizzati. L'esecuzione locale di questo modello richiede una GPU con VRAM sufficiente per gestire in modo efficiente i suoi 8 miliardi di parametri, garantendo prestazioni reattive per dialoghi in tempo reale.
ollama pull vntl-llama3-8b-v2:8bgemma-4-E4B-it-GGUF
Il modello linguistico gemma-4-E4B-it-GGUF, con 4 miliardi di parametri, è stato sviluppato da Google e ottimizzato per la lingua italiana utilizzando la quantizzazione GGUF. Eccelle nella gestione di complesse attività di ragionamento all'interno dell'architettura Gemma 4, supportando al contempo conversioni efficienti da immagine a testo grazie a ottimizzazioni specifiche per l'algoritmo Unsloth. L'esecuzione locale di questo modello richiede una GPU moderna per sfruttarne appieno la velocità, rendendolo ideale per gli utenti che desiderano prestazioni elevate nell'inferenza locale senza dipendenze dal cloud.
ollama pull gemma-4-e4b-it:4bQwen3.6-27B-GGUF
Qwen3.6-27B-GGUF è un modello linguistico di grandi dimensioni con 27 miliardi di parametri, sviluppato da Alibaba, che supporta funzionalità avanzate di intelligenza artificiale conversazionale e di conversione da immagine a testo. Eccelle in compiti di ragionamento complessi, comunicazione multilingue e analisi visiva, risultando ideale per applicazioni professionali che richiedono un'elevata precisione nella generazione e comprensione del testo. L'esecuzione locale di questo modello richiede in genere una notevole quantità di memoria GPU e un processore potente per gestire in modo efficiente i suoi 27 miliardi di parametri, pertanto è più adatto agli utenti con hardware dedicato o accesso a istanze cloud.
ollama pull qwen3.6-27b:27bQwen3.6-35B-A3B-GGUF
Qwen3.6-35B-A3B-GGUF è un modello linguistico di grandi dimensioni con 35 miliardi di parametri, sviluppato da Alibaba, che presenta ottimizzazioni specifiche per la conversione da immagine a testo e la conversazione multilingue. Questo modello eccelle nella gestione di complesse attività di ragionamento visivo e nel mantenimento di dialoghi coerenti, risultando ideale per applicazioni che richiedono una profonda comprensione contestuale di diversi argomenti. L'esecuzione locale di questo modello richiede una notevole quantità di memoria GPU per gestire il numero completo di parametri, sebbene le versioni GGUF quantizzate possano offrire un buon compromesso tra velocità e prestazioni su hardware consumer di fascia alta.
ollama pull qwen3.6-35b-a3b:35bHy3-GGUF
Modello di pesi aperti sconosciuto da vcruz305 per l'inferenza AI locale.
ollama pull hy3:latestHyperCLOVAX-SEED-Text-Instruct-1.5B-Q4_K_M-GGUF
HyperCLOVAX-SEED-Text-Instruct-1.5B-Q4_K_M-GGUF è un modello linguistico con 1.5 miliardi di parametri, creato da rippertnt e ottimizzato per l'utilizzo con llama-cpp. Eccelle nelle attività di conversazione e nella generazione di testo generico, risultando ideale per applicazioni leggere che richiedono un'inferenza efficiente su hardware standard. L'esecuzione locale di questo modello è pratica anche su sistemi modesti grazie al suo formato quantizzato, che offre tempi di risposta rapidi senza la necessità di GPU di fascia alta.
ollama pull hyperclovax-seed-text-instruct-1.5b-q4-k-m:1.5bQwen3.5-9B-GGUF
Qwen3.5-9B-GGUF è un modello linguistico compatto di grandi dimensioni sviluppato da Alibaba, contenente 9 miliardi di parametri. Eccelle nelle attività di conversazione e nella conversione da immagine a testo, risultando ideale per applicazioni leggere che richiedono un'implementazione efficiente nella regione Stati Uniti. L'esecuzione locale di questo modello è pratica su hardware di fascia consumer grazie al suo ingombro ridotto, offrendo velocità di inferenza elevate anche su GPU di fascia media se abbinato a librerie di ottimizzazione come Unsloth.
ollama pull qwen3.5-9b:9bQwen3.5-4B-GGUF
Qwen3.5-4B-GGUF è un modello linguistico compatto da 4 miliardi di parametri sviluppato da Alibaba che supporta attività conversazionali e la conversione da immagine a testo. Eccelle nella gestione di carichi di lavoro di inferenza leggeri, mantenendo al contempo prestazioni elevate in ambienti non ottimizzati per l'algoritmo Sloth per la generazione di testo. L'esecuzione locale di questo modello richiede risorse hardware minime, il che lo rende ideale per gli utenti che cercano un'implementazione rapida ed efficiente su dispositivi consumer standard.
ollama pull qwen3.5-4b:4bparakeet-unified-en-0.6b-gguf
Modello open-weight da 0.6 miliardi di Handy-Computer per l'inferenza AI locale.
ollama pull parakeet-unified-en-0.6b:0.6bnemotron-3.5-asr-streaming-0.6b-gguf
Modello open-weight da 0.6 miliardi di Handy-Computer per l'inferenza AI locale.
ollama pull nemotron-3.5-asr-streaming-0.6b:0.6bgemma-4-26B-A4B-it-GGUF
Il modello gemma-4-26B-A4B-it-GGUF è un modello linguistico di grandi dimensioni con 26 miliardi di parametri, sviluppato da Google, che sfrutta un'ottimizzazione avanzata delle istruzioni per un ragionamento ad alte prestazioni. Questo modello eccelle nella generazione di testo complesso e in attività multimodali, risultando ideale per applicazioni che richiedono una profonda comprensione contestuale e un'esecuzione precisa delle istruzioni. L'esecuzione locale di questo modello richiede una notevole quantità di memoria GPU e una potenza di calcolo considerevole, pertanto è più adatto a utenti con hardware di fascia alta o a coloro che utilizzano framework di inferenza come Unsloth per gestire i requisiti di risorse.
ollama pull gemma-4-26b-a4b-it:26bBonsai-27B-gguf
Bonsai-27B-gguf è un modello linguistico compatto da 27 miliardi di parametri sviluppato da prism-ml che utilizza la quantizzazione per un'implementazione efficiente. Eccelle nelle attività conversazionali e nel ragionamento generale, funzionando senza problemi su llama.cpp con supporto sia per l'accelerazione hardware CPU che CUDA. Gli utenti possono eseguire questo modello localmente su hardware modesto, sebbene le prestazioni varieranno a seconda che utilizzino la quantizzazione a 1 bit o abbiano accesso a una GPU.
ollama pull bonsai-27b:27bQwen3.6-35B-A3B-Non censurato-HauhauCS-Aggressivo
Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive è un modello linguistico di grandi dimensioni con 35 miliardi di parametri, sviluppato da HauhauCS, che combina l'architettura MoE con funzionalità multimodali e di visione avanzate. Eccelle nel ragionamento complesso, nell'analisi multilingue di immagini e testi e nella generazione di contenuti non censurati per casi d'uso aggressivi o senza restrizioni, dove i filtri di sicurezza standard sono indesiderabili. L'esecuzione locale di questo modello richiede una notevole quantità di memoria GPU di fascia alta per gestire la sua struttura sparsa a miscela di esperti, rendendolo più adatto a workstation potenti o server con una quantità significativa di VRAM disponibile.
ollama pull qwen3.6-35b-a3b-uncensored-hauhaucs-aggressive:35bQwythos-9B-Claude-Mythos-5-1M-GGUF
Modello open-weight 9B di empero-ai per l'inferenza AI locale.
ollama pull qwythos-9b-claude-mythos-5-1m:9bOrnith-1.0-35B-GGUF
Ornith-1.0-35B-GGUF è un modello linguistico con 35 miliardi di parametri, sviluppato da ornith-ai specificamente per attività conversazionali nella regione degli Stati Uniti. Eccelle nel mantenere flussi di dialogo naturali e nel gestire interazioni contestualizzate, risultando ideale per chatbot e assistenti virtuali. L'esecuzione locale di questo modello richiede una notevole quantità di memoria GPU per gestirne le dimensioni in modo efficiente, pertanto è più adatto a utenti con hardware di fascia alta o a coloro che sono disposti a utilizzare versioni GGUF quantizzate per ridurre il fabbisogno di risorse.
ollama pull ornith-1.0-35b:35bQwen3.6-27B-MTP-GGUF
Qwen3.6-27B-MTP-GGUF è un modello linguistico di grandi dimensioni con 27 miliardi di parametri, sviluppato da Alibaba, che supporta attività di conversazione avanzate e la conversione da immagine a testo. Eccelle nella gestione di ragionamenti complessi e dialoghi a più turni, risultando ideale per applicazioni che richiedono una profonda comprensione contestuale e analisi visiva. L'esecuzione locale di questo modello richiede in genere hardware GPU di fascia alta per gestire il suo considerevole consumo di memoria, sebbene le versioni GGUF quantizzate possano offrire un buon compromesso tra velocità e prestazioni su sistemi di fascia consumer.
ollama pull qwen3.6-27b-mtp:27bricerca profonda v4-gguf
Il modello deepseek-v4-gguf è un'architettura Mixture-of-Experts quantizzata fornita da antirez, con un numero di parametri sconosciuti disponibile in formato a 2 e 4 bit. Eccelle nell'inferenza efficiente per attività linguistiche complesse, mantenendo al contempo prestazioni elevate grazie alla sua struttura MoE specializzata, risultando ideale per gli utenti che necessitano di un ridotto consumo di memoria senza una significativa perdita di funzionalità. L'esecuzione locale di questo modello richiede risorse hardware moderate per gestire efficacemente i pesi quantizzati, offrendo una soluzione rapida e pratica per implementare funzionalità di intelligenza artificiale avanzate su sistemi di livello consumer.
ollama pull deepseek-v4:latestOrnith-1.0-9B-GGUF
Ornith-1.0-9B-GGUF è un modello linguistico con 9 miliardi di parametri sviluppato da ornith-ai e progettato per interazioni conversazionali all'interno della regione degli Stati Uniti. Eccelle nella generazione di dialoghi naturali e nella gestione di attività di chat informali, risultando ideale per assistenti virtuali leggeri o semplici bot di assistenza clienti. L'esecuzione locale di questo modello richiede risorse hardware modeste, consentendogli di operare rapidamente su GPU di fascia consumer senza la necessità di enormi data center.
ollama pull ornith-1.0-9b:9b
