Съдържание
- 1 AI модели за Ollama
- 1.0.1 Mistral-Small-24B-Instruct-2501-GGUF
- 1.0.2 Llama-3-8B-Instruct-32k-v0.1-GGUF
- 1.0.3 SmolLM2-135M-GGUF
- 1.0.4 Qwen3.6-35B-A3B-NVFP4-MTP-GGUF
- 1.0.5 Llama-3.3-70B-Instruct-GGUF
- 1.0.6 gemma-3-4b-it-GGUF
- 1.0.7 Mistral-7B-Instruct-v0.3-GGUF
- 1.0.8 Mixtral-8x22B-v0.1-GGUF
- 1.0.9 Qwen3.8_4B_Distilled_GGUF
- 1.0.10 Мета-Лама-3-8B-Инструкция-GGUF
- 1.0.11 Melody1437-26B-A4B-v2.0-GGUF
- 1.0.12 Serenity-26B-A4B-GGUF
- 1.0.13 Dark-Scarlett-v0.3-26B-A4B-GGUF
- 1.0.14 XYZAILab_XYZ-Aquila-mini-GGUF
- 1.0.15 Qwen3.5-4B-Claude-4.6-Opus-Reasoning-Distilled-GGUF
- 1.0.16 Parable-Granite-4.1-8B-Claude-Fable-5-GGUF
- 1.0.17 Qwen3.6-14B-A3B-FableVibes-GGUF
- 1.0.18 MiniMax-H3-Pruned-GGUF
- 1.0.19 Qwen_Qwen3.5-0.8B-GGUF
- 1.0.20 Qwen3.6-35B-A3B-APEX-GGUF
- 1.0.21 supergemma4-26b-uncensored-gguf-v2
- 1.0.22 gemma-4-26B-A4B-it-APEX-GGUF
- 1.0.23 Qwopus3.6-27B-Coder-MTP-GGUF
- 1.0.24 Qwen_Qwen3.5-2B-GGUF
- 1.0.25 Qwen3.5-397B-A17B-GGUF
- 1.0.26 Qwen3-4B-Instruct-2507-GGUF
- 1.0.27 Троичен бонсай-8B-gguf
- 1.0.28 PinkCherry_NSFW_LTX23
- 1.0.29 Parable-Granite-4.1-3B-Claude-Fable-5-GGUF
- 1.0.30 Qwen_Qwen3.5-35B-A3B-GGUF
- 1.0.31 endless-frontier_BigBang-v1-GGUF
- 1.0.32 Qwen_Qwen3.5-4B-GGUF
- 1.0.33 Qwen3.6-27B-Heretic-Uncensored-FINETUNE-NEO-CODE-Di-IMatrix-MAX-GGUF
- 1.0.34 Qwen3.5-9B-DeepSeek-V4-Flash-GGUF
- 1.0.35 Притча-Qwen3-8B-Claude-Fable-5-GGUF
- 1.0.36 grug-27b-gguf
- 1.0.37 GLM-4.7-Flash-GGUF
- 1.0.38 gemma-4-31B-it-qat-q4_0-gguf
- 1.0.39 Qwen3.5-27B-GGUF
- 1.0.40 Kwaipilot_KAT-Coder-V2.5-Dev-GGUF
- 1.0.41 Притча-Qwen3-4B-Claude-Fable-5-GGUF
- 1.0.42 gemma-4-E2B-it-qat-GGUF
- 1.0.43 ACE-Step-1.5-GGUF
- 1.0.44 Huihui-DeepSeek-V4-Flash-0731-abliterated-GGUF
- 1.0.45 POCKET-35B-GGUF
- 1.0.46 gemma-4-26B-A4B-it-qat-q4_0-gguf
- 1.0.47 gemma-4-E2B-it-qat-q4_0-gguf
- 1.0.48 gemma-4-E4B-it-qat-q4_0-gguf
- 1.0.49 автомобилен
- 1.0.50 DeepSeek-V4-Flash-0731-GGUF
- 1.0.51 LFM2.5-2.6B-GGUF
- 1.0.52 Qwen3.5-122B-A10B-GGUF
- 1.0.53 Qwen3.8-27B-Uncensored-GGUF
- 1.0.54 MiniMax-H3
- 1.0.55 MiniMax-H3_GGUFs
- 1.0.56 audio.cpp-gguf
- 1.0.57 Inkling-Small-GGUF
- 1.0.58 maple-preview-GGUF
- 1.0.59 KAT-Coder-V2.5-Dev-APEX-GGUF
- 1.0.60 Qwen3-TTS-GGUF
- 1.0.61 MiniMax-H3-GGUF
- 1.0.62 Muse-Glimmer-30B-GGUF
- 1.0.63 Laguna-XS-2.1-APEX-GGUF
- 1.0.64 Qwen3-30B-A3B-Thinking-2507-GGUF
- 1.0.65 Qwen3.8-27B-GGUF
- 1.0.66 Higgs Audio v3 Studio
- 1.0.67 DeepSeek-V4-Flash-GGUF
- 1.0.68 Qwen3.5-2B-GGUF
- 1.0.69 Qwen3.5-4B-Нецензурирана-HauhauCS-Агресивна
- 1.0.70 Qwen3.5-35B-A3B-GGUF
- 1.0.71 Llama-3.2-3B-Instruct-GGUF
- 1.0.72 gemma-3-1b-it-GGUF
- 1.0.73 Qwen3.5-122B-A10B-MTP-GGUF
- 1.0.74 FLUX.2-klein-4B-GGUF
- 1.0.75 Qwen2.5-7B-Instruct-GGUF
- 1.0.76 Qwen3-30B-A3B-GGUF
- 1.0.77 Qwen3-32B-GGUF
- 1.0.78 Qwen3-1.7B-GGUF
- 1.0.79 Кими-К3-ГГУФ
- 1.0.80 Qwen2.5-0.5B-Instruct-GGUF
- 1.0.81 Qwen3-14B-GGUF
- 1.0.82 Qwen3-0.6B-GGUF
- 1.0.83 Лагуна-S-2.1-GGUF
- 1.0.84 Qwen3.6-35B-A3B-Нецензурирана-Генезис-Хермес-V7-GGUF
- 1.0.85 gemma-gguf
- 1.0.86 Qwen2.5-VL-7B-Instruct-GGUF
- 1.0.87 Qwen3-235B-A22B-GGUF
- 1.0.88 Voxtral-Small-24B-2507-gguf
- 1.0.89 Сугой-14B-Ултра-GGUF
- 1.0.90 Qwen3-ASR-1.7B-gguf
- 1.0.91 Qwen3-30B-A3B-Instruct-2507-GGUF
- 1.0.92 Qwen2.5-3B-Instruct-GGUF
- 1.0.93 gemma-4-12b-heretic-abliterated-GGUF
- 1.0.94 Qwen3.5-122B-A10B-Нецензурирана-HauhauCS-Агресивна
- 1.0.95 Qwen2.5-Coder-7B-Instruct-GGUF
- 1.0.96 Qwen-Image-Edit-2511-GGUF
- 1.0.97 Qwen3-Coder-Next-GGUF
- 1.0.98 Qwen2.5-1.5B-Instruct-GGUF
- 1.0.99 Qwen3.6-35B-A3B-Нецензурирана-Генезис-Хермес-V6-GGUF
- 1.0.100 програми за лапи
- 1.0.101 Qwen2.5-Coder-32B-Instruct-GGUF
- 1.0.102 gemma-4-31B-it-qat-GGUF
- 1.0.103 gemma-4-26B-A4B-it-ultra-uncensored-heretic-i1-GGUF
- 1.0.104 gemma-4-12B-coder-fable5-composer2.5-v1-GGUF
- 1.0.105 намек-GGUF
- 1.0.106 гранит-4.1-3b-GGUF
- 1.0.107 Сугой-32B-Ултра-GGUF
- 1.0.108 Qwen3-VL-4B-Instruct-GGUF
- 1.0.109 madlad400-3b-mt
- 1.0.110 MiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking-GGUF
- 1.0.111 svara-tts-v1
- 1.0.112 Qwen3.6-40B-Claude-4.6-Opus-Deckard-Heretic-Uncensored-Thinking-NEO-CODE-Di-IMatrix-MAX-GGUF
- 1.0.113 Холо-3.1-35B-A3B-GGUF
- 1.0.114 gemma-4-12B-it-qat-q4_0-gguf
- 1.0.115 Qwen3.5-9B-Непокорната-басня-Нецензурирана-Херетик-NEO-IMATRIX-MAX-MTP-GGUF
- 1.0.116 LTX-2.3-GGUF
- 1.0.117 gemma-4-E4B-it-qat-GGUF
- 1.0.118 шепот-голям-v3-турбо-gguf
- 1.0.119 LTX-2
- 1.0.120 Qwen3-4B-GGUF
- 1.0.121 Qwen3.5-0.8B-GGUF
- 1.0.122 Мета-Лама-3.1-8B-Инструкция-GGUF
- 1.0.123 LFM2.5-1.2B-Инструкция-GGUF
- 1.0.124 GLM-5.2-GGUF
- 1.0.125 canary-180m-flash-gguf
- 1.0.126 шепот-голям-v3-gguf
- 1.0.127 Qwen3-8B-GGUF
- 1.0.128 Ян-v3.5-4B-gguf
- 1.0.129 Kimi-K2.7-Code-GGUF
- 1.0.130 MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF
- 1.0.131 Лама-3.2-1B-Инструкция-Q8_0-GGUF
- 1.0.132 Bielik-11B-v3.0-Instruct-awq
- 1.0.133 Wan2.2-I2V-A14B-GGUF
- 1.0.134 Джема-4-31B-то-е-заличена
- 1.0.135 Qwen3.6-27B-Нецензурирана-HauhauCS-Агресивна
- 1.0.136 ThinkingCap-Qwen3.6-27B-GGUF
- 1.0.137 Wan2.1
- 1.0.138 Voxtral-Mini-4B-Realtime-2602-gguf
- 1.0.139 Qwen_Qwen3.6-35B-A3B-GGUF
- 1.0.140 Qwythos-9B-v2-GGUF
- 1.0.141 gemma-4-12B-agentic-fable5-composer2.5-v2-3.5x-tau2-GGUF
- 1.0.142 Сяра-2-база
- 1.0.143 шепот-среден-gguf
- 1.0.144 gemma-4-E2B-it-GGUF
- 1.0.145 папагал-tdt-0.6b-v3-gguf
- 1.0.146 Qwen3.5-9B-Нецензурирана-HauhauCS-Агресивна
- 1.0.147 gemma-4-26B-A4B-it-qat-GGUF
- 1.0.148 gpt-oss-20b-GGUF
- 1.0.149 Qwen3-VL-8B-Instruct-abliterated-GGUF
- 1.0.150 Flux2-Klein-9B-True-V2
- 1.0.151 Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF
- 1.0.152 Qwen3-Coder-30B-A3B-Instruct-GGUF
- 1.0.153 gemma-4-31B-it-GGUF
- 1.0.154 Gemma-4-E4B-Нецензурирана-HauhauCS-Агресивна
- 1.0.155 Qwopus3.6-27B-Coder-Compat-MTP-GGUF
- 1.0.156 UI-TARS-1.5-7B-GGUF
- 1.0.157 Huihui-DeepSeek-V4-Flash-abliterated-ds4-GGUF
- 1.0.158 gemma-4-12B-it-QAT-GGUF
- 1.0.159 Троичен бонсай-27B-gguf
- 1.0.160 Gemmable-4-12B-MTP-GGUF
- 1.0.161 Qwopus3.6-35B-A3B-Кодер-MTP-GGUF
- 1.0.162 Qwen3.6-35B-A3B-MTP-GGUF
- 1.0.163 gemma-4-12b-it-GGUF
- 1.0.164 Qwen3-VL-30B-A3B-Instruct-GGUF
- 1.0.165 модели-преместени
- 1.0.166 cohere-transcribe-03-2026-gguf
- 1.0.167 Qwen-AgentWorld-35B-A3B-GGUF
- 1.0.168 vntl-llama3-8b-v2-gguf
- 1.0.169 gemma-4-E4B-it-GGUF
- 1.0.170 Qwen3.6-27B-GGUF
- 1.0.171 Qwen3.6-35B-A3B-GGUF
- 1.0.172 Hy3-GGUF
- 1.0.173 HyperCLOVAX-SEED-Text-Instruct-1.5B-Q4_K_M-GGUF
- 1.0.174 Qwen3.5-9B-GGUF
- 1.0.175 Qwen3.5-4B-GGUF
- 1.0.176 папагал-унифициран-en-0.6b-gguf
- 1.0.177 nemotron-3.5-asr-streaming-0.6b-gguf
- 1.0.178 gemma-4-26B-A4B-it-GGUF
- 1.0.179 Бонсай-27B-gguf
- 1.0.180 Qwen3.6-35B-A3B-Нецензурирана-HauhauCS-Агресивна
- 1.0.181 Qwythos-9B-Claude-Mythos-5-1M-GGUF
- 1.0.182 Орнит-1.0-35B-GGUF
- 1.0.183 Qwen3.6-27B-MTP-GGUF
- 1.0.184 deepseek-v4-gguf
- 1.0.185 Орнит-1.0-9B-GGUF
- 1.1 Здравей, приятно ми е да се запознаем!
AI модели за Ollama
Всеки модел в тази директория е във формат GGUF, така че работи директно в Ollama. Ето пълния каталог с готови за копиране команди за изтегляне.
Mistral-Small-24B-Instruct-2501-GGUF
24B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.
ollama pull mistral-small-24b-instruct-2501:24bLlama-3-8B-Instruct-32k-v0.1-GGUF
8B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.
ollama pull llama-3-8b-instruct-32k-v0.1:8bSmolLM2-135M-GGUF
Unknown open-weight model from QuantFactory for local AI inference.
ollama pull smollm2-135m:latestQwen3.6-35B-A3B-NVFP4-MTP-GGUF
35B open-weight model from michaelw9999 for local AI inference.
ollama pull qwen3.6-35b-a3b-nvfp4-mtp:35bLlama-3.3-70B-Instruct-GGUF
70B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.
ollama pull llama-3.3-70b:70bgemma-3-4b-it-GGUF
4B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.
ollama pull gemma-3-4b-it:4bMistral-7B-Instruct-v0.3-GGUF
7B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.
ollama pull mistral-7b-instruct-v0.3:7bMixtral-8x22B-v0.1-GGUF
22B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.
ollama pull mixtral-8x22b-v0.1:22bQwen3.8_4B_Distilled_GGUF
4B open-weight model from Ma7ee7 for local AI inference.
ollama pull qwen3.8-4b-distilled-gguf:4bМета-Лама-3-8B-Инструкция-GGUF
8B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.
ollama pull meta-llama-3-8b:8bMelody1437-26B-A4B-v2.0-GGUF
26B open-weight model from ReadyArt for local AI inference.
ollama pull melody1437-26b-a4b-v2.0:26bSerenity-26B-A4B-GGUF
26B open-weight model from ReadyArt for local AI inference.
ollama pull serenity-26b-a4b:26bDark-Scarlett-v0.3-26B-A4B-GGUF
26B open-weight model from ReadyArt for local AI inference.
ollama pull dark-scarlett-v0.3-26b-a4b:26bXYZAILab_XYZ-Aquila-mini-GGUF
Unknown open-weight model from bartowski for local AI inference.
ollama pull xyzailab-xyz-aquila-mini:latestQwen3.5-4B-Claude-4.6-Opus-Reasoning-Distilled-GGUF
4B модел с отворено тегло от Jackrong за локално извеждане с изкуствен интелект.
ollama pull qwen3.5-4b-claude-4.6-opus-reasoning-distilled:4bParable-Granite-4.1-8B-Claude-Fable-5-GGUF
8B модел с отворено тегло от AnkitAI за локално извеждане с изкуствен интелект.
ollama pull parable-granite-4.1-8b-claude-fable-5:8bQwen3.6-14B-A3B-FableVibes-GGUF
14B open-weight model from tvall43 for local AI inference.
ollama pull qwen3.6-14b-a3b-fablevibes:14bMiniMax-H3-Pruned-GGUF
Unknown open-weight model from Abiray for local AI inference.
ollama pull minimax-h3-pruned:latestQwen_Qwen3.5-0.8B-GGUF
0.8B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen-qwen3.5-0.8b:0.8bQwen3.6-35B-A3B-APEX-GGUF
35B open-weight model from mudler for local AI inference.
ollama pull qwen3.6-35b-a3b-apex:35bsupergemma4-26b-uncensored-gguf-v2
26B open-weight model from Jiunsong for local AI inference.
ollama pull supergemma4-26b-uncensored-gguf-v2:26bgemma-4-26B-A4B-it-APEX-GGUF
26B open-weight model from mudler for local AI inference.
ollama pull gemma-4-26b-a4b-it-apex:26bQwopus3.6-27B-Coder-MTP-GGUF
27B модел с отворено тегло от Jackrong за локално извеждане с изкуствен интелект.
ollama pull qwopus3.6-27b-coder-mtp:27bQwen_Qwen3.5-2B-GGUF
2B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen-qwen3.5-2b:2bQwen3.5-397B-A17B-GGUF
397B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen3.5-397b-a17b:397bQwen3-4B-Instruct-2507-GGUF
4B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.
ollama pull qwen3-4b-instruct-2507:4bТроичен бонсай-8B-gguf
8B модел с отворено тегло от prism-ml за локално извеждане с изкуствен интелект.
ollama pull ternary-bonsai-8b:8bPinkCherry_NSFW_LTX23
Unknown open-weight model from SexGod1979 for local AI inference.
ollama pull pinkcherry-nsfw-ltx23:latestParable-Granite-4.1-3B-Claude-Fable-5-GGUF
3B модел с отворено тегло от AnkitAI за локално извеждане с изкуствен интелект.
ollama pull parable-granite-4.1-3b-claude-fable-5:3bQwen_Qwen3.5-35B-A3B-GGUF
35B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen-qwen3.5-35b-a3b:35bendless-frontier_BigBang-v1-GGUF
Unknown open-weight model from bartowski for local AI inference.
ollama pull endless-frontier-bigbang-v1:latestQwen_Qwen3.5-4B-GGUF
4B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen-qwen3.5-4b:4bQwen3.6-27B-Heretic-Uncensored-FINETUNE-NEO-CODE-Di-IMatrix-MAX-GGUF
27B модел с отворено тегло от DavidAU за локално извеждане с изкуствен интелект.
ollama pull qwen3.6-27b-heretic-uncensored-finetune-neo-code-di-imatrix-max:27bQwen3.5-9B-DeepSeek-V4-Flash-GGUF
9B модел с отворено тегло от Jackrong за локално извеждане с изкуствен интелект.
ollama pull qwen3.5-9b-deepseek-v4-flash:9bПритча-Qwen3-8B-Claude-Fable-5-GGUF
8B модел с отворено тегло от AnkitAI за локално извеждане с изкуствен интелект.
ollama pull parable-qwen3-8b-claude-fable-5:8bgrug-27b-gguf
27B open-weight model from ProCreations for local AI inference.
ollama pull grug-27b:27bGLM-4.7-Flash-GGUF
Неизвестен модел с отворено тегло от unsloth за локално извеждане от изкуствен интелект.
ollama pull glm-4.7-flash:latestgemma-4-31B-it-qat-q4_0-gguf
31B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.
ollama pull gemma-4-31b-it-qat-q4-0:31bQwen3.5-27B-GGUF
27B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen3.5-27b:27bKwaipilot_KAT-Coder-V2.5-Dev-GGUF
Unknown open-weight model from bartowski for local AI inference.
ollama pull kwaipilot-kat-coder-v2.5-dev:latestПритча-Qwen3-4B-Claude-Fable-5-GGUF
4B модел с отворено тегло от AnkitAI за локално извеждане с изкуствен интелект.
ollama pull parable-qwen3-4b-claude-fable-5:4bgemma-4-E2B-it-qat-GGUF
2B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.
ollama pull gemma-4-e2b-it-qat:2bACE-Step-1.5-GGUF
Unknown open-weight model from Serveurperso for local AI inference.
ollama pull ace-step-1.5:latestHuihui-DeepSeek-V4-Flash-0731-abliterated-GGUF
Неизвестен модел с отворено тегло от huihui-ai за локално извеждане с изкуствен интелект.
ollama pull huihui-deepseek-v4-flash-0731-abliterated:latestPOCKET-35B-GGUF
35B open-weight model from FINAL-Bench for local AI inference.
ollama pull pocket-35b:35bgemma-4-26B-A4B-it-qat-q4_0-gguf
26B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.
ollama pull gemma-4-26b-a4b-it-qat-q4-0:26bgemma-4-E2B-it-qat-q4_0-gguf
2B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.
ollama pull gemma-4-e2b-it-qat-q4-0:2bgemma-4-E4B-it-qat-q4_0-gguf
4B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.
ollama pull gemma-4-e4b-it-qat-q4-0:4bавтомобилен
Unknown open-weight model from flywheel-ai for local AI inference.
ollama pull automotive:latestDeepSeek-V4-Flash-0731-GGUF
Неизвестен модел с отворено тегло от DeepSeek за локално извеждане с изкуствен интелект.
ollama pull deepseek-v4-flash-0731:latestLFM2.5-2.6B-GGUF
2.6B модел с отворено тегло от LiquidAI за локално извеждане от ИИ.
ollama pull lfm2.5-2.6b:2.6bQwen3.5-122B-A10B-GGUF
122B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen3.5-122b-a10b:122bQwen3.8-27B-Uncensored-GGUF
27B open-weight model from JonathanColetti for local AI inference.
ollama pull qwen3.8-27b-uncensored:27bMiniMax-H3
Неизвестен модел с отворено тегло от DeepBeepMeep за локално извеждане с изкуствен интелект.
ollama pull minimax-h3:latestMiniMax-H3_GGUFs
Unknown open-weight model from realrebelai for local AI inference.
ollama pull minimax-h3-ggufs:latestaudio.cpp-gguf
Unknown open-weight model from audio-cpp for local AI inference.
ollama pull audio.cpp:latestInkling-Small-GGUF
Неизвестен модел с отворено тегло от unsloth за локално извеждане от изкуствен интелект.
ollama pull inkling-small:latestmaple-preview-GGUF
Unknown open-weight model from deepgrove for local AI inference.
ollama pull maple-preview:latestKAT-Coder-V2.5-Dev-APEX-GGUF
Unknown open-weight model from mudler for local AI inference.
ollama pull kat-coder-v2.5-dev-apex:latestQwen3-TTS-GGUF
Unknown open-weight model from Serveurperso for local AI inference.
ollama pull qwen3-tts:latestMiniMax-H3-GGUF
Unknown open-weight model from Abiray for local AI inference.
ollama pull minimax-h3:latestMuse-Glimmer-30B-GGUF
30B модел с отворено тегло от Unsloth за локално извеждане с изкуствен интелект.
ollama pull muse-glimmer-30b:30bLaguna-XS-2.1-APEX-GGUF
Unknown open-weight model from mudler for local AI inference.
ollama pull laguna-xs-2.1-apex:latestQwen3-30B-A3B-Thinking-2507-GGUF
30B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen3-30b-a3b-thinking-2507:30bQwen3.8-27B-GGUF
27B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen3.8-27b:27bHiggs Audio v3 Studio
Неизвестен модел с отворено тегло от drbaph за локален AI извод.
ollama pull higgs-audio-v3-studio:latestDeepSeek-V4-Flash-GGUF
Неизвестен модел с отворено тегло от DeepSeek за локално извеждане с изкуствен интелект.
ollama pull deepseek-v4-flash:latestQwen3.5-2B-GGUF
2B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen3.5-2b:2bQwen3.5-4B-Нецензурирана-HauhauCS-Агресивна
4B модел с отворено тегло от HauhauCS за локално извеждане с изкуствен интелект.
ollama pull qwen3.5-4b-uncensored-hauhaucs-aggressive:4bQwen3.5-35B-A3B-GGUF
35B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen3.5-35b-a3b:35bLlama-3.2-3B-Instruct-GGUF
3B модел с отворено тегло от Meta за локално извеждане с изкуствен интелект.
ollama pull llama-3.2-3b:3bgemma-3-1b-it-GGUF
1B модел с отворено тегло от ggml-org за локално извеждане с изкуствен интелект.
ollama pull gemma-3-1b-it:1bQwen3.5-122B-A10B-MTP-GGUF
122B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen3.5-122b-a10b-mtp:122bFLUX.2-klein-4B-GGUF
4B модел с отворено тегло от Unsloth за локално извеждане с изкуствен интелект.
ollama pull flux.2-klein-4b:4bQwen2.5-7B-Instruct-GGUF
7B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen2.5-7b:7bQwen3-30B-A3B-GGUF
30B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.
ollama pull qwen3-30b-a3b:30bQwen3-32B-GGUF
32B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.
ollama pull qwen3-32b:32bQwen3-1.7B-GGUF
1.7B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.
ollama pull qwen3-1.7b:1.7bКими-К3-ГГУФ
Неизвестен модел с отворено тегло от unsloth за локално извеждане от изкуствен интелект.
ollama pull kimi-k3:latestQwen2.5-0.5B-Instruct-GGUF
0.5B модел с отворено тегло от Qwen за локално извеждане с изкуствен интелект.
ollama pull qwen2.5-0.5b:0.5bQwen3-14B-GGUF
14B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.
ollama pull qwen3-14b:14bQwen3-0.6B-GGUF
0.6B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.
ollama pull qwen3-0.6b:0.6bЛагуна-S-2.1-GGUF
Неизвестен модел с отворено тегло от unsloth за локално извеждане от изкуствен интелект.
ollama pull laguna-s-2.1:latestQwen3.6-35B-A3B-Нецензурирана-Генезис-Хермес-V7-GGUF
35B модел с отворено тегло от LuffyTheFox за локално извеждане с изкуствен интелект.
ollama pull qwen3.6-35b-a3b-uncensored-genesis-hermes-v7:35bgemma-gguf
Неизвестен модел с отворено тегло от rahul7star за локално извеждане с изкуствен интелект.
ollama pull gemma:latestQwen2.5-VL-7B-Instruct-GGUF
7B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen2.5-vl-7b:7bQwen3-235B-A22B-GGUF
235B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen3-235b-a22b:235bVoxtral-Small-24B-2507-gguf
24B модел с отворено тегло от handy-computer за локално извеждане с изкуствен интелект.
ollama pull voxtral-small-24b-2507:24bСугой-14B-Ултра-GGUF
14B модел с отворено тегло от sugoitoolkit за локално извеждане с изкуствен интелект.
ollama pull sugoi-14b-ultra:14bQwen3-ASR-1.7B-gguf
1.7B модел с отворено тегло от handy-computer за локално извеждане с изкуствен интелект.
ollama pull qwen3-asr-1.7b:1.7bQwen3-30B-A3B-Instruct-2507-GGUF
30B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen3-30b-a3b-instruct-2507:30bQwen2.5-3B-Instruct-GGUF
3B модел с отворено тегло от Qwen за локално извеждане с изкуствен интелект.
ollama pull qwen2.5-3b:3bgemma-4-12b-heretic-abliterated-GGUF
12B модел с отворено тегло от culturerevolt за локално извеждане с изкуствен интелект.
ollama pull gemma-4-12b-heretic-abliterated:12bQwen3.5-122B-A10B-Нецензурирана-HauhauCS-Агресивна
122B модел с отворено тегло от HauhauCS за локално извеждане с изкуствен интелект.
ollama pull qwen3.5-122b-a10b-uncensored-hauhaucs-aggressive:122bQwen2.5-Coder-7B-Instruct-GGUF
7B модел с отворено тегло от Qwen за локално извеждане с изкуствен интелект.
ollama pull qwen2.5-coder-7b:7bQwen-Image-Edit-2511-GGUF
Неизвестен модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen-image-edit-2511:latestQwen3-Coder-Next-GGUF
Неизвестен модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen3-coder-next:latestQwen2.5-1.5B-Instruct-GGUF
1.5B модел с отворено тегло от Qwen за локално извеждане с изкуствен интелект.
ollama pull qwen2.5-1.5b:1.5bQwen3.6-35B-A3B-Нецензурирана-Генезис-Хермес-V6-GGUF
35B модел с отворено тегло от LuffyTheFox за локално извеждане с изкуствен интелект.
ollama pull qwen3.6-35b-a3b-uncensored-genesis-hermes-v6:35bпрограми за лапи
Неизвестен модел с отворено тегло от programasweights за локален AI извод.
ollama pull paw-programs:latestQwen2.5-Coder-32B-Instruct-GGUF
32B модел с отворено тегло от Qwen за локално извеждане с изкуствен интелект.
ollama pull qwen2.5-coder-32b:32bgemma-4-31B-it-qat-GGUF
31B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.
ollama pull gemma-4-31b-it-qat:31bgemma-4-26B-A4B-it-ultra-uncensored-heretic-i1-GGUF
26B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.
ollama pull gemma-4-26b-a4b-it-ultra-uncensored-heretic-i1:26bgemma-4-12B-coder-fable5-composer2.5-v1-GGUF
12B модел с отворено тегло от yuxinlu1 за локално извеждане с изкуствен интелект.
ollama pull gemma-4-12b-coder-fable5-composer2.5-v1:12bнамек-GGUF
Неизвестен модел с отворено тегло от unsloth за локално извеждане от изкуствен интелект.
ollama pull inkling:latestгранит-4.1-3b-GGUF
3B модел с отворено тегло от ibm-granite за локално извеждане с изкуствен интелект.
ollama pull granite-4.1-3b:3bСугой-32B-Ултра-GGUF
32B модел с отворено тегло от sugoitoolkit за локално извеждане с изкуствен интелект.
ollama pull sugoi-32b-ultra:32bQwen3-VL-4B-Instruct-GGUF
4B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen3-vl-4b:4bmadlad400-3b-mt
3B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.
ollama pull madlad400-3b-mt:3bMiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking-GGUF
1B модел с отворено тегло от GnLOLot за локално извеждане с изкуствен интелект.
ollama pull minicpm5-1b-claude-opus-fable5-v2-thinking:1bsvara-tts-v1
Неизвестен модел с отворено тегло от kenpath за локално извеждане с изкуствен интелект.
ollama pull svara-tts-v1:latestQwen3.6-40B-Claude-4.6-Opus-Deckard-Heretic-Uncensored-Thinking-NEO-CODE-Di-IMatrix-MAX-GGUF
40B модел с отворено тегло от DavidAU за локално извеждане с изкуствен интелект.
ollama pull qwen3.6-40b-claude-4.6-opus-deckard-heretic-uncensored-thinking-neo-code-di-imatrix-max:40bХоло-3.1-35B-A3B-GGUF
35B модел с отворено тегло от Hcompany за локално извеждане с изкуствен интелект.
ollama pull holo-3.1-35b-a3b:35bgemma-4-12B-it-qat-q4_0-gguf
12B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.
ollama pull gemma-4-12b-it-qat-q4-0:12bQwen3.5-9B-Непокорната-басня-Нецензурирана-Херетик-NEO-IMATRIX-MAX-MTP-GGUF
9B модел с отворено тегло от DavidAU за локално извеждане с изкуствен интелект.
ollama pull qwen3.5-9b-the-defiant-fable-uncensored-heretic-neo-imatrix-max-mtp:9bLTX-2.3-GGUF
Неизвестен модел с отворено тегло от unsloth за локално извеждане от изкуствен интелект.
ollama pull ltx-2.3:latestgemma-4-E4B-it-qat-GGUF
4B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.
ollama pull gemma-4-e4b-it-qat:4bшепот-голям-v3-турбо-gguf
Неизвестен модел с отворено тегло от удобен компютър за локално извеждане с изкуствен интелект.
ollama pull whisper-large-v3-turbo:latestLTX-2
Неизвестен модел с отворено тегло от DeepBeepMeep за локално извеждане с изкуствен интелект.
ollama pull ltx-2:latestQwen3-4B-GGUF
4B модел с отворено тегло от Qwen за локално извеждане с изкуствен интелект.
ollama pull qwen3-4b:4bQwen3.5-0.8B-GGUF
0.8B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen3.5-0.8b:0.8bМета-Лама-3.1-8B-Инструкция-GGUF
8B модел с отворено тегло от Meta за локално извеждане с изкуствен интелект.
ollama pull meta-llama-3.1-8b:8bLFM2.5-1.2B-Инструкция-GGUF
1.2B модел с отворено тегло от LiquidAI за локално извеждане от ИИ.
ollama pull lfm2.5-1.2b:1.2bGLM-5.2-GGUF
Неизвестен модел с отворено тегло от unsloth за локално извеждане от изкуствен интелект.
ollama pull glm-5.2:latestcanary-180m-flash-gguf
Неизвестен модел с отворено тегло от удобен компютър за локално извеждане с изкуствен интелект.
ollama pull canary-180m-flash:latestшепот-голям-v3-gguf
Неизвестен модел с отворено тегло от удобен компютър за локално извеждане с изкуствен интелект.
ollama pull whisper-large-v3:latestQwen3-8B-GGUF
8B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen3-8b:8bЯн-v3.5-4B-gguf
4B модел с отворено тегло от janhq за локално извеждане с изкуствен интелект.
ollama pull jan-v3.5-4b:4bKimi-K2.7-Code-GGUF
Неизвестен модел с отворено тегло от unsloth за локално извеждане от изкуствен интелект.
ollama pull kimi-k2.7-code:latestMiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF
1B модел с отворено тегло от GnLOLot за локално извеждане с изкуствен интелект.
ollama pull minicpm5-1b-claude-opus-fable5-thinking:1bЛама-3.2-1B-Инструкция-Q8_0-GGUF
1B модел с отворено тегло от прегръщащи кванти за локален ИИ извод.
ollama pull llama-3.2-1b-instruct-q8-0:1bBielik-11B-v3.0-Instruct-awq
11B модел с отворено тегло от speakleash за локално извеждане с изкуствен интелект.
ollama pull bielik-11b-v3.0-instruct-awq:11bWan2.2-I2V-A14B-GGUF
14B модел с отворено тегло от QuantStack за локално извеждане с изкуствен интелект.
ollama pull wan2.2-i2v-a14b:14bДжема-4-31B-то-е-заличена
31B модел с отворено тегло от paperscarecrow за локално извеждане с изкуствен интелект.
ollama pull gemma-4-31b-it-abliterated:31bQwen3.6-27B-Нецензурирана-HauhauCS-Агресивна
27B модел с отворено тегло от HauhauCS за локално извеждане с изкуствен интелект.
ollama pull qwen3.6-27b-uncensored-hauhaucs-aggressive:27bThinkingCap-Qwen3.6-27B-GGUF
27B модел с отворено тегло от bottlecapai за локално извеждане с изкуствен интелект.
ollama pull thinkingcap-qwen3.6-27b:27bWan2.1
Неизвестен модел с отворено тегло от DeepBeepMeep за локално извеждане с изкуствен интелект.
ollama pull wan2.1:latestVoxtral-Mini-4B-Realtime-2602-gguf
4B модел с отворено тегло от handy-computer за локално извеждане с изкуствен интелект.
ollama pull voxtral-mini-4b-realtime-2602:4bQwen_Qwen3.6-35B-A3B-GGUF
35B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen-qwen3.6-35b-a3b:35bQwythos-9B-v2-GGUF
9B модел с отворено тегло от empero-ai за локално извеждане с изкуствен интелект.
ollama pull qwythos-9b-v2:9bgemma-4-12B-agentic-fable5-composer2.5-v2-3.5x-tau2-GGUF
12B модел с отворено тегло от yuxinlu1 за локално извеждане с изкуствен интелект.
ollama pull gemma-4-12b-agentic-fable5-composer2.5-v2-3.5x-tau2:12bСяра-2-база
Неизвестен модел с отворено тегло от SulfurAI за локално извеждане от ИИ.
ollama pull sulphur-2-base:latestшепот-среден-gguf
Неизвестен модел с отворено тегло от удобен компютър за локално извеждане с изкуствен интелект.
ollama pull whisper-medium:latestgemma-4-E2B-it-GGUF
2B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.
ollama pull gemma-4-e2b-it:2bпапагал-tdt-0.6b-v3-gguf
0.6B модел с отворено тегло от handy-computer за локално извеждане с изкуствен интелект.
ollama pull parakeet-tdt-0.6b-v3:0.6bQwen3.5-9B-Нецензурирана-HauhauCS-Агресивна
9B модел с отворено тегло от HauhauCS за локално извеждане с изкуствен интелект.
ollama pull qwen3.5-9b-uncensored-hauhaucs-aggressive:9bgemma-4-26B-A4B-it-qat-GGUF
26B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.
ollama pull gemma-4-26b-a4b-it-qat:26bgpt-oss-20b-GGUF
20B модел с отворено тегло от Unsloth за локално извеждане с изкуствен интелект.
ollama pull gpt-oss-20b:20bQwen3-VL-8B-Instruct-abliterated-GGUF
Qwen3-VL-8B-Instruct-abliterated-GGUF is an 8-billion parameter vision-language model developed by Alibaba that has been fully abliterated to remove proprietary constraints while retaining core capabilities. This model excels at handling complex visual reasoning and multi-step tasks within a conversational framework, making it ideal for open-ended analysis and creative generation in the US region. Running this GGUF quantized version locally is highly practical for users with mid-range GPUs, offering fast inference speeds without requiring specialized enterprise hardware.
ollama pull qwen3-vl-8b-instruct-abliterated:8bFlux2-Klein-9B-True-V2
9B модел с отворено тегло от wikeeyang за локално извеждане с изкуствен интелект.
ollama pull flux2-klein-9b-true-v2:9bQwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF
The Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF is a 27-billion parameter large language model created by DavidAU that combines multiple fine-tuning techniques including Unsloth and Heretic methods. This model excels at generating uncensored, highly creative, and unrestricted content across diverse topics, making it ideal for users seeking an abliterated assistant capable of multi-stage tuned responses without safety filters. Running this GGUF quantized version locally requires a substantial GPU with ample VRAM to handle the 27B parameter load efficiently, offering best performance on systems equipped with high-end hardware for fast inference speeds.
ollama pull qwen3.6-27b-fable-fusion-711-uncensored-heretic-nm-dau-neo-max-mtp:27bQwen3-Coder-30B-A3B-Instruct-GGUF
Qwen3-Coder-30B-A3B-Instruct-GGUF is a 30-billion parameter coding model developed by Alibaba that integrates advanced instruction tuning for specialized tasks. It excels at complex code generation, debugging, and conversational programming assistance, making it ideal for developers seeking high-performance solutions in the US region. Running this model locally requires substantial GPU memory to handle its large parameter count, so it is best suited for users with powerful hardware who prioritize raw coding capability over speed.
ollama pull qwen3-coder-30b-a3b:30bgemma-4-31B-it-GGUF
31B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.
ollama pull gemma-4-31b-it:31bGemma-4-E4B-Нецензурирана-HauhauCS-Агресивна
Gemma-4-E4B-Uncensored-HauhauCS-Aggressive е мултимодален модел с 4 милиарда параметра, разработен от HauhauCS, който интегрира разширени възможности от Gemma 4 с аблатирани филтри за безопасност. Този агресивен вариант се отличава с неограничено генериране на текст, визуален анализ и обработка на аудио, което го прави идеален за творчески задачи, изискващи суров изход без модериране на съдържание. Локалното изпълнение на този модел изисква значителна графична памет за обработка на мултимодалните входове и потребителите трябва да очакват високи изчислителни разходи при обработка на сложни аудио или видео потоци.
ollama pull gemma-4-e4b-uncensored-hauhaucs-aggressive:4bQwopus3.6-27B-Coder-Compat-MTP-GGUF
27B модел с отворено тегло от Jackrong за локално извеждане с изкуствен интелект.
ollama pull qwopus3.6-27b-coder-compat-mtp:27bUI-TARS-1.5-7B-GGUF
7B модел с отворено тегло от mradermacher за локално извеждане с изкуствен интелект.
ollama pull ui-tars-1.5-7b:7bHuihui-DeepSeek-V4-Flash-abliterated-ds4-GGUF
Неизвестен модел с отворено тегло от huihui-ai за локално извеждане с изкуствен интелект.
ollama pull huihui-deepseek-v4-flash-abliterated-ds4:latestgemma-4-12B-it-QAT-GGUF
12B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.
ollama pull gemma-4-12b-it-qat:12bТроичен бонсай-27B-gguf
27B модел с отворено тегло от prism-ml за локално извеждане с изкуствен интелект.
ollama pull ternary-bonsai-27b:27bGemmable-4-12B-MTP-GGUF
12B модел с отворено тегло от Mia-AiLab за локално извеждане с изкуствен интелект.
ollama pull gemmable-4-12b-mtp:12bQwopus3.6-35B-A3B-Кодер-MTP-GGUF
35B модел с отворено тегло от Jackrong за локално извеждане с изкуствен интелект.
ollama pull qwopus3.6-35b-a3b-coder-mtp:35bQwen3.6-35B-A3B-MTP-GGUF
35B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen3.6-35b-a3b-mtp:35bgemma-4-12b-it-GGUF
12B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.
ollama pull gemma-4-12b-it:12bQwen3-VL-30B-A3B-Instruct-GGUF
30B модел с отворено тегло от Qwen за локално извеждане с изкуствен интелект.
ollama pull qwen3-vl-30b-a3b:30bмодели-преместени
The models-moved collection is provided by ggml-org and currently lists an unknown parameter count for its various model files. These models excel at general-purpose tasks within the US region and are best suited for users seeking accessible inference options from this specific provider. Running them locally requires downloading the appropriate GGUF quantization files, with performance varying significantly based on your GPU or CPU hardware capabilities.
ollama pull models-moved:latestcohere-transcribe-03-2026-gguf
Неизвестен модел с отворено тегло от удобен компютър за локално извеждане с изкуствен интелект.
ollama pull cohere-transcribe-03-2026:latestQwen-AgentWorld-35B-A3B-GGUF
35B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.
ollama pull qwen-agentworld-35b-a3b:35bvntl-llama3-8b-v2-gguf
The vntl-llama3-8b-v2-gguf is an 8B parameter language model developed by lmg-anon that specializes in high-quality translation and conversational tasks. It excels at processing the VNTL-v5-1k dataset to deliver fluent responses, making it ideal for multilingual chat applications and localized content generation. Running this model locally requires a GPU with sufficient VRAM to handle its 8B parameter weight efficiently, ensuring responsive performance for real-time dialogue.
ollama pull vntl-llama3-8b-v2:8bgemma-4-E4B-it-GGUF
The gemma-4-E4B-it-GGUF is a 4-billion parameter language model developed by Google and optimized for Italian using GGUF quantization. It excels at handling complex reasoning tasks within the Gemma 4 architecture while supporting efficient image-to-text conversions through specialized unsloth optimizations. Running this model locally requires a modern GPU to leverage its speed, making it ideal for users seeking high-performance local inference without cloud dependencies.
ollama pull gemma-4-e4b-it:4bQwen3.6-27B-GGUF
Qwen3.6-27B-GGUF is a 27-billion parameter large language model developed by Alibaba that supports advanced conversational AI and image-to-text capabilities. It excels at complex reasoning tasks, multilingual communication, and visual analysis, making it ideal for professional applications requiring high accuracy in text generation and understanding. Running this model locally typically demands substantial GPU memory and a powerful processor to handle its 27B parameters efficiently, so it is best suited for users with dedicated hardware or access to cloud instances.
ollama pull qwen3.6-27b:27bQwen3.6-35B-A3B-GGUF
Qwen3.6-35B-A3B-GGUF is a 35-billion parameter large language model developed by Alibaba that features specialized optimizations for image-to-text conversion and multilingual conversation. This model excels at handling complex visual reasoning tasks and maintaining coherent dialogue, making it ideal for applications requiring deep contextual understanding across diverse topics. Running this model locally requires substantial GPU memory to handle its full parameter count, though quantized GGUF versions can offer a practical balance between speed and performance on high-end consumer hardware.
ollama pull qwen3.6-35b-a3b:35bHy3-GGUF
Неизвестен модел с отворено тегло от vcruz305 за локално извеждане от изкуствен интелект.
ollama pull hy3:latestHyperCLOVAX-SEED-Text-Instruct-1.5B-Q4_K_M-GGUF
HyperCLOVAX-SEED-Text-Instruct-1.5B-Q4_K_M-GGUF is a 1.5 billion parameter language model created by rippertnt and optimized for use with llama-cpp. It excels at conversational tasks and general text generation, making it ideal for lightweight chat applications that require efficient inference on standard hardware. Running this model locally is practical even on modest systems due to its quantized format, offering fast response times without the need for high-end GPUs.
ollama pull hyperclovax-seed-text-instruct-1.5b-q4-k-m:1.5bQwen3.5-9B-GGUF
Qwen3.5-9B-GGUF is a compact large language model developed by Alibaba containing 9 billion parameters. It excels at conversational tasks and image-to-text conversion, making it ideal for lightweight applications that require efficient region US deployment. Running this model locally is practical on consumer-grade hardware thanks to its small footprint, offering fast inference speeds even on modest GPUs when paired with optimization libraries like Unsloth.
ollama pull qwen3.5-9b:9bQwen3.5-4B-GGUF
Qwen3.5-4B-GGUF is a compact 4-billion parameter language model developed by Alibaba that supports conversational tasks and image-to-text conversion. It excels at handling lightweight inference workloads while maintaining strong performance in unsloth-optimized environments for text generation. Running this model locally requires minimal hardware resources, making it ideal for users seeking fast, efficient deployment on standard consumer devices.
ollama pull qwen3.5-4b:4bпапагал-унифициран-en-0.6b-gguf
0.6B модел с отворено тегло от handy-computer за локално извеждане с изкуствен интелект.
ollama pull parakeet-unified-en-0.6b:0.6bnemotron-3.5-asr-streaming-0.6b-gguf
0.6B модел с отворено тегло от handy-computer за локално извеждане с изкуствен интелект.
ollama pull nemotron-3.5-asr-streaming-0.6b:0.6bgemma-4-26B-A4B-it-GGUF
The gemma-4-26B-A4B-it-GGUF is a 26-billion parameter large language model developed by Google that leverages advanced instruction tuning for high-performance reasoning. This model excels at complex text generation and multimodal tasks, making it ideal for applications requiring deep contextual understanding and precise instruction following. Running this model locally demands substantial GPU memory and significant compute power, so it is best suited for users with high-end hardware or those utilizing optimized inference frameworks like Unsloth to manage its resource requirements.
ollama pull gemma-4-26b-a4b-it:26bБонсай-27B-gguf
Bonsai-27B-gguf is a compact 27-billion parameter language model developed by prism-ml that utilizes quantization for efficient deployment. It excels at conversational tasks and general reasoning while running smoothly on llama.cpp with support for both CPU and CUDA hardware acceleration. Users can run this model locally on modest hardware, though performance will vary depending on whether they utilize 1-bit quantization or have access to a GPU.
ollama pull bonsai-27b:27bQwen3.6-35B-A3B-Нецензурирана-HauhauCS-Агресивна
Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive is a 35-billion parameter large language model developed by HauhauCS that combines MoE architecture with advanced multimodal and vision capabilities. It excels at complex reasoning, multilingual image-text analysis, and generating uncensored content for aggressive or unrestricted use cases where standard safety filters are undesirable. Running this model locally requires substantial high-end GPU memory to handle its sparse mixture-of-experts structure, making it best suited for powerful workstations or servers with significant VRAM available.
ollama pull qwen3.6-35b-a3b-uncensored-hauhaucs-aggressive:35bQwythos-9B-Claude-Mythos-5-1M-GGUF
9B модел с отворено тегло от empero-ai за локално извеждане с изкуствен интелект.
ollama pull qwythos-9b-claude-mythos-5-1m:9bОрнит-1.0-35B-GGUF
Ornith-1.0-35B-GGUF is a 35-billion parameter language model developed by ornith-ai specifically for conversational tasks within the US region. It excels at maintaining natural dialogue flows and handling context-aware interactions, making it ideal for chatbots and virtual assistants. Running this model locally requires substantial GPU memory to handle its size efficiently, so it is best suited for users with high-end hardware or those willing to use quantized GGUF versions to reduce resource demands.
ollama pull ornith-1.0-35b:35bQwen3.6-27B-MTP-GGUF
Qwen3.6-27B-MTP-GGUF is a 27-billion parameter large language model developed by Alibaba that supports advanced conversational tasks and image-to-text conversion. It excels at handling complex reasoning and multi-turn dialogues, making it ideal for applications requiring deep contextual understanding and visual analysis. Running this model locally typically demands high-end GPU hardware to manage its substantial memory footprint, though quantized GGUF versions can offer a practical balance between speed and performance on consumer-grade systems.
ollama pull qwen3.6-27b-mtp:27bdeepseek-v4-gguf
The deepseek-v4-gguf model is a quantized Mixture-of-Experts architecture provided by antirez with unknown parameter counts available in 2-bit and 4-bit formats. It excels at efficient inference for large language tasks while maintaining high performance through its specialized MoE structure, making it ideal for users needing reduced memory footprints without significant capability loss. Running this model locally requires moderate hardware resources to handle the quantized weights effectively, offering a fast and practical solution for deploying advanced AI capabilities on consumer-grade systems.
ollama pull deepseek-v4:latestОрнит-1.0-9B-GGUF
Ornith-1.0-9B-GGUF is a 9-billion parameter language model developed by ornith-ai designed for conversational interactions within the US region. It excels at generating natural dialogue and handling casual chat tasks, making it ideal for lightweight virtual assistants or simple customer support bots. Running this model locally requires modest hardware resources, allowing it to operate quickly on consumer-grade GPUs without needing massive data centers.
ollama pull ornith-1.0-9b:9b
