Олама Модели

Съдържание

AI модели за Ollama

Всеки модел в тази директория е във формат GGUF, така че работи директно в Ollama. Ето пълния каталог с готови за копиране команди за изтегляне.

Mistral-Small-24B-Instruct-2501-GGUF

МазиярПанахи24B24 GB RAM

24B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.

ollama pull mistral-small-24b-instruct-2501:24b

Llama-3-8B-Instruct-32k-v0.1-GGUF

МазиярПанахи8B16 GB RAM

8B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.

ollama pull llama-3-8b-instruct-32k-v0.1:8b

SmolLM2-135M-GGUF

QuantFactoryнеизвестен8 GB RAM

Unknown open-weight model from QuantFactory for local AI inference.

ollama pull smollm2-135m:latest

Qwen3.6-35B-A3B-NVFP4-MTP-GGUF

michaelw999935B48 GB RAM

35B open-weight model from michaelw9999 for local AI inference.

ollama pull qwen3.6-35b-a3b-nvfp4-mtp:35b

Llama-3.3-70B-Instruct-GGUF

МазиярПанахи70B48 GB RAM

70B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.

ollama pull llama-3.3-70b:70b

gemma-3-4b-it-GGUF

МазиярПанахи4B8 GB RAM

4B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.

ollama pull gemma-3-4b-it:4b

Mistral-7B-Instruct-v0.3-GGUF

МазиярПанахи7B8 GB RAM

7B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.

ollama pull mistral-7b-instruct-v0.3:7b

Mixtral-8x22B-v0.1-GGUF

МазиярПанахи22B24 GB RAM

22B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.

ollama pull mixtral-8x22b-v0.1:22b

Qwen3.8_4B_Distilled_GGUF

Ma7ee74B8 GB RAM

4B open-weight model from Ma7ee7 for local AI inference.

ollama pull qwen3.8-4b-distilled-gguf:4b

Мета-Лама-3-8B-Инструкция-GGUF

МазиярПанахи8B16 GB RAM

8B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.

ollama pull meta-llama-3-8b:8b

Melody1437-26B-A4B-v2.0-GGUF

ReadyArt26B24 GB RAM

26B open-weight model from ReadyArt for local AI inference.

ollama pull melody1437-26b-a4b-v2.0:26b

Serenity-26B-A4B-GGUF

ReadyArt26B24 GB RAM

26B open-weight model from ReadyArt for local AI inference.

ollama pull serenity-26b-a4b:26b

Dark-Scarlett-v0.3-26B-A4B-GGUF

ReadyArt26B24 GB RAM

26B open-weight model from ReadyArt for local AI inference.

ollama pull dark-scarlett-v0.3-26b-a4b:26b

XYZAILab_XYZ-Aquila-mini-GGUF

bartowskiнеизвестен8 GB RAM

Unknown open-weight model from bartowski for local AI inference.

ollama pull xyzailab-xyz-aquila-mini:latest

Qwen3.5-4B-Claude-4.6-Opus-Reasoning-Distilled-GGUF

Джакронг4B8 GB RAM

4B модел с отворено тегло от Jackrong за локално извеждане с изкуствен интелект.

ollama pull qwen3.5-4b-claude-4.6-opus-reasoning-distilled:4b

Parable-Granite-4.1-8B-Claude-Fable-5-GGUF

AnkitAI8B16 GB RAM

8B модел с отворено тегло от AnkitAI за локално извеждане с изкуствен интелект.

ollama pull parable-granite-4.1-8b-claude-fable-5:8b

Qwen3.6-14B-A3B-FableVibes-GGUF

tvall4314B24 GB RAM

14B open-weight model from tvall43 for local AI inference.

ollama pull qwen3.6-14b-a3b-fablevibes:14b

MiniMax-H3-Pruned-GGUF

Abirayнеизвестен8 GB RAM

Unknown open-weight model from Abiray for local AI inference.

ollama pull minimax-h3-pruned:latest

Qwen_Qwen3.5-0.8B-GGUF

Alibaba0.8B2 GB RAM

0.8B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen-qwen3.5-0.8b:0.8b

Qwen3.6-35B-A3B-APEX-GGUF

mudler35B48 GB RAM

35B open-weight model from mudler for local AI inference.

ollama pull qwen3.6-35b-a3b-apex:35b

supergemma4-26b-uncensored-gguf-v2

Jiunsong26B24 GB RAM

26B open-weight model from Jiunsong for local AI inference.

ollama pull supergemma4-26b-uncensored-gguf-v2:26b

gemma-4-26B-A4B-it-APEX-GGUF

mudler26B24 GB RAM

26B open-weight model from mudler for local AI inference.

ollama pull gemma-4-26b-a4b-it-apex:26b

Qwopus3.6-27B-Coder-MTP-GGUF

Джакронг27B24 GB RAM

27B модел с отворено тегло от Jackrong за локално извеждане с изкуствен интелект.

ollama pull qwopus3.6-27b-coder-mtp:27b

Qwen_Qwen3.5-2B-GGUF

Alibaba2B4 GB RAM

2B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen-qwen3.5-2b:2b

Qwen3.5-397B-A17B-GGUF

Alibaba397B80 GB RAM

397B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen3.5-397b-a17b:397b

Qwen3-4B-Instruct-2507-GGUF

МазиярПанахи4B8 GB RAM

4B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.

ollama pull qwen3-4b-instruct-2507:4b

Троичен бонсай-8B-gguf

призма-мл8B16 GB RAM

8B модел с отворено тегло от prism-ml за локално извеждане с изкуствен интелект.

ollama pull ternary-bonsai-8b:8b

PinkCherry_NSFW_LTX23

SexGod1979неизвестен8 GB RAM

Unknown open-weight model from SexGod1979 for local AI inference.

ollama pull pinkcherry-nsfw-ltx23:latest

Parable-Granite-4.1-3B-Claude-Fable-5-GGUF

AnkitAI3B4 GB RAM

3B модел с отворено тегло от AnkitAI за локално извеждане с изкуствен интелект.

ollama pull parable-granite-4.1-3b-claude-fable-5:3b

Qwen_Qwen3.5-35B-A3B-GGUF

Alibaba35B48 GB RAM

35B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen-qwen3.5-35b-a3b:35b

endless-frontier_BigBang-v1-GGUF

bartowskiнеизвестен8 GB RAM

Unknown open-weight model from bartowski for local AI inference.

ollama pull endless-frontier-bigbang-v1:latest

Qwen_Qwen3.5-4B-GGUF

Alibaba4B8 GB RAM

4B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen-qwen3.5-4b:4b

Qwen3.6-27B-Heretic-Uncensored-FINETUNE-NEO-CODE-Di-IMatrix-MAX-GGUF

ДейвидАУ27B24 GB RAM

27B модел с отворено тегло от DavidAU за локално извеждане с изкуствен интелект.

ollama pull qwen3.6-27b-heretic-uncensored-finetune-neo-code-di-imatrix-max:27b

Qwen3.5-9B-DeepSeek-V4-Flash-GGUF

Джакронг9B16 GB RAM

9B модел с отворено тегло от Jackrong за локално извеждане с изкуствен интелект.

ollama pull qwen3.5-9b-deepseek-v4-flash:9b

Притча-Qwen3-8B-Claude-Fable-5-GGUF

AnkitAI8B16 GB RAM

8B модел с отворено тегло от AnkitAI за локално извеждане с изкуствен интелект.

ollama pull parable-qwen3-8b-claude-fable-5:8b

grug-27b-gguf

ProCreations27B24 GB RAM

27B open-weight model from ProCreations for local AI inference.

ollama pull grug-27b:27b

GLM-4.7-Flash-GGUF

неленостнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от unsloth за локално извеждане от изкуствен интелект.

ollama pull glm-4.7-flash:latest

gemma-4-31B-it-qat-q4_0-gguf

Google31B24 GB RAM

31B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.

ollama pull gemma-4-31b-it-qat-q4-0:31b

Qwen3.5-27B-GGUF

Alibaba27B24 GB RAM

27B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen3.5-27b:27b

Kwaipilot_KAT-Coder-V2.5-Dev-GGUF

bartowskiнеизвестен8 GB RAM

Unknown open-weight model from bartowski for local AI inference.

ollama pull kwaipilot-kat-coder-v2.5-dev:latest

Притча-Qwen3-4B-Claude-Fable-5-GGUF

AnkitAI4B8 GB RAM

4B модел с отворено тегло от AnkitAI за локално извеждане с изкуствен интелект.

ollama pull parable-qwen3-4b-claude-fable-5:4b

gemma-4-E2B-it-qat-GGUF

Google2B4 GB RAM

2B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.

ollama pull gemma-4-e2b-it-qat:2b

ACE-Step-1.5-GGUF

Serveurpersoнеизвестен8 GB RAM

Unknown open-weight model from Serveurperso for local AI inference.

ollama pull ace-step-1.5:latest

Huihui-DeepSeek-V4-Flash-0731-abliterated-GGUF

Хуейхуей-айнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от huihui-ai за локално извеждане с изкуствен интелект.

ollama pull huihui-deepseek-v4-flash-0731-abliterated:latest

POCKET-35B-GGUF

FINAL-Bench35B48 GB RAM

35B open-weight model from FINAL-Bench for local AI inference.

ollama pull pocket-35b:35b

gemma-4-26B-A4B-it-qat-q4_0-gguf

Google26B24 GB RAM

26B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.

ollama pull gemma-4-26b-a4b-it-qat-q4-0:26b

gemma-4-E2B-it-qat-q4_0-gguf

Google2B4 GB RAM

2B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.

ollama pull gemma-4-e2b-it-qat-q4-0:2b

gemma-4-E4B-it-qat-q4_0-gguf

Google4B8 GB RAM

4B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.

ollama pull gemma-4-e4b-it-qat-q4-0:4b

автомобилен

flywheel-aiнеизвестен8 GB RAM

Unknown open-weight model from flywheel-ai for local AI inference.

ollama pull automotive:latest

DeepSeek-V4-Flash-0731-GGUF

DeepSeekнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от DeepSeek за локално извеждане с изкуствен интелект.

ollama pull deepseek-v4-flash-0731:latest

LFM2.5-2.6B-GGUF

LiquidAI2.6B4 GB RAM

2.6B модел с отворено тегло от LiquidAI за локално извеждане от ИИ.

ollama pull lfm2.5-2.6b:2.6b

Qwen3.5-122B-A10B-GGUF

Alibaba122B80 GB RAM

122B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen3.5-122b-a10b:122b

Qwen3.8-27B-Uncensored-GGUF

JonathanColetti27B24 GB RAM

27B open-weight model from JonathanColetti for local AI inference.

ollama pull qwen3.8-27b-uncensored:27b

MiniMax-H3

ДълбокоБийпМийпнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от DeepBeepMeep за локално извеждане с изкуствен интелект.

ollama pull minimax-h3:latest

MiniMax-H3_GGUFs

realrebelaiнеизвестен8 GB RAM

Unknown open-weight model from realrebelai for local AI inference.

ollama pull minimax-h3-ggufs:latest

audio.cpp-gguf

audio-cppнеизвестен8 GB RAM

Unknown open-weight model from audio-cpp for local AI inference.

ollama pull audio.cpp:latest

Inkling-Small-GGUF

неленостнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от unsloth за локално извеждане от изкуствен интелект.

ollama pull inkling-small:latest

maple-preview-GGUF

deepgroveнеизвестен8 GB RAM

Unknown open-weight model from deepgrove for local AI inference.

ollama pull maple-preview:latest

KAT-Coder-V2.5-Dev-APEX-GGUF

mudlerнеизвестен8 GB RAM

Unknown open-weight model from mudler for local AI inference.

ollama pull kat-coder-v2.5-dev-apex:latest

Qwen3-TTS-GGUF

Serveurpersoнеизвестен8 GB RAM

Unknown open-weight model from Serveurperso for local AI inference.

ollama pull qwen3-tts:latest

MiniMax-H3-GGUF

Abirayнеизвестен8 GB RAM

Unknown open-weight model from Abiray for local AI inference.

ollama pull minimax-h3:latest

Muse-Glimmer-30B-GGUF

неленост30B24 GB RAM

30B модел с отворено тегло от Unsloth за локално извеждане с изкуствен интелект.

ollama pull muse-glimmer-30b:30b

Laguna-XS-2.1-APEX-GGUF

mudlerнеизвестен8 GB RAM

Unknown open-weight model from mudler for local AI inference.

ollama pull laguna-xs-2.1-apex:latest

Qwen3-30B-A3B-Thinking-2507-GGUF

Alibaba30B24 GB RAM

30B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen3-30b-a3b-thinking-2507:30b

Qwen3.8-27B-GGUF

Alibaba27B24 GB RAM

27B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen3.8-27b:27b

Higgs Audio v3 Studio

дрбафнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от drbaph за локален AI извод.

ollama pull higgs-audio-v3-studio:latest

DeepSeek-V4-Flash-GGUF

DeepSeekнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от DeepSeek за локално извеждане с изкуствен интелект.

ollama pull deepseek-v4-flash:latest

Qwen3.5-2B-GGUF

Alibaba2B4 GB RAM

2B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen3.5-2b:2b

Qwen3.5-4B-Нецензурирана-HauhauCS-Агресивна

HauhauCS4B8 GB RAM

4B модел с отворено тегло от HauhauCS за локално извеждане с изкуствен интелект.

ollama pull qwen3.5-4b-uncensored-hauhaucs-aggressive:4b

Qwen3.5-35B-A3B-GGUF

Alibaba35B48 GB RAM

35B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen3.5-35b-a3b:35b

Llama-3.2-3B-Instruct-GGUF

Meta3B4 GB RAM

3B модел с отворено тегло от Meta за локално извеждане с изкуствен интелект.

ollama pull llama-3.2-3b:3b

gemma-3-1b-it-GGUF

ggml-org1B2 GB RAM

1B модел с отворено тегло от ggml-org за локално извеждане с изкуствен интелект.

ollama pull gemma-3-1b-it:1b

Qwen3.5-122B-A10B-MTP-GGUF

Alibaba122B80 GB RAM

122B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen3.5-122b-a10b-mtp:122b

FLUX.2-klein-4B-GGUF

неленост4B8 GB RAM

4B модел с отворено тегло от Unsloth за локално извеждане с изкуствен интелект.

ollama pull flux.2-klein-4b:4b

Qwen2.5-7B-Instruct-GGUF

Alibaba7B8 GB RAM

7B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen2.5-7b:7b

Qwen3-30B-A3B-GGUF

МазиярПанахи30B24 GB RAM

30B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.

ollama pull qwen3-30b-a3b:30b

Qwen3-32B-GGUF

МазиярПанахи32B24 GB RAM

32B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.

ollama pull qwen3-32b:32b

Qwen3-1.7B-GGUF

МазиярПанахи1.7B4 GB RAM

1.7B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.

ollama pull qwen3-1.7b:1.7b

Кими-К3-ГГУФ

неленостнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от unsloth за локално извеждане от изкуствен интелект.

ollama pull kimi-k3:latest

Qwen2.5-0.5B-Instruct-GGUF

Куен0.5B2 GB RAM

0.5B модел с отворено тегло от Qwen за локално извеждане с изкуствен интелект.

ollama pull qwen2.5-0.5b:0.5b

Qwen3-14B-GGUF

МазиярПанахи14B24 GB RAM

14B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.

ollama pull qwen3-14b:14b

Qwen3-0.6B-GGUF

МазиярПанахи0.6B2 GB RAM

0.6B модел с отворено тегло от MaziyarPanahi за локално извеждане с изкуствен интелект.

ollama pull qwen3-0.6b:0.6b

Лагуна-S-2.1-GGUF

неленостнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от unsloth за локално извеждане от изкуствен интелект.

ollama pull laguna-s-2.1:latest

Qwen3.6-35B-A3B-Нецензурирана-Генезис-Хермес-V7-GGUF

ЛуфиЛисицата35B48 GB RAM

35B модел с отворено тегло от LuffyTheFox за локално извеждане с изкуствен интелект.

ollama pull qwen3.6-35b-a3b-uncensored-genesis-hermes-v7:35b

gemma-gguf

рахул7звезданеизвестен8 GB RAM

Неизвестен модел с отворено тегло от rahul7star за локално извеждане с изкуствен интелект.

ollama pull gemma:latest

Qwen2.5-VL-7B-Instruct-GGUF

Alibaba7B8 GB RAM

7B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen2.5-vl-7b:7b

Qwen3-235B-A22B-GGUF

Alibaba235B80 GB RAM

235B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen3-235b-a22b:235b

Voxtral-Small-24B-2507-gguf

ръчен компютър24B24 GB RAM

24B модел с отворено тегло от handy-computer за локално извеждане с изкуствен интелект.

ollama pull voxtral-small-24b-2507:24b

Сугой-14B-Ултра-GGUF

sugoitoolkit14B24 GB RAM

14B модел с отворено тегло от sugoitoolkit за локално извеждане с изкуствен интелект.

ollama pull sugoi-14b-ultra:14b

Qwen3-ASR-1.7B-gguf

ръчен компютър1.7B4 GB RAM

1.7B модел с отворено тегло от handy-computer за локално извеждане с изкуствен интелект.

ollama pull qwen3-asr-1.7b:1.7b

Qwen3-30B-A3B-Instruct-2507-GGUF

Alibaba30B24 GB RAM

30B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen3-30b-a3b-instruct-2507:30b

Qwen2.5-3B-Instruct-GGUF

Куен3B4 GB RAM

3B модел с отворено тегло от Qwen за локално извеждане с изкуствен интелект.

ollama pull qwen2.5-3b:3b

gemma-4-12b-heretic-abliterated-GGUF

културен бунт12B16 GB RAM

12B модел с отворено тегло от culturerevolt за локално извеждане с изкуствен интелект.

ollama pull gemma-4-12b-heretic-abliterated:12b

Qwen3.5-122B-A10B-Нецензурирана-HauhauCS-Агресивна

HauhauCS122B80 GB RAM

122B модел с отворено тегло от HauhauCS за локално извеждане с изкуствен интелект.

ollama pull qwen3.5-122b-a10b-uncensored-hauhaucs-aggressive:122b

Qwen2.5-Coder-7B-Instruct-GGUF

Куен7B8 GB RAM

7B модел с отворено тегло от Qwen за локално извеждане с изкуствен интелект.

ollama pull qwen2.5-coder-7b:7b

Qwen-Image-Edit-2511-GGUF

Alibabaнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen-image-edit-2511:latest

Qwen3-Coder-Next-GGUF

Alibabaнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen3-coder-next:latest

Qwen2.5-1.5B-Instruct-GGUF

Куен1.5B4 GB RAM

1.5B модел с отворено тегло от Qwen за локално извеждане с изкуствен интелект.

ollama pull qwen2.5-1.5b:1.5b

Qwen3.6-35B-A3B-Нецензурирана-Генезис-Хермес-V6-GGUF

ЛуфиЛисицата35B48 GB RAM

35B модел с отворено тегло от LuffyTheFox за локално извеждане с изкуствен интелект.

ollama pull qwen3.6-35b-a3b-uncensored-genesis-hermes-v6:35b

програми за лапи

програми за теглонеизвестен8 GB RAM

Неизвестен модел с отворено тегло от programasweights за локален AI извод.

ollama pull paw-programs:latest

Qwen2.5-Coder-32B-Instruct-GGUF

Куен32B24 GB RAM

32B модел с отворено тегло от Qwen за локално извеждане с изкуствен интелект.

ollama pull qwen2.5-coder-32b:32b

gemma-4-31B-it-qat-GGUF

Google31B24 GB RAM

31B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.

ollama pull gemma-4-31b-it-qat:31b

gemma-4-26B-A4B-it-ultra-uncensored-heretic-i1-GGUF

Google26B24 GB RAM

26B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.

ollama pull gemma-4-26b-a4b-it-ultra-uncensored-heretic-i1:26b

gemma-4-12B-coder-fable5-composer2.5-v1-GGUF

yuxinlu112B16 GB RAM

12B модел с отворено тегло от yuxinlu1 за локално извеждане с изкуствен интелект.

ollama pull gemma-4-12b-coder-fable5-composer2.5-v1:12b

намек-GGUF

неленостнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от unsloth за локално извеждане от изкуствен интелект.

ollama pull inkling:latest

гранит-4.1-3b-GGUF

IBM Granite3B4 GB RAM

3B модел с отворено тегло от ibm-granite за локално извеждане с изкуствен интелект.

ollama pull granite-4.1-3b:3b

Сугой-32B-Ултра-GGUF

sugoitoolkit32B24 GB RAM

32B модел с отворено тегло от sugoitoolkit за локално извеждане с изкуствен интелект.

ollama pull sugoi-32b-ultra:32b

Qwen3-VL-4B-Instruct-GGUF

Alibaba4B8 GB RAM

4B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen3-vl-4b:4b

madlad400-3b-mt

Google3B4 GB RAM

3B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.

ollama pull madlad400-3b-mt:3b

MiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking-GGUF

ГнЛОЛот1B2 GB RAM

1B модел с отворено тегло от GnLOLot за локално извеждане с изкуствен интелект.

ollama pull minicpm5-1b-claude-opus-fable5-v2-thinking:1b

svara-tts-v1

кенпътнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от kenpath за локално извеждане с изкуствен интелект.

ollama pull svara-tts-v1:latest

Qwen3.6-40B-Claude-4.6-Opus-Deckard-Heretic-Uncensored-Thinking-NEO-CODE-Di-IMatrix-MAX-GGUF

ДейвидАУ40B48 GB RAM

40B модел с отворено тегло от DavidAU за локално извеждане с изкуствен интелект.

ollama pull qwen3.6-40b-claude-4.6-opus-deckard-heretic-uncensored-thinking-neo-code-di-imatrix-max:40b

Холо-3.1-35B-A3B-GGUF

Hcompany35B48 GB RAM

35B модел с отворено тегло от Hcompany за локално извеждане с изкуствен интелект.

ollama pull holo-3.1-35b-a3b:35b

gemma-4-12B-it-qat-q4_0-gguf

Google12B16 GB RAM

12B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.

ollama pull gemma-4-12b-it-qat-q4-0:12b

Qwen3.5-9B-Непокорната-басня-Нецензурирана-Херетик-NEO-IMATRIX-MAX-MTP-GGUF

ДейвидАУ9B16 GB RAM

9B модел с отворено тегло от DavidAU за локално извеждане с изкуствен интелект.

ollama pull qwen3.5-9b-the-defiant-fable-uncensored-heretic-neo-imatrix-max-mtp:9b

LTX-2.3-GGUF

неленостнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от unsloth за локално извеждане от изкуствен интелект.

ollama pull ltx-2.3:latest

gemma-4-E4B-it-qat-GGUF

Google4B8 GB RAM

4B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.

ollama pull gemma-4-e4b-it-qat:4b

шепот-голям-v3-турбо-gguf

ръчен компютърнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от удобен компютър за локално извеждане с изкуствен интелект.

ollama pull whisper-large-v3-turbo:latest

LTX-2

ДълбокоБийпМийпнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от DeepBeepMeep за локално извеждане с изкуствен интелект.

ollama pull ltx-2:latest

Qwen3-4B-GGUF

Куен4B8 GB RAM

4B модел с отворено тегло от Qwen за локално извеждане с изкуствен интелект.

ollama pull qwen3-4b:4b

Qwen3.5-0.8B-GGUF

Alibaba0.8B2 GB RAM

0.8B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen3.5-0.8b:0.8b

Мета-Лама-3.1-8B-Инструкция-GGUF

Meta8B16 GB RAM

8B модел с отворено тегло от Meta за локално извеждане с изкуствен интелект.

ollama pull meta-llama-3.1-8b:8b

LFM2.5-1.2B-Инструкция-GGUF

LiquidAI1.2B4 GB RAM

1.2B модел с отворено тегло от LiquidAI за локално извеждане от ИИ.

ollama pull lfm2.5-1.2b:1.2b

GLM-5.2-GGUF

неленостнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от unsloth за локално извеждане от изкуствен интелект.

ollama pull glm-5.2:latest

canary-180m-flash-gguf

ръчен компютърнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от удобен компютър за локално извеждане с изкуствен интелект.

ollama pull canary-180m-flash:latest

шепот-голям-v3-gguf

ръчен компютърнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от удобен компютър за локално извеждане с изкуствен интелект.

ollama pull whisper-large-v3:latest

Qwen3-8B-GGUF

Alibaba8B16 GB RAM

8B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen3-8b:8b

Ян-v3.5-4B-gguf

джанк4B8 GB RAM

4B модел с отворено тегло от janhq за локално извеждане с изкуствен интелект.

ollama pull jan-v3.5-4b:4b

Kimi-K2.7-Code-GGUF

неленостнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от unsloth за локално извеждане от изкуствен интелект.

ollama pull kimi-k2.7-code:latest

MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF

ГнЛОЛот1B2 GB RAM

1B модел с отворено тегло от GnLOLot за локално извеждане с изкуствен интелект.

ollama pull minicpm5-1b-claude-opus-fable5-thinking:1b

Лама-3.2-1B-Инструкция-Q8_0-GGUF

прегръщащи кванти1B2 GB RAM

1B модел с отворено тегло от прегръщащи кванти за локален ИИ извод.

ollama pull llama-3.2-1b-instruct-q8-0:1b

Bielik-11B-v3.0-Instruct-awq

speakease11B16 GB RAM

11B модел с отворено тегло от speakleash за локално извеждане с изкуствен интелект.

ollama pull bielik-11b-v3.0-instruct-awq:11b

Wan2.2-I2V-A14B-GGUF

QuantStack14B24 GB RAM

14B модел с отворено тегло от QuantStack за локално извеждане с изкуствен интелект.

ollama pull wan2.2-i2v-a14b:14b

Джема-4-31B-то-е-заличена

плашило31B24 GB RAM

31B модел с отворено тегло от paperscarecrow за локално извеждане с изкуствен интелект.

ollama pull gemma-4-31b-it-abliterated:31b

Qwen3.6-27B-Нецензурирана-HauhauCS-Агресивна

HauhauCS27B24 GB RAM

27B модел с отворено тегло от HauhauCS за локално извеждане с изкуствен интелект.

ollama pull qwen3.6-27b-uncensored-hauhaucs-aggressive:27b

ThinkingCap-Qwen3.6-27B-GGUF

бутилкапай27B24 GB RAM

27B модел с отворено тегло от bottlecapai за локално извеждане с изкуствен интелект.

ollama pull thinkingcap-qwen3.6-27b:27b

Wan2.1

ДълбокоБийпМийпнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от DeepBeepMeep за локално извеждане с изкуствен интелект.

ollama pull wan2.1:latest

Voxtral-Mini-4B-Realtime-2602-gguf

ръчен компютър4B8 GB RAM

4B модел с отворено тегло от handy-computer за локално извеждане с изкуствен интелект.

ollama pull voxtral-mini-4b-realtime-2602:4b

Qwen_Qwen3.6-35B-A3B-GGUF

Alibaba35B48 GB RAM

35B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen-qwen3.6-35b-a3b:35b

Qwythos-9B-v2-GGUF

император-ай9B16 GB RAM

9B модел с отворено тегло от empero-ai за локално извеждане с изкуствен интелект.

ollama pull qwythos-9b-v2:9b

gemma-4-12B-agentic-fable5-composer2.5-v2-3.5x-tau2-GGUF

yuxinlu112B16 GB RAM

12B модел с отворено тегло от yuxinlu1 за локално извеждане с изкуствен интелект.

ollama pull gemma-4-12b-agentic-fable5-composer2.5-v2-3.5x-tau2:12b

Сяра-2-база

SulphurAIнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от SulfurAI за локално извеждане от ИИ.

ollama pull sulphur-2-base:latest

шепот-среден-gguf

ръчен компютърнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от удобен компютър за локално извеждане с изкуствен интелект.

ollama pull whisper-medium:latest

gemma-4-E2B-it-GGUF

Google2B4 GB RAM

2B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.

ollama pull gemma-4-e2b-it:2b

папагал-tdt-0.6b-v3-gguf

ръчен компютър0.6B2 GB RAM

0.6B модел с отворено тегло от handy-computer за локално извеждане с изкуствен интелект.

ollama pull parakeet-tdt-0.6b-v3:0.6b

Qwen3.5-9B-Нецензурирана-HauhauCS-Агресивна

HauhauCS9B16 GB RAM

9B модел с отворено тегло от HauhauCS за локално извеждане с изкуствен интелект.

ollama pull qwen3.5-9b-uncensored-hauhaucs-aggressive:9b

gemma-4-26B-A4B-it-qat-GGUF

Google26B24 GB RAM

26B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.

ollama pull gemma-4-26b-a4b-it-qat:26b

gpt-oss-20b-GGUF

неленост20B24 GB RAM

20B модел с отворено тегло от Unsloth за локално извеждане с изкуствен интелект.

ollama pull gpt-oss-20b:20b

Qwen3-VL-8B-Instruct-abliterated-GGUF

Alibaba8B16 GB RAM

Qwen3-VL-8B-Instruct-abliterated-GGUF is an 8-billion parameter vision-language model developed by Alibaba that has been fully abliterated to remove proprietary constraints while retaining core capabilities. This model excels at handling complex visual reasoning and multi-step tasks within a conversational framework, making it ideal for open-ended analysis and creative generation in the US region. Running this GGUF quantized version locally is highly practical for users with mid-range GPUs, offering fast inference speeds without requiring specialized enterprise hardware.

ollama pull qwen3-vl-8b-instruct-abliterated:8b

Flux2-Klein-9B-True-V2

Уикиянг9B16 GB RAM

9B модел с отворено тегло от wikeeyang за локално извеждане с изкуствен интелект.

ollama pull flux2-klein-9b-true-v2:9b

Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF

ДейвидАУ27B24 GB RAM

The Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF is a 27-billion parameter large language model created by DavidAU that combines multiple fine-tuning techniques including Unsloth and Heretic methods. This model excels at generating uncensored, highly creative, and unrestricted content across diverse topics, making it ideal for users seeking an abliterated assistant capable of multi-stage tuned responses without safety filters. Running this GGUF quantized version locally requires a substantial GPU with ample VRAM to handle the 27B parameter load efficiently, offering best performance on systems equipped with high-end hardware for fast inference speeds.

ollama pull qwen3.6-27b-fable-fusion-711-uncensored-heretic-nm-dau-neo-max-mtp:27b

Qwen3-Coder-30B-A3B-Instruct-GGUF

Alibaba30B24 GB RAM

Qwen3-Coder-30B-A3B-Instruct-GGUF is a 30-billion parameter coding model developed by Alibaba that integrates advanced instruction tuning for specialized tasks. It excels at complex code generation, debugging, and conversational programming assistance, making it ideal for developers seeking high-performance solutions in the US region. Running this model locally requires substantial GPU memory to handle its large parameter count, so it is best suited for users with powerful hardware who prioritize raw coding capability over speed.

ollama pull qwen3-coder-30b-a3b:30b

gemma-4-31B-it-GGUF

Google31B24 GB RAM

31B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.

ollama pull gemma-4-31b-it:31b

Gemma-4-E4B-Нецензурирана-HauhauCS-Агресивна

HauhauCS4B8 GB RAM

Gemma-4-E4B-Uncensored-HauhauCS-Aggressive е мултимодален модел с 4 милиарда параметра, разработен от HauhauCS, който интегрира разширени възможности от Gemma 4 с аблатирани филтри за безопасност. Този агресивен вариант се отличава с неограничено генериране на текст, визуален анализ и обработка на аудио, което го прави идеален за творчески задачи, изискващи суров изход без модериране на съдържание. Локалното изпълнение на този модел изисква значителна графична памет за обработка на мултимодалните входове и потребителите трябва да очакват високи изчислителни разходи при обработка на сложни аудио или видео потоци.

ollama pull gemma-4-e4b-uncensored-hauhaucs-aggressive:4b

Qwopus3.6-27B-Coder-Compat-MTP-GGUF

Джакронг27B24 GB RAM

27B модел с отворено тегло от Jackrong за локално извеждане с изкуствен интелект.

ollama pull qwopus3.6-27b-coder-compat-mtp:27b

UI-TARS-1.5-7B-GGUF

мрадермахер7B8 GB RAM

7B модел с отворено тегло от mradermacher за локално извеждане с изкуствен интелект.

ollama pull ui-tars-1.5-7b:7b

Huihui-DeepSeek-V4-Flash-abliterated-ds4-GGUF

Хуейхуей-айнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от huihui-ai за локално извеждане с изкуствен интелект.

ollama pull huihui-deepseek-v4-flash-abliterated-ds4:latest

gemma-4-12B-it-QAT-GGUF

Google12B16 GB RAM

12B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.

ollama pull gemma-4-12b-it-qat:12b

Троичен бонсай-27B-gguf

призма-мл27B24 GB RAM

27B модел с отворено тегло от prism-ml за локално извеждане с изкуствен интелект.

ollama pull ternary-bonsai-27b:27b

Gemmable-4-12B-MTP-GGUF

Mia-AiLab12B16 GB RAM

12B модел с отворено тегло от Mia-AiLab за локално извеждане с изкуствен интелект.

ollama pull gemmable-4-12b-mtp:12b

Qwopus3.6-35B-A3B-Кодер-MTP-GGUF

Джакронг35B48 GB RAM

35B модел с отворено тегло от Jackrong за локално извеждане с изкуствен интелект.

ollama pull qwopus3.6-35b-a3b-coder-mtp:35b

Qwen3.6-35B-A3B-MTP-GGUF

Alibaba35B48 GB RAM

35B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen3.6-35b-a3b-mtp:35b

gemma-4-12b-it-GGUF

Google12B16 GB RAM

12B модел с отворено тегло от Google за локално извеждане с изкуствен интелект.

ollama pull gemma-4-12b-it:12b

Qwen3-VL-30B-A3B-Instruct-GGUF

Куен30B24 GB RAM

30B модел с отворено тегло от Qwen за локално извеждане с изкуствен интелект.

ollama pull qwen3-vl-30b-a3b:30b

модели-преместени

ggml-orgнеизвестен8 GB RAM

The models-moved collection is provided by ggml-org and currently lists an unknown parameter count for its various model files. These models excel at general-purpose tasks within the US region and are best suited for users seeking accessible inference options from this specific provider. Running them locally requires downloading the appropriate GGUF quantization files, with performance varying significantly based on your GPU or CPU hardware capabilities.

ollama pull models-moved:latest

cohere-transcribe-03-2026-gguf

ръчен компютърнеизвестен8 GB RAM

Неизвестен модел с отворено тегло от удобен компютър за локално извеждане с изкуствен интелект.

ollama pull cohere-transcribe-03-2026:latest

Qwen-AgentWorld-35B-A3B-GGUF

Alibaba35B48 GB RAM

35B модел с отворено тегло от Alibaba за локално извеждане с изкуствен интелект.

ollama pull qwen-agentworld-35b-a3b:35b

vntl-llama3-8b-v2-gguf

lmg-anon8B16 GB RAM

The vntl-llama3-8b-v2-gguf is an 8B parameter language model developed by lmg-anon that specializes in high-quality translation and conversational tasks. It excels at processing the VNTL-v5-1k dataset to deliver fluent responses, making it ideal for multilingual chat applications and localized content generation. Running this model locally requires a GPU with sufficient VRAM to handle its 8B parameter weight efficiently, ensuring responsive performance for real-time dialogue.

ollama pull vntl-llama3-8b-v2:8b

gemma-4-E4B-it-GGUF

Google4B8 GB RAM

The gemma-4-E4B-it-GGUF is a 4-billion parameter language model developed by Google and optimized for Italian using GGUF quantization. It excels at handling complex reasoning tasks within the Gemma 4 architecture while supporting efficient image-to-text conversions through specialized unsloth optimizations. Running this model locally requires a modern GPU to leverage its speed, making it ideal for users seeking high-performance local inference without cloud dependencies.

ollama pull gemma-4-e4b-it:4b

Qwen3.6-27B-GGUF

Alibaba27B24 GB RAM

Qwen3.6-27B-GGUF is a 27-billion parameter large language model developed by Alibaba that supports advanced conversational AI and image-to-text capabilities. It excels at complex reasoning tasks, multilingual communication, and visual analysis, making it ideal for professional applications requiring high accuracy in text generation and understanding. Running this model locally typically demands substantial GPU memory and a powerful processor to handle its 27B parameters efficiently, so it is best suited for users with dedicated hardware or access to cloud instances.

ollama pull qwen3.6-27b:27b

Qwen3.6-35B-A3B-GGUF

Alibaba35B48 GB RAM

Qwen3.6-35B-A3B-GGUF is a 35-billion parameter large language model developed by Alibaba that features specialized optimizations for image-to-text conversion and multilingual conversation. This model excels at handling complex visual reasoning tasks and maintaining coherent dialogue, making it ideal for applications requiring deep contextual understanding across diverse topics. Running this model locally requires substantial GPU memory to handle its full parameter count, though quantized GGUF versions can offer a practical balance between speed and performance on high-end consumer hardware.

ollama pull qwen3.6-35b-a3b:35b

Hy3-GGUF

vcruz305неизвестен8 GB RAM

Неизвестен модел с отворено тегло от vcruz305 за локално извеждане от изкуствен интелект.

ollama pull hy3:latest

HyperCLOVAX-SEED-Text-Instruct-1.5B-Q4_K_M-GGUF

рипъртнт1.5B4 GB RAM

HyperCLOVAX-SEED-Text-Instruct-1.5B-Q4_K_M-GGUF is a 1.5 billion parameter language model created by rippertnt and optimized for use with llama-cpp. It excels at conversational tasks and general text generation, making it ideal for lightweight chat applications that require efficient inference on standard hardware. Running this model locally is practical even on modest systems due to its quantized format, offering fast response times without the need for high-end GPUs.

ollama pull hyperclovax-seed-text-instruct-1.5b-q4-k-m:1.5b

Qwen3.5-9B-GGUF

Alibaba9B16 GB RAM

Qwen3.5-9B-GGUF is a compact large language model developed by Alibaba containing 9 billion parameters. It excels at conversational tasks and image-to-text conversion, making it ideal for lightweight applications that require efficient region US deployment. Running this model locally is practical on consumer-grade hardware thanks to its small footprint, offering fast inference speeds even on modest GPUs when paired with optimization libraries like Unsloth.

ollama pull qwen3.5-9b:9b

Qwen3.5-4B-GGUF

Alibaba4B8 GB RAM

Qwen3.5-4B-GGUF is a compact 4-billion parameter language model developed by Alibaba that supports conversational tasks and image-to-text conversion. It excels at handling lightweight inference workloads while maintaining strong performance in unsloth-optimized environments for text generation. Running this model locally requires minimal hardware resources, making it ideal for users seeking fast, efficient deployment on standard consumer devices.

ollama pull qwen3.5-4b:4b

папагал-унифициран-en-0.6b-gguf

ръчен компютър0.6B2 GB RAM

0.6B модел с отворено тегло от handy-computer за локално извеждане с изкуствен интелект.

ollama pull parakeet-unified-en-0.6b:0.6b

nemotron-3.5-asr-streaming-0.6b-gguf

ръчен компютър0.6B2 GB RAM

0.6B модел с отворено тегло от handy-computer за локално извеждане с изкуствен интелект.

ollama pull nemotron-3.5-asr-streaming-0.6b:0.6b

gemma-4-26B-A4B-it-GGUF

Google26B24 GB RAM

The gemma-4-26B-A4B-it-GGUF is a 26-billion parameter large language model developed by Google that leverages advanced instruction tuning for high-performance reasoning. This model excels at complex text generation and multimodal tasks, making it ideal for applications requiring deep contextual understanding and precise instruction following. Running this model locally demands substantial GPU memory and significant compute power, so it is best suited for users with high-end hardware or those utilizing optimized inference frameworks like Unsloth to manage its resource requirements.

ollama pull gemma-4-26b-a4b-it:26b

Бонсай-27B-gguf

призма-мл27B24 GB RAM

Bonsai-27B-gguf is a compact 27-billion parameter language model developed by prism-ml that utilizes quantization for efficient deployment. It excels at conversational tasks and general reasoning while running smoothly on llama.cpp with support for both CPU and CUDA hardware acceleration. Users can run this model locally on modest hardware, though performance will vary depending on whether they utilize 1-bit quantization or have access to a GPU.

ollama pull bonsai-27b:27b

Qwen3.6-35B-A3B-Нецензурирана-HauhauCS-Агресивна

HauhauCS35B48 GB RAM

Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive is a 35-billion parameter large language model developed by HauhauCS that combines MoE architecture with advanced multimodal and vision capabilities. It excels at complex reasoning, multilingual image-text analysis, and generating uncensored content for aggressive or unrestricted use cases where standard safety filters are undesirable. Running this model locally requires substantial high-end GPU memory to handle its sparse mixture-of-experts structure, making it best suited for powerful workstations or servers with significant VRAM available.

ollama pull qwen3.6-35b-a3b-uncensored-hauhaucs-aggressive:35b

Qwythos-9B-Claude-Mythos-5-1M-GGUF

император-ай9B16 GB RAM

9B модел с отворено тегло от empero-ai за локално извеждане с изкуствен интелект.

ollama pull qwythos-9b-claude-mythos-5-1m:9b

Орнит-1.0-35B-GGUF

ornith-ai35B48 GB RAM

Ornith-1.0-35B-GGUF is a 35-billion parameter language model developed by ornith-ai specifically for conversational tasks within the US region. It excels at maintaining natural dialogue flows and handling context-aware interactions, making it ideal for chatbots and virtual assistants. Running this model locally requires substantial GPU memory to handle its size efficiently, so it is best suited for users with high-end hardware or those willing to use quantized GGUF versions to reduce resource demands.

ollama pull ornith-1.0-35b:35b

Qwen3.6-27B-MTP-GGUF

Alibaba27B24 GB RAM

Qwen3.6-27B-MTP-GGUF is a 27-billion parameter large language model developed by Alibaba that supports advanced conversational tasks and image-to-text conversion. It excels at handling complex reasoning and multi-turn dialogues, making it ideal for applications requiring deep contextual understanding and visual analysis. Running this model locally typically demands high-end GPU hardware to manage its substantial memory footprint, though quantized GGUF versions can offer a practical balance between speed and performance on consumer-grade systems.

ollama pull qwen3.6-27b-mtp:27b

deepseek-v4-gguf

антирезнеизвестен8 GB RAM

The deepseek-v4-gguf model is a quantized Mixture-of-Experts architecture provided by antirez with unknown parameter counts available in 2-bit and 4-bit formats. It excels at efficient inference for large language tasks while maintaining high performance through its specialized MoE structure, making it ideal for users needing reduced memory footprints without significant capability loss. Running this model locally requires moderate hardware resources to handle the quantized weights effectively, offering a fast and practical solution for deploying advanced AI capabilities on consumer-grade systems.

ollama pull deepseek-v4:latest

Орнит-1.0-9B-GGUF

ornith-ai9B16 GB RAM

Ornith-1.0-9B-GGUF is a 9-billion parameter language model developed by ornith-ai designed for conversational interactions within the US region. It excels at generating natural dialogue and handling casual chat tasks, making it ideal for lightweight virtual assistants or simple customer support bots. Running this model locally requires modest hardware resources, allowing it to operate quickly on consumer-grade GPUs without needing massive data centers.

ollama pull ornith-1.0-9b:9b

Здравей, приятно ми е да се запознаем! 👋

Абонирайте се за нашия бюлетин, за да получавате най-новите новини за изкуствения интелект.

Защита на WordPress от злонамерени програми