Inhalte
- 1 KI-Modelle für Olama
- 1.0.1 Mistral-Small-24B-Instruct-2501-GGUF
- 1.0.2 Llama-3-8B-Instruct-32k-v0.1-GGUF
- 1.0.3 SmolLM2-135M-GGUF
- 1.0.4 Qwen3.6-35B-A3B-NVFP4-MTP-GGUF
- 1.0.5 Lama-3.3-70B-Anweisung-GGUF
- 1.0.6 gemma-3-4b-it-GGUF
- 1.0.7 Mistral-7B-Instruct-v0.3-GGUF
- 1.0.8 Mixtral-8x22B-v0.1-GGUF
- 1.0.9 Qwen3.8_4B_Distilled_GGUF
- 1.0.10 Meta-Llama-3-8B-Instruct-GGUF
- 1.0.11 Melody1437-26B-A4B-v2.0-GGUF
- 1.0.12 Serenity-26B-A4B-GGUF
- 1.0.13 Dark-Scarlett-v0.3-26B-A4B-GGUF
- 1.0.14 XYZAILab_XYZ-Aquila-mini-GGUF
- 1.0.15 Qwen3.5-4B-Claude-4.6-Opus-Reasoning-Distilled-GGUF
- 1.0.16 Parabel-Granit-4.1-8B-Claude-Fabel-5-GGUF
- 1.0.17 Qwen3.6-14B-A3B-FableVibes-GGUF
- 1.0.18 MiniMax-H3-Pruned-GGUF
- 1.0.19 Qwen_Qwen3.5-0.8B-GGUF
- 1.0.20 Qwen3.6-35B-A3B-APEX-GGUF
- 1.0.21 supergemma4-26b-uncensored-gguf-v2
- 1.0.22 gemma-4-26B-A4B-it-APEX-GGUF
- 1.0.23 Qwopus3.6-27B-Coder-MTP-GGUF
- 1.0.24 Qwen_Qwen3.5-2B-GGUF
- 1.0.25 Qwen3.5-397B-A17B-GGUF
- 1.0.26 Qwen3-4B-Instruct-2507-GGUF
- 1.0.27 Ternary-Bonsai-8B-gguf
- 1.0.28 PinkCherry_NSFW_LTX23
- 1.0.29 Parabel-Granit-4.1-3B-Claude-Fabel-5-GGUF
- 1.0.30 Qwen_Qwen3.5-35B-A3B-GGUF
- 1.0.31 endless-frontier_BigBang-v1-GGUF
- 1.0.32 Qwen_Qwen3.5-4B-GGUF
- 1.0.33 Qwen3.6-27B-Heretic-Uncensored-FINETUNE-NEO-CODE-Di-IMatrix-MAX-GGUF
- 1.0.34 Qwen3.5-9B-DeepSeek-V4-Flash-GGUF
- 1.0.35 Parabel-Qwen3-8B-Claude-Fabel-5-GGUF
- 1.0.36 grug-27b-gguf
- 1.0.37 GLM-4.7-Flash-GGUF
- 1.0.38 gemma-4-31B-it-qat-q4_0-gguf
- 1.0.39 Qwen3.5-27B-GGUF
- 1.0.40 Kwaipilot_KAT-Coder-V2.5-Dev-GGUF
- 1.0.41 Parabel-Qwen3-4B-Claude-Fabel-5-GGUF
- 1.0.42 gemma-4-E2B-it-qat-GGUF
- 1.0.43 ACE-Schritt-1.5-GGUF
- 1.0.44 Huihui-DeepSeek-V4-Flash-0731-abliterated-GGUF
- 1.0.45 POCKET-35B-GGUF
- 1.0.46 gemma-4-26B-A4B-it-qat-q4_0-gguf
- 1.0.47 gemma-4-E2B-it-qat-q4_0-gguf
- 1.0.48 gemma-4-E4B-it-qat-q4_0-gguf
- 1.0.49 Automobilindustrie
- 1.0.50 DeepSeek-V4-Flash-0731-GGUF
- 1.0.51 LFM2.5-2.6B-GGUF
- 1.0.52 Qwen3.5-122B-A10B-GGUF
- 1.0.53 Qwen3.8-27B-Unzensiert-GGUF
- 1.0.54 MiniMax-H3
- 1.0.55 MiniMax-H3_GGUFs
- 1.0.56 audio.cpp-gguf
- 1.0.57 Inkling-Small-GGUF
- 1.0.58 Maple-Vorschau-GGUF
- 1.0.59 KAT-Coder-V2.5-Dev-APEX-GGUF
- 1.0.60 Qwen3-TTS-GGUF
- 1.0.61 MiniMax-H3-GGUF
- 1.0.62 Muse-Glimmer-30B-GGUF
- 1.0.63 Laguna-XS-2.1-APEX-GGUF
- 1.0.64 Qwen3-30B-A3B-Thinking-2507-GGUF
- 1.0.65 Qwen3.8-27B-GGUF
- 1.0.66 Higgs Audio v3 Studio
- 1.0.67 DeepSeek-V4-Flash-GGUF
- 1.0.68 Qwen3.5-2B-GGUF
- 1.0.69 Qwen3.5-4B-Unzensiert-HauhauCS-Aggressiv
- 1.0.70 Qwen3.5-35B-A3B-GGUF
- 1.0.71 Lama-3.2-3B-Anweisung-GGUF
- 1.0.72 gemma-3-1b-it-GGUF
- 1.0.73 Qwen3.5-122B-A10B-MTP-GGUF
- 1.0.74 FLUX.2-klein-4B-GGUF
- 1.0.75 Qwen2.5-7B-Instruct-GGUF
- 1.0.76 Qwen3-30B-A3B-GGUF
- 1.0.77 Qwen3-32B-GGUF
- 1.0.78 Qwen3-1.7B-GGUF
- 1.0.79 Kimi-K3-GGUF
- 1.0.80 Qwen2.5-0.5B-Instruct-GGUF
- 1.0.81 Qwen3-14B-GGUF
- 1.0.82 Qwen3-0.6B-GGUF
- 1.0.83 Laguna-S-2.1-GGUF
- 1.0.84 Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V7-GGUF
- 1.0.85 gemma-gguf
- 1.0.86 Qwen2.5-VL-7B-Instruct-GGUF
- 1.0.87 Qwen3-235B-A22B-GGUF
- 1.0.88 Voxtral-Small-24B-2507-gguf
- 1.0.89 Sugoi-14B-Ultra-GGUF
- 1.0.90 Qwen3-ASR-1.7B-gguf
- 1.0.91 Qwen3-30B-A3B-Instruct-2507-GGUF
- 1.0.92 Qwen2.5-3B-Instruct-GGUF
- 1.0.93 gemma-4-12b-heretic-abliterated-GGUF
- 1.0.94 Qwen3.5-122B-A10B-Unzensiert-HauhauCS-Aggressiv
- 1.0.95 Qwen2.5-Coder-7B-Instruct-GGUF
- 1.0.96 Qwen-Image-Edit-2511-GGUF
- 1.0.97 Qwen3-Coder-Next-GGUF
- 1.0.98 Qwen2.5-1.5B-Instruct-GGUF
- 1.0.99 Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V6-GGUF
- 1.0.100 Pfotenprogramme
- 1.0.101 Qwen2.5-Coder-32B-Instruct-GGUF
- 1.0.102 gemma-4-31B-it-qat-GGUF
- 1.0.103 gemma-4-26B-A4B-it-ultra-uncensored-heretic-i1-GGUF
- 1.0.104 gemma-4-12B-coder-fable5-composer2.5-v1-GGUF
- 1.0.105 Inkling-GGUF
- 1.0.106 granite-4.1-3b-GGUF
- 1.0.107 Sugoi-32B-Ultra-GGUF
- 1.0.108 Qwen3-VL-4B-Instruct-GGUF
- 1.0.109 madlad400-3b-mt
- 1.0.110 MiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking-GGUF
- 1.0.111 svara-tts-v1
- 1.0.112 Qwen3.6-40B-Claude-4.6-Opus-Deckard-Heretic-Uncensored-Thinking-NEO-CODE-Di-IMatrix-MAX-GGUF
- 1.0.113 Holo-3.1-35B-A3B-GGUF
- 1.0.114 gemma-4-12B-it-qat-q4_0-gguf
- 1.0.115 Qwen3.5-9B-The-Defiant-Fable-Uncensored-Heretic-NEO-IMATRIX-MAX-MTP-GGUF
- 1.0.116 LTX-2.3-GGUF
- 1.0.117 gemma-4-E4B-it-qat-GGUF
- 1.0.118 whisper-large-v3-turbo-gguf
- 1.0.119 LTX-2
- 1.0.120 Qwen3-4B-GGUF
- 1.0.121 Qwen3.5-0.8B-GGUF
- 1.0.122 Meta-Llama-3.1-8B-Instruct-GGUF
- 1.0.123 LFM2.5-1.2B-Instruct-GGUF
- 1.0.124 GLM-5.2-GGUF
- 1.0.125 canary-180m-flash-gguf
- 1.0.126 whisper-large-v3-gguf
- 1.0.127 Qwen3-8B-GGUF
- 1.0.128 Jan-v3.5-4B-gguf
- 1.0.129 Kimi-K2.7-Code-GGUF
- 1.0.130 MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF
- 1.0.131 Llama-3.2-1B-Instruct-Q8_0-GGUF
- 1.0.132 Bielik-11B-v3.0-Instruct-awq
- 1.0.133 Wan2.2-I2V-A14B-GGUF
- 1.0.134 Gemma-4-31B-it-abliterated
- 1.0.135 Qwen3.6-27B-Unzensiert-HauhauCS-Aggressiv
- 1.0.136 ThinkingCap-Qwen3.6-27B-GGUF
- 1.0.137 Wan2.1
- 1.0.138 Voxtral-Mini-4B-Realtime-2602-gguf
- 1.0.139 Qwen_Qwen3.6-35B-A3B-GGUF
- 1.0.140 Qwythos-9B-v2-GGUF
- 1.0.141 gemma-4-12B-agentic-fable5-composer2.5-v2-3.5x-tau2-GGUF
- 1.0.142 Schwefel-2-Base
- 1.0.143 flüstern-mittel-gguf
- 1.0.144 gemma-4-E2B-it-GGUF
- 1.0.145 parakeet-tdt-0.6b-v3-gguf
- 1.0.146 Qwen3.5-9B-Unzensiert-HauhauCS-Aggressiv
- 1.0.147 gemma-4-26B-A4B-it-qat-GGUF
- 1.0.148 gpt-oss-20b-GGUF
- 1.0.149 Qwen3-VL-8B-Instruct-abliterated-GGUF
- 1.0.150 Flux2-Klein-9B-True-V2
- 1.0.151 Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF
- 1.0.152 Qwen3-Coder-30B-A3B-Instruct-GGUF
- 1.0.153 gemma-4-31B-it-GGUF
- 1.0.154 Gemma-4-E4B-Unzensiert-HauhauCS-Aggressiv
- 1.0.155 Qwopus3.6-27B-Coder-Compat-MTP-GGUF
- 1.0.156 UI-TARS-1.5-7B-GGUF
- 1.0.157 Huihui-DeepSeek-V4-Flash-abliterated-ds4-GGUF
- 1.0.158 gemma-4-12B-it-QAT-GGUF
- 1.0.159 Ternary-Bonsai-27B-gguf
- 1.0.160 Gemmable-4-12B-MTP-GGUF
- 1.0.161 Qwopus3.6-35B-A3B-Coder-MTP-GGUF
- 1.0.162 Qwen3.6-35B-A3B-MTP-GGUF
- 1.0.163 gemma-4-12b-it-GGUF
- 1.0.164 Qwen3-VL-30B-A3B-Instruct-GGUF
- 1.0.165 Modelle verschoben
- 1.0.166 cohere-transcribe-03-2026-gguf
- 1.0.167 Qwen-AgentWorld-35B-A3B-GGUF
- 1.0.168 vntl-llama3-8b-v2-gguf
- 1.0.169 gemma-4-E4B-it-GGUF
- 1.0.170 Qwen3.6-27B-GGUF
- 1.0.171 Qwen3.6-35B-A3B-GGUF
- 1.0.172 Hy3-GGUF
- 1.0.173 HyperCLOVAX-SEED-Text-Instruct-1.5B-Q4_K_M-GGUF
- 1.0.174 Qwen3.5-9B-GGUF
- 1.0.175 Qwen3.5-4B-GGUF
- 1.0.176 parakeet-unified-en-0.6b-gguf
- 1.0.177 nemotron-3.5-asr-streaming-0.6b-gguf
- 1.0.178 gemma-4-26B-A4B-it-GGUF
- 1.0.179 Bonsai-27B-gguf
- 1.0.180 Qwen3.6-35B-A3B-Unzensiert-HauhauCS-Aggressiv
- 1.0.181 Qwythos-9B-Claude-Mythos-5-1M-GGUF
- 1.0.182 Ornith-1.0-35B-GGUF
- 1.0.183 Qwen3.6-27B-MTP-GGUF
- 1.0.184 deepseek-v4.gguf
- 1.0.185 Ornith-1.0-9B-GGUF
- 1.1 Hallo, schön dich kennen zu lernen!
KI-Modelle für Olama
Alle Modelle in diesem Verzeichnis liegen im GGUF-Format vor und können daher direkt in Ollama ausgeführt werden. Hier finden Sie den vollständigen Katalog mit den zum Kopieren bereitstehenden Befehlen.
Mistral-Small-24B-Instruct-2501-GGUF
24B Open-Weight-Modell von MaziyarPanahi für lokale KI-Inferenz.
ollama pull mistral-small-24b-instruct-2501:24bLlama-3-8B-Instruct-32k-v0.1-GGUF
8B Open-Weight-Modell von MaziyarPanahi für lokale KI-Inferenz.
ollama pull llama-3-8b-instruct-32k-v0.1:8bSmolLM2-135M-GGUF
Unbekanntes Open-Weight-Modell von QuantFactory für lokale KI-Inferenz.
ollama pull smollm2-135m:latestQwen3.6-35B-A3B-NVFP4-MTP-GGUF
35B Open-Weight-Modell von michaelw9999 für lokale KI-Inferenz.
ollama pull qwen3.6-35b-a3b-nvfp4-mtp:35bLama-3.3-70B-Anweisung-GGUF
70B Open-Weight-Modell von MaziyarPanahi für lokale KI-Inferenz.
ollama pull llama-3.3-70b:70bgemma-3-4b-it-GGUF
4B Open-Weight-Modell von MaziyarPanahi für lokale KI-Inferenz.
ollama pull gemma-3-4b-it:4bMistral-7B-Instruct-v0.3-GGUF
7B Open-Weight-Modell von MaziyarPanahi für lokale KI-Inferenz.
ollama pull mistral-7b-instruct-v0.3:7bMixtral-8x22B-v0.1-GGUF
22B Open-Weight-Modell von MaziyarPanahi für lokale KI-Inferenz.
ollama pull mixtral-8x22b-v0.1:22bQwen3.8_4B_Distilled_GGUF
4B Open-Weight-Modell von Ma7ee7 für lokale KI-Inferenz.
ollama pull qwen3.8-4b-distilled-gguf:4bMeta-Llama-3-8B-Instruct-GGUF
8B Open-Weight-Modell von MaziyarPanahi für lokale KI-Inferenz.
ollama pull meta-llama-3-8b:8bMelody1437-26B-A4B-v2.0-GGUF
26B Open-Weight-Modell von ReadyArt für lokale KI-Inferenz.
ollama pull melody1437-26b-a4b-v2.0:26bSerenity-26B-A4B-GGUF
26B Open-Weight-Modell von ReadyArt für lokale KI-Inferenz.
ollama pull serenity-26b-a4b:26bDark-Scarlett-v0.3-26B-A4B-GGUF
26B Open-Weight-Modell von ReadyArt für lokale KI-Inferenz.
ollama pull dark-scarlett-v0.3-26b-a4b:26bXYZAILab_XYZ-Aquila-mini-GGUF
Unbekanntes Open-Weight-Modell von Bartowski für lokale KI-Inferenz.
ollama pull xyzailab-xyz-aquila-mini:latestQwen3.5-4B-Claude-4.6-Opus-Reasoning-Distilled-GGUF
4B Open-Weight-Modell von Jackrong für lokale KI-Inferenz.
ollama pull qwen3.5-4b-claude-4.6-opus-reasoning-distilled:4bParabel-Granit-4.1-8B-Claude-Fabel-5-GGUF
8B Open-Weight-Modell von AnkitAI für lokale KI-Inferenz.
ollama pull parable-granite-4.1-8b-claude-fable-5:8bQwen3.6-14B-A3B-FableVibes-GGUF
14B Open-Weight-Modell von tvall43 für lokale KI-Inferenz.
ollama pull qwen3.6-14b-a3b-fablevibes:14bMiniMax-H3-Pruned-GGUF
Unbekanntes Open-Weight-Modell von Abiray für lokale KI-Inferenz.
ollama pull minimax-h3-pruned:latestQwen_Qwen3.5-0.8B-GGUF
0.8B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen-qwen3.5-0.8b:0.8bQwen3.6-35B-A3B-APEX-GGUF
35B Open-Weight-Modell von Mudler für lokale KI-Inferenz.
ollama pull qwen3.6-35b-a3b-apex:35bsupergemma4-26b-uncensored-gguf-v2
26B Open-Weight-Modell von Jiunsong für lokale KI-Inferenz.
ollama pull supergemma4-26b-uncensored-gguf-v2:26bgemma-4-26B-A4B-it-APEX-GGUF
26B Open-Weight-Modell von Mudler für lokale KI-Inferenz.
ollama pull gemma-4-26b-a4b-it-apex:26bQwopus3.6-27B-Coder-MTP-GGUF
27B Open-Weight-Modell von Jackrong für lokale KI-Inferenz.
ollama pull qwopus3.6-27b-coder-mtp:27bQwen_Qwen3.5-2B-GGUF
2B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen-qwen3.5-2b:2bQwen3.5-397B-A17B-GGUF
397B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen3.5-397b-a17b:397bQwen3-4B-Instruct-2507-GGUF
4B Open-Weight-Modell von MaziyarPanahi für lokale KI-Inferenz.
ollama pull qwen3-4b-instruct-2507:4bTernary-Bonsai-8B-gguf
8B Open-Weight-Modell von prism-ml für lokale KI-Inferenz.
ollama pull ternary-bonsai-8b:8bPinkCherry_NSFW_LTX23
Unbekanntes Open-Weight-Modell von SexGod1979 für lokale KI-Inferenz.
ollama pull pinkcherry-nsfw-ltx23:latestParabel-Granit-4.1-3B-Claude-Fabel-5-GGUF
3B Open-Weight-Modell von AnkitAI für lokale KI-Inferenz.
ollama pull parable-granite-4.1-3b-claude-fable-5:3bQwen_Qwen3.5-35B-A3B-GGUF
35B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen-qwen3.5-35b-a3b:35bendless-frontier_BigBang-v1-GGUF
Unbekanntes Open-Weight-Modell von Bartowski für lokale KI-Inferenz.
ollama pull endless-frontier-bigbang-v1:latestQwen_Qwen3.5-4B-GGUF
4B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen-qwen3.5-4b:4bQwen3.6-27B-Heretic-Uncensored-FINETUNE-NEO-CODE-Di-IMatrix-MAX-GGUF
27B Open-Weight-Modell von DavidAU für lokale KI-Inferenz.
ollama pull qwen3.6-27b-heretic-uncensored-finetune-neo-code-di-imatrix-max:27bQwen3.5-9B-DeepSeek-V4-Flash-GGUF
9B Open-Weight-Modell von Jackrong für lokale KI-Inferenz.
ollama pull qwen3.5-9b-deepseek-v4-flash:9bParabel-Qwen3-8B-Claude-Fabel-5-GGUF
8B Open-Weight-Modell von AnkitAI für lokale KI-Inferenz.
ollama pull parable-qwen3-8b-claude-fable-5:8bgrug-27b-gguf
27B Open-Weight-Modell von ProCreations für lokale KI-Inferenz.
ollama pull grug-27b:27bGLM-4.7-Flash-GGUF
Unbekanntes Open-Weight-Modell von Unsloth für lokale KI-Inferenz.
ollama pull glm-4.7-flash:latestgemma-4-31B-it-qat-q4_0-gguf
31B Open-Weight-Modell von Google für lokale KI-Inferenz.
ollama pull gemma-4-31b-it-qat-q4-0:31bQwen3.5-27B-GGUF
27B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen3.5-27b:27bKwaipilot_KAT-Coder-V2.5-Dev-GGUF
Unbekanntes Open-Weight-Modell von Bartowski für lokale KI-Inferenz.
ollama pull kwaipilot-kat-coder-v2.5-dev:latestParabel-Qwen3-4B-Claude-Fabel-5-GGUF
4B Open-Weight-Modell von AnkitAI für lokale KI-Inferenz.
ollama pull parable-qwen3-4b-claude-fable-5:4bgemma-4-E2B-it-qat-GGUF
2B Open-Weight-Modell von Google für lokale KI-Inferenz.
ollama pull gemma-4-e2b-it-qat:2bACE-Schritt-1.5-GGUF
Unbekanntes Open-Weight-Modell von Serveurperso für lokale KI-Inferenz.
ollama pull ace-step-1.5:latestHuihui-DeepSeek-V4-Flash-0731-abliterated-GGUF
Unbekanntes Open-Weight-Modell von huihui-ai für lokale KI-Inferenz.
ollama pull huihui-deepseek-v4-flash-0731-abliterated:latestPOCKET-35B-GGUF
35B Open-Weight-Modell von FINAL-Bench für lokale KI-Inferenz.
ollama pull pocket-35b:35bgemma-4-26B-A4B-it-qat-q4_0-gguf
26B Open-Weight-Modell von Google für lokale KI-Inferenz.
ollama pull gemma-4-26b-a4b-it-qat-q4-0:26bgemma-4-E2B-it-qat-q4_0-gguf
2B Open-Weight-Modell von Google für lokale KI-Inferenz.
ollama pull gemma-4-e2b-it-qat-q4-0:2bgemma-4-E4B-it-qat-q4_0-gguf
4B Open-Weight-Modell von Google für lokale KI-Inferenz.
ollama pull gemma-4-e4b-it-qat-q4-0:4bAutomobilindustrie
Unbekanntes Open-Weight-Modell von flywheel-ai für lokale KI-Inferenz.
ollama pull automotive:latestDeepSeek-V4-Flash-0731-GGUF
Unbekanntes Open-Weight-Modell von DeepSeek für lokale KI-Inferenz.
ollama pull deepseek-v4-flash-0731:latestLFM2.5-2.6B-GGUF
2.6 Milliarden Open-Weight-Modell von LiquidAI für lokale KI-Inferenz.
ollama pull lfm2.5-2.6b:2.6bQwen3.5-122B-A10B-GGUF
122B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen3.5-122b-a10b:122bQwen3.8-27B-Unzensiert-GGUF
27B Open-Weight-Modell von JonathanColetti für lokale KI-Inferenz.
ollama pull qwen3.8-27b-uncensored:27bMiniMax-H3
Unbekanntes Open-Weight-Modell von DeepBeepMeep für lokale KI-Inferenz.
ollama pull minimax-h3:latestMiniMax-H3_GGUFs
Unbekanntes Open-Weight-Modell von realrebelai für lokale KI-Inferenz.
ollama pull minimax-h3-ggufs:latestaudio.cpp-gguf
Unbekanntes Open-Weight-Modell von audio-cpp für lokale KI-Inferenz.
ollama pull audio.cpp:latestInkling-Small-GGUF
Unbekanntes Open-Weight-Modell von Unsloth für lokale KI-Inferenz.
ollama pull inkling-small:latestMaple-Vorschau-GGUF
Unbekanntes Open-Weight-Modell von Deepgrove für lokale KI-Inferenz.
ollama pull maple-preview:latestKAT-Coder-V2.5-Dev-APEX-GGUF
Unbekanntes Open-Weight-Modell von Mudler für lokale KI-Inferenz.
ollama pull kat-coder-v2.5-dev-apex:latestQwen3-TTS-GGUF
Unbekanntes Open-Weight-Modell von Serveurperso für lokale KI-Inferenz.
ollama pull qwen3-tts:latestMiniMax-H3-GGUF
Unbekanntes Open-Weight-Modell von Abiray für lokale KI-Inferenz.
ollama pull minimax-h3:latestMuse-Glimmer-30B-GGUF
30B Open-Weight-Modell von Unsloth für lokale KI-Inferenz.
ollama pull muse-glimmer-30b:30bLaguna-XS-2.1-APEX-GGUF
Unbekanntes Open-Weight-Modell von Mudler für lokale KI-Inferenz.
ollama pull laguna-xs-2.1-apex:latestQwen3-30B-A3B-Thinking-2507-GGUF
30B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen3-30b-a3b-thinking-2507:30bQwen3.8-27B-GGUF
27B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen3.8-27b:27bHiggs Audio v3 Studio
Unbekanntes Open-Weight-Modell von drbaph für lokale KI-Inferenz.
ollama pull higgs-audio-v3-studio:latestDeepSeek-V4-Flash-GGUF
Unbekanntes Open-Weight-Modell von DeepSeek für lokale KI-Inferenz.
ollama pull deepseek-v4-flash:latestQwen3.5-2B-GGUF
2B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen3.5-2b:2bQwen3.5-4B-Unzensiert-HauhauCS-Aggressiv
4B Open-Weight-Modell von HauhauCS für lokale KI-Inferenz.
ollama pull qwen3.5-4b-uncensored-hauhaucs-aggressive:4bQwen3.5-35B-A3B-GGUF
35B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen3.5-35b-a3b:35bLama-3.2-3B-Anweisung-GGUF
3B Open-Weight-Modell von Meta für lokale KI-Inferenz.
ollama pull llama-3.2-3b:3bgemma-3-1b-it-GGUF
1B Open-Weight-Modell von ggml-org für lokale KI-Inferenz.
ollama pull gemma-3-1b-it:1bQwen3.5-122B-A10B-MTP-GGUF
122B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen3.5-122b-a10b-mtp:122bFLUX.2-klein-4B-GGUF
4B Open-Weight-Modell von Unsloth für lokale KI-Inferenz.
ollama pull flux.2-klein-4b:4bQwen2.5-7B-Instruct-GGUF
7B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen2.5-7b:7bQwen3-30B-A3B-GGUF
30B Open-Weight-Modell von MaziyarPanahi für lokale KI-Inferenz.
ollama pull qwen3-30b-a3b:30bQwen3-32B-GGUF
32B Open-Weight-Modell von MaziyarPanahi für lokale KI-Inferenz.
ollama pull qwen3-32b:32bQwen3-1.7B-GGUF
1.7B Open-Weight-Modell von MaziyarPanahi für lokale KI-Inferenz.
ollama pull qwen3-1.7b:1.7bKimi-K3-GGUF
Unbekanntes Open-Weight-Modell von Unsloth für lokale KI-Inferenz.
ollama pull kimi-k3:latestQwen2.5-0.5B-Instruct-GGUF
0.5B Open-Weight-Modell von Qwen für lokale KI-Inferenz.
ollama pull qwen2.5-0.5b:0.5bQwen3-14B-GGUF
14B Open-Weight-Modell von MaziyarPanahi für lokale KI-Inferenz.
ollama pull qwen3-14b:14bQwen3-0.6B-GGUF
0.6B Open-Weight-Modell von MaziyarPanahi für lokale KI-Inferenz.
ollama pull qwen3-0.6b:0.6bLaguna-S-2.1-GGUF
Unbekanntes Open-Weight-Modell von Unsloth für lokale KI-Inferenz.
ollama pull laguna-s-2.1:latestQwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V7-GGUF
35B Open-Weight-Modell von LuffyTheFox für lokale KI-Inferenz.
ollama pull qwen3.6-35b-a3b-uncensored-genesis-hermes-v7:35bgemma-gguf
Unbekanntes Open-Weight-Modell von rahul7star für lokale KI-Inferenz.
ollama pull gemma:latestQwen2.5-VL-7B-Instruct-GGUF
7B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen2.5-vl-7b:7bQwen3-235B-A22B-GGUF
235B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen3-235b-a22b:235bVoxtral-Small-24B-2507-gguf
24B Open-Weight-Modell von Handy-Computer für lokale KI-Inferenz.
ollama pull voxtral-small-24b-2507:24bSugoi-14B-Ultra-GGUF
14B Open-Weight-Modell aus dem Sugoitoolkit für lokale KI-Inferenz.
ollama pull sugoi-14b-ultra:14bQwen3-ASR-1.7B-gguf
1.7B Open-Weight-Modell von Handy-Computer für lokale KI-Inferenz.
ollama pull qwen3-asr-1.7b:1.7bQwen3-30B-A3B-Instruct-2507-GGUF
30B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen3-30b-a3b-instruct-2507:30bQwen2.5-3B-Instruct-GGUF
3B Open-Weight-Modell von Qwen für lokale KI-Inferenz.
ollama pull qwen2.5-3b:3bgemma-4-12b-heretic-abliterated-GGUF
12B Open-Weight-Modell von CultureRevolt für lokale KI-Inferenz.
ollama pull gemma-4-12b-heretic-abliterated:12bQwen3.5-122B-A10B-Unzensiert-HauhauCS-Aggressiv
122B Open-Weight-Modell von HauhauCS für lokale KI-Inferenz.
ollama pull qwen3.5-122b-a10b-uncensored-hauhaucs-aggressive:122bQwen2.5-Coder-7B-Instruct-GGUF
7B Open-Weight-Modell von Qwen für lokale KI-Inferenz.
ollama pull qwen2.5-coder-7b:7bQwen-Image-Edit-2511-GGUF
Unbekanntes Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen-image-edit-2511:latestQwen3-Coder-Next-GGUF
Unbekanntes Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen3-coder-next:latestQwen2.5-1.5B-Instruct-GGUF
1.5B Open-Weight-Modell von Qwen für lokale KI-Inferenz.
ollama pull qwen2.5-1.5b:1.5bQwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V6-GGUF
35B Open-Weight-Modell von LuffyTheFox für lokale KI-Inferenz.
ollama pull qwen3.6-35b-a3b-uncensored-genesis-hermes-v6:35bPfotenprogramme
Unbekanntes Open-Weight-Modell aus programasweights für lokale KI-Inferenz.
ollama pull paw-programs:latestQwen2.5-Coder-32B-Instruct-GGUF
32B Open-Weight-Modell von Qwen für lokale KI-Inferenz.
ollama pull qwen2.5-coder-32b:32bgemma-4-31B-it-qat-GGUF
31B Open-Weight-Modell von Google für lokale KI-Inferenz.
ollama pull gemma-4-31b-it-qat:31bgemma-4-26B-A4B-it-ultra-uncensored-heretic-i1-GGUF
26B Open-Weight-Modell von Google für lokale KI-Inferenz.
ollama pull gemma-4-26b-a4b-it-ultra-uncensored-heretic-i1:26bgemma-4-12B-coder-fable5-composer2.5-v1-GGUF
12B Open-Weight-Modell von yuxinlu1 für lokale KI-Inferenz.
ollama pull gemma-4-12b-coder-fable5-composer2.5-v1:12bInkling-GGUF
Unbekanntes Open-Weight-Modell von Unsloth für lokale KI-Inferenz.
ollama pull inkling:latestgranite-4.1-3b-GGUF
3B Open-Weight-Modell von ibm-granite für lokale KI-Inferenz.
ollama pull granite-4.1-3b:3bSugoi-32B-Ultra-GGUF
32B Open-Weight-Modell aus dem Sugoitoolkit für lokale KI-Inferenz.
ollama pull sugoi-32b-ultra:32bQwen3-VL-4B-Instruct-GGUF
4B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen3-vl-4b:4bmadlad400-3b-mt
3B Open-Weight-Modell von Google für lokale KI-Inferenz.
ollama pull madlad400-3b-mt:3bMiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking-GGUF
1B Open-Weight-Modell von GnLOLot für lokale KI-Inferenz.
ollama pull minicpm5-1b-claude-opus-fable5-v2-thinking:1bsvara-tts-v1
Unbekanntes Open-Weight-Modell von KenPath für lokale KI-Inferenz.
ollama pull svara-tts-v1:latestQwen3.6-40B-Claude-4.6-Opus-Deckard-Heretic-Uncensored-Thinking-NEO-CODE-Di-IMatrix-MAX-GGUF
40B Open-Weight-Modell von DavidAU für lokale KI-Inferenz.
ollama pull qwen3.6-40b-claude-4.6-opus-deckard-heretic-uncensored-thinking-neo-code-di-imatrix-max:40bHolo-3.1-35B-A3B-GGUF
35B Open-Weight-Modell von Hcompany für lokale KI-Inferenz.
ollama pull holo-3.1-35b-a3b:35bgemma-4-12B-it-qat-q4_0-gguf
12B Open-Weight-Modell von Google für lokale KI-Inferenz.
ollama pull gemma-4-12b-it-qat-q4-0:12bQwen3.5-9B-The-Defiant-Fable-Uncensored-Heretic-NEO-IMATRIX-MAX-MTP-GGUF
9B Open-Weight-Modell von DavidAU für lokale KI-Inferenz.
ollama pull qwen3.5-9b-the-defiant-fable-uncensored-heretic-neo-imatrix-max-mtp:9bLTX-2.3-GGUF
Unbekanntes Open-Weight-Modell von Unsloth für lokale KI-Inferenz.
ollama pull ltx-2.3:latestgemma-4-E4B-it-qat-GGUF
4B Open-Weight-Modell von Google für lokale KI-Inferenz.
ollama pull gemma-4-e4b-it-qat:4bwhisper-large-v3-turbo-gguf
Unbekanntes Open-Weight-Modell von Handy-Computer für lokale KI-Inferenz.
ollama pull whisper-large-v3-turbo:latestLTX-2
Unbekanntes Open-Weight-Modell von DeepBeepMeep für lokale KI-Inferenz.
ollama pull ltx-2:latestQwen3-4B-GGUF
4B Open-Weight-Modell von Qwen für lokale KI-Inferenz.
ollama pull qwen3-4b:4bQwen3.5-0.8B-GGUF
0.8B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen3.5-0.8b:0.8bMeta-Llama-3.1-8B-Instruct-GGUF
8B Open-Weight-Modell von Meta für lokale KI-Inferenz.
ollama pull meta-llama-3.1-8b:8bLFM2.5-1.2B-Instruct-GGUF
1.2 Milliarden Open-Weight-Modell von LiquidAI für lokale KI-Inferenz.
ollama pull lfm2.5-1.2b:1.2bGLM-5.2-GGUF
Unbekanntes Open-Weight-Modell von Unsloth für lokale KI-Inferenz.
ollama pull glm-5.2:latestcanary-180m-flash-gguf
Unbekanntes Open-Weight-Modell von Handy-Computer für lokale KI-Inferenz.
ollama pull canary-180m-flash:latestwhisper-large-v3-gguf
Unbekanntes Open-Weight-Modell von Handy-Computer für lokale KI-Inferenz.
ollama pull whisper-large-v3:latestQwen3-8B-GGUF
8B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen3-8b:8bJan-v3.5-4B-gguf
4B Open-Weight-Modell von janhq für lokale KI-Inferenz.
ollama pull jan-v3.5-4b:4bKimi-K2.7-Code-GGUF
Unbekanntes Open-Weight-Modell von Unsloth für lokale KI-Inferenz.
ollama pull kimi-k2.7-code:latestMiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF
1B Open-Weight-Modell von GnLOLot für lokale KI-Inferenz.
ollama pull minicpm5-1b-claude-opus-fable5-thinking:1bLlama-3.2-1B-Instruct-Q8_0-GGUF
1B Open-Weight-Modell von Hugging-Quants für lokale KI-Inferenz.
ollama pull llama-3.2-1b-instruct-q8-0:1bBielik-11B-v3.0-Instruct-awq
11B Open-Weight-Modell von Speakleash für lokale KI-Inferenz.
ollama pull bielik-11b-v3.0-instruct-awq:11bWan2.2-I2V-A14B-GGUF
14B Open-Weight-Modell von QuantStack für lokale KI-Inferenz.
ollama pull wan2.2-i2v-a14b:14bGemma-4-31B-it-abliterated
31B Open-Weight-Modell von Paperscarecrow für lokale KI-Inferenz.
ollama pull gemma-4-31b-it-abliterated:31bQwen3.6-27B-Unzensiert-HauhauCS-Aggressiv
27B Open-Weight-Modell von HauhauCS für lokale KI-Inferenz.
ollama pull qwen3.6-27b-uncensored-hauhaucs-aggressive:27bThinkingCap-Qwen3.6-27B-GGUF
27B Open-Weight-Modell von bottlecapai für lokale KI-Inferenz.
ollama pull thinkingcap-qwen3.6-27b:27bWan2.1
Unbekanntes Open-Weight-Modell von DeepBeepMeep für lokale KI-Inferenz.
ollama pull wan2.1:latestVoxtral-Mini-4B-Realtime-2602-gguf
4B Open-Weight-Modell von Handy-Computer für lokale KI-Inferenz.
ollama pull voxtral-mini-4b-realtime-2602:4bQwen_Qwen3.6-35B-A3B-GGUF
35B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen-qwen3.6-35b-a3b:35bQwythos-9B-v2-GGUF
9B Open-Weight-Modell von empero-ai für lokale KI-Inferenz.
ollama pull qwythos-9b-v2:9bgemma-4-12B-agentic-fable5-composer2.5-v2-3.5x-tau2-GGUF
12B Open-Weight-Modell von yuxinlu1 für lokale KI-Inferenz.
ollama pull gemma-4-12b-agentic-fable5-composer2.5-v2-3.5x-tau2:12bSchwefel-2-Base
Unbekanntes Open-Weight-Modell von SulfurAI für lokale KI-Inferenz.
ollama pull sulphur-2-base:latestflüstern-mittel-gguf
Unbekanntes Open-Weight-Modell von Handy-Computer für lokale KI-Inferenz.
ollama pull whisper-medium:latestgemma-4-E2B-it-GGUF
2B Open-Weight-Modell von Google für lokale KI-Inferenz.
ollama pull gemma-4-e2b-it:2bparakeet-tdt-0.6b-v3-gguf
0.6B Open-Weight-Modell von Handy-Computer für lokale KI-Inferenz.
ollama pull parakeet-tdt-0.6b-v3:0.6bQwen3.5-9B-Unzensiert-HauhauCS-Aggressiv
9B Open-Weight-Modell von HauhauCS für lokale KI-Inferenz.
ollama pull qwen3.5-9b-uncensored-hauhaucs-aggressive:9bgemma-4-26B-A4B-it-qat-GGUF
26B Open-Weight-Modell von Google für lokale KI-Inferenz.
ollama pull gemma-4-26b-a4b-it-qat:26bgpt-oss-20b-GGUF
20B Open-Weight-Modell von Unsloth für lokale KI-Inferenz.
ollama pull gpt-oss-20b:20bQwen3-VL-8B-Instruct-abliterated-GGUF
Qwen3-VL-8B-Instruct-abliterated-GGUF ist ein von Alibaba entwickeltes Bildverarbeitungsmodell mit 8 Milliarden Parametern, das vollständig von proprietären Beschränkungen befreit wurde, während die Kernfunktionen erhalten blieben. Dieses Modell eignet sich hervorragend für komplexe visuelle Schlussfolgerungen und mehrstufige Aufgaben in einem dialogorientierten Rahmen und ist daher ideal für offene Analysen und kreative Generierung in den USA. Die lokale Ausführung dieser quantisierten GGUF-Version ist für Nutzer mit GPUs der Mittelklasse äußerst praktisch und bietet hohe Inferenzgeschwindigkeiten ohne die Notwendigkeit spezieller Unternehmenshardware.
ollama pull qwen3-vl-8b-instruct-abliterated:8bFlux2-Klein-9B-True-V2
9B Open-Weight-Modell von Wikeeyang für lokale KI-Inferenz.
ollama pull flux2-klein-9b-true-v2:9bQwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF
Das Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF ist ein von DavidAU entwickeltes, umfangreiches Sprachmodell mit 27 Milliarden Parametern, das verschiedene Feinabstimmungstechniken, darunter die Unsloth- und Heretic-Methoden, kombiniert. Dieses Modell generiert hervorragend unzensierte, hochkreative und uneingeschränkte Inhalte zu unterschiedlichsten Themen und eignet sich daher ideal für Nutzer, die einen ressourcenschonenden Assistenten suchen, der mehrstufige, optimierte Antworten ohne Sicherheitsfilter liefert. Für die lokale Ausführung dieser quantisierten GGUF-Version ist eine leistungsstarke GPU mit ausreichend VRAM erforderlich, um die 27 Milliarden Parameter effizient zu verarbeiten. Die beste Performance wird auf Systemen mit High-End-Hardware für schnelle Inferenzgeschwindigkeiten erzielt.
ollama pull qwen3.6-27b-fable-fusion-711-uncensored-heretic-nm-dau-neo-max-mtp:27bQwen3-Coder-30B-A3B-Instruct-GGUF
Qwen3-Coder-30B-A3B-Instruct-GGUF ist ein von Alibaba entwickeltes Codierungsmodell mit 30 Milliarden Parametern, das fortschrittliche Befehlsoptimierung für spezielle Aufgaben integriert. Es eignet sich hervorragend für die Generierung komplexen Codes, das Debugging und die dialogbasierte Programmierunterstützung und ist damit ideal für Entwickler in den USA, die nach leistungsstarken Lösungen suchen. Die lokale Ausführung dieses Modells erfordert aufgrund der großen Parameteranzahl viel GPU-Speicher und ist daher am besten für Benutzer mit leistungsstarker Hardware geeignet, die Wert auf reine Codierungsfähigkeit legen.
ollama pull qwen3-coder-30b-a3b:30bgemma-4-31B-it-GGUF
31B Open-Weight-Modell von Google für lokale KI-Inferenz.
ollama pull gemma-4-31b-it:31bGemma-4-E4B-Unzensiert-HauhauCS-Aggressiv
Gemma-4-E4B-Uncensored-HauhauCS-Aggressive ist ein multimodales Modell mit 4 Milliarden Parametern, entwickelt von HauhauCS. Es integriert die erweiterten Funktionen von Gemma 4 mit ablativen Sicherheitsfiltern. Diese aggressive Variante eignet sich hervorragend für uneingeschränkte Textgenerierung, Bildanalyse und Audioverarbeitung und ist somit ideal für kreative Aufgaben, die eine Rohausgabe ohne Inhaltsmoderation erfordern. Die lokale Ausführung dieses Modells benötigt viel GPU-Speicher zur Verarbeitung der multimodalen Eingaben. Benutzer sollten daher mit hohen Rechenkosten bei der Verarbeitung komplexer Audio- oder Videostreams rechnen.
ollama pull gemma-4-e4b-uncensored-hauhaucs-aggressive:4bQwopus3.6-27B-Coder-Compat-MTP-GGUF
27B Open-Weight-Modell von Jackrong für lokale KI-Inferenz.
ollama pull qwopus3.6-27b-coder-compat-mtp:27bUI-TARS-1.5-7B-GGUF
7B Open-Weight-Modell von mradermacher für lokale KI-Inferenz.
ollama pull ui-tars-1.5-7b:7bHuihui-DeepSeek-V4-Flash-abliterated-ds4-GGUF
Unbekanntes Open-Weight-Modell von huihui-ai für lokale KI-Inferenz.
ollama pull huihui-deepseek-v4-flash-abliterated-ds4:latestgemma-4-12B-it-QAT-GGUF
12B Open-Weight-Modell von Google für lokale KI-Inferenz.
ollama pull gemma-4-12b-it-qat:12bTernary-Bonsai-27B-gguf
27B Open-Weight-Modell von prism-ml für lokale KI-Inferenz.
ollama pull ternary-bonsai-27b:27bGemmable-4-12B-MTP-GGUF
12B Open-Weight-Modell von Mia-AiLab für lokale KI-Inferenz.
ollama pull gemmable-4-12b-mtp:12bQwopus3.6-35B-A3B-Coder-MTP-GGUF
35B Open-Weight-Modell von Jackrong für lokale KI-Inferenz.
ollama pull qwopus3.6-35b-a3b-coder-mtp:35bQwen3.6-35B-A3B-MTP-GGUF
35B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen3.6-35b-a3b-mtp:35bgemma-4-12b-it-GGUF
12B Open-Weight-Modell von Google für lokale KI-Inferenz.
ollama pull gemma-4-12b-it:12bQwen3-VL-30B-A3B-Instruct-GGUF
30B Open-Weight-Modell von Qwen für lokale KI-Inferenz.
ollama pull qwen3-vl-30b-a3b:30bModelle verschoben
Die Sammlung „models-moved“ wird von ggml-org bereitgestellt und weist derzeit eine unbekannte Anzahl an Parametern für ihre verschiedenen Modelldateien auf. Diese Modelle eignen sich hervorragend für allgemeine Aufgaben in den USA und sind besonders für Nutzer geeignet, die nach leicht zugänglichen Inferenzoptionen dieses Anbieters suchen. Für die lokale Ausführung müssen die entsprechenden GGUF-Quantisierungsdateien heruntergeladen werden, wobei die Leistung je nach GPU- oder CPU-Hardware erheblich variiert.
ollama pull models-moved:latestcohere-transcribe-03-2026-gguf
Unbekanntes Open-Weight-Modell von Handy-Computer für lokale KI-Inferenz.
ollama pull cohere-transcribe-03-2026:latestQwen-AgentWorld-35B-A3B-GGUF
35B Open-Weight-Modell von Alibaba für lokale KI-Inferenz.
ollama pull qwen-agentworld-35b-a3b:35bvntl-llama3-8b-v2-gguf
Das Sprachmodell vntl-llama3-8b-v2-gguf mit 8 Milliarden Parametern wurde von lmg-anon entwickelt und ist auf hochwertige Übersetzungen und Konversationsaufgaben spezialisiert. Es eignet sich hervorragend für die Verarbeitung des VNTL-v5-1k-Datensatzes und liefert flüssige Antworten, wodurch es ideal für mehrsprachige Chat-Anwendungen und die Generierung lokalisierter Inhalte ist. Für die lokale Ausführung dieses Modells wird eine GPU mit ausreichend VRAM benötigt, um die 8 Milliarden Parameter effizient zu verarbeiten und so eine reaktionsschnelle Performance für Echtzeitdialoge zu gewährleisten.
ollama pull vntl-llama3-8b-v2:8bgemma-4-E4B-it-GGUF
Das gemma-4-E4B-it-GGUF ist ein von Google entwickeltes Sprachmodell mit vier Milliarden Parametern, das mithilfe der GGUF-Quantisierung für Italienisch optimiert wurde. Es eignet sich hervorragend für komplexe Schlussfolgerungsaufgaben innerhalb der Gemma-4-Architektur und unterstützt effiziente Bild-zu-Text-Konvertierungen durch spezielle Unsloth-Optimierungen. Um die hohe Geschwindigkeit dieses Modells lokal auszunutzen, ist eine moderne GPU erforderlich. Daher ist es ideal für Anwender, die eine leistungsstarke lokale Inferenz ohne Cloud-Abhängigkeiten benötigen.
ollama pull gemma-4-e4b-it:4bQwen3.6-27B-GGUF
Qwen3.6-27B-GGUF ist ein von Alibaba entwickeltes, umfangreiches Sprachmodell mit 27 Milliarden Parametern, das fortschrittliche Konversations-KI und Bild-zu-Text-Funktionen unterstützt. Es eignet sich hervorragend für komplexe Schlussfolgerungsaufgaben, mehrsprachige Kommunikation und visuelle Analyse und ist daher ideal für professionelle Anwendungen, die eine hohe Genauigkeit bei der Textgenerierung und -interpretation erfordern. Die lokale Ausführung dieses Modells benötigt in der Regel viel GPU-Speicher und einen leistungsstarken Prozessor, um die 27 Milliarden Parameter effizient zu verarbeiten. Daher ist es am besten für Nutzer mit dedizierter Hardware oder Zugriff auf Cloud-Instanzen geeignet.
ollama pull qwen3.6-27b:27bQwen3.6-35B-A3B-GGUF
Qwen3.6-35B-A3B-GGUF ist ein von Alibaba entwickeltes, 35 Milliarden Parameter umfassendes Sprachmodell mit speziellen Optimierungen für die Bild-zu-Text-Konvertierung und mehrsprachige Konversation. Es eignet sich hervorragend für komplexe visuelle Analyseaufgaben und die Aufrechterhaltung eines kohärenten Dialogs und ist daher ideal für Anwendungen, die ein tiefes Kontextverständnis über verschiedene Themenbereiche hinweg erfordern. Die lokale Ausführung dieses Modells benötigt aufgrund der hohen Parameteranzahl viel GPU-Speicher. Quantisierte GGUF-Versionen bieten jedoch ein gutes Verhältnis zwischen Geschwindigkeit und Leistung auf leistungsstarker Consumer-Hardware.
ollama pull qwen3.6-35b-a3b:35bHy3-GGUF
Unbekanntes Open-Weight-Modell von vcruz305 für lokale KI-Inferenz.
ollama pull hy3:latestHyperCLOVAX-SEED-Text-Instruct-1.5B-Q4_K_M-GGUF
HyperCLOVAX-SEED-Text-Instruct-1.5B-Q4_K_M-GGUF ist ein Sprachmodell mit 1.5 Milliarden Parametern, das von rippertnt entwickelt und für die Verwendung mit llama-cpp optimiert wurde. Es eignet sich hervorragend für Konversationsaufgaben und die allgemeine Textgenerierung und ist daher ideal für ressourcenschonende Anwendungen, die eine effiziente Inferenz auf Standardhardware erfordern. Dank seines quantisierten Formats lässt sich dieses Modell auch auf weniger leistungsstarken Systemen lokal ausführen und bietet schnelle Reaktionszeiten ohne die Notwendigkeit von High-End-GPUs.
ollama pull hyperclovax-seed-text-instruct-1.5b-q4-k-m:1.5bQwen3.5-9B-GGUF
Qwen3.5-9B-GGUF ist ein kompaktes, großes Sprachmodell von Alibaba mit 9 Milliarden Parametern. Es eignet sich hervorragend für Konversationsaufgaben und die Bild-zu-Text-Konvertierung und ist daher ideal für ressourcenschonende Anwendungen, die eine effiziente Bereitstellung in den USA erfordern. Dank seines geringen Speicherbedarfs lässt sich dieses Modell lokal auf handelsüblicher Hardware ausführen und bietet in Kombination mit Optimierungsbibliotheken wie Unsloth selbst auf leistungsschwächeren GPUs hohe Inferenzgeschwindigkeiten.
ollama pull qwen3.5-9b:9bQwen3.5-4B-GGUF
Qwen3.5-4B-GGUF ist ein kompaktes Sprachmodell mit 4 Milliarden Parametern, entwickelt von Alibaba, das Konversationsaufgaben und die Umwandlung von Bildern in Text unterstützt. Es eignet sich hervorragend für die Verarbeitung leichter Inferenzlasten und bietet gleichzeitig eine hohe Leistung in Umgebungen, die für die Textgenerierung optimiert sind. Da das Modell lokal ausgeführt werden muss, benötigt es nur minimale Hardware-Ressourcen und ist daher ideal für Anwender, die eine schnelle und effiziente Bereitstellung auf gängigen Endgeräten wünschen.
ollama pull qwen3.5-4b:4bparakeet-unified-en-0.6b-gguf
0.6B Open-Weight-Modell von Handy-Computer für lokale KI-Inferenz.
ollama pull parakeet-unified-en-0.6b:0.6bnemotron-3.5-asr-streaming-0.6b-gguf
0.6B Open-Weight-Modell von Handy-Computer für lokale KI-Inferenz.
ollama pull nemotron-3.5-asr-streaming-0.6b:0.6bgemma-4-26B-A4B-it-GGUF
Das gemma-4-26B-A4B-it-GGUF ist ein von Google entwickeltes, 26 Milliarden Parameter umfassendes Sprachmodell, das fortschrittliches Befehlstuning für leistungsstarkes logisches Schließen nutzt. Dieses Modell eignet sich hervorragend für die Generierung komplexer Texte und multimodale Aufgaben und ist daher ideal für Anwendungen, die ein tiefes Kontextverständnis und die präzise Befolgung von Anweisungen erfordern. Die lokale Ausführung dieses Modells benötigt viel GPU-Speicher und erhebliche Rechenleistung und ist daher am besten für Nutzer mit High-End-Hardware oder solche geeignet, die Inferenz-Frameworks wie Unsloth zur Ressourcenoptimierung einsetzen.
ollama pull gemma-4-26b-a4b-it:26bBonsai-27B-gguf
Bonsai-27B-gguf ist ein kompaktes Sprachmodell mit 27 Milliarden Parametern, entwickelt von prism-ml, das Quantisierung für eine effiziente Bereitstellung nutzt. Es eignet sich hervorragend für Konversationsaufgaben und allgemeines logisches Denken und läuft reibungslos auf llama.cpp mit Unterstützung für CPU- und CUDA-Hardwarebeschleunigung. Benutzer können dieses Modell lokal auf einfacher Hardware ausführen, wobei die Leistung je nach Verwendung von 1-Bit-Quantisierung oder Zugriff auf eine GPU variiert.
ollama pull bonsai-27b:27bQwen3.6-35B-A3B-Unzensiert-HauhauCS-Aggressiv
Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive ist ein von HauhauCS entwickeltes, 35 Milliarden Parameter umfassendes Sprachmodell, das die Mixture-of-Experts-Architektur mit fortschrittlichen multimodalen und visuellen Funktionen kombiniert. Es eignet sich hervorragend für komplexes Schließen, mehrsprachige Bild-Text-Analyse und die Generierung unzensierter Inhalte für aggressive oder uneingeschränkte Anwendungsfälle, in denen Standard-Sicherheitsfilter unerwünscht sind. Die lokale Ausführung dieses Modells erfordert aufgrund seiner spärlichen Mixture-of-Experts-Struktur erheblichen High-End-GPU-Speicher und ist daher am besten für leistungsstarke Workstations oder Server mit ausreichend verfügbarem VRAM geeignet.
ollama pull qwen3.6-35b-a3b-uncensored-hauhaucs-aggressive:35bQwythos-9B-Claude-Mythos-5-1M-GGUF
9B Open-Weight-Modell von empero-ai für lokale KI-Inferenz.
ollama pull qwythos-9b-claude-mythos-5-1m:9bOrnith-1.0-35B-GGUF
Ornith-1.0-35B-GGUF ist ein Sprachmodell mit 35 Milliarden Parametern, das von ornith-ai speziell für Konversationsaufgaben im US-amerikanischen Raum entwickelt wurde. Es zeichnet sich durch die Aufrechterhaltung natürlicher Dialogabläufe und die Verarbeitung kontextbezogener Interaktionen aus und ist daher ideal für Chatbots und virtuelle Assistenten. Die lokale Ausführung dieses Modells erfordert aufgrund seiner Größe viel GPU-Speicher und eignet sich daher am besten für Nutzer mit leistungsstarker Hardware oder solche, die bereit sind, quantisierte GGUF-Versionen zu verwenden, um den Ressourcenbedarf zu reduzieren.
ollama pull ornith-1.0-35b:35bQwen3.6-27B-MTP-GGUF
Qwen3.6-27B-MTP-GGUF ist ein von Alibaba entwickeltes, 27 Milliarden Parameter umfassendes Sprachmodell, das fortgeschrittene Konversationsaufgaben und die Umwandlung von Bildern in Text unterstützt. Es eignet sich hervorragend für komplexe Schlussfolgerungen und mehrstufige Dialoge und ist daher ideal für Anwendungen, die ein tiefes Kontextverständnis und visuelle Analysen erfordern. Die lokale Ausführung dieses Modells erfordert in der Regel leistungsstarke GPU-Hardware, um den großen Speicherbedarf zu bewältigen. Quantisierte GGUF-Versionen bieten jedoch ein gutes Verhältnis zwischen Geschwindigkeit und Leistung auf Consumer-Systemen.
ollama pull qwen3.6-27b-mtp:27bdeepseek-v4.gguf
Das deepseek-v4-gguf-Modell ist eine quantisierte Mixture-of-Experts-Architektur von antirez mit unbekannter Parameteranzahl, die in 2-Bit- und 4-Bit-Formaten verfügbar ist. Es zeichnet sich durch effiziente Inferenz bei großen Sprachverarbeitungsaufgaben aus und bietet dank seiner speziellen MoE-Struktur eine hohe Leistung. Dadurch ist es ideal für Anwender, die einen geringen Speicherbedarf ohne signifikante Leistungseinbußen benötigen. Die lokale Ausführung dieses Modells erfordert moderate Hardware-Ressourcen zur effektiven Verarbeitung der quantisierten Gewichte und bietet somit eine schnelle und praktische Lösung für den Einsatz fortschrittlicher KI-Funktionen auf Consumer-Systemen.
ollama pull deepseek-v4:latestOrnith-1.0-9B-GGUF
Ornith-1.0-9B-GGUF ist ein Sprachmodell mit 9 Milliarden Parametern, entwickelt von ornith-ai für die Konversation in den USA. Es eignet sich hervorragend zur Generierung natürlicher Dialoge und zur Bewältigung alltäglicher Chat-Aufgaben und ist daher ideal für schlanke virtuelle Assistenten oder einfache Kundensupport-Bots. Da das Modell lokal mit geringen Hardware-Ressourcen ausgeführt werden kann, läuft es schnell auf handelsüblichen GPUs, ohne dass große Rechenzentren erforderlich sind.
ollama pull ornith-1.0-9b:9b
