Modelos de lhama

conteúdo

Modelos de IA para lhamas

Todos os modelos neste diretório estão no formato GGUF, portanto, funcionam diretamente no Ollama. Aqui está o catálogo completo com comandos de extração prontos para copiar.

Estúdio Higgs Audio v3

drbaphDesconhecidas8 GB RAM

Modelo open-weight desconhecido do drbaph para inferência local de IA.

ollama pull higgs-audio-v3-studio:latest

DeepSeek-V4-Flash-GGUF

DeepSeekDesconhecidas8 GB RAM

Modelo de peso aberto desconhecido do DeepSeek para inferência local de IA.

ollama pull deepseek-v4-flash:latest

Qwen3.5-2B-GGUF

Alibaba2B4 GB RAM

Modelo open-weight 2B da Alibaba para inferência local de IA.

ollama pull qwen3.5-2b:2b

Qwen3.5-4B-Sem Censura-HauhauCS-Agressivo

HauhauCS4B8 GB RAM

Modelo de peso aberto 4B do HauhauCS para inferência de IA local.

ollama pull qwen3.5-4b-uncensored-hauhaucs-aggressive:4b

Qwen3.5-35B-A3B-GGUF

Alibaba35B48 GB RAM

Modelo open-weight 35B da Alibaba para inferência local de IA.

ollama pull qwen3.5-35b-a3b:35b

Lhama-3.2-3B-Instruções-GGUF

Meta3B4 GB RAM

Modelo open-weight 3B da Meta para inferência local de IA.

ollama pull llama-3.2-3b:3b

gemma-3-1b-it-GGUF

ggml-org1B2 GB RAM

Modelo open-weight 1B do ggml-org para inferência local de IA.

ollama pull gemma-3-1b-it:1b

Qwen3.5-122B-A10B-MTP-GGUF

Alibaba122B80 GB RAM

Modelo open-weight 122B da Alibaba para inferência local de IA.

ollama pull qwen3.5-122b-a10b-mtp:122b

FLUX.2-klein-4B-GGUF

preguiçoso4B8 GB RAM

Modelo open-weight 4B do unsloth para inferência local de IA.

ollama pull flux.2-klein-4b:4b

Qwen2.5-7B-Instruções-GGUF

Alibaba7B8 GB RAM

Modelo open-weight 7B da Alibaba para inferência local de IA.

ollama pull qwen2.5-7b:7b

Qwen3-30B-A3B-GGUF

MaziyarPanahi30B24 GB RAM

Modelo open-weight 30B de MaziyarPanahi para inferência local de IA.

ollama pull qwen3-30b-a3b:30b

Qwen3-32B-GGUF

MaziyarPanahi32B24 GB RAM

Modelo open-weight 32B de MaziyarPanahi para inferência local de IA.

ollama pull qwen3-32b:32b

Qwen3-1.7B-GGUF

MaziyarPanahi1.7B4 GB RAM

Modelo open-weight 1.7B de MaziyarPanahi para inferência local de IA.

ollama pull qwen3-1.7b:1.7b

Kimi-K3-GGUF

preguiçosoDesconhecidas8 GB RAM

Modelo open-weight desconhecido do unsloth para inferência local de IA.

ollama pull kimi-k3:latest

Qwen2.5-0.5B-Instruções-GGUF

Qwen0.5B2 GB RAM

Modelo open-weight 0.5B do Qwen para inferência local de IA.

ollama pull qwen2.5-0.5b:0.5b

Qwen3-14B-GGUF

MaziyarPanahi14B24 GB RAM

Modelo open-weight 14B de MaziyarPanahi para inferência local de IA.

ollama pull qwen3-14b:14b

Qwen3-0.6B-GGUF

MaziyarPanahi0.6B2 GB RAM

Modelo open-weight 0.6B de MaziyarPanahi para inferência local de IA.

ollama pull qwen3-0.6b:0.6b

Laguna-S-2.1-GGUF

preguiçosoDesconhecidas8 GB RAM

Modelo open-weight desconhecido do unsloth para inferência local de IA.

ollama pull laguna-s-2.1:latest

Qwen3.6-35B-A3B-Sem Censura-Gênesis-Hermes-V7-GGUF

LuffyTheFox35B48 GB RAM

Modelo open-weight 35B de LuffyTheFox para inferência local de IA.

ollama pull qwen3.6-35b-a3b-uncensored-genesis-hermes-v7:35b

gemma-gguf

rahul7starDesconhecidas8 GB RAM

Modelo open-weight desconhecido de rahul7star para inferência local de IA.

ollama pull gemma:latest

Qwen2.5-VL-7B-Instruct-GGUF

Alibaba7B8 GB RAM

Modelo open-weight 7B da Alibaba para inferência local de IA.

ollama pull qwen2.5-vl-7b:7b

Qwen3-235B-A22B-GGUF

Alibaba235B80 GB RAM

Modelo open-weight 235B da Alibaba para inferência local de IA.

ollama pull qwen3-235b-a22b:235b

Voxtral-Pequeno-24B-2507-gguf

computador portátil24B24 GB RAM

Modelo open-weight de 24B do handy-computer para inferência local de IA.

ollama pull voxtral-small-24b-2507:24b

Sugoi-14B-Ultra-GGUF

kit de ferramentas sugoi14B24 GB RAM

Modelo open-weight 14B do sugoitoolkit para inferência local de IA.

ollama pull sugoi-14b-ultra:14b

Qwen3-ASR-1.7B-gguf

computador portátil1.7B4 GB RAM

Modelo open-weight de 1.7B do handy-computer para inferência local de IA.

ollama pull qwen3-asr-1.7b:1.7b

Qwen3-30B-A3B-Instruct-2507-GGUF

Alibaba30B24 GB RAM

Modelo open-weight 30B da Alibaba para inferência local de IA.

ollama pull qwen3-30b-a3b-instruct-2507:30b

Qwen2.5-3B-Instruções-GGUF

Qwen3B4 GB RAM

Modelo open-weight 3B do Qwen para inferência local de IA.

ollama pull qwen2.5-3b:3b

gemma-4-12b-herege-abolido-GGUF

revolta cultural12B16 GB RAM

Modelo open-weight 12B da culturerevolt para inferência local de IA.

ollama pull gemma-4-12b-heretic-abliterated:12b

Qwen3.5-122B-A10B-Sem Censura-HauhauCS-Agressivo

HauhauCS122B80 GB RAM

Modelo de peso aberto 122B do HauhauCS para inferência de IA local.

ollama pull qwen3.5-122b-a10b-uncensored-hauhaucs-aggressive:122b

Qwen2.5-Coder-7B-Instruct-GGUF

Qwen7B8 GB RAM

Modelo open-weight 7B do Qwen para inferência local de IA.

ollama pull qwen2.5-coder-7b:7b

Qwen-Image-Edit-2511-GGUF

AlibabaDesconhecidas8 GB RAM

Modelo open-weight desconhecido da Alibaba para inferência local de IA.

ollama pull qwen-image-edit-2511:latest

Qwen3-Coder-Next-GGUF

AlibabaDesconhecidas8 GB RAM

Modelo open-weight desconhecido da Alibaba para inferência local de IA.

ollama pull qwen3-coder-next:latest

Qwen2.5-1.5B-Instruções-GGUF

Qwen1.5B4 GB RAM

Modelo open-weight 1.5B do Qwen para inferência local de IA.

ollama pull qwen2.5-1.5b:1.5b

Qwen3.6-35B-A3B-Sem Censura-Gênesis-Hermes-V6-GGUF

LuffyTheFox35B48 GB RAM

Modelo open-weight 35B de LuffyTheFox para inferência local de IA.

ollama pull qwen3.6-35b-a3b-uncensored-genesis-hermes-v6:35b

programas de patas

pesos dos programasDesconhecidas8 GB RAM

Modelo open-weight desconhecido do programaweights para inferência local de IA.

ollama pull paw-programs:latest

Qwen2.5-Coder-32B-Instruct-GGUF

Qwen32B24 GB RAM

Modelo open-weight 32B do Qwen para inferência local de IA.

ollama pull qwen2.5-coder-32b:32b

gemma-4-31B-it-qat-GGUF

Google31B24 GB RAM

Modelo open-weight 31B do Google para inferência local de IA.

ollama pull gemma-4-31b-it-qat:31b

gemma-4-26B-A4B-it-ultra-uncensored-heretic-i1-GGUF

Google26B24 GB RAM

Modelo open-weight 26B do Google para inferência local de IA.

ollama pull gemma-4-26b-a4b-it-ultra-uncensored-heretic-i1:26b

gemma-4-12B-coder-fable5-composer2.5-v1-GGUF

yuxinlu112B16 GB RAM

Modelo open-weight 12B de yuxinlu1 para inferência local de IA.

ollama pull gemma-4-12b-coder-fable5-composer2.5-v1:12b

pressentimento-GGUF

preguiçosoDesconhecidas8 GB RAM

Modelo open-weight desconhecido do unsloth para inferência local de IA.

ollama pull inkling:latest

granito-4.1-3b-GGUF

IBM Granito3B4 GB RAM

Modelo de peso aberto 3B do ibm-granite para inferência local de IA.

ollama pull granite-4.1-3b:3b

Sugoi-32B-Ultra-GGUF

kit de ferramentas sugoi32B24 GB RAM

Modelo open-weight 32B do sugoitoolkit para inferência local de IA.

ollama pull sugoi-32b-ultra:32b

Qwen3-VL-4B-Instruct-GGUF

Alibaba4B8 GB RAM

Modelo open-weight 4B da Alibaba para inferência local de IA.

ollama pull qwen3-vl-4b:4b

madlad400-3b-mt

google3B4 GB RAM

Modelo open-weight 3B do Google para inferência local de IA.

ollama pull madlad400-3b-mt:3b

MiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking-GGUF

GnLOLot1B2 GB RAM

Modelo open-weight 1B do GnLOLot para inferência local de IA.

ollama pull minicpm5-1b-claude-opus-fable5-v2-thinking:1b

svara-tts-v1

kenpathDesconhecidas8 GB RAM

Modelo open-weight desconhecido do KenPath para inferência local de IA.

ollama pull svara-tts-v1:latest

Qwen3.6-40B-Claude-4.6-Opus-Deckard-Heretic-Uncensored-Thinking-NEO-CODE-Di-IMatrix-MAX-GGUF

DavidAU40B48 GB RAM

Modelo open-weight 40B de DavidAU para inferência local de IA.

ollama pull qwen3.6-40b-claude-4.6-opus-deckard-heretic-uncensored-thinking-neo-code-di-imatrix-max:40b

Holo-3.1-35B-A3B-GGUF

Empresa H35B48 GB RAM

Modelo open-weight 35B da Hcompany para inferência local de IA.

ollama pull holo-3.1-35b-a3b:35b

gemma-4-12B-it-qat-q4_0-gguf

google12B16 GB RAM

Modelo open-weight 12B do Google para inferência local de IA.

ollama pull gemma-4-12b-it-qat-q4-0:12b

Qwen3.5-9B-A-Fábula-Desafiadora-Sem-Censura-Herege-NEO-IMATRIX-MAX-MTP-GGUF

DavidAU9B16 GB RAM

Modelo open-weight 9B de DavidAU para inferência local de IA.

ollama pull qwen3.5-9b-the-defiant-fable-uncensored-heretic-neo-imatrix-max-mtp:9b

LTX-2.3-GGUF

preguiçosoDesconhecidas8 GB RAM

Modelo open-weight desconhecido do unsloth para inferência local de IA.

ollama pull ltx-2.3:latest

gemma-4-E4B-it-qat-GGUF

Google4B8 GB RAM

Modelo open-weight 4B do Google para inferência local de IA.

ollama pull gemma-4-e4b-it-qat:4b

sussurro-grande-v3-turbo-gguf

computador portátilDesconhecidas8 GB RAM

Modelo open-weight desconhecido do handy-computer para inferência local de IA.

ollama pull whisper-large-v3-turbo:latest

LTX-2

DeepBeepMeepDesconhecidas8 GB RAM

Modelo de peso aberto desconhecido do DeepBeepMeep para inferência local de IA.

ollama pull ltx-2:latest

Qwen3-4B-GGUF

Qwen4B8 GB RAM

Modelo open-weight 4B do Qwen para inferência local de IA.

ollama pull qwen3-4b:4b

Qwen3.5-0.8B-GGUF

Alibaba0.8B2 GB RAM

Modelo open-weight 0.8B da Alibaba para inferência local de IA.

ollama pull qwen3.5-0.8b:0.8b

Meta-Llama-3.1-8B-Instruções-GGUF

Meta8B16 GB RAM

Modelo open-weight 8B da Meta para inferência local de IA.

ollama pull meta-llama-3.1-8b:8b

LFM2.5-1.2B-Instruções-GGUF

LiquidAI1.2B4 GB RAM

Modelo open-weight de 1.2 bilhões de caracteres da LiquidAI para inferência local de IA.

ollama pull lfm2.5-1.2b:1.2b

GLM-5.2-GGUF

preguiçosoDesconhecidas8 GB RAM

Modelo open-weight desconhecido do unsloth para inferência local de IA.

ollama pull glm-5.2:latest

canário-180m-flash-gguf

computador portátilDesconhecidas8 GB RAM

Modelo open-weight desconhecido do handy-computer para inferência local de IA.

ollama pull canary-180m-flash:latest

sussurro-grande-v3-gguf

computador portátilDesconhecidas8 GB RAM

Modelo open-weight desconhecido do handy-computer para inferência local de IA.

ollama pull whisper-large-v3:latest

Qwen3-8B-GGUF

Alibaba8B16 GB RAM

Modelo open-weight 8B da Alibaba para inferência local de IA.

ollama pull qwen3-8b:8b

Jan-v3.5-4B-gguf

janhq4B8 GB RAM

Modelo open-weight 4B do janhq para inferência local de IA.

ollama pull jan-v3.5-4b:4b

Kimi-K2.7-Código-GGUF

preguiçosoDesconhecidas8 GB RAM

Modelo open-weight desconhecido do unsloth para inferência local de IA.

ollama pull kimi-k2.7-code:latest

MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF

GnLOLot1B2 GB RAM

Modelo open-weight 1B do GnLOLot para inferência local de IA.

ollama pull minicpm5-1b-claude-opus-fable5-thinking:1b

Lhama-3.2-1B-Instruções-Q8_0-GGUF

abraços-quants1B2 GB RAM

Modelo open-weight 1B do embrace-quants para inferência local de IA.

ollama pull llama-3.2-1b-instruct-q8-0:1b

Bielik-11B-v3.0-Instruções-awq

coleira de speakleash11B16 GB RAM

Modelo open-weight 11B do speakleash para inferência local de IA.

ollama pull bielik-11b-v3.0-instruct-awq:11b

Wan2.2-I2V-A14B-GGUF

QuantStack14B24 GB RAM

Modelo open-weight 14B da QuantStack para inferência local de IA.

ollama pull wan2.2-i2v-a14b:14b

Gemma-4-31B-isso-abolido

espantalho de papel31B24 GB RAM

Modelo open-weight 31B do paperscarecrow para inferência local de IA.

ollama pull gemma-4-31b-it-abliterated:31b

Qwen3.6-27B-Sem Censura-HauhauCS-Agressivo

HauhauCS27B24 GB RAM

Modelo de peso aberto 27B do HauhauCS para inferência de IA local.

ollama pull qwen3.6-27b-uncensored-hauhaucs-aggressive:27b

ThinkingCap-Qwen3.6-27B-GGUF

bottlecapai27B24 GB RAM

Modelo open-weight 27B do bottlecapai para inferência local de IA.

ollama pull thinkingcap-qwen3.6-27b:27b

Wan2.1

DeepBeepMeepDesconhecidas8 GB RAM

Modelo de peso aberto desconhecido do DeepBeepMeep para inferência local de IA.

ollama pull wan2.1:latest

Voxtral-Mini-4B-Realtime-2602-gguf

computador portátil4B8 GB RAM

Modelo open-weight de 4B do handy-computer para inferência local de IA.

ollama pull voxtral-mini-4b-realtime-2602:4b

Qwen_Qwen3.6-35B-A3B-GGUF

Alibaba35B48 GB RAM

Modelo open-weight 35B da Alibaba para inferência local de IA.

ollama pull qwen-qwen3.6-35b-a3b:35b

Qwythos-9B-v2-GGUF

imperador-ai9B16 GB RAM

Modelo open-weight 9B da empero-ai para inferência local de IA.

ollama pull qwythos-9b-v2:9b

gemma-4-12B-agentic-fable5-composer2.5-v2-3.5x-tau2-GGUF

yuxinlu112B16 GB RAM

Modelo open-weight 12B de yuxinlu1 para inferência local de IA.

ollama pull gemma-4-12b-agentic-fable5-composer2.5-v2-3.5x-tau2:12b

Base de enxofre-2

EnxofreAIDesconhecidas8 GB RAM

Modelo de peso aberto desconhecido do SulfurAI para inferência de IA local.

ollama pull sulphur-2-base:latest

sussurro-médio-gguf

computador portátilDesconhecidas8 GB RAM

Modelo open-weight desconhecido do handy-computer para inferência local de IA.

ollama pull whisper-medium:latest

gemma-4-E2B-it-GGUF

Google2B4 GB RAM

Modelo open-weight 2B do Google para inferência local de IA.

ollama pull gemma-4-e2b-it:2b

periquito-tdt-0.6b-v3-gguf

computador portátil0.6B2 GB RAM

Modelo open-weight de 0.6B do handy-computer para inferência local de IA.

ollama pull parakeet-tdt-0.6b-v3:0.6b

Qwen3.5-9B-Sem Censura-HauhauCS-Agressivo

HauhauCS9B16 GB RAM

Modelo de peso aberto 9B do HauhauCS para inferência de IA local.

ollama pull qwen3.5-9b-uncensored-hauhaucs-aggressive:9b

gemma-4-26B-A4B-it-qat-GGUF

Google26B24 GB RAM

Modelo open-weight 26B do Google para inferência local de IA.

ollama pull gemma-4-26b-a4b-it-qat:26b

gpt-oss-20b-GGUF

preguiçoso20B24 GB RAM

Modelo open-weight 20B do unsloth para inferência local de IA.

ollama pull gpt-oss-20b:20b

Qwen3-VL-8B-Instruct-abolido-GGUF

Alibaba8B16 GB RAM

Modelo open-weight 8B da Alibaba para inferência local de IA.

ollama pull qwen3-vl-8b-instruct-abliterated:8b

Flux2-Klein-9B-Verdadeiro-V2

wikeeyang9B16 GB RAM

Modelo open-weight 9B de wikeeyang para inferência local de IA.

ollama pull flux2-klein-9b-true-v2:9b

Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF

DavidAU27B24 GB RAM

Modelo open-weight 27B de DavidAU para inferência local de IA.

ollama pull qwen3.6-27b-fable-fusion-711-uncensored-heretic-nm-dau-neo-max-mtp:27b

Qwen3-Coder-30B-A3B-Instruct-GGUF

Alibaba30B24 GB RAM

Modelo open-weight 30B da Alibaba para inferência local de IA.

ollama pull qwen3-coder-30b-a3b:30b

gemma-4-31B-it-GGUF

Google31B24 GB RAM

Modelo open-weight 31B do Google para inferência local de IA.

ollama pull gemma-4-31b-it:31b

Gemma-4-E4B-Sem Censura-HauhauCS-Agressivo

HauhauCS4B8 GB RAM

Modelo de peso aberto 4B do HauhauCS para inferência de IA local.

ollama pull gemma-4-e4b-uncensored-hauhaucs-aggressive:4b

Qwopus3.6-27B-Coder-Compat-MTP-GGUF

Jackrong27B24 GB RAM

Modelo open-weight 27B da Jackrong para inferência local de IA.

ollama pull qwopus3.6-27b-coder-compat-mtp:27b

UI-TARS-1.5-7B-GGUF

mradermacher7B8 GB RAM

Modelo de peso aberto 7B de mradermacher para inferência local de IA.

ollama pull ui-tars-1.5-7b:7b

Huihui-DeepSeek-V4-Flash-abolido-ds4-GGUF

huihui-aiDesconhecidas8 GB RAM

Modelo de peso aberto desconhecido do huihui-ai para inferência de IA local.

ollama pull huihui-deepseek-v4-flash-abliterated-ds4:latest

gemma-4-12B-it-QAT-GGUF

Google12B16 GB RAM

Modelo open-weight 12B do Google para inferência local de IA.

ollama pull gemma-4-12b-it-qat:12b

Ternary-Bonsai-27B-gguf

prisma-ml27B24 GB RAM

Modelo open-weight 27B do prism-ml para inferência local de IA.

ollama pull ternary-bonsai-27b:27b

Gemmable-4-12B-MTP-GGUF

Mia-AiLab12B16 GB RAM

Modelo open-weight 12B do Mia-AiLab para inferência local de IA.

ollama pull gemmable-4-12b-mtp:12b

Qwopus3.6-35B-A3B-Coder-MTP-GGUF

Jackrong35B48 GB RAM

Modelo open-weight 35B da Jackrong para inferência local de IA.

ollama pull qwopus3.6-35b-a3b-coder-mtp:35b

Qwen3.6-35B-A3B-MTP-GGUF

Alibaba35B48 GB RAM

Modelo open-weight 35B da Alibaba para inferência local de IA.

ollama pull qwen3.6-35b-a3b-mtp:35b

gemma-4-12b-it-GGUF

Google12B16 GB RAM

Modelo open-weight 12B do Google para inferência local de IA.

ollama pull gemma-4-12b-it:12b

Qwen3-VL-30B-A3B-Instrução-GGUF

Qwen30B24 GB RAM

Modelo open-weight 30B do Qwen para inferência local de IA.

ollama pull qwen3-vl-30b-a3b:30b

modelos-movidos

ggml-orgDesconhecidas8 GB RAM

Modelo open-weight desconhecido do ggml-org para inferência local de IA.

ollama pull models-moved:latest

cohere-transcribe-03-2026-gguf

computador portátilDesconhecidas8 GB RAM

Modelo open-weight desconhecido do handy-computer para inferência local de IA.

ollama pull cohere-transcribe-03-2026:latest

Qwen-AgentWorld-35B-A3B-GGUF

Alibaba35B48 GB RAM

Modelo open-weight 35B da Alibaba para inferência local de IA.

ollama pull qwen-agentworld-35b-a3b:35b

vntl-llama3-8b-v2-gguf

lmg-anônimo8B16 GB RAM

Modelo open-weight 8B do lmg-anon para inferência local de IA.

ollama pull vntl-llama3-8b-v2:8b

gemma-4-E4B-it-GGUF

Google4B8 GB RAM

Modelo open-weight 4B do Google para inferência local de IA.

ollama pull gemma-4-e4b-it:4b

Qwen3.6-27B-GGUF

Alibaba27B24 GB RAM

Modelo open-weight 27B da Alibaba para inferência local de IA.

ollama pull qwen3.6-27b:27b

Qwen3.6-35B-A3B-GGUF

Alibaba35B48 GB RAM

Modelo open-weight 35B da Alibaba para inferência local de IA.

ollama pull qwen3.6-35b-a3b:35b

Hy3-GGUF

vcruz305Desconhecidas8 GB RAM

Modelo de peso aberto desconhecido de vcruz305 para inferência de IA local.

ollama pull hy3:latest

HyperCLOVAX-SEED-Text-Instruct-1.5B-Q4_K_M-GGUF

rippertnt1.5B4 GB RAM

Modelo open-weight de 1.5 bilhão de caracteres, desenvolvido por rippertnt, para inferência local de IA.

ollama pull hyperclovax-seed-text-instruct-1.5b-q4-k-m:1.5b

Qwen3.5-9B-GGUF

Alibaba9B16 GB RAM

Modelo open-weight 9B da Alibaba para inferência local de IA.

ollama pull qwen3.5-9b:9b

Qwen3.5-4B-GGUF

Alibaba4B8 GB RAM

Modelo open-weight 4B da Alibaba para inferência local de IA.

ollama pull qwen3.5-4b:4b

periquito-unificado-en-0.6b-gguf

computador portátil0.6B2 GB RAM

Modelo open-weight de 0.6B do handy-computer para inferência local de IA.

ollama pull parakeet-unified-en-0.6b:0.6b

nemotron-3.5-asr-streaming-0.6b-gguf

computador portátil0.6B2 GB RAM

Modelo open-weight de 0.6B do handy-computer para inferência local de IA.

ollama pull nemotron-3.5-asr-streaming-0.6b:0.6b

gemma-4-26B-A4B-it-GGUF

Google26B24 GB RAM

Modelo open-weight 26B do Google para inferência local de IA.

ollama pull gemma-4-26b-a4b-it:26b

Bonsai-27B-gguf

prisma-ml27B24 GB RAM

Modelo open-weight 27B do prism-ml para inferência local de IA.

ollama pull bonsai-27b:27b

Qwen3.6-35B-A3B-Sem Censura-HauhauCS-Agressivo

HauhauCS35B48 GB RAM

Modelo de peso aberto 35B do HauhauCS para inferência de IA local.

ollama pull qwen3.6-35b-a3b-uncensored-hauhaucs-aggressive:35b

Qwythos-9B-Claude-Mythos-5-1M-GGUF

imperador-ai9B16 GB RAM

Modelo open-weight 9B da empero-ai para inferência local de IA.

ollama pull qwythos-9b-claude-mythos-5-1m:9b

Ornith-1.0-35B-GGUF

deepreinforce-ai35B48 GB RAM

Modelo open-weight 35B do deepreinforce-ai para inferência local de IA.

ollama pull ornith-1.0-35b:35b

Qwen3.6-27B-MTP-GGUF

Alibaba27B24 GB RAM

Modelo open-weight 27B da Alibaba para inferência local de IA.

ollama pull qwen3.6-27b-mtp:27b

deepseek-v4-gguf

antirezDesconhecidas8 GB RAM

Modelo de peso aberto desconhecido do antirez para inferência local de IA.

ollama pull deepseek-v4:latest

Ornith-1.0-9B-GGUF

deepreinforce-ai9B16 GB RAM

Modelo open-weight 9B do deepreinforce-ai para inferência local de IA.

ollama pull ornith-1.0-9b:9b

Olá prazer em conhecê-lo! ????

Assine nossa newsletter para receber as últimas notícias sobre IA.

Malcare WordPress Segurança