Browse Models

DeepSeek-V4-Flash-0731-GGUF

DeepSeekUnknown8 GB RAM

Unknown open-weight model from DeepSeek for local AI inference.

LFM2.5-2.6B-GGUF

LiquidAI2.6B4 GB RAM

2.6B open-weight model from LiquidAI for local AI inference.

Qwen3.5-122B-A10B-GGUF

Alibaba122B80 GB RAM

122B open-weight model from Alibaba for local AI inference.

Qwen3.8-27B-Uncensored-GGUF

JonathanColetti27B24 GB RAM

27B open-weight model from JonathanColetti for local AI inference.

MiniMax-H3

DeepBeepMeepUnknown8 GB RAM

Unknown open-weight model from DeepBeepMeep for local AI inference.

MiniMax-H3_GGUFs

realrebelaiUnknown8 GB RAM

Unknown open-weight model from realrebelai for local AI inference.

audio.cpp-gguf

audio-cppUnknown8 GB RAM

Unknown open-weight model from audio-cpp for local AI inference.

Inkling-Small-GGUF

unslothUnknown8 GB RAM

Unknown open-weight model from unsloth for local AI inference.

maple-preview-GGUF

deepgroveUnknown8 GB RAM

Unknown open-weight model from deepgrove for local AI inference.

KAT-Coder-V2.5-Dev-APEX-GGUF

mudlerUnknown8 GB RAM

Unknown open-weight model from mudler for local AI inference.

Qwen3-TTS-GGUF

ServeurpersoUnknown8 GB RAM

Unknown open-weight model from Serveurperso for local AI inference.

MiniMax-H3-GGUF

AbirayUnknown8 GB RAM

Unknown open-weight model from Abiray for local AI inference.

Muse-Glimmer-30B-GGUF

unsloth30B24 GB RAM

30B open-weight model from unsloth for local AI inference.

Laguna-XS-2.1-APEX-GGUF

mudlerUnknown8 GB RAM

Unknown open-weight model from mudler for local AI inference.

Qwen3-30B-A3B-Thinking-2507-GGUF

Alibaba30B24 GB RAM

30B open-weight model from Alibaba for local AI inference.

Qwen3.8-27B-GGUF

Alibaba27B24 GB RAM

27B open-weight model from Alibaba for local AI inference.

Higgs-Audio-v3-Studio

drbaphUnknown8 GB RAM

Unknown open-weight model from drbaph for local AI inference.

DeepSeek-V4-Flash-GGUF

DeepSeekUnknown8 GB RAM

Unknown open-weight model from DeepSeek for local AI inference.

Qwen3.5-2B-GGUF

Alibaba2B4 GB RAM

2B open-weight model from Alibaba for local AI inference.

Qwen3.5-4B-Uncensored-HauhauCS-Aggressive

HauhauCS4B8 GB RAM

4B open-weight model from HauhauCS for local AI inference.

Qwen3.5-35B-A3B-GGUF

Alibaba35B48 GB RAM

35B open-weight model from Alibaba for local AI inference.

Llama-3.2-3B-Instruct-GGUF

Meta3B4 GB RAM

3B open-weight model from Meta for local AI inference.

gemma-3-1b-it-GGUF

ggml-org1B2 GB RAM

1B open-weight model from ggml-org for local AI inference.

Hello, Nice to meet you! 👋

Subscribe our newsletter to get the latest AI news.

Malcare WordPress Security