Browse Models

DeepSeek-V4-Flash-GGUF

DeepSeekUnknown8 GB RAM

Unknown open-weight model from DeepSeek for local AI inference.

Qwen3.5-2B-GGUF

Alibaba2B4 GB RAM

2B open-weight model from Alibaba for local AI inference.

Qwen3.5-4B-Uncensored-HauhauCS-Aggressive

HauhauCS4B8 GB RAM

4B open-weight model from HauhauCS for local AI inference.

Qwen3.5-35B-A3B-GGUF

Alibaba35B48 GB RAM

35B open-weight model from Alibaba for local AI inference.

Llama-3.2-3B-Instruct-GGUF

Meta3B4 GB RAM

3B open-weight model from Meta for local AI inference.

gemma-3-1b-it-GGUF

ggml-org1B2 GB RAM

1B open-weight model from ggml-org for local AI inference.

Qwen3.5-122B-A10B-MTP-GGUF

Alibaba122B80 GB RAM

122B open-weight model from Alibaba for local AI inference.

FLUX.2-klein-4B-GGUF

unsloth4B8 GB RAM

4B open-weight model from unsloth for local AI inference.

Qwen2.5-7B-Instruct-GGUF

Alibaba7B8 GB RAM

7B open-weight model from Alibaba for local AI inference.

Qwen3-30B-A3B-GGUF

MaziyarPanahi30B24 GB RAM

30B open-weight model from MaziyarPanahi for local AI inference.

Qwen3-32B-GGUF

MaziyarPanahi32B24 GB RAM

32B open-weight model from MaziyarPanahi for local AI inference.

Qwen3-1.7B-GGUF

MaziyarPanahi1.7B4 GB RAM

1.7B open-weight model from MaziyarPanahi for local AI inference.

Kimi-K3-GGUF

unslothUnknown8 GB RAM

Unknown open-weight model from unsloth for local AI inference.

Qwen2.5-0.5B-Instruct-GGUF

Qwen0.5B2 GB RAM

0.5B open-weight model from Qwen for local AI inference.

Qwen3-14B-GGUF

MaziyarPanahi14B24 GB RAM

14B open-weight model from MaziyarPanahi for local AI inference.

Qwen3-0.6B-GGUF

MaziyarPanahi0.6B2 GB RAM

0.6B open-weight model from MaziyarPanahi for local AI inference.

Laguna-S-2.1-GGUF

unslothUnknown8 GB RAM

Unknown open-weight model from unsloth for local AI inference.

Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V7-GGUF

LuffyTheFox35B48 GB RAM

35B open-weight model from LuffyTheFox for local AI inference.

gemma-gguf

rahul7starUnknown8 GB RAM

Unknown open-weight model from rahul7star for local AI inference.

Qwen2.5-VL-7B-Instruct-GGUF

Alibaba7B8 GB RAM

7B open-weight model from Alibaba for local AI inference.

Qwen3-235B-A22B-GGUF

Alibaba235B80 GB RAM

235B open-weight model from Alibaba for local AI inference.

Voxtral-Small-24B-2507-gguf

handy-computer24B24 GB RAM

24B open-weight model from handy-computer for local AI inference.

Sugoi-14B-Ultra-GGUF

sugoitoolkit14B24 GB RAM

14B open-weight model from sugoitoolkit for local AI inference.

1 2 3 5

Hello, Nice to meet you! 👋

Subscribe our newsletter to get the latest AI news.

Malcare WordPress Security