Models

Llama-3-8B-Instruct-32k-v0.1-GGUF

MaziyarPanahi8B16 GB RAM

8B open-weight model from MaziyarPanahi for local AI inference.

SmolLM2-135M-GGUF

QuantFactoryUnknown8 GB RAM

Unknown open-weight model from QuantFactory for local AI inference.

Qwen3.6-35B-A3B-NVFP4-MTP-GGUF

michaelw999935B48 GB RAM

35B open-weight model from michaelw9999 for local AI inference.

Llama-3.3-70B-Instruct-GGUF

MaziyarPanahi70B48 GB RAM

70B open-weight model from MaziyarPanahi for local AI inference.

gemma-3-4b-it-GGUF

MaziyarPanahi4B8 GB RAM

4B open-weight model from MaziyarPanahi for local AI inference.

Mistral-7B-Instruct-v0.3-GGUF

MaziyarPanahi7B8 GB RAM

7B open-weight model from MaziyarPanahi for local AI inference.

Mixtral-8x22B-v0.1-GGUF

MaziyarPanahi22B24 GB RAM

22B open-weight model from MaziyarPanahi for local AI inference.

Qwen3.8_4B_Distilled_GGUF

Ma7ee74B8 GB RAM

4B open-weight model from Ma7ee7 for local AI inference.

Meta-Llama-3-8B-Instruct-GGUF

MaziyarPanahi8B16 GB RAM

8B open-weight model from MaziyarPanahi for local AI inference.

Melody1437-26B-A4B-v2.0-GGUF

ReadyArt26B24 GB RAM

26B open-weight model from ReadyArt for local AI inference.

Serenity-26B-A4B-GGUF

ReadyArt26B24 GB RAM

26B open-weight model from ReadyArt for local AI inference.

Dark-Scarlett-v0.3-26B-A4B-GGUF

ReadyArt26B24 GB RAM

26B open-weight model from ReadyArt for local AI inference.

XYZAILab_XYZ-Aquila-mini-GGUF

bartowskiUnknown8 GB RAM

Unknown open-weight model from bartowski for local AI inference.

Qwen3.5-4B-Claude-4.6-Opus-Reasoning-Distilled-GGUF

Jackrong4B8 GB RAM

4B open-weight model from Jackrong for local AI inference.

Parable-Granite-4.1-8B-Claude-Fable-5-GGUF

AnkitAI8B16 GB RAM

8B open-weight model from AnkitAI for local AI inference.

Qwen3.6-14B-A3B-FableVibes-GGUF

tvall4314B24 GB RAM

14B open-weight model from tvall43 for local AI inference.

MiniMax-H3-Pruned-GGUF

AbirayUnknown8 GB RAM

Unknown open-weight model from Abiray for local AI inference.

Qwen_Qwen3.5-0.8B-GGUF

Alibaba0.8B2 GB RAM

0.8B open-weight model from Alibaba for local AI inference.

Qwen3.6-35B-A3B-APEX-GGUF

mudler35B48 GB RAM

35B open-weight model from mudler for local AI inference.

supergemma4-26b-uncensored-gguf-v2

Jiunsong26B24 GB RAM

26B open-weight model from Jiunsong for local AI inference.

gemma-4-26B-A4B-it-APEX-GGUF

mudler26B24 GB RAM

26B open-weight model from mudler for local AI inference.

Qwopus3.6-27B-Coder-MTP-GGUF

Jackrong27B24 GB RAM

27B open-weight model from Jackrong for local AI inference.

Qwen_Qwen3.5-2B-GGUF

Alibaba2B4 GB RAM

2B open-weight model from Alibaba for local AI inference.

1 2 3 8

Hello, Nice to meet you! 👋

Subscribe our newsletter to get the latest AI news.

Malcare WordPress Security