Models

nemotron-3.5-asr-streaming-0.6b-gguf

handy-computer0.6B2 GB RAM

0.6B open-weight model from handy-computer for local AI inference.

gemma-4-26B-A4B-it-GGUF

Google26B24 GB RAM

26B open-weight model from Google for local AI inference.

Bonsai-27B-gguf

prism-ml27B24 GB RAM

27B open-weight model from prism-ml for local AI inference.

Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive

HauhauCS35B48 GB RAM

35B open-weight model from HauhauCS for local AI inference.

Qwythos-9B-Claude-Mythos-5-1M-GGUF

empero-ai9B16 GB RAM

9B open-weight model from empero-ai for local AI inference.

Ornith-1.0-35B-GGUF

deepreinforce-ai35B48 GB RAM

35B open-weight model from deepreinforce-ai for local AI inference.

Qwen3.6-27B-MTP-GGUF

Alibaba27B24 GB RAM

27B open-weight model from Alibaba for local AI inference.

mxbai-embed-large-v1

mixedbread-aiUnknown8 GB RAM

Unknown open-weight model from mixedbread-ai for local AI inference.

embeddinggemma-300M-GGUF

ggml-orgUnknown8 GB RAM

Unknown open-weight model from ggml-org for local AI inference.

deepseek-v4-gguf

antirezUnknown8 GB RAM

Unknown open-weight model from antirez for local AI inference.

Ornith-1.0-9B-GGUF

deepreinforce-ai9B16 GB RAM

9B open-weight model from deepreinforce-ai for local AI inference.

Hello, Nice to meet you! 👋

Subscribe our newsletter to get the latest AI news.