Bạn mới sử dụng LM Studio? Hãy đọc hướng dẫn thiết lập đầy đủ.
Nội dung
- 1 Mô hình AI cho LM Studio
- 1.0.1 Mistral-Small-24B-Instruct-2501-GGUF
- 1.0.2 Llama-3-8B-Instruct-32k-v0.1-GGUF
- 1.0.3 SmolLM2-135M-GGUF
- 1.0.4 Qwen3.6-35B-A3B-NVFP4-MTP-GGUF
- 1.0.5 Llama-3.3-70B-Instruct-GGUF
- 1.0.6 gemma-3-4b-it-GGUF
- 1.0.7 Mistral-7B-Instruct-v0.3-GGUF
- 1.0.8 Mixtral-8x22B-v0.1-GGUF
- 1.0.9 Qwen3.8_4B_Distilled_GGUF
- 1.0.10 Meta-Llama-3-8B-Instruct-GGUF
- 1.0.11 Melody1437-26B-A4B-v2.0-GGUF
- 1.0.12 Serenity-26B-A4B-GGUF
- 1.0.13 Dark-Scarlett-v0.3-26B-A4B-GGUF
- 1.0.14 XYZAILab_XYZ-Aquila-mini-GGUF
- 1.0.15 Qwen3.5-4B-Claude-4.6-Opus-Lý luận-Say xỉn-GGUF
- 1.0.16 Parable-Granite-4.1-8B-Claude-Fable-5-GGUF
- 1.0.17 Qwen3.6-14B-A3B-FableVibes-GGUF
- 1.0.18 MiniMax-H3-Pruned-GGUF
- 1.0.19 Qwen_Qwen3.5-0.8B-GGUF
- 1.0.20 Qwen3.6-35B-A3B-APEX-GGUF
- 1.0.21 supergemma4-26b-uncensored-gguf-v2
- 1.0.22 gemma-4-26B-A4B-it-APEX-GGUF
- 1.0.23 Qwopus3.6-27B-Coder-MTP-GGUF
- 1.0.24 Qwen_Qwen3.5-2B-GGUF
- 1.0.25 Qwen3.5-397B-A17B-GGUF
- 1.0.26 Qwen3-4B-Instruct-2507-GGUF
- 1.0.27 Ternary-Bonsai-8B-gguf
- 1.0.28 PinkCherry_NSFW_LTX23
- 1.0.29 Parable-Granite-4.1-3B-Claude-Fable-5-GGUF
- 1.0.30 Qwen_Qwen3.5-35B-A3B-GGUF
- 1.0.31 endless-frontier_BigBang-v1-GGUF
- 1.0.32 Qwen_Qwen3.5-4B-GGUF
- 1.0.33 Qwen3.6-27B-Dị Giáo-Không Kiểm Duyệt-FINETUNE-NEO-CODE-Di-IMatrix-MAX-GGUF
- 1.0.34 Qwen3.5-9B-DeepSeek-V4-Flash-GGUF
- 1.0.35 Parable-Qwen3-8B-Claude-Fable-5-GGUF
- 1.0.36 grug-27b-gguf
- 1.0.37 GLM-4.7-Flash-GGUF
- 1.0.38 gemma-4-31B-it-qat-q4_0-gguf
- 1.0.39 Qwen3.5-27B-GGUF
- 1.0.40 Kwaipilot_KAT-Coder-V2.5-Dev-GGUF
- 1.0.41 Parable-Qwen3-4B-Claude-Fable-5-GGUF
- 1.0.42 gemma-4-E2B-it-qat-GGUF
- 1.0.43 ACE-Step-1.5-GGUF
- 1.0.44 Huihui-DeepSeek-V4-Flash-0731-abliterated-GGUF
- 1.0.45 POCKET-35B-GGUF
- 1.0.46 gemma-4-26B-A4B-it-qat-q4_0-gguf
- 1.0.47 gemma-4-E2B-it-qat-q4_0-gguf
- 1.0.48 gemma-4-E4B-it-qat-q4_0-gguf
- 1.0.49 ô tô
- 1.0.50 DeepSeek-V4-Flash-0731-GGUF
- 1.0.51 LFM2.5-2.6B-GGUF
- 1.0.52 Qwen3.5-122B-A10B-GGUF
- 1.0.53 Qwen3.8-27B-Uncensored-GGUF
- 1.0.54 MiniMax-H3
- 1.0.55 MiniMax-H3_GGUFs
- 1.0.56 audio.cpp-gguf
- 1.0.57 Inkling-Small-GGUF
- 1.0.58 maple-preview-GGUF
- 1.0.59 KAT-Coder-V2.5-Dev-APEX-GGUF
- 1.0.60 Qwen3-TTS-GGUF
- 1.0.61 MiniMax-H3-GGUF
- 1.0.62 Muse-Glimmer-30B-GGUF
- 1.0.63 Laguna-XS-2.1-APEX-GGUF
- 1.0.64 Qwen3-30B-A3B-Thinking-2507-GGUF
- 1.0.65 Qwen3.8-27B-GGUF
- 1.0.66 Phòng thu âm Higgs Audio v3
- 1.0.67 DeepSeek-V4-Flash-GGUF
- 1.0.68 Qwen3.5-2B-GGUF
- 1.0.69 Qwen3.5-4B-Không kiểm duyệt-HauhauCS-Hung hăng
- 1.0.70 Qwen3.5-35B-A3B-GGUF
- 1.0.71 Llama-3.2-3B-Instruct-GGUF
- 1.0.72 gemma-3-1b-it-GGUF
- 1.0.73 Qwen3.5-122B-A10B-MTP-GGUF
- 1.0.74 FLUX.2-klein-4B-GGUF
- 1.0.75 Qwen2.5-7B-Instruct-GGUF
- 1.0.76 Qwen3-30B-A3B-GGUF
- 1.0.77 Qwen3-32B-GGUF
- 1.0.78 Qwen3-1.7B-GGUF
- 1.0.79 Kimi-K3-GGUF
- 1.0.80 Qwen2.5-0.5B-Instruct-GGUF
- 1.0.81 Qwen3-14B-GGUF
- 1.0.82 Qwen3-0.6B-GGUF
- 1.0.83 Laguna-S-2.1-GGUF
- 1.0.84 Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V7-GGUF
- 1.0.85 gemma-gguf
- 1.0.86 Qwen2.5-VL-7B-Instruct-GGUF
- 1.0.87 Qwen3-235B-A22B-GGUF
- 1.0.88 Voxtral-Small-24B-2507-gguf
- 1.0.89 Sugoi-14B-Ultra-GGUF
- 1.0.90 Qwen3-ASR-1.7B-gguf
- 1.0.91 Qwen3-30B-A3B-Instruct-2507-GGUF
- 1.0.92 Qwen2.5-3B-Instruct-GGUF
- 1.0.93 gemma-4-12b-heretic-abliterated-GGUF
- 1.0.94 Qwen3.5-122B-A10B-Không kiểm duyệt-HauhauCS-Hung hăng
- 1.0.95 Qwen2.5-Coder-7B-Instruct-GGUF
- 1.0.96 Qwen-Image-Edit-2511-GGUF
- 1.0.97 Qwen3-Coder-Next-GGUF
- 1.0.98 Qwen2.5-1.5B-Instruct-GGUF
- 1.0.99 Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V6-GGUF
- 1.0.100 chương trình paw
- 1.0.101 Qwen2.5-Coder-32B-Instruct-GGUF
- 1.0.102 gemma-4-31B-it-qat-GGUF
- 1.0.103 gemma-4-26B-A4B-it-ultra-uncensored-heretic-i1-GGUF
- 1.0.104 gemma-4-12B-coder-fable5-composer2.5-v1-GGUF
- 1.0.105 inkling-GGUF
- 1.0.106 đá granit-4.1-3b-GGUF
- 1.0.107 Sugoi-32B-Ultra-GGUF
- 1.0.108 Qwen3-VL-4B-Instruct-GGUF
- 1.0.109 madlad400-3b-mt
- 1.0.110 MiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking-GGUF
- 1.0.111 svara-tts-v1
- 1.0.112 Qwen3.6-40B-Claude-4.6-Opus-Deckard-Heretic-Uncensored-Thinking-NEO-CODE-Di-IMatrix-MAX-GGUF
- 1.0.113 Holo-3.1-35B-A3B-GGUF
- 1.0.114 gemma-4-12B-it-qat-q4_0-gguf
- 1.0.115 Qwen3.5-9B-The-Defiant-Fable-Uncensored-Heretic-NEO-IMATRIX-MAX-MTP-GGUF
- 1.0.116 LTX-2.3-GGUF
- 1.0.117 gemma-4-E4B-it-qat-GGUF
- 1.0.118 whisper-large-v3-turbo-gguf
- 1.0.119 LTX-2
- 1.0.120 Qwen3-4B-GGUF
- 1.0.121 Qwen3.5-0.8B-GGUF
- 1.0.122 Meta-Llama-3.1-8B-Instruct-GGUF
- 1.0.123 LFM2.5-1.2B-Instruct-GGUF
- 1.0.124 GLM-5.2-GGUF
- 1.0.125 canary-180m-flash-gguf
- 1.0.126 whisper-large-v3-gguf
- 1.0.127 Qwen3-8B-GGUF
- 1.0.128 Jan-v3.5-4B-gguf
- 1.0.129 Kimi-K2.7-Code-GGUF
- 1.0.130 MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF
- 1.0.131 Llama-3.2-1B-Instruct-Q8_0-GGUF
- 1.0.132 Bielik-11B-v3.0-Instruct-awq
- 1.0.133 Wan2.2-I2V-A14B-GGUF
- 1.0.134 Gemma-4-31B-it-abliterated
- 1.0.135 Qwen3.6-27B-Không kiểm duyệt-HauhauCS-Hung hăng
- 1.0.136 ThinkingCap-Qwen3.6-27B-GGUF
- 1.0.137 Wan2.1
- 1.0.138 Voxtral-Mini-4B-Realtime-2602-gguf
- 1.0.139 Qwen_Qwen3.6-35B-A3B-GGUF
- 1.0.140 Qwythos-9B-v2-GGUF
- 1.0.141 gemma-4-12B-agentic-fable5-composer2.5-v2-3.5x-tau2-GGUF
- 1.0.142 Lưu huỳnh-2-bazơ
- 1.0.143 thì thầm-trung bình-gguf
- 1.0.144 gemma-4-E2B-it-GGUF
- 1.0.145 parakeet-tdt-0.6b-v3-gguf
- 1.0.146 Qwen3.5-9B-Không kiểm duyệt-HauhauCS-Hung hăng
- 1.0.147 gemma-4-26B-A4B-it-qat-GGUF
- 1.0.148 gpt-oss-20b-GGUF
- 1.0.149 Qwen3-VL-8B-Instruct-abliterated-GGUF
- 1.0.150 Flux2-Klein-9B-True-V2
- 1.0.151 Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF
- 1.0.152 Qwen3-Coder-30B-A3B-Instruct-GGUF
- 1.0.153 gemma-4-31B-it-GGUF
- 1.0.154 Gemma-4-E4B-Không kiểm duyệt-HauhauCS-Hung hăng
- 1.0.155 Qwopus3.6-27B-Coder-Compat-MTP-GGUF
- 1.0.156 UI-TARS-1.5-7B-GGUF
- 1.0.157 Huihui-DeepSeek-V4-Flash-abliterated-ds4-GGUF
- 1.0.158 gemma-4-12B-it-QAT-GGUF
- 1.0.159 Ternary-Bonsai-27B-gguf
- 1.0.160 Gemmable-4-12B-MTP-GGUF
- 1.0.161 Qwopus3.6-35B-A3B-Coder-MTP-GGUF
- 1.0.162 Qwen3.6-35B-A3B-MTP-GGUF
- 1.0.163 gemma-4-12b-it-GGUF
- 1.0.164 Qwen3-VL-30B-A3B-Instruct-GGUF
- 1.0.165 mô hình đã di chuyển
- 1.0.166 cohere-transcribe-03-2026-gguf
- 1.0.167 Qwen-AgentWorld-35B-A3B-GGUF
- 1.0.168 vntl-llama3-8b-v2-gguf
- 1.0.169 gemma-4-E4B-it-GGUF
- 1.0.170 Qwen3.6-27B-GGUF
- 1.0.171 Qwen3.6-35B-A3B-GGUF
- 1.0.172 Hy3-GGUF
- 1.0.173 HyperCLOVAX-SEED-Text-Instruct-1.5B-Q4_K_M-GGUF
- 1.0.174 Qwen3.5-9B-GGUF
- 1.0.175 Qwen3.5-4B-GGUF
- 1.0.176 parakeet-unified-en-0.6b-gguf
- 1.0.177 nemotron-3.5-asr-streaming-0.6b-gguf
- 1.0.178 gemma-4-26B-A4B-it-GGUF
- 1.0.179 Bonsai-27B-gguf
- 1.0.180 Qwen3.6-35B-A3B-Không kiểm duyệt-HauhauCS-Hung hăng
- 1.0.181 Qwythos-9B-Claude-Mythos-5-1M-GGUF
- 1.0.182 Ornith-1.0-35B-GGUF
- 1.0.183 Qwen3.6-27B-MTP-GGUF
- 1.0.184 deepseek-v4-gguf
- 1.0.185 Ornith-1.0-9B-GGUF
- 1.1 Xin chào hân hạnh được gặp bạn!
Mô hình AI cho LM Studio
Mọi mô hình trong thư mục này đều ở định dạng GGUF, vì vậy chúng được tải trực tiếp vào LM Studio. Dưới đây là toàn bộ danh mục với các liên kết trực tiếp đến HuggingFace.
Mistral-Small-24B-Instruct-2501-GGUF
Mô hình trọng lượng mở 24B từ MaziyarPanahi dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Llama-3-8B-Instruct-32k-v0.1-GGUF
Mô hình trọng lượng mở 8B từ MaziyarPanahi dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →SmolLM2-135M-GGUF
Mô hình trọng số mở chưa xác định từ QuantFactory dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.6-35B-A3B-NVFP4-MTP-GGUF
Mô hình trọng lượng mở 35B từ michaelw9999 dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Llama-3.3-70B-Instruct-GGUF
Mô hình trọng lượng mở 70B từ MaziyarPanahi dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gemma-3-4b-it-GGUF
Mô hình trọng lượng mở 4B từ MaziyarPanahi dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Mistral-7B-Instruct-v0.3-GGUF
Mô hình trọng lượng mở 7B từ MaziyarPanahi dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Mixtral-8x22B-v0.1-GGUF
Mô hình trọng lượng mở 22B từ MaziyarPanahi dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.8_4B_Distilled_GGUF
Mô hình trọng lượng mở 4B từ Ma7ee7 dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Meta-Llama-3-8B-Instruct-GGUF
Mô hình trọng lượng mở 8B từ MaziyarPanahi dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Melody1437-26B-A4B-v2.0-GGUF
Mô hình trọng lượng mở 26B từ ReadyArt dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Serenity-26B-A4B-GGUF
Mô hình trọng lượng mở 26B từ ReadyArt dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Dark-Scarlett-v0.3-26B-A4B-GGUF
Mô hình trọng lượng mở 26B từ ReadyArt dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →XYZAILab_XYZ-Aquila-mini-GGUF
Mô hình trọng lượng mở chưa xác định từ Bartowski cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.5-4B-Claude-4.6-Opus-Lý luận-Say xỉn-GGUF
Mô hình trọng lượng mở 4B từ Jackrong dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Parable-Granite-4.1-8B-Claude-Fable-5-GGUF
Mô hình trọng số mở 8B từ AnkitAI dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.6-14B-A3B-FableVibes-GGUF
Mô hình trọng lượng mở 14B từ tvall43 dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →MiniMax-H3-Pruned-GGUF
Mô hình trọng lượng mở chưa xác định từ Abiray dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen_Qwen3.5-0.8B-GGUF
Mô hình trọng lượng mở 0.8B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.6-35B-A3B-APEX-GGUF
Mô hình trọng lượng mở 35B từ mudler dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →supergemma4-26b-uncensored-gguf-v2
Mô hình trọng lượng mở 26B từ Jiunsong dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gemma-4-26B-A4B-it-APEX-GGUF
Mô hình trọng lượng mở 26B từ mudler dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwopus3.6-27B-Coder-MTP-GGUF
Mô hình trọng lượng mở 27B từ Jackrong dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen_Qwen3.5-2B-GGUF
Mô hình trọng lượng mở 2B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.5-397B-A17B-GGUF
Mô hình trọng lượng mở 397B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3-4B-Instruct-2507-GGUF
Mô hình trọng lượng mở 4B từ MaziyarPanahi dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Ternary-Bonsai-8B-gguf
Mô hình trọng lượng mở 8B từ prism-ml dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →PinkCherry_NSFW_LTX23
Unknown open-weight model from SexGod1979 for local AI inference.
Tải xuống cho LM Studio →Parable-Granite-4.1-3B-Claude-Fable-5-GGUF
Mô hình trọng số mở 3B từ AnkitAI dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen_Qwen3.5-35B-A3B-GGUF
Mô hình trọng lượng mở 35B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →endless-frontier_BigBang-v1-GGUF
Mô hình trọng lượng mở chưa xác định từ Bartowski cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen_Qwen3.5-4B-GGUF
Mô hình trọng lượng mở 4B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.6-27B-Dị Giáo-Không Kiểm Duyệt-FINETUNE-NEO-CODE-Di-IMatrix-MAX-GGUF
Mô hình trọng lượng mở 27B từ DavidAU dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.5-9B-DeepSeek-V4-Flash-GGUF
Mô hình trọng lượng mở 9B từ Jackrong dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Parable-Qwen3-8B-Claude-Fable-5-GGUF
Mô hình trọng số mở 8B từ AnkitAI dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →grug-27b-gguf
27B open-weight model from ProCreations for local AI inference.
Tải xuống cho LM Studio →GLM-4.7-Flash-GGUF
Mô hình trọng lượng mở chưa xác định từ unsloth dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gemma-4-31B-it-qat-q4_0-gguf
Mô hình 31B open-weight từ Google dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.5-27B-GGUF
Mô hình trọng lượng mở 27B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Kwaipilot_KAT-Coder-V2.5-Dev-GGUF
Mô hình trọng lượng mở chưa xác định từ Bartowski cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Parable-Qwen3-4B-Claude-Fable-5-GGUF
Mô hình trọng số mở 4B từ AnkitAI dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gemma-4-E2B-it-qat-GGUF
Mô hình trọng lượng mở 2B từ Google dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →ACE-Step-1.5-GGUF
Mô hình trọng lượng mở chưa xác định từ Serveurperso dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Huihui-DeepSeek-V4-Flash-0731-abliterated-GGUF
Mô hình trọng lượng mở chưa xác định từ huihui-ai dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →POCKET-35B-GGUF
Mô hình trọng lượng mở 35B từ FINAL-Bench dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gemma-4-26B-A4B-it-qat-q4_0-gguf
Mô hình 26B open-weight từ Google dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gemma-4-E2B-it-qat-q4_0-gguf
Mô hình 2B open-weight từ Google dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gemma-4-E4B-it-qat-q4_0-gguf
Mô hình 4B open-weight từ Google dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →ô tô
Unknown open-weight model from flywheel-ai for local AI inference.
Tải xuống cho LM Studio →DeepSeek-V4-Flash-0731-GGUF
Mô hình trọng lượng mở chưa xác định từ DeepSeek dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →LFM2.5-2.6B-GGUF
Mô hình trọng lượng mở 2.6 tỷ từ LiquidAI dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.5-122B-A10B-GGUF
Mô hình trọng lượng mở 122B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.8-27B-Uncensored-GGUF
27B open-weight model from JonathanColetti for local AI inference.
Tải xuống cho LM Studio →MiniMax-H3
Mô hình trọng lượng mở chưa xác định từ DeepBeepMeep dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →MiniMax-H3_GGUFs
Unknown open-weight model from realrebelai for local AI inference.
Tải xuống cho LM Studio →audio.cpp-gguf
Unknown open-weight model from audio-cpp for local AI inference.
Tải xuống cho LM Studio →Inkling-Small-GGUF
Mô hình trọng lượng mở chưa xác định từ unsloth dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →maple-preview-GGUF
Unknown open-weight model from deepgrove for local AI inference.
Tải xuống cho LM Studio →KAT-Coder-V2.5-Dev-APEX-GGUF
Unknown open-weight model from mudler for local AI inference.
Tải xuống cho LM Studio →Qwen3-TTS-GGUF
Mô hình trọng lượng mở chưa xác định từ Serveurperso dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →MiniMax-H3-GGUF
Mô hình trọng lượng mở chưa xác định từ Abiray dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Muse-Glimmer-30B-GGUF
Mô hình trọng lượng mở 30B từ unsloth dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Laguna-XS-2.1-APEX-GGUF
Unknown open-weight model from mudler for local AI inference.
Tải xuống cho LM Studio →Qwen3-30B-A3B-Thinking-2507-GGUF
Mô hình trọng lượng mở 30B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.8-27B-GGUF
Mô hình trọng lượng mở 27B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Phòng thu âm Higgs Audio v3
Mô hình trọng lượng mở không xác định từ drbaph dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →DeepSeek-V4-Flash-GGUF
Mô hình trọng lượng mở chưa xác định từ DeepSeek dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.5-2B-GGUF
Mô hình trọng lượng mở 2B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.5-4B-Không kiểm duyệt-HauhauCS-Hung hăng
Mô hình trọng số mở 4B từ HauhauCS dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.5-35B-A3B-GGUF
Mô hình trọng lượng mở 35B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Llama-3.2-3B-Instruct-GGUF
Mô hình trọng lượng mở 3B từ Meta dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gemma-3-1b-it-GGUF
Mô hình trọng số mở 1B từ ggml-org dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.5-122B-A10B-MTP-GGUF
Mô hình trọng lượng mở 122B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →FLUX.2-klein-4B-GGUF
Mô hình trọng lượng mở 4B từ unsloth dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen2.5-7B-Instruct-GGUF
Mô hình trọng lượng mở 7B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3-30B-A3B-GGUF
Mô hình trọng lượng mở 30B từ MaziyarPanahi dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3-32B-GGUF
Mô hình trọng lượng mở 32B từ MaziyarPanahi dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3-1.7B-GGUF
Mô hình trọng lượng mở 1.7B từ MaziyarPanahi dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Kimi-K3-GGUF
Mô hình trọng lượng mở chưa xác định từ unsloth dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen2.5-0.5B-Instruct-GGUF
Mô hình trọng lượng mở 0.5B từ Qwen dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3-14B-GGUF
Mô hình trọng lượng mở 14B từ MaziyarPanahi dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3-0.6B-GGUF
Mô hình trọng lượng mở 0.6B từ MaziyarPanahi dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Laguna-S-2.1-GGUF
Mô hình trọng lượng mở chưa xác định từ unsloth dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V7-GGUF
Mô hình trọng lượng mở 35B từ LuffyTheFox dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gemma-gguf
Mô hình trọng lượng mở chưa xác định từ rahul7star dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen2.5-VL-7B-Instruct-GGUF
Mô hình trọng lượng mở 7B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3-235B-A22B-GGUF
Mô hình trọng lượng mở 235B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Voxtral-Small-24B-2507-gguf
Mô hình trọng lượng mở 24 tỷ từ handy-computer dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Sugoi-14B-Ultra-GGUF
Mô hình trọng lượng mở 14B từ sugoitoolkit dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3-ASR-1.7B-gguf
Mô hình trọng lượng mở 1.7 tỷ từ handy-computer dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3-30B-A3B-Instruct-2507-GGUF
Mô hình trọng lượng mở 30B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen2.5-3B-Instruct-GGUF
Mô hình trọng lượng mở 3B từ Qwen dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gemma-4-12b-heretic-abliterated-GGUF
Mô hình trọng lượng mở 12B từ culturerevolt dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.5-122B-A10B-Không kiểm duyệt-HauhauCS-Hung hăng
Mô hình trọng số mở 122B từ HauhauCS dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen2.5-Coder-7B-Instruct-GGUF
Mô hình trọng lượng mở 7B từ Qwen dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen-Image-Edit-2511-GGUF
Mô hình trọng lượng mở không xác định từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3-Coder-Next-GGUF
Mô hình trọng lượng mở không xác định từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen2.5-1.5B-Instruct-GGUF
Mô hình trọng lượng mở 1.5B từ Qwen dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.6-35B-A3B-Uncensored-Genesis-Hermes-V6-GGUF
Mô hình trọng lượng mở 35B từ LuffyTheFox dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →chương trình paw
Mô hình trọng số mở không xác định từ programasweights dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen2.5-Coder-32B-Instruct-GGUF
Mô hình trọng lượng mở 32B từ Qwen dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gemma-4-31B-it-qat-GGUF
Mô hình trọng lượng mở 31B từ Google dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gemma-4-26B-A4B-it-ultra-uncensored-heretic-i1-GGUF
Mô hình trọng lượng mở 26B từ Google dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gemma-4-12B-coder-fable5-composer2.5-v1-GGUF
Mô hình trọng lượng mở 12B từ yuxinlu1 dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →inkling-GGUF
Mô hình trọng lượng mở chưa xác định từ unsloth dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →đá granit-4.1-3b-GGUF
Mô hình trọng số mở 3B từ ibm-granite dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Sugoi-32B-Ultra-GGUF
Mô hình trọng lượng mở 32B từ sugoitoolkit dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3-VL-4B-Instruct-GGUF
Mô hình trọng lượng mở 4B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →madlad400-3b-mt
Mô hình 3B open-weight từ Google dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →MiniCPM5-1B-Claude-Opus-Fable5-V2-Thinking-GGUF
Mô hình trọng lượng mở 1B từ GnLOLot dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →svara-tts-v1
Mô hình trọng lượng mở không xác định từ kenpath dùng cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.6-40B-Claude-4.6-Opus-Deckard-Heretic-Uncensored-Thinking-NEO-CODE-Di-IMatrix-MAX-GGUF
Mô hình trọng lượng mở 40B từ DavidAU dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Holo-3.1-35B-A3B-GGUF
Mô hình trọng lượng mở 35B từ Hcompany dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gemma-4-12B-it-qat-q4_0-gguf
Mô hình 12B open-weight từ Google dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.5-9B-The-Defiant-Fable-Uncensored-Heretic-NEO-IMATRIX-MAX-MTP-GGUF
Mô hình trọng lượng mở 9B từ DavidAU dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →LTX-2.3-GGUF
Mô hình trọng lượng mở chưa xác định từ unsloth dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gemma-4-E4B-it-qat-GGUF
Mô hình trọng lượng mở 4B từ Google dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →whisper-large-v3-turbo-gguf
Mô hình trọng lượng mở không xác định từ máy tính cầm tay dùng cho suy luận AI cục bộ.
Tải xuống cho LM Studio →LTX-2
Mô hình trọng lượng mở chưa xác định từ DeepBeepMeep dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3-4B-GGUF
Mô hình trọng lượng mở 4B từ Qwen dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.5-0.8B-GGUF
Mô hình trọng lượng mở 0.8B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Meta-Llama-3.1-8B-Instruct-GGUF
Mô hình trọng lượng mở 8B từ Meta dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →LFM2.5-1.2B-Instruct-GGUF
Mô hình trọng lượng mở 1.2 tỷ từ LiquidAI dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →GLM-5.2-GGUF
Mô hình trọng lượng mở chưa xác định từ unsloth dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →canary-180m-flash-gguf
Mô hình trọng lượng mở không xác định từ máy tính cầm tay dùng cho suy luận AI cục bộ.
Tải xuống cho LM Studio →whisper-large-v3-gguf
Mô hình trọng lượng mở không xác định từ máy tính cầm tay dùng cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3-8B-GGUF
Mô hình trọng lượng mở 8B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Jan-v3.5-4B-gguf
Mô hình trọng lượng mở 4B từ janq dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Kimi-K2.7-Code-GGUF
Mô hình trọng lượng mở chưa xác định từ unsloth dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →MiniCPM5-1B-Claude-Opus-Fable5-Thinking-GGUF
Mô hình trọng lượng mở 1B từ GnLOLot dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Llama-3.2-1B-Instruct-Q8_0-GGUF
Mô hình trọng số mở 1B từ hugging-quants dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Bielik-11B-v3.0-Instruct-awq
Mô hình trọng lượng mở 11B từ speakleash dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Wan2.2-I2V-A14B-GGUF
Mô hình trọng số mở 14B từ QuantStack dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Gemma-4-31B-it-abliterated
Mô hình trọng lượng mở 31B từ paperscarecrow dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.6-27B-Không kiểm duyệt-HauhauCS-Hung hăng
Mô hình trọng số mở 27B từ HauhauCS dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →ThinkingCap-Qwen3.6-27B-GGUF
Mô hình trọng lượng mở 27B từ bottlecapai dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Wan2.1
Mô hình trọng lượng mở chưa xác định từ DeepBeepMeep dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Voxtral-Mini-4B-Realtime-2602-gguf
Mô hình trọng lượng mở 4 tỷ từ handy-computer dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen_Qwen3.6-35B-A3B-GGUF
Mô hình trọng lượng mở 35B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwythos-9B-v2-GGUF
Mô hình trọng lượng mở 9B từ empero-ai dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gemma-4-12B-agentic-fable5-composer2.5-v2-3.5x-tau2-GGUF
Mô hình trọng lượng mở 12B từ yuxinlu1 dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Lưu huỳnh-2-bazơ
Mô hình trọng lượng mở chưa xác định từ SulfurAI dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →thì thầm-trung bình-gguf
Mô hình trọng lượng mở không xác định từ máy tính cầm tay dùng cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gemma-4-E2B-it-GGUF
Mô hình trọng lượng mở 2B từ Google dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →parakeet-tdt-0.6b-v3-gguf
Mô hình trọng lượng mở 0.6 tỷ từ handy-computer dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.5-9B-Không kiểm duyệt-HauhauCS-Hung hăng
Mô hình trọng số mở 9B từ HauhauCS dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gemma-4-26B-A4B-it-qat-GGUF
Mô hình trọng lượng mở 26B từ Google dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gpt-oss-20b-GGUF
Mô hình trọng lượng mở 20B từ unsloth dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3-VL-8B-Instruct-abliterated-GGUF
Qwen3-VL-8B-Instruct-abliterated-GGUF is an 8-billion parameter vision-language model developed by Alibaba that has been fully abliterated to remove proprietary constraints while retaining core capabilities. This model excels at handling complex visual reasoning and multi-step tasks within a conversational framework, making it ideal for open-ended analysis and creative generation in the US region. Running this GGUF quantized version locally is highly practical for users with mid-range GPUs, offering fast inference speeds without requiring specialized enterprise hardware.
Tải xuống cho LM Studio →Flux2-Klein-9B-True-V2
Mô hình trọng lượng mở 9B từ wikeeyang dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF
The Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF is a 27-billion parameter large language model created by DavidAU that combines multiple fine-tuning techniques including Unsloth and Heretic methods. This model excels at generating uncensored, highly creative, and unrestricted content across diverse topics, making it ideal for users seeking an abliterated assistant capable of multi-stage tuned responses without safety filters. Running this GGUF quantized version locally requires a substantial GPU with ample VRAM to handle the 27B parameter load efficiently, offering best performance on systems equipped with high-end hardware for fast inference speeds.
Tải xuống cho LM Studio →Qwen3-Coder-30B-A3B-Instruct-GGUF
Qwen3-Coder-30B-A3B-Instruct-GGUF is a 30-billion parameter coding model developed by Alibaba that integrates advanced instruction tuning for specialized tasks. It excels at complex code generation, debugging, and conversational programming assistance, making it ideal for developers seeking high-performance solutions in the US region. Running this model locally requires substantial GPU memory to handle its large parameter count, so it is best suited for users with powerful hardware who prioritize raw coding capability over speed.
Tải xuống cho LM Studio →gemma-4-31B-it-GGUF
Mô hình trọng lượng mở 31B từ Google dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Gemma-4-E4B-Không kiểm duyệt-HauhauCS-Hung hăng
Gemma-4-E4B-Uncensored-HauhauCS-Aggressive is a 4-billion parameter multimodal model developed by HauhauCS that integrates advanced capabilities from Gemma 4 with ablated safety filters. This aggressive variant excels at unrestricted text generation, vision analysis, and audio processing, making it ideal for creative tasks requiring raw output without content moderation. Running this model locally demands significant GPU memory to handle its multimodal inputs, and users should expect high computational costs when processing complex audio or video streams.
Tải xuống cho LM Studio →Qwopus3.6-27B-Coder-Compat-MTP-GGUF
Mô hình trọng lượng mở 27B từ Jackrong dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →UI-TARS-1.5-7B-GGUF
Mô hình trọng lượng mở 7B từ mradermacher dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Huihui-DeepSeek-V4-Flash-abliterated-ds4-GGUF
Mô hình trọng lượng mở chưa xác định từ huihui-ai dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gemma-4-12B-it-QAT-GGUF
Mô hình trọng lượng mở 12B từ Google dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Ternary-Bonsai-27B-gguf
Mô hình trọng lượng mở 27B từ prism-ml dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Gemmable-4-12B-MTP-GGUF
Mô hình trọng lượng mở 12B từ Mia-AiLab dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwopus3.6-35B-A3B-Coder-MTP-GGUF
Mô hình trọng lượng mở 35B từ Jackrong dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3.6-35B-A3B-MTP-GGUF
Mô hình trọng lượng mở 35B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gemma-4-12b-it-GGUF
Mô hình trọng lượng mở 12B từ Google dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen3-VL-30B-A3B-Instruct-GGUF
Mô hình trọng lượng mở 30B từ Qwen dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →mô hình đã di chuyển
The models-moved collection is provided by ggml-org and currently lists an unknown parameter count for its various model files. These models excel at general-purpose tasks within the US region and are best suited for users seeking accessible inference options from this specific provider. Running them locally requires downloading the appropriate GGUF quantization files, with performance varying significantly based on your GPU or CPU hardware capabilities.
Tải xuống cho LM Studio →cohere-transcribe-03-2026-gguf
Mô hình trọng lượng mở không xác định từ máy tính cầm tay dùng cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Qwen-AgentWorld-35B-A3B-GGUF
Mô hình trọng lượng mở 35B từ Alibaba dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →vntl-llama3-8b-v2-gguf
The vntl-llama3-8b-v2-gguf is an 8B parameter language model developed by lmg-anon that specializes in high-quality translation and conversational tasks. It excels at processing the VNTL-v5-1k dataset to deliver fluent responses, making it ideal for multilingual chat applications and localized content generation. Running this model locally requires a GPU with sufficient VRAM to handle its 8B parameter weight efficiently, ensuring responsive performance for real-time dialogue.
Tải xuống cho LM Studio →gemma-4-E4B-it-GGUF
The gemma-4-E4B-it-GGUF is a 4-billion parameter language model developed by Google and optimized for Italian using GGUF quantization. It excels at handling complex reasoning tasks within the Gemma 4 architecture while supporting efficient image-to-text conversions through specialized unsloth optimizations. Running this model locally requires a modern GPU to leverage its speed, making it ideal for users seeking high-performance local inference without cloud dependencies.
Tải xuống cho LM Studio →Qwen3.6-27B-GGUF
Qwen3.6-27B-GGUF is a 27-billion parameter large language model developed by Alibaba that supports advanced conversational AI and image-to-text capabilities. It excels at complex reasoning tasks, multilingual communication, and visual analysis, making it ideal for professional applications requiring high accuracy in text generation and understanding. Running this model locally typically demands substantial GPU memory and a powerful processor to handle its 27B parameters efficiently, so it is best suited for users with dedicated hardware or access to cloud instances.
Tải xuống cho LM Studio →Qwen3.6-35B-A3B-GGUF
Qwen3.6-35B-A3B-GGUF is a 35-billion parameter large language model developed by Alibaba that features specialized optimizations for image-to-text conversion and multilingual conversation. This model excels at handling complex visual reasoning tasks and maintaining coherent dialogue, making it ideal for applications requiring deep contextual understanding across diverse topics. Running this model locally requires substantial GPU memory to handle its full parameter count, though quantized GGUF versions can offer a practical balance between speed and performance on high-end consumer hardware.
Tải xuống cho LM Studio →Hy3-GGUF
Mô hình trọng lượng mở không xác định từ vcruz305 dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →HyperCLOVAX-SEED-Text-Instruct-1.5B-Q4_K_M-GGUF
HyperCLOVAX-SEED-Text-Instruct-1.5B-Q4_K_M-GGUF is a 1.5 billion parameter language model created by rippertnt and optimized for use with llama-cpp. It excels at conversational tasks and general text generation, making it ideal for lightweight chat applications that require efficient inference on standard hardware. Running this model locally is practical even on modest systems due to its quantized format, offering fast response times without the need for high-end GPUs.
Tải xuống cho LM Studio →Qwen3.5-9B-GGUF
Qwen3.5-9B-GGUF is a compact large language model developed by Alibaba containing 9 billion parameters. It excels at conversational tasks and image-to-text conversion, making it ideal for lightweight applications that require efficient region US deployment. Running this model locally is practical on consumer-grade hardware thanks to its small footprint, offering fast inference speeds even on modest GPUs when paired with optimization libraries like Unsloth.
Tải xuống cho LM Studio →Qwen3.5-4B-GGUF
Qwen3.5-4B-GGUF is a compact 4-billion parameter language model developed by Alibaba that supports conversational tasks and image-to-text conversion. It excels at handling lightweight inference workloads while maintaining strong performance in unsloth-optimized environments for text generation. Running this model locally requires minimal hardware resources, making it ideal for users seeking fast, efficient deployment on standard consumer devices.
Tải xuống cho LM Studio →parakeet-unified-en-0.6b-gguf
Mô hình trọng lượng mở 0.6 tỷ từ handy-computer dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →nemotron-3.5-asr-streaming-0.6b-gguf
Mô hình trọng lượng mở 0.6 tỷ từ handy-computer dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →gemma-4-26B-A4B-it-GGUF
The gemma-4-26B-A4B-it-GGUF is a 26-billion parameter large language model developed by Google that leverages advanced instruction tuning for high-performance reasoning. This model excels at complex text generation and multimodal tasks, making it ideal for applications requiring deep contextual understanding and precise instruction following. Running this model locally demands substantial GPU memory and significant compute power, so it is best suited for users with high-end hardware or those utilizing optimized inference frameworks like Unsloth to manage its resource requirements.
Tải xuống cho LM Studio →Bonsai-27B-gguf
Bonsai-27B-gguf is a compact 27-billion parameter language model developed by prism-ml that utilizes quantization for efficient deployment. It excels at conversational tasks and general reasoning while running smoothly on llama.cpp with support for both CPU and CUDA hardware acceleration. Users can run this model locally on modest hardware, though performance will vary depending on whether they utilize 1-bit quantization or have access to a GPU.
Tải xuống cho LM Studio →Qwen3.6-35B-A3B-Không kiểm duyệt-HauhauCS-Hung hăng
Qwen3.6-35B-A3B-Uncensored-HauhauCS-Aggressive is a 35-billion parameter large language model developed by HauhauCS that combines MoE architecture with advanced multimodal and vision capabilities. It excels at complex reasoning, multilingual image-text analysis, and generating uncensored content for aggressive or unrestricted use cases where standard safety filters are undesirable. Running this model locally requires substantial high-end GPU memory to handle its sparse mixture-of-experts structure, making it best suited for powerful workstations or servers with significant VRAM available.
Tải xuống cho LM Studio →Qwythos-9B-Claude-Mythos-5-1M-GGUF
Mô hình trọng lượng mở 9B từ empero-ai dành cho suy luận AI cục bộ.
Tải xuống cho LM Studio →Ornith-1.0-35B-GGUF
Ornith-1.0-35B-GGUF is a 35-billion parameter language model developed by ornith-ai specifically for conversational tasks within the US region. It excels at maintaining natural dialogue flows and handling context-aware interactions, making it ideal for chatbots and virtual assistants. Running this model locally requires substantial GPU memory to handle its size efficiently, so it is best suited for users with high-end hardware or those willing to use quantized GGUF versions to reduce resource demands.
Tải xuống cho LM Studio →Qwen3.6-27B-MTP-GGUF
Qwen3.6-27B-MTP-GGUF is a 27-billion parameter large language model developed by Alibaba that supports advanced conversational tasks and image-to-text conversion. It excels at handling complex reasoning and multi-turn dialogues, making it ideal for applications requiring deep contextual understanding and visual analysis. Running this model locally typically demands high-end GPU hardware to manage its substantial memory footprint, though quantized GGUF versions can offer a practical balance between speed and performance on consumer-grade systems.
Tải xuống cho LM Studio →deepseek-v4-gguf
The deepseek-v4-gguf model is a quantized Mixture-of-Experts architecture provided by antirez with unknown parameter counts available in 2-bit and 4-bit formats. It excels at efficient inference for large language tasks while maintaining high performance through its specialized MoE structure, making it ideal for users needing reduced memory footprints without significant capability loss. Running this model locally requires moderate hardware resources to handle the quantized weights effectively, offering a fast and practical solution for deploying advanced AI capabilities on consumer-grade systems.
Tải xuống cho LM Studio →Ornith-1.0-9B-GGUF
Ornith-1.0-9B-GGUF is a 9-billion parameter language model developed by ornith-ai designed for conversational interactions within the US region. It excels at generating natural dialogue and handling casual chat tasks, making it ideal for lightweight virtual assistants or simple customer support bots. Running this model locally requires modest hardware resources, allowing it to operate quickly on consumer-grade GPUs without needing massive data centers.
Tải xuống cho LM Studio →
