Modelos 7B

Los mejores modelos de IA locales 7B

Los modelos compactos de la gama 7B-9B son la opción ideal para ejecutarlos en un portátil o en una única GPU de consumo.

Llama-3-8B-Instruct-32k-v0.1-GGUF

Maziyar Panahi8BRAM de 16 GB

Modelo de peso abierto 8B de MaziyarPanahi para inferencia de IA local.

Mistral-7B-Instruct-v0.3-GGUF

Maziyar Panahi7BRAM de 8 GB

Modelo de peso abierto 7B de MaziyarPanahi para inferencia de IA local.

Meta-Llama-3-8B-Instruct-GGUF

Maziyar Panahi8BRAM de 16 GB

Modelo de peso abierto 8B de MaziyarPanahi para inferencia de IA local.

Parable-Granite-4.1-8B-Claude-Fable-5-GGUF

AnkitAI8BRAM de 16 GB

Modelo de peso abierto 8B de AnkitAI para inferencia de IA local.

Bonsái ternario-8B-gguf

prisma-ml8BRAM de 16 GB

Modelo de ponderación abierta 8B de prism-ml para inferencia de IA local.

Qwen3.5-9B-DeepSeek-V4-Flash-GGUF

Jackrong9BRAM de 16 GB

Modelo de ponderación abierta 9B de Jackrong para inferencia de IA local.

Parábola-Qwen3-8B-Claude-Fábula-5-GGUF

AnkitAI8BRAM de 16 GB

Modelo de peso abierto 8B de AnkitAI para inferencia de IA local.

Qwen2.5-7B-Instruct-GGUF

Alibaba 7BRAM de 8 GB

Modelo de ponderación abierta 7B de Alibaba para inferencia de IA local.

Qwen2.5-VL-7B-Instrucciones-GGUF

Alibaba 7BRAM de 8 GB

Modelo de ponderación abierta 7B de Alibaba para inferencia de IA local.

Qwen2.5-Codificador-7B-Instrucciones-GGUF

Qwen7BRAM de 8 GB

Modelo de ponderación abierta 7B de Qwen para inferencia de IA local.

Qwen3.5-9B-La-Fábula-Desafiante-Hereje-Sin-Censura-NEO-IMATRIX-MAX-MTP-GGUF

DavidAU9BRAM de 16 GB

Modelo de ponderación abierta 9B de DavidAU para inferencia de IA local.

Meta-Llama-3.1-8B-Instruct-GGUF

Meta8BRAM de 16 GB

Modelo de ponderación abierta 8B de Meta para inferencia de IA local.

Qwen3-8B-GGUF

Alibaba 8BRAM de 16 GB

Modelo de ponderación abierta 8B de Alibaba para inferencia de IA local.

Qwythos-9B-v2-GGUF

empero-ai9BRAM de 16 GB

Modelo de ponderación abierta 9B de empero-ai para inferencia de IA local.

Qwen3.5-9B-Sin censura-HauhauCS-Agresivo

HauhauCS9BRAM de 16 GB

Modelo de peso abierto 9B de HauhauCS para inferencia de IA local.

Qwen3-VL-8B-Instruct-abliterated-GGUF

Alibaba 8BRAM de 16 GB

Qwen3-VL-8B-Instruct-abliterated-GGUF is an 8-billion parameter vision-language model developed by Alibaba that has been fully abliterated to remove proprietary constraints while retaining core capabilities. This model excels at handling complex visual reasoning and multi-step tasks within a conversational framework, making it ideal for open-ended analysis and creative generation in the US region. Running this GGUF quantized version locally is highly practical for users with mid-range GPUs, offering fast inference speeds without requiring specialized enterprise hardware.

Flux2-Klein-9B-Verdadero-V2

wikeeyang9BRAM de 16 GB

Modelo de ponderación abierta 9B de wikeeyang para inferencia de IA local.

UI-TARS-1.5-7B-GGUF

señor mazer7BRAM de 8 GB

Modelo de ponderación abierta 7B de mradermacher para inferencia de IA local.

vntl-llama3-8b-v2-gguf

lmg-anon8BRAM de 16 GB

The vntl-llama3-8b-v2-gguf is an 8B parameter language model developed by lmg-anon that specializes in high-quality translation and conversational tasks. It excels at processing the VNTL-v5-1k dataset to deliver fluent responses, making it ideal for multilingual chat applications and localized content generation. Running this model locally requires a GPU with sufficient VRAM to handle its 8B parameter weight efficiently, ensuring responsive performance for real-time dialogue.

Qwen3.5-9B-GGUF

Alibaba 9BRAM de 16 GB

Qwen3.5-9B-GGUF is a compact large language model developed by Alibaba containing 9 billion parameters. It excels at conversational tasks and image-to-text conversion, making it ideal for lightweight applications that require efficient region US deployment. Running this model locally is practical on consumer-grade hardware thanks to its small footprint, offering fast inference speeds even on modest GPUs when paired with optimization libraries like Unsloth.

Qwythos-9B-Claude-Mythos-5-1M-GGUF

empero-ai9BRAM de 16 GB

Modelo de ponderación abierta 9B de empero-ai para inferencia de IA local.

Ornith-1.0-9B-GGUF

ornith-ai9BRAM de 16 GB

Ornith-1.0-9B-GGUF is a 9-billion parameter language model developed by ornith-ai designed for conversational interactions within the US region. It excels at generating natural dialogue and handling casual chat tasks, making it ideal for lightweight virtual assistants or simple customer support bots. Running this model locally requires modest hardware resources, allowing it to operate quickly on consumer-grade GPUs without needing massive data centers.

¡Hola mucho gusto! 👋

Suscríbete a nuestro boletín para recibir las últimas noticias sobre IA.

Seguridad de Malcare WordPress