Test gratuito de compatibilidad con LLM locales

¿Puede mi PC ejecutar una IA local o un LLM local?

Ejecuta un LLM en local sin ir a ciegas. Compara modelos de IA local populares con tu hardware y revisa la VRAM, la memoria, la cuantización, la longitud del contexto y los tokens por segundo estimados antes de descargar nada.

Gratis y sin instalar software. La detección del hardware se realiza en tu navegador y no se envían los datos sin procesar de la GPU.

Tu hardware

Detectando el hardware…

Memoria unificada48 GBRAM del sistema48 GBAncho de banda273 GB/s
Cuantización / precisión
Contexto
31Funciona bien
0Muy justo
3Con descarga
5No cabe

39 modelos evaluados

¿Qué LLM local puedo ejecutar en este hardware?

Busca modelos de IA locales para chat, programación, razonamiento o visión. Compara la compatibilidad, la memoria y la velocidad estimadas, el motor de ejecución y las fuentes que justifican cada resultado.

Tarea
Compatibilidad
Proveedor
Ordenar

La clasificación de Arena se muestra para 20 modelos que coinciden exactamente; los demás quedan sin clasificar en lugar de asignarles una coincidencia dudosa.

Arena · CC BY 4.0 · 2026-07-10
Funciona con holguraAlibaba

Qwen3.5 9B

Chat · Razonamiento · Programación · Visión · Apache-2.0

Parámetros 9B
Memoria estimada 6,9 GBQ4_K_M
Velocidad estimada 24–36 tok/sMLX
Puesto open source en Arena Sin coincidencia exacta en Arena
Funciona con holguraAlibabaMoE

Qwen3 30B-A3B

Chat · Razonamiento · Programación · Apache-2.0

Parámetros 31B3,3B activos
Memoria estimada 20 GBQ4_K_M
Velocidad estimada 65–98 tok/sMLX
Puesto open source en Arena #821317 · 26.474 votos
Funciona con holguraAlibabaMoE

Qwen3.5 35B-A3B

Chat · Razonamiento · Programación · Visión · Apache-2.0

Parámetros 35B3B activos
Memoria estimada 23 GBQ4_K_M
Velocidad estimada 72–108 tok/sMLX
Puesto open source en Arena #451396 · 29.184 votos
Funciona con holguraMeta

Llama 3.1 8B Instruct

Chat · Programación · Llama 3.1 Community

Parámetros 8B
Memoria estimada 6,3 GBQ4_K_M
Velocidad estimada 27–40 tok/sMLX
Puesto open source en Arena #1301187 · 49.605 votos
Funciona con holguraOpenAIMoE

GPT-OSS 20B

Chat · Programación · Razonamiento · Apache-2.0

Parámetros 21B3,6B activos
Memoria estimada 14 GBQ4_K_M
Velocidad estimada 60–90 tok/sMLX
Puesto open source en Arena #931288 · 10.621 votos
Funciona con holguraAlibaba

Qwen2.5 Coder 7B Instruct

Programación · Chat · Apache-2.0

Parámetros 7,6B
Memoria estimada 6 GBQ4_K_M
Velocidad estimada 28–43 tok/sMLX
Puesto open source en Arena Sin coincidencia exacta en Arena
Funciona con holguraDeepSeek

DeepSeek R1 Distill Qwen 14B

Razonamiento · Chat · MIT

Parámetros 15B
Memoria estimada 11 GBQ4_K_M
Velocidad estimada 15–22 tok/sMLX
Puesto open source en Arena Sin coincidencia exacta en Arena
Funciona con holguraAlibaba

Qwen3 8B

Chat · Razonamiento · Programación · Apache-2.0

Parámetros 8,2B
Memoria estimada 6,4 GBQ4_K_M
Velocidad estimada 26–39 tok/sMLX
Puesto open source en Arena Sin coincidencia exacta en Arena
Funciona con holguraAlibaba

Qwen2.5 7B Instruct

Chat · Razonamiento · Apache-2.0

Parámetros 7,6B
Memoria estimada 6 GBQ4_K_M
Velocidad estimada 28–43 tok/sMLX
Puesto open source en Arena Sin coincidencia exacta en Arena
Funciona con holguraDeepSeek

DeepSeek R1 Distill Qwen 7B

Razonamiento · Chat · MIT

Parámetros 7,6B
Memoria estimada 6 GBQ4_K_M
Velocidad estimada 28–43 tok/sMLX
Puesto open source en Arena Sin coincidencia exacta en Arena
Funciona con holguraDeepSeek

DeepSeek R1 Distill Qwen 32B

Razonamiento · Chat · MIT

Parámetros 33B
Memoria estimada 23 GBQ4_K_M
Velocidad estimada 6,6–9,9 tok/sMLX
Puesto open source en Arena Sin coincidencia exacta en Arena
Funciona con holguraGoogle

Gemma 3 12B IT

Chat · Razonamiento · Visión · Gemma Terms

Parámetros 12B
Memoria estimada 8,8 GBQ4_K_M
Velocidad estimada 18–27 tok/sMLX
Puesto open source en Arena #751334 · 3829 votos
Funciona con holguraAlibaba

Qwen2.5 Coder 14B Instruct

Programación · Chat · Apache-2.0

Parámetros 15B
Memoria estimada 11 GBQ4_K_M
Velocidad estimada 15–22 tok/sMLX
Puesto open source en Arena Sin coincidencia exacta en Arena
Funciona con holguraAlibaba

Qwen3 14B

Chat · Razonamiento · Programación · Apache-2.0

Parámetros 15B
Memoria estimada 11 GBQ4_K_M
Velocidad estimada 15–22 tok/sMLX
Puesto open source en Arena Sin coincidencia exacta en Arena
Funciona con holguraGoogle

Gemma 3 27B IT

Chat · Razonamiento · Visión · Gemma Terms

Parámetros 27B
Memoria estimada 19 GBQ4_K_M
Velocidad estimada 8–12 tok/sMLX
Puesto open source en Arena #621358 · 47.514 votos
Funciona con holguraMicrosoft

Phi-4 14B

Chat · Programación · Razonamiento · MIT

Parámetros 14B
Memoria estimada 10 GBQ4_K_M
Velocidad estimada 15–23 tok/sMLX
Puesto open source en Arena #1211217 · 24.126 votos
Funciona con holguraAlibaba

Qwen2.5 Coder 32B Instruct

Programación · Chat · Apache-2.0

Parámetros 33B
Memoria estimada 22 GBQ4_K_M
Velocidad estimada 6,6–10 tok/sMLX
Puesto open source en Arena #1131230 · 5432 votos
Funciona con holguraMistral AI

Mistral Small 3.1 24B

Chat · Programación · Visión · Apache-2.0

Parámetros 24B
Memoria estimada 17 GBQ4_K_M
Velocidad estimada 9–14 tok/sMLX
Puesto open source en Arena #991278 · 33.199 votos
Funciona con holguraAlibaba

Qwen2.5 14B Instruct

Chat · Razonamiento · Apache-2.0

Parámetros 15B
Memoria estimada 11 GBQ4_K_M
Velocidad estimada 15–22 tok/sMLX
Puesto open source en Arena Sin coincidencia exacta en Arena
Funciona con holguraAlibaba

Qwen3 32B

Chat · Razonamiento · Programación · Apache-2.0

Parámetros 33B
Memoria estimada 23 GBQ4_K_M
Velocidad estimada 6,6–9,9 tok/sMLX
Puesto open source en Arena #711340 · 3926 votos
Funciona con holguraGoogle

Gemma 3 4B IT

Chat · Visión · Gemma Terms

Parámetros 4B
Memoria estimada 3,7 GBQ4_K_M
Velocidad estimada 54–81 tok/sMLX
Puesto open source en Arena #911291 · 4171 votos
Funciona con holguraAlibaba

Qwen2.5 32B Instruct

Chat · Razonamiento · Apache-2.0

Parámetros 33B
Memoria estimada 22 GBQ4_K_M
Velocidad estimada 6,6–10 tok/sMLX
Puesto open source en Arena Sin coincidencia exacta en Arena
Funciona con holguraMicrosoft

Phi-4 Mini Instruct

Chat · Programación · Razonamiento · MIT

Parámetros 3,8B
Memoria estimada 3,6 GBQ4_K_M
Velocidad estimada 57–85 tok/sMLX
Puesto open source en Arena Sin coincidencia exacta en Arena
Funciona con holguraMeta

Llama 3.2 3B Instruct

Chat · Llama 3.2 Community

Parámetros 3B
Memoria estimada 3 GBQ4_K_M
Velocidad estimada 72–108 tok/sMLX
Puesto open source en Arena #1561110 · 7936 votos
Funciona con holguraMistral AI

Mistral 7B Instruct v0.3

Chat · Programación · Apache-2.0

Parámetros 7,3B
Memoria estimada 5,8 GBQ4_K_M
Velocidad estimada 30–44 tok/sMLX
Puesto open source en Arena Sin coincidencia exacta en Arena
Funciona con holguraGoogle

Gemma 2 9B IT

Chat · Gemma Terms

Parámetros 9,2B
Memoria estimada 7 GBQ4_K_M
Velocidad estimada 24–35 tok/sMLX
Puesto open source en Arena #1221208 · 54.611 votos
Funciona con holguraMicrosoft

Phi-3.5 Mini Instruct

Chat · Programación · MIT

Parámetros 3,8B
Memoria estimada 3,6 GBQ4_K_M
Velocidad estimada 57–85 tok/sMLX
Puesto open source en Arena Sin coincidencia exacta en Arena
Funciona con holguraMistral AI

Mistral NeMo 12B Instruct

Chat · Programación · Apache-2.0

Parámetros 12B
Memoria estimada 8,9 GBQ4_K_M
Velocidad estimada 18–27 tok/sMLX
Puesto open source en Arena Sin coincidencia exacta en Arena
Funciona con holguraGoogle

Gemma 2 27B IT

Chat · Razonamiento · Gemma Terms

Parámetros 27B
Memoria estimada 19 GBQ4_K_M
Velocidad estimada 8–12 tok/sMLX
Puesto open source en Arena #1121232 · 75.754 votos
Funciona con holguraMeta

Llama 3.2 1B Instruct

Chat · Llama 3.2 Community

Parámetros 1B
Memoria estimada 1,7 GBQ4_K_M
Velocidad estimada 200–300 tok/sMLX
Puesto open source en Arena #1831055 · 8045 votos
Funciona con holguraZhipu AI

GLM-4 9B Chat

Chat · Programación · GLM-4 License

Parámetros 9,4B
Memoria estimada 7,2 GBQ4_K_M
Velocidad estimada 23–34 tok/sMLX
Puesto open source en Arena Sin coincidencia exacta en Arena
Funciona con descargaMeta

Llama 3.1 70B Instruct

Chat · Razonamiento · Llama 3.1 Community

Parámetros 70B
Memoria estimada 47 GBQ4_K_M
Velocidad estimada 0,5–0,7 tok/sMLX
Puesto open source en Arena #1071261 · 55.240 votos
Funciona con descargaMeta

Llama 3.3 70B Instruct

Chat · Razonamiento · Llama 3.3 Community

Parámetros 70B
Memoria estimada 47 GBQ4_K_M
Velocidad estimada 0,5–0,7 tok/sMLX
Puesto open source en Arena #1001275 · 54.726 votos
Funciona con descargaDeepSeek

DeepSeek R1 Distill Llama 70B

Razonamiento · Chat · MIT + Llama

Parámetros 70B
Memoria estimada 47 GBQ4_K_M
Velocidad estimada 0,5–0,7 tok/sMLX
Puesto open source en Arena Sin coincidencia exacta en Arena
No cabe en memoriaOpenAIMoE

GPT-OSS 120B

Chat · Programación · Razonamiento · Apache-2.0

Parámetros 117B5,1B activos
Memoria estimada 75 GBQ4_K_M
Velocidad estimada 1,7–2,5 tok/sMLX
Puesto open source en Arena #591366 · 30.628 votos
No cabe en memoriaMoonshot AIMoE

Kimi K2 Instruct

Chat · Programación · Razonamiento · Modified MIT

Parámetros 1000B32B activos
Memoria estimada 633 GBQ4_K_M
Velocidad estimada 0,3–0,4 tok/sMLX
Puesto open source en Arena Sin coincidencia exacta en Arena
No cabe en memoriaMetaMoE

Llama 4 Scout 17B-16E

Chat · Razonamiento · Visión · Llama 4 Community

Parámetros 109B17B activos
Memoria estimada 70 GBQ4_K_M
Velocidad estimada 0,5–0,8 tok/sMLX
Puesto open source en Arena #981281 · 30.280 votos
No cabe en memoriaMiniMaxMoE

MiniMax M2.1

Chat · Programación · Razonamiento · MiniMax Open License

Parámetros 230B10B activos
Memoria estimada 146 GBQ4_K_M
Velocidad estimada 0,9–1,3 tok/sMLX
Puesto open source en Arena Sin coincidencia exacta en Arena
No cabe en memoriaMetaMoE

Llama 4 Maverick 17B-128E

Chat · Razonamiento · Visión · Llama 4 Community

Parámetros 400B17B activos
Memoria estimada 254 GBQ4_K_M
Velocidad estimada 0,5–0,8 tok/sMLX
Puesto open source en Arena #921288 · 39.963 votos
Catálogo 2026.07.17-mvp.2Actualizado el 2026-07-17Engine 1.1.0

El rendimiento es una estimación basada en especificaciones públicas. Los controladores, las versiones del motor, la refrigeración, la longitud del contexto y la carga en segundo plano pueden cambiar los resultados reales.

Mucho más que cabe o no cabe

IA local: compatibilidad, VRAM, memoria y velocidad explicadas

Usa este test gratuito como calculadora de VRAM para LLM local y como guía de decisión, no solo como una lista de hardware. Los datos y límites de cada estimación permanecen visibles.

Compatibilidad con PC, GPU y Mac

Empieza con la detección del navegador, elige un perfil conocido de GPU o Mac, o edita la VRAM, la memoria unificada, la RAM del sistema y el ancho de banda.

Calculadora de VRAM y memoria para LLM local

Estima los pesos del modelo, la caché KV del contexto y la sobrecarga del motor en vez de comparar solo el tamaño del archivo con la VRAM anunciada.

Cuantización adaptada a tu hardware

Compara Q4, Q5, Q8, BF16, FP8 y NVFP4 mientras el test explica el uso de memoria y qué precisiones admite tu hardware.

Velocidad estimada del LLM en local

Consulta un intervalo estimado de tokens de salida por segundo. Es una ayuda para planificar, no el resultado de un benchmark garantizado en tu equipo.

Razones y fuentes, no una caja negra

Abre un resultado para consultar el desglose de memoria, el motivo de compatibilidad, el motor, la fuente, la fecha del catálogo y la versión del motor de evaluación.

Detección del hardware en el navegador

La detección automática se ejecuta en tu navegador. No se envían los datos sin procesar del adaptador GPU y siempre puedes corregir manualmente un resultado aproximado.

Antes de descargar

Ejecutar IA localmente: comprueba el hardware y la memoria

Para ejecutar IA localmente no basta con comparar el número de parámetros con la VRAM anunciada. Comprueba la memoria útil, el formato del modelo, la cuantización, el contexto y la sobrecarga del motor antes de elegir una descarga.

Comprobar mi configuración de LLM local

Empieza por la VRAM o la memoria unificada útil

Reserva espacio para el sistema operativo, la pantalla, el motor de inferencia, el contexto del modelo y los búferes temporales, en vez de considerar disponible cada gigabyte anunciado.

Elige un modelo de IA local y su cuantización

Combina la arquitectura y el número de parámetros del modelo con una versión Q4, Q5, Q8, BF16, FP8 o NVFP4 que tu hardware y tu motor admitan de verdad.

Usa la calculadora LLM antes de descargar

Compara los pesos estimados, la caché KV, la sobrecarga del motor, el estado de compatibilidad y los tokens por segundo antes de dedicar almacenamiento y tiempo a la instalación.

Cómo ejecutar un LLM en local

Comprueba en tres pasos si tu PC puede ejecutar una IA local

Empieza por tu PC, GPU o Mac, ajusta la precisión y el contexto del modelo y usa las estimaciones de compatibilidad, memoria y velocidad para decidir qué descargar.

Comprobar mi hardware ahora

1. Confirma tu PC, GPU o Mac

El test prueba WebGPU y WebGL de forma local. Las restricciones de privacidad del navegador pueden hacer que la detección sea aproximada, por lo que puedes elegir un perfil o editar los valores del hardware.

2. Ajusta la cuantización y el contexto

Q4, Q5 y Q8 ofrecen una amplia compatibilidad; BF16 necesita más memoria; FP8 y NVFP4 requieren determinadas arquitecturas NVIDIA. Un contexto mayor aumenta la memoria de la caché KV.

3. Elige un modelo de IA local

Valora a la vez la compatibilidad, el desglose de memoria, la velocidad estimada, el motor, la fuente, la versión del catálogo y la del motor de evaluación, no una sola cifra de VRAM.

Preguntas sobre LLM locales

IA local y LLM local: preguntas frecuentes

Respuestas prácticas sobre el hardware para un LLM local, la VRAM, la memoria unificada de los Mac, la cuantización, la velocidad estimada y la detección desde el navegador.

Encuentra el LLM local que tu hardware puede ejecutar de verdad

Usa gratis el test de compatibilidad antes de descargar modelos de IA locales. Compara en un solo lugar compatibilidad, VRAM, memoria, cuantización, contexto y velocidad estimada.