¿Qué modelo abierto cabe en tu equipo?
Elige tu memoria y mira qué modelos caben a 4 bits.
Cabe con holgura 0
Cabe justo 0
No cabe 0
Regla: tamaño del modelo + ~1,5 GB de contexto corto. En Mac contamos ~75% de la memoria unificada; en solo CPU, 4 GB menos. Es una estimación nuestra Sin confirmar; los tamaños tienen fuente. Más contexto pide más memoria: Qwen3.8-27B usó 19,7 GiB con 32K en Ollama y 22,2 GiB con 262K en llama.cpp con caché KV de 4 bits, en una RTX 4090 Terceros. ¿Mediste algo? Envía un pasaporte.