En algún lugar, un desarrollador paga 200 dólares al mes por IA y tiene un Mac mini a tres pies de distancia que podría hacer la mayor parte de eso por el precio de la electricidad.
El Mac mini es el dispositivo al que la gente recurre primero cuando quiere ejecutar IA en casa, y por buenas razones. Es silencioso, consume poca energía y lo deja todo en tu propia máquina. Pero hay dos números que deciden si es brillante o una pérdida de dinero para ti, y casi nadie los explica antes de comprar.
Esta es la versión honesta. Para qué es excelente el Mac mini, dónde se queda corto silenciosamente, qué configuración deberías comprar realmente, y las cuentas reales en 2026.
Por qué el Mac mini, específicamente
La palabra mágica es memoria unificada.
En una PC normal, la tarjeta gráfica tiene su propia VRAM, y esa VRAM es un muro infranqueable. Si un modelo no cabe, no se carga. Apple construye un único grupo de memoria que comparten la CPU y la GPU, por lo que el Mac mini puede contener y ejecutar modelos que una caja Windows con especificaciones similares y VRAM separada no puede.
Añádele tres cosas más. Funciona casi en silencio, consume entre 10 y 30 vatios bajo carga en lugar de cientos, y es lo suficientemente pequeño como para dejarlo encendido las 24 horas como el servidor silencioso detrás de tus automatizaciones. Esa combinación es la razón por la que el Mac mini se convirtió en la caja de IA doméstica por defecto, no la potencia bruta.

Los dos números que lo deciden todo
Antes de mirar un solo precio, entiende las dos especificaciones que realmente importan para la IA local.
La memoria es capacidad. Decide qué modelos pueden cargarse en absoluto. A grandes rasgos: 16 GB ejecutan cómodamente un modelo de 7B, 24 GB se estiran hasta un 14B cuantizado, y necesitas 48 GB antes de que un modelo de 30B sea realmente cómodo. Compra para el tamaño de modelo que quieras ejecutar, porque esto es un muro, no un regulador.
El ancho de banda es velocidad. Decide qué tan rápido salen las palabras una vez que el modelo está cargado. Esta es la parte que el marketing de Apple nunca pone en la caja, y es donde los dos chips se separan drásticamente:
1Apple M4 120 GB/s2Apple M4 Pro 273 GB/s
Esa brecha no es cosmética. Es por lo que el M4 base se siente instantáneo en un modelo de 7B y empieza a arrastrarse en algo grande, mientras que el M4 Pro sigue siendo utilizable en modelos de 30B. La capacidad permite que el modelo se cargue. El ancho de banda determina si disfrutas usándolo.

Qué configuración comprar realmente
Tres niveles honestos, con velocidades medidas reales.
El M4 base (16 a 24 GB, 120 GB/s). Esta es la máquina del "mi asistente diario vive aquí". Con 16 GB ejecuta Llama 3.2 3B y Qwen2.5 7B a unos 25 tokens por segundo, lo que se siente instantáneo, y un modelo de 14B a unos 10 tokens por segundo, que es utilizable pero ya no es rápido. Perfecto para escribir, redactar, resumir, clasificar y preguntas y respuestas sobre tus propias notas. No disfrutará un modelo de 30B.
El M4 Pro (48 GB, 273 GB/s). Este es el mejor Mac mini para IA local en 2026, punto final. El ancho de banda y la memoria adicionales le permiten ejecutar un modelo de clase 30B a aproximadamente 40 tokens por segundo en uso real de chat, lo que es genuinamente cómodo. Si quieres que el mini sea un servidor de inferencia real y no solo un chatbot, este es el indicado.
Salta el intermedio si puedes. Un M4 base con la máxima RAM pero atascado a 120 GB/s cargará modelos más grandes y luego los ejecutará lentamente. Si necesitas modelos grandes, el ancho de banda del Pro importa más que unos pocos gigabytes adicionales en el chip base.
Las cuentas honestas en 2026
Aquí es donde la historia cambió este año, y la versión honesta importa.
1Mac mini M4 (16GB / 512GB) desde $7992 Actualización a 24GB de memoria ~ +$2003Mac mini M4 Pro (24GB) desde $1,5994 Configuración de 48GB más alto, y con suministro limitado5Electricidad 24/7 ~$3 a $8 / mes
El precio base saltó de $599 a $799 este año, y Apple limitó silenciosamente el M4 a 24 GB y el M4 Pro a 48 GB, porque una escasez global de memoria impulsada por la construcción de centros de datos de IA ha hecho que la RAM sea escasa y cara. Para una máquina donde la memoria es el punto central, ese es el asterisco honesto: ponle precio a la configuración que realmente necesitas, y sabe que el número está subiendo, no bajando.
Frente a un conjunto de suscripciones, la recuperación de la inversión es real pero no instantánea. Un mini de $799 frente a un hábito de IA de $100 al mes se amortiza en unos ocho meses, luego son unos pocos dólares de electricidad para siempre. Frente a un hábito ligero de ChatGPT Plus de $20, el mini nunca se paga solo en efectivo, y no deberías fingir lo contrario. La caja vale la pena cuando realmente usas IA a diario, no ocasionalmente.
La configuración lleva una tarde
El proceso es el mismo para todas las configuraciones.
Instala Ollama, la herramienta que convierte cualquier modelo en una API local que habla el lenguaje de OpenAI:
1curl -fsSL https://ollama.com/install.sh | sh
Descarga un modelo adaptado a tu memoria:
1# M4 base, 16 a 24 GB:2ollama pull llama3.23ollama pull qwen2.5:7b45# M4 Pro, 48 GB:6ollama pull qwen2.5:32b
Luego apunta cualquier herramienta que ya uses al endpoint local cambiando una línea:
1client = OpenAI(base_url="http://localhost:11434/v1", api_key="ollama")
Añade Open WebUI en Docker si quieres un chat en navegador que se vea como ChatGPT, y tendrás un asistente privado funcionando completamente en tu escritorio.
Qué sale mal realmente
La memoria es el techo, y es cara ahora mismo. Cada historia de "no funciona" es un modelo que no cabía. Compra la RAM por adelantado, porque no puedes añadirla después, y la escasez ha hecho que esas actualizaciones sean más caras que hace un año.
El M4 base tiene limitaciones de ancho de banda. A 120 GB/s es una maravilla en modelos de 7B y lento en los grandes. No compres el mini más barato esperando velocidades de 30B. Para eso está el Pro.
El trabajo de frontera aún pertenece a la nube. El razonamiento más difícil y la codificación de vanguardia siguen favoreciendo a los mejores modelos alojados. El Mac mini es el caballo de batalla confiable, privado y siempre encendido para el 80% del día a día, no un reemplazo para todo. Mantén una suscripción en la nube para el 20% difícil y ejecuta el resto en casa.
No es portátil. Es un escritorio atado a la pared. Si necesitas IA en movimiento, esta es la herramienta equivocada.
Para quién es, y para quién no es
Compra un Mac mini si usas IA a diario, quieres una máquina silenciosa que funcione todo el día, te importa mantener tus datos en tu propio hardware, y estás contento con un terminal para la configuración. Compra el M4 Pro si quieres ejecutar modelos de 30B a velocidad real.
Saltátelo si toda tu vida de IA cabe en una suscripción de $20, solo necesitas un chatbot de vez en cuando, o necesitas algo que puedas llevar contigo.
Dos cosas que hacer ahora
Pruébalo gratis primero. Instala Ollama en el Mac que ya tienes y ejecuta un modelo de 7B este fin de semana. Cualquier máquina Apple Silicon con 16 GB lo hace. Prueba el flujo de trabajo antes de gastar un centavo.
Luego compra para el modelo, no para la etiqueta de precio. Decide el modelo más grande que realmente quieras ejecutar, luego elige la configuración cuya memoria lo contenga y cuyo ancho de banda lo ejecute. Para la mayoría de las personas, eso es un M4 base de 24 GB. Para cualquiera que hable en serio sobre modelos de 30B, es el M4 Pro con 48 GB.
La estrategia nunca fue la parte difícil. Es una caja silenciosa, un cambio de una línea, y la decisión de dejar de alimentar una suscripción por trabajo que una máquina en tu escritorio ya puede hacer.
Sígueme para más análisis como este.
*
*Analizo herramientas de IA y el dinero que se gana con ellas regularmente como esta. Sígueme para la próxima, y únete a mi Telegram: https://t.me/+3XrP38Cv9fk2YTM6





