studio raoulsoftware innovation, architecture & development
← Blog
IA en la práctica · 14 de agosto de 2026

Cuando un modelo de IA potente no cuesta nada por uso

Meta lanzó un potente modelo de IA que cualquiera puede ejecutar gratis en su propio hardware, lo que cambia cuánto cuesta construir productos con IA.

Datos clave
30B
parámetros, comprimido para una sola GPU
Apache 2.0
licencia — gratis para uso comercial
24 GB
memoria GPU para ejecutarlo localmente
51.2
puntuación en benchmark de programación (SWE-Bench Pro)

Usar una IA capaz significaba antes pagar una factura de API cada vez — fracciones de céntimo por fragmento de texto, y esas fracciones se acumulan rápido a escala. Meta lanzó Muse Glimmer el 10 de agosto con licencia Apache 2.0: un modelo de 30.000 millones de parámetros pensado para tareas agénticas reales, libre para uso comercial y diseñado para correr en una sola tarjeta gráfica de consumo.

Muse Glimmer está hecho para el trabajo donde una IA toma un objetivo, lo divide en pasos, llama a herramientas y sigue hasta terminar. Procesa texto e imágenes, soporta programación, análisis de documentos y llamadas a funciones, y cabe en una tarjeta gráfica de 24 GB tras la compresión. Meta reporta una puntuación de 51,2 en SWE-Bench Pro — un benchmark que mide qué tan bien el modelo corrige errores reales de software — lo que lo sitúa cerca de los modelos de pago más avanzados.

La licencia Apache 2.0 es el punto clave. Muchos modelos de IA 'abiertos' restringen el uso comercial a partir de cierta escala o no permiten modificaciones. Este no tiene esas restricciones. Para equipos donde los datos deben quedarse en tus propios servidores — en fintech, derecho o salud — es la primera vez que un modelo tan capaz está disponible sin condiciones.

El paso práctico es hacer una comparación de costos. Muse Glimmer no supera a los grandes modelos de pago en todas las tareas, pero para herramientas internas, asistentes de código o flujos de trabajo que se ejecutan cientos de veces al día, tener tu propio modelo puede costar menos que pagar por token. Ya está en Hugging Face y funciona con ollama 0.32.7 en adelante.

Fuentes
← La nueva IA de programación de Google es mucho mejor — y más barata hasta enero← El coste de construir software acaba de bajar — y una apuesta de 13.000 millones lo demuestra
Cuando un modelo de IA potente no cuesta nada por uso