Microsoft lanza MAI-Image-2-Efficient: un modelo de generación de imágenes un 41% más barato y 4x más eficiente

Microsoft lanza MAI-Image-2-Efficient: 41% más barato y 4x más eficiente que su modelo insignia. El precio baja a $5 por millón de tokens de entrada y $19,50 por millón de tokens de imagen.

Microsoft ha lanzado MAI-Image-2-Efficient, una variante optimizada de su modelo de texto a imagen que reduce el coste por token de salida un 41% y ofrece cuatro veces más rendimiento por GPU que su hermano insignia. El modelo se posiciona como una opción competitiva frente a las alternativas líderes del mercado.

Según Microsoft, MAI-Image-2 ha sido diseñado para ser su mejor modelo de texto a imagen: fotorrealista, expresivo y con generación de texto dentro de imágenes fiable. El modo Efficient añade optimización de inference que permite producir imágenes un 22% más rápido con la mitad del coste computacional.

Los precios reflejan esta eficiencia: $5 por millón de tokens de texto de entrada y $19,50 por millón de tokens de imagen de salida, frente a los $35 de la versión anterior. Para aplicaciones de producción que generan grandes volúmenes de imágenes, la reducción de coste es significativa.

MAI-Image-2-Efficient está disponible a través de Azure AI y la API de Microsoft, con soporte para generación por lotes y priorización de solicitudes. La versión Efficient mantiene la misma calidad de salida que la versión completa según los benchmarks internos de Microsoft.

El lanzamiento llega en un momento de alta competencia en el espacio de generación de imágenes con IA, donde Midjourney, DALL-E y Stable Diffusion dominan el mercado de consumo. La apuesta de Microsoft es ofrecer calidad comparable a menor coste, algo que puede cambiar las dinámicas de precio de todo el sector.