El modelo MAI-Image-2-Efficient de Microsoft acelera el alejamiento de la empresa de OpenAI

El modelo MAI-Image-2-Efficient de Microsoft acelera el alejamiento de la empresa de OpenAI

Microsoft Corp. El impulso por la independencia de la IA cobra impulso hoy con el lanzamiento de MAI-Image-2-Efficient, una versión delgada y mediana del modelo insignia de generación de imágenes que debutó a principios de este mes.

La nueva versión está diseñada para ofrecer imágenes de alta calidad más rápido y a un precio más bajo que su predecesora, afirmó la compañía. El modelo MAI-Image-2 original fue lanzado a principios de este mes por el nuevo equipo de superinteligencia MAI de Microsoft, y un equipo dirigido por Mustafa Suleyman se atribuyó el mérito de lanzar una versión simplificada de ese modelo apenas unas semanas después.

Como sugiere el nombre, MAI-Image-2-Efficient tiene que ver con la eficiencia, y Microsoft promete cuatro veces el ancho de banda por GPU cuando se trabaja con procesadores Nvidia Corp. H100. En términos de rendimiento bruto, es aproximadamente un 22% más rápido que el modelo base MAI-Image-2, superando al Gemini 3.1 Flash de Google LLC con una latencia un 40% mejor, dijo la compañía, según sus puntos de referencia.

Microsoft dijo que MAI-Image-2-Efficient también es más rentable, a partir de 5 dólares por millón de tokens de entrada, lo mismo que el modelo insignia, y 19,50 dólares por millón de tokens de salida, que es un 41% más barato. Esta estrategia de precios de dos niveles, donde los usuarios pueden elegir entre un modelo de gama alta para un trabajo creativo ultrapreciso o una versión eficiente para producción a gran escala, refleja los planes de Google y de nuevas empresas como OpenAI Group PBC y Anthropic PBC. La compañía dijo que MAI-Image-2-Efficient es particularmente adecuado para tareas de «línea de ensamblaje», como maquetas de interfaces de usuario, fotografías de productos y activos de marketing donde el costo por imagen es un factor clave.

Los primeros comentarios sobre el MAI-Image-2 original han sido positivos, con el modelo ocupando el tercer lugar en la clasificación de Arena.ai y ganando elogios por su fotorrealismo y capacidad para representar tipografía compleja, un área en la que muchos otros modelos de generación de imágenes tienen dificultades. Sin embargo, aún no está claro si MAI-Image-2-Efficient sufre las mismas limitaciones molestas que su hermano. Por ejemplo, el original recibió muchas críticas por su período de «reflexión» de 30 segundos entre mensajes, su incapacidad para generar imágenes con una relación de aspecto de 1:1 y su filtrado de contenido demasiado agresivo.

Distancia desde OpenAI

El impulso de Microsoft para desarrollar sus propios modelos está impulsado por su deseo de reducir su dependencia de OpenAI, en el que ha invertido mucho a lo largo de los años. Hubo un tiempo en el que el fabricante de software de Windows dependía casi exclusivamente de los modelos OpenAI para sus productos y capacidades de IA. Pero parece que temía quedar «encerrada» en una empresa en crecimiento que ha mostrado un deseo de afirmar su independencia.

Ayer mismo, CNBC informó que había publicado un memorando interno de la nueva directora de ingresos de OpenAI, Denise Dresser, que decía a los empleados que la asociación de la compañía con Microsoft «también ha limitado nuestra capacidad para encontrarnos con las empresas donde están». El memorando afirma que la nueva asociación de OpenAI con la plataforma Bedrock de Amazon Web Services Inc. es un motor clave de crecimiento, y señala que desde que se anunció la asociación en febrero.

OpenAI también ha buscado diversificar su base de infraestructura en la nube con proveedores como CoreWeave Inc., Google LLC y Oracle Corp., a expensas de Microsoft. A su vez, Microsoft añadió OpenAI a su lista oficial de competidores en 2024.

Mientras tanto, Rebecca Wettemann, analista de Valoir, dijo a SiliconANGLE en enero que la dependencia de Microsoft de OpenAI se está convirtiendo en una preocupación clave para los inversores, ya que OpenAI enfrenta una competencia cada vez mayor de rivales como Google y Anthropic. «Los inversores están perdiendo la paciencia, principalmente porque la mayor parte de la recuperación potencial de Microsoft está ligada al dinero proveniente de OpenAI, lo cual es en su mayor parte hipotético en este momento», explicó.

Crear tus propios modelos para Microsoft puede resultar mucho más rentable. Los modelos MAI ahora son la opción predeterminada cuando alguien le pide a la herramienta Copilot de la compañía que genere una imagen que reemplace el modelo OpenAI DALL-E. Esto significa que Microsoft puede quedarse con todos los costos incurridos en lugar de pagar tarifas de licencia a OpenAI.

MAI-Image-2-Efficient también ayuda a acelerar la estrategia de IA agente de Microsoft. Con servicios como Copilot Cowork y Agent 365, Microsoft se está moviendo hacia un mundo donde la inteligencia artificial maneja tareas y flujos de trabajo complejos de múltiples niveles en nombre de los usuarios. Si se le pidiera a un agente autónomo que produjera materiales para una nueva campaña de marketing, sería esencial tener una latencia baja y mantener los costos bajos para que pudieran iterar a escala.

Microsoft dijo que MAI-Image-2-Efficient ahora está disponible a través de Microsoft Foundry y MAI Playground.

Imagen: Microsoft

Apoye nuestra misión de mantener el contenido abierto y gratuito trabajando con la comunidad CUBE. Únase a la red CUBE Alumni Trustdonde los líderes tecnológicos se conectan, comparten inteligencia y crean oportunidades.

  • Más de 15 millones de espectadores de vídeos CUBEimpulsar conversaciones sobre IA, la nube, ciberseguridad y más
  • Más de 11,4 mil graduados de theCUBE — Conéctese con más de 11,400 líderes empresariales y tecnológicos que están dando forma al futuro a través de una red única y confiable.

Acerca de SiliconANGLE Media

SiliconANGLE Media es un líder reconocido en innovación de medios digitales, que reúne tecnología avanzada, conocimientos estratégicos y participación de la audiencia en tiempo real. Como empresa matriz de SiliconANGLE, TheCUBE Network, TheCUBE Research, CUBE365, TheCUBE AI y CUBE SuperStudios con sede en Silicon Valley y la Bolsa de Nueva York, SiliconANGLE Media opera en la intersección de los medios, la tecnología y la inteligencia artificial.

Fundada por los visionarios tecnológicos John Furrier y Dave Vellante, SiliconANGLE Media ha creado un ecosistema dinámico de marcas de medios digitales líderes en la industria que llegan a más de 15 millones de profesionales tecnológicos de élite. Nuestra nueva nube de video patentada theCUBE AI está irrumpiendo en la interacción con la audiencia al aprovechar la red neuronal de CUBEai.com para ayudar a las empresas de tecnología a tomar decisiones basadas en datos y mantenerse a la vanguardia de las conversaciones de la industria.

Comentarios

Aún no hay comentarios. ¿Por qué no comienzas el debate?

    Deja una respuesta

    Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *