Google ha lanzado un nuevo modelo de inteligencia artificial que puede transformar cualquier tipo de contenido (texto, imagen, audio, vídeo) en cualquier otro formato de salida, según ha anunciado la compañía el 23 de mayo de 2026. El modelo, denominado anything-to-anything, representa un avance significativo en la versatilidad de los sistemas de IA, al unificar capacidades que hasta ahora requerían modelos separados.
El sistema permite, por ejemplo, generar un vídeo a partir de una descripción textual, convertir un audio en un guion escrito, o transformar una imagen en una narración hablada. Esta funcionalidad amplía las aplicaciones potenciales de la IA en áreas como la creación de contenido multimedia, la accesibilidad y la automatización de flujos de trabajo.
El anuncio de Google subraya la creciente competencia en el campo de la IA frontera, donde empresas como OpenAI, Microsoft y Anthropic también desarrollan modelos multimodales. Sin embargo, el enfoque «anything-to-anything» de Google destaca por su capacidad de procesar y generar en cualquier dirección, lo que reduce la necesidad de múltiples herramientas especializadas.
La compañía no ha detallado las especificaciones técnicas del modelo ni su fecha de disponibilidad pública, pero ha señalado que el sistema se basa en su arquitectura Gemini, optimizada para manejar múltiples tipos de datos de forma nativa. Analistas del sector señalan que este tipo de modelos podría requerir una capacidad computacional elevada, lo que plantea interrogantes sobre la soberanía de los datos y el acceso a la infraestructura necesaria.
Por el momento, Google no ha confirmado si el modelo estará disponible a través de sus servicios en la nube o si se comercializará como producto independiente. La compañía prevé ofrecer más detalles en las próximas semanas, según fuentes internas citadas por el comunicado oficial.




