Google trabaja arduamente para optimizar su IA Gemini. En los últimos meses se ha enfocado en mejorar la creación de imágenes. La mejora más reciente en cuanto a crear imágenes con Google Gemini es la posibilidad de redimensionar el tamaño de estas a gusto del usuario.
Esto Google lo está haciendo realidad en su nuevo modelo de generación de imágenes llamado Imagen 3 debido a que, en principio, este solo era capaz de crear imágenes en formato cuadrado. Una limitación que alejaba mucho a Imagen 3 en la carrera contra las plataformas líderes en la generación de imágenes con IA como DALL-E, Midjourney o Adobe Firefly. Estas son más flexibles y permiten ajustar el aspecto, el tipo de acabado o el estilo visual de las imágenes que se generan.
Por las críticas que recibió Imagen 3, Google detuvo su lanzamiento global para aplicarle algunas mejoras como la de poder ajustar diversos parámetros de las imágenes generadas por la IA. La idea es que las imágenes que vaya creando Imagen 3 se puedan utilizar en diferentes formatos como pantallas más anchas u otras proporciones más específicas como las que se usan en las diferentes redes sociales.
Redimensionar imágenes en Google Gemini
Esta mejora que Google está introduciendo en Imagen 3 también van a llegar a Gemini. Pronto vamos a poder cambiar el tamaño y la proporción de las imágenes generadas y la prueba de ello está incluida en la versión beta de la aplicación. En concreto, la versión 15.41.34.29.arm64 evidencia ajustes en cuanto a la modificación del aspecto de las imágenes. Los formatos disponibles son 16:9, el cual es perfecto para pantallas más anchas, y 4:3 o 3:4 para diferentes usos.
La actualización también incluye el uso de la IA para rellenar los espacios vacíos cuando se modifica la proporción de una imagen. Al ampliar el lienzo de una imagen cuadrada a una proporción más amplia, como 4:3, la IA genera contenido adicional para completar la escena. Es algo así como un relleno generativo, similar al que utiliza Adobe en su herramienta Firefly de Photoshop.
Google Gemini va a permitir, además, añadir elementos a las imágenes y mejorarlas según se vayan describiendo nuevos detalles a través de los prompts.
Gemini ahora disponible en español
Gemini Live actúa como un asistente personal de IA, capaz de ayudar con tareas diarias, responder preguntas o generar ideas. Este asistente ya interactúa con diferentes aplicaciones como Gmail, Maps, YouTube, Calendario, Tareas y Keep. Pronto podremos realizar diversas tareas e interactuar con estas apps por medio de la IA en nuestra propia lengua.
En el evento Made by Google la compañía anunció que Gemini Live, la versión conversacional de su IA, ya está disponible en español de España, junto a 40 idiomas más. Las funciones que podremos realizar en español serán buscar información en Gmail, añadir recordatorios en las listas de tareas de Keep o planificar eventos o citas a través del calendario de Google. También podremos configurar la IA en dos idiomas en simultáneo.