La inteligencia artificial de Google comienza a interpretar imágenes
Google continúa mejorando su experiencia de búsqueda basada en inteligencia artificial. El chatbot centrado en la búsqueda de la compañía, al que denomina Modo IA, ahora puede interactuar no solo con textos, sino también con imágenes. Gracias a esta nueva función, los usuarios pueden hacer preguntas sobre las imágenes y recibir respuestas detalladas. Google ha puesto esta actualización a disposición de millones de usuarios en las plataformas Android e iOS a través de la aplicación de Google.
12punto
La actualización se basa en la combinación de una versión especial del modelo de inteligencia artificial Gemini y la tecnología de Google Lens. Los usuarios pueden hacer preguntas sobre el contenido a la IA tomando una foto o cargando una imagen desde sus dispositivos. El sistema no solo reconoce los objetos en la imagen, sino que también evalúa el contexto de dichos objetos. De esta manera, los usuarios no solo obtienen información sobre los objetos presentes en la imagen, sino que también adquieren conocimientos profundos sobre las relaciones que los rodean y el significado general de la imagen.
Robby Stein, director de producto de Google Search, describe esta actualización como una etapa más avanzada de los esfuerzos previos de búsqueda visual. La inteligencia artificial ahora comprende toda la escena al leer elementos como la forma, el color, el material y la disposición. Cada objeto en la imagen se trata no solo como una entidad independiente, sino como un todo relacionado con otros elementos. Esta característica permite que el Modo IA ofrezca a los usuarios respuestas más naturales y significativas.
Al analizar imágenes, la inteligencia artificial utiliza un enfoque llamado 'fan-out'. Con este método, se generan múltiples consultas paralelas para cada objeto en la imagen. Esto permite ofrecer una respuesta estratificada y coherente en términos de contexto sobre todos los detalles de la imagen. Por ejemplo, al examinar la fotografía de una estantería, el sistema puede reconocer los libros, sugerir contenidos similares y ofrecer recomendaciones de lectura.
Esta innovación no se limita solo al reconocimiento visual; también interactúa con los usuarios y responde a sus preguntas. Cuando el usuario solicita más información sobre la imagen, el sistema puede generar consultas adicionales y ofrecer nuevas sugerencias. Esta característica convierte al Modo IA de ser una herramienta de análisis estático a un asistente dinámico. Cada imagen se convierte en un punto de partida para acceder a información dentro del sistema.
Google presentó el Modo IA por primera vez el mes pasado con acceso limitado a los suscriptores de Google One AI Premium. Sin embargo, con esta actualización, la función ya no es exclusiva para suscriptores de pago. La compañía anunció que ha brindado acceso a millones de usuarios dentro del programa Labs. Esto significa que más personas podrán beneficiarse de la experiencia de búsqueda visual avanzada.