¡Se añadió la función de comprensión de grabaciones de audio a Google Gemini!

Se ha añadido a la plataforma de inteligencia artificial Gemini de Google la capacidad de escuchar y comprender grabaciones de audio. Con esta nueva función, será posible realizar fácilmente tareas como la transcripción o el resumen de grabaciones de voz.

12punto

Google ha añadido a su plataforma de inteligencia artificial Gemini la capacidad de escuchar y comprender grabaciones de audio. Esta nueva función podrá utilizarse para tareas de transcripción de grabaciones de voz a texto o para realizar resúmenes. Con esta novedad incorporada a la herramienta de inteligencia artificial Gemini, desarrollada por la empresa tecnológica con sede en EE. UU., los archivos de audio ahora pueden ser escuchados y analizados.

Según la noticia publicada en Webtekno, esta nueva función de Gemini aún no está disponible para el público general. La característica puede probarse dentro del plan Gemini 1.5 Pro, que se encuentra en fase de pruebas. Los usuarios pueden hacer que Gemini escuche archivos de audio cargados desde fuentes externas y recibir asistencia para obtener los resultados deseados. Google Gemini tiene la capacidad de comprender los audios que escucha y procesarlos según las solicitudes de los usuarios. Funciones como la transcripción o el resumen de archivos de audio formarán parte de las capacidades de Google Gemini.

El uso de Gemini 1.5 Pro actualmente solo es posible a través de las plataformas de desarrollo Vertex AI o AI Studio de Google. Por el momento, no existe información clara sobre si esta nueva función permanecerá exclusiva para estas plataformas o si se lanzará para el uso general.