Comienza la era de la producción de vídeo con inteligencia artificial
La startup de inteligencia artificial detrás de Stable Diffusion está probando ahora su herramienta de IA generativa para vídeo. Es capaz de crear vídeos a partir de una imagen estática.
Hasta ahora habíamos visto modelos de inteligencia artificial que producían vídeo, pero Stability AI, la startup de IA detrás de Stable Diffusion, entra en este campo elevando considerablemente el listón de la calidad. El nuevo modelo Stable Video Diffusion, que se distingue de sus competidores por su calidad y realismo, permite a los usuarios crear vídeos a partir de una sola imagen.
LA INTELIGENCIA ARTIFICIAL TAMBIÉN PUEDE CREAR VÍDEOS
Tal y como informa Donanımhaber, Stable Video Diffusion llega en realidad en forma de dos modelos: SVD y SVD-XT. El primero, SVD, convierte imágenes estáticas en vídeos de 576×1024 píxeles con 14 fotogramas. SVD-XT utiliza la misma arquitectura, pero aumenta el número de fotogramas a 24. Ambos pueden generar vídeos a una velocidad de entre tres y 30 fotogramas por segundo. Estos resultados parecen estar a la par o incluso superar en calidad a los obtenidos por el último modelo de creación de vídeo de Meta, así como a los de Google y las startups de IA Runway y Pika Labs.

A pesar de estos avances, Stable Video Diffusion solo está disponible actualmente para fines de investigación, no para aplicaciones comerciales o del mundo real. Stability AI señala que los usuarios potenciales pueden inscribirse en una lista de espera para obtener acceso, y la herramienta podría utilizarse en aplicaciones potenciales en sectores como la publicidad, la educación, el entretenimiento y muchos otros.
AÚN HAY DEFICIENCIAS
Los ejemplos mostrados en el vídeo publicado parecen ser de una calidad relativamente alta y estar a la altura de los sistemas generativos de la competencia. Sin embargo, según la empresa, existen algunas deficiencias: produce vídeos relativamente cortos (menos de 4 segundos), carece de un fotorrealismo perfecto, no puede realizar movimientos de cámara más allá de desplazamientos lentos, no tiene control de texto, no puede generar texto legible y puede tener dificultades para generar personas y rostros correctamente.
En cuanto al entrenamiento, Stability AI afirma que la herramienta fue entrenada sobre un conjunto de datos compuesto por millones de vídeos y, posteriormente, pasó por un ajuste fino utilizando un conjunto de datos más pequeño de entre varios cientos de miles y un millón de vídeos. Stability AI subraya que solo utilizó vídeos disponibles públicamente para fines de investigación.
Al igual que las herramientas de IA de texto a imagen han evolucionado rápidamente hasta alcanzar niveles fotorrealistas, las IA generadoras de vídeo pronto podrán producir contenidos mucho más realistas. Todo esto conlleva riesgos de deepfake, derechos de autor y diversos usos indebidos. Por lo tanto, es esencial que los desarrollos se realicen dentro de ciertas limitaciones.
Fuente de la noticia: 12punto
Noticias relacionadas
Mas leidos
Serdal Adalı presenta una denuncia contra la prensa
¡A tal cabeza, tal corte de pelo!
Una votación triste
El Fenerbahçe organizará una ceremonia de firma para Romelu Lukaku
Evaluación jurídica sobre la 'Ley Marco'
Cargando nueva infraestructura 3- Centros de datos y el orden mundial
La encuesta del YENİ Parti sacude el panorama
Sale a la luz la declaración de la sospechosa que quemó la bandera en Muğla
El líder de los Süleymancılar, Alihan Kuriş, bajo custodia
El precio más bajo en vehículos sin ÖTV es de 783 mil liras turcas: Aquí está la lista