
OpenAI ha presentado Sora 2, un modelo insignia de generación de vídeo y audio que busca un realismo físico mucho mayor, consistencia multitoma y un control preciso. Se lanza junto con una nueva app social para iOS basada en “cameos” de tu propia imagen.
OpenAI presenta Sora 2 como un salto desde las primeras demostraciones de “funciona” hacia un sistema que simula mejor la causa y el efecto. El modelo está diseñado para modelar estados de fallo y obedecer más a la física cotidiana que esperan los cineastas, a la vez que añade diálogos sincronizados y un diseño de sonido que puede seguir las indicaciones con mayor precisión.
Novedades del modelo Sora 2
OpenAI afirma que Sora 2 gestiona escenarios que antes no funcionaban con los generadores de vídeo, como la gimnasia olímpica y las volteretas hacia atrás en una tabla de paddle surf, que respetan la flotabilidad y la rigidez. Mientras que los modelos anteriores teletransportaban un balón de baloncesto fallado al aro, Sora 2 lo deja salir del aro o rebotar en el tablero, un ejemplo de cómo el sistema modela los resultados en lugar de forzar el éxito. La compañía lo posiciona como un paso hacia un simulador de mundos de propósito general.
Controlabilidad y consistencia en múltiples tomas
Las indicaciones ahora pueden abarcar múltiples tomas, manteniendo el estado de la escena, la continuidad de los personajes y el bloqueo. OpenAI destaca un mejor seguimiento de instrucciones en estilos realistas, cinematográficos y anime. Para el uso en producción, esto significa menos interrupciones de continuidad al evolucionar una escena y mayor fiabilidad al iterar la cobertura.
Audio nativo: diálogos y efectos de sonido
Sora 2 puede generar paisajes sonoros de fondo, diálogos y efectos sincronizados con las imágenes, todo dentro de un único sistema programable. Para previsualizaciones rápidas, animaciones o piezas sociales, esto reduce los viajes a herramientas de audio independientes.
Cameos: Inyecta imagen y voz del mundo real
Una nueva e importante función permite a los usuarios “subirse” a sí mismos. Tras una breve captura, el modelo puede insertar la apariencia y la voz de una persona en las escenas generadas con notable fidelidad. OpenAI afirma que esto se aplica a cualquier humano, animal u objeto. El control permanece en manos del propietario del cameo, quien puede revocar el acceso y eliminar los vídeos que incluyan su imagen.
La app Sora: Redes sociales para vídeos de IA
Además del modelo, OpenAI lanza una app para iOS basada en invitaciones llamada “Sora”, disponible solo para EE. UU. y Canadá en su lanzamiento. El feed está orientado a las personas que sigues y a las creaciones que probablemente inspiren tus propios vídeos. OpenAI afirma que prioriza un diseño no adictivo, controles de personalización opcionales, comprobaciones de bienestar y controles parentales que pueden limitar el desplazamiento y gestionar los mensajes directos para adolescentes. La compañía afirma que la monetización se limitará inicialmente al pago de generaciones adicionales cuando el cómputo sea limitado.

Disponibilidad y acceso
La app de Sora para iOS se lanza primero en Estados Unidos y Canadá, con expansión prevista. El acceso se realiza mediante registro dentro de la app. Tras recibir una invitación, los usuarios también pueden acceder a Sora 2 a través de sora.com. Sora 2 será gratuito inicialmente con generosos límites, sujetos a la disponibilidad de recursos. Los usuarios de ChatGPT Pro tendrán acceso a una versión experimental de “Sora 2 Pro” de mayor calidad en ChatGPT, con soporte próximamente para la app de Sora y un lanzamiento de API previsto. La versión anterior de Sora 1 Turbo sigue disponible, y las creaciones anteriores permanecen en las bibliotecas de los usuarios.
Continúan las cuestiones de seguridad
OpenAI describe controles de consentimiento para cameos, medidas de procedencia, pilas de seguridad automatizadas y moderación humana a escala, con valores predeterminados más estrictos para las cuentas de adolescentes. La compañía ha publicado documentos adicionales de seguridad y diseño de feeds para detallar las medidas de seguridad y su filosofía.
Aún queda por ver cómo se asegurarán de que solo uses tu propia imagen para los cameos. Suponemos que necesitarás demostrar tu identidad de alguna manera con una identificación con foto. Si no se hace correctamente, esto podría ser problemático con el aumento de videos de noticias falsas que se hacen pasar por reales.
Lo que Sora 2 podría hacer por los cineastas
Para la previsualización y la pitchvis, la atención de Sora 2 a la física básica y la continuidad podría reducir el tiempo necesario para iterar el bloqueo, la lente y los ritmos de las acrobacias. La capa de audio nativa permite crear piezas de tono rápidas sin herramientas adicionales. Los cameos podrían ayudar a los directores a preparar las actuaciones con sus colaboradores para el tiempo y las líneas de visión, y luego cambiar a los actores a medida que evolucionan los proyectos.
Para los efectos visuales y la posproducción, las afirmaciones de realismo son prometedoras, pero la industria aún deberá probar cómo se mantiene el modelo en la unión, la coherencia del movimiento en tomas largas (si es que se pueden hacer largas) y casos extremos como oclusiones complejas, interacciones con el agua y una articulación manual de grano fino.
Como ocurre con todo el vídeo generativo, las licencias, los créditos y la procedencia siguen siendo aspectos esenciales en el trabajo profesional. Sin embargo, OpenAI solía entrenar sus modelos con cualquier contenido online que tuviera a su alcance, por lo que todo esto sigue siendo cuestionable.
¿Se integrarán estas herramientas significativamente en tu flujo de trabajo de previsualización o conceptualización este año, o te preocupa el estado de la IA para vídeo generativo? Cuéntanoslo en los comentarios.




































