Genie 3: la IA que te permite generar mundos fotorrealistas y moverte por ellos como si fuera un videojuego
Google DeepMind anunció el lanzamiento de otra IA disruptiva en el mundo actual, hablamos de Genie 3. Estamos ante un modelo mundial de IA (world model) capaz de generar entornos interactivos 3D en tiempo real a partir de un texto descriptivo.
Es decir, que ahora no solo podrás crear un vídeo de IA, sino que podrás moverte dentro de él en tiempo real. Básicamente, es una versión mejorada del Genie 2. El cual ya se postulaba como el futuro del gaming. Donde cada usuario podrá crear su propio juego únicamente escribiendo qué es lo que quiere.
En esta nueva versión hay grandes novedades, y es que se puede generar una simulación de varios minutos, todo ello a una resolución de 720p a 24 FPS. Además, se indica que la consistencia visual del entorno interactivo tiene una memoria visual de hasta 1 minuto, todo ello aderezado de una interacción en tiempo real donde podrás moverte en cualquier dirección, y todo ello modificable permitiendo eventos dinámicos vía prompt.
Estas son las funciones destacadas de Genie 3
Para empezar, lo impresionante de Genie 3 es poder interactuar en tiempo real con el mundo que has creado. Y es que el mundo responde a tus movimientos e inputs como en un videojuego: te mueves y el entorno reacciona al instante. Durante esta simulación puedes añadir eventos modificables por prompt. Es decir, que mientras estas “jugando” puedes introducir comandos para que empiece a llover, que haya una lluvia de meteoritos o aparezcan más personajes o elementos en pantalla. Quizás lo más impresionante, es que incluso se interactúa con físicas. A continuación puedes ver como al golpear una lámpara esta tiene físicas, y no simplemente la atraviesa.
Evidentemente, para que Genie 3 resulte en una experiencia disruptiva, se adereza de escenarios hiperrealistas o de fantasía. Puedes generar paisajes volcánicos, océanos, festivales, entornos históricos o completamente imaginarios. Actualmente, existen limitaciones, pero poco importan. Entre ellas, está en que no es capaz de replicar ubicaciones reales con precisión geográfica (texto o señalización debe ser proporcionado inicialmente para aparecer legible). Además de una duración máxima limitada, diseñada para interacciones de minutos, no horas continuas. Imagina que pudiera funcionar durante horas. Implicaría poder crear en tiempo real el juego de tus sueños y que este vaya evolucionando en base a los prompts que añadas día a día.
Por ahora está únicamente disponible para desarrolladores
Genie 3 representa un salto clave en la investigación de “world models” y en el entrenamiento de agentes incorporados (embodied agents), impulsando el avance hacia la inteligencia artificial general (AGI). También como punto negativo, es que Genie 3 únicamente sólo está disponible en forma de vista previa de investigación limitada. Por lo que únicamente es accesible para un grupo reducido de académicos y creadores, mientras Google evalúa los riesgos y su futura apertura al usuario en general.
Genie 3 se posiciona así como una de las innovaciones más avanzadas en simulación generativa y realidad interactiva. Con sus capacidades en tiempo real, consistencia visual extendida y acciones modificables por prompts, abre nuevas posibilidades para entretenimiento, educación y el entrenamiento de agentes inteligentes. Aunque todavía está muy limitado en cuanto a disponibilidad y alcance, marca un importante paso hacia mundos generativos inmersivos y entornos modélicos para la IA del futuro.
Fuente: elchapuzasinformatico.









