Atlas de World Labs genera vistas 3D inéditas desde fotos y ya sirve para entrenar robots

World Labs presenta Atlas, un modelo multimodal entrenado desde cero que combina texto, imágenes, mapas de profundidad y vídeo para reconstruir escenas 3D coherentes.

03 de septiembre de 2026 a las 10:16h
Atlas de World Labs genera vistas 3D inéditas desde fotos y ya sirve para entrenar robots
Atlas de World Labs genera vistas 3D inéditas desde fotos y ya sirve para entrenar robots

Añadir Mangas Verdes como fuente preferida de Google de forma gratuita.

Mantente informado con las últimas noticias de actualidad.

Activar ahora

La apuesta de World Labs parte de una idea incómoda para buena parte de la inteligencia artificial actual. Fei-Fei Li, impulsora del proyecto, lo resumió con una frase que obliga a mirar fuera de la pantalla y volver al mundo físico.

"No hay lenguaje ahí fuera. No sales a la naturaleza y ves palabras escritas en el cielo para ti". - Fei-Fei Li, impulsora del proyecto Atlas en World Labs

Atlas nace justo en ese punto. World Labs lo ha presentado como un modelo multimodal entrenado desde cero para trabajar con texto, imágenes, posiciones de cámara, mapas de profundidad y secuencias de vídeo.

Atlas intenta ver lo que falta en una escena

Su nombre técnico ya dice mucho del desafío, porque se trata de un transformador de difusión autorregresiva multimodal. Dicho de forma menos áspera, predice qué debería verse a continuación desde una posición concreta del espacio.

Eso le permite hacer algo que resulta fácil de imaginar y difícil de construir. A partir de imágenes tomadas con un teléfono inteligente, Atlas genera perspectivas que nunca fueron grabadas y las mantiene coherentes con los datos reales del espacio tridimensional.

Cuantas más imágenes recibe, menos tiene que imaginar.

Esa es la fórmula con la que World Labs explica el comportamiento del sistema. También marca una frontera interesante con otros modelos multimodales y con modelos multimodales de IA que ya combinan varios tipos de entrada, pero no siempre trabajan el espacio como una realidad consistente.

El objetivo no acaba en la imagen y llega hasta los robots

Después aparece la parte menos vistosa y quizá más práctica. La tecnología incorpora un proceso de real a simulación que convierte espacios reales en entornos virtuales para entrenar robots antes de llevarlos al mundo físico.

Ahí la promesa ya no consiste solo en generar vistas nuevas, sino en dar a una máquina un lugar donde aprender sin tocar todavía el lugar verdadero. Es una idea que conecta con enseñar 3D a las máquinas y con una ambición más amplia que la simple creación visual.

Runway también desarrolla un modelo parecido, GWM-1.

La estrategia de World Labs se mueve precisamente en ese terreno más amplio. La compañía quiere construir modelos capaces de percibir, generar, razonar e interactuar con mundos virtuales y físicos.

Por ahora, sin embargo, Atlas no es un producto completo y solo está disponible con acceso anticipado para socios seleccionados.

Sobre el autor
Redacción
Ver biografía