Martes del Mañana – Setiembre 2026 (Edición #8)

Imagen creada con GPT Image 2
La semana pasada hablamos de máquinas que generan contenido más rápido de lo que podemos mirarlo. Esta semana nos metemos adentro del contenido.
Bienvenidos a otra edición de Martes del Mañana, donde cubrimos la revolución que atraviesa el cine, los juegos, la música y las industrias creativas.
Una newsletter de SOUTS, donde exploramos qué pasa cuando la inteligencia artificial deja de ser solamente una herramienta y empieza a cambiar cómo creamos y consumimos historias.
¿Qué carajo es AGI?

Estoy cansado jefe

Esta semana salió GPT-6 Astra, el nuevo modelo de OpenAI. El marketing fue de “ya llegó la AGI”. Lo dijo Jensen Huang, el CEO de NVIDIA, lo dijo Greg Brockman, lo dijo algún otro en Twitter.
AGI significa inteligencia artificial general. Es el gran objetivo de varios laboratorios de IA. El problema es que estos laboratorios no se deciden cuál es su definición de AGI. OpenAI habla de sistemas muy autónomos que superan a los humanos en la mayoría del trabajo económicamente valioso. Esta definición trae bastante problemas, por ejemplo cómo medimos eso? quién decide cuándo se cumplió? Ahí empieza la discusión, es un arco que se mueve como convenga para cada uno.
El gato de Cheshire le dice a Alicia “si no sabés adónde querés ir no importa qué camino tomes”. Sam Altman y OpenAI usan una versión parecida “si no sabés definir cuándo llegaste, podés decir que ya estás ahí”.
A todo esto, Anthropic presentó Claude Fable 5.1 y Mythos 5.1 y Google presentó Gemini 3.8 Flash.
Ya estamos un poco aburridos de toda esta calesita. Todos sacan un modelo que es más potente que cualquier modelo anterior. Dicen que va a revolucionar el mundo. Tienen avances en alguna rama muy sorprendente, por ejemplo diseñan proteínas o encuentran pruebas matemáticas, todos sufrimos de FOMO.
Después, cuando nos toca usarlo nos damos cuenta de que modelos mucho más chicos ya satisfacían nuestras necesidades. De repente no necesitás Fable porque con Opus o Sonnet basta. Mientras tanto nos vamos desgastando y sintiendo que nos quedamos afuera.
Capaz que podemos dejar pasar un lanzamiento sin que nos genere ansiedad. Si llega la AGI nos enteraremos.
¿La interfaz del futuro es video generativo?

Demo de Solaris compartido por Runway
Desde que se creó el internet el paradigma es que alguien genera una experiencia para el usuario: una web, una aplicación, una interfaz. El usuario tiene que aprender dónde está cada botón, qué se puede hacer y qué no, las mañas.
Esta semana Runway presentó Solaris, una investigación que plantea un cambio de paradigma: que la interfaz se genere mientras la usamos.
Runway lo llama un Interface World Model. La idea es que genera la interfaz visual cuadro a cuadro y responde a nuestras acciones en tiempo real. No necesita convertir primero ese diseño en el código de una página para producir la interacción.
Pensemos en aprender a usar una herramienta. Hoy mirás un tutorial, pausás, buscás dónde está el botón y volvés al video. Una interfaz generativa podría ir mostrando lo que necesitamos a medida que avanzamos y adaptarse cuando hacemos algo distinto de lo esperado.
Todavía hay una distancia entre esa visión y lo que funciona. Solaris tiene problemas con el texto legible, la coherencia durante sesiones largas y la integración con otros sistemas.
Al final del día, el video empieza a aparecer como candidato a interfaz universal. Solo que una nueva iteración del video.
Imaginemos por ejemplo que podes generar un video muy rápido. Ahora agarrás el frame final, lo segmentás en sus componentes y armas un sistema donde podés hacer click en estos componentes para generar nuevo video. Pasas a tener un juego point and click infinito. Básicamente lo que hicieron en Diivergence.
Falta para que esto sea algo generalizado, pero empieza a asomar una visión sobre cuál va a ser la computadora de nuestros hijos.
¿O la interfaz del futuro es 3D?

WorldLabs Atlas
Otra posibilidad es que para interactuar con el contenido nos metamos adentro. Que podamos recorrer un espacio, tocar cosas, moverlas y que todo responda como si estuviera pasando en la realidad.
Ya hemos hablado de los World Models, pero esta semana hubo varios avances que van acercando esa idea.
World Labs presentó Atlas, un modelo que trabaja con texto, imágenes, video y 3D. Podemos darle imágenes de un lugar y generar nuevas vistas definiendo dónde está la cámara y hacia dónde mira. El modelo completa lo que no vio e incluso puede producir representaciones 3D del espacio.
Pensemos en la imagen de una casa. Normalmente podemos mirarla. Con estas herramientas empezamos a poder acercarnos, mirar por un costado y descubrir qué hay atrás. Obviamente, si no le mostramos qué había atrás, se lo inventa. Pero para construir un mundo ficticio eso es parte de la gracia.
Runway mostró GWM Worlds 2, donde además podemos intervenir sobre lo que pasa. Genera video y audio en tiempo real mientras nos movemos, controlamos personajes o cambiamos el entorno.
Podemos actuar como jugador y como un dios al mismo tiempo. Caminar por el desierto con un personaje y decidir que ahora llueva. O que alguien aparezca y nos hable. Ya no estamos solamente eligiendo hacia dónde mirar, también estamos cambiando lo que sucede.
Lucida de ByteDance trabaja sobre otra pieza: reconstruir interiores con objetos separados y editables. Porque una cosa es poder ver una silla desde cualquier ángulo y otra es tener esa silla como un objeto que podemos modificar dentro de una escena.
Y ni que hablar de las habilidades de GPT-6 Astra usando Blender. Puede modelar, riggear, hasta tiene buen gusto. Ya hacer cosas en 3D es viable hasta para los que no sabemos sobre 3D.
Si bien todas estas herramientas parecen tener un uso muy parecido, lo que está pasando por el fondo es bastante distinto. Recorrer un mundo generado en video no significa que exista un modelo 3D editable. GWM Worlds 2, Atlas y Lucida resuelven partes distintas de esta idea. El término "World Model" al final tiene el mismo problema que AGI.
Igual estos anuncios nos permiten imaginar algo interesante. Hoy alguien crea una locación para una película, filma lo que sucede y nosotros vemos los planos que eligió. Pero ¿qué pasa si queremos explorar ese mundo, quedarnos con otro personaje o intervenir en lo que sucede?
Ese es el espacio entre el cine y los videojuegos que venimos explorando en SOUTS. Todavía falta resolver cómo se cuenta una buena historia ahí. Poder hacer que llueva es espectacular, pero alguien tiene que lograr que nos importe mojarnos.
Esto fue Martes del Mañana, la newsletter semanal. Si querés suscribirte, suscribite!
En SOUTS intentamos estar siempre al tanto de lo que pasa y cada vez que haya algo relevante se los vamos a traer en esta newsletter.
Nos vemos el próximo Martes del Mañana.
Yves

