> ## Content Index
> Fetch the complete content index at: https://www.digitalbrain.news/llms.txt
> Use this file to discover other available public pages before exploring further.

# Runway genera interfaces como vídeo, sin código debajo
- URL: https://www.digitalbrain.news/noticias/runway-solaris-interfaces-video-sin-codigo/
- Published: 2026-09-01T14:39:16.000Z
- Updated: 2026-09-02T07:42:48.000Z
- Description: Runway presentó el 31 de agosto Solaris, el primer modelo de una familia que la empresa llama Interface World Models. Genera la pantalla de una web o una…
- Author: Ramón Pérez Coronado
- Tags: #noticias, runway, modelos-de-mundo, generacion-video, video-ia

[Runway](https://www.digitalbrain.news/glosario/#runway) presentó el 31 de agosto [Solaris](https://runway.com/news/research/introducing-solaris?ref=digitalbrain.news), el primer modelo de una familia que la empresa llama Interface World Models. Genera la pantalla de una web o una app fotograma a fotograma, a 720p, mientras el usuario hace clic y arrastra. Debajo no corre HTML, ni CSS, ni JavaScript. En un estudio de la propia Runway con 250 evaluadores y cerca de 7.500 comparaciones por pares, las interfaces de Solaris ganaron a las mismas interfaces programadas con [Claude](https://www.digitalbrain.news/guias/que-es-claude-ia/) Opus 5 en el 71% de los casos al juzgar si la pantalla se comportaba de forma natural, y en el 61% al juzgar si obedecía la instrucción.

## Puntos clave

- Solaris se apoya en Gen-4.5, el modelo de vídeo de Runway, adaptado para responder a la interacción en tiempo real dentro de su línea de modelos del mundo (GWM-1).
- Un modelo de lenguaje lee cada clic o arrastre, decide qué debería ocurrir y le pide al modelo de vídeo los siguientes fotogramas. La salida es un flujo continuo a 720p.
- En el estudio de preferencia con 250 participantes y 30 ejemplos de interacción: 61% para Solaris en seguimiento de instrucciones frente al 24% de la versión programada, y 71% frente al 21% en comportamiento natural.
- Runway admite cuatro problemas abiertos: texto legible, fiabilidad, coherencia en sesiones largas y accesibilidad.
- Acceso anticipado por solicitud. No hay fecha de lanzamiento público ni precio.

## Cómo funciona por dentro

El software de siempre define cada pantalla antes de que nadie la vea. Un desarrollador escribe el código, el navegador lo convierte en botones y menús, y el estado de la aplicación vive en variables. Solaris se salta esa capa intermedia entera y dibuja la pantalla directamente.

Runway lo resuelve con tres piezas. La generación de fotogramas es autorregresiva, es decir, cada imagen se calcula a partir de las anteriores y de lo que el usuario acaba de hacer. El proceso de denoising, que en un modelo de vídeo normal se come decenas de pasos, está destilado a unos pocos para que dé tiempo real. Y el modelo se entrena con sus propias salidas para no irse desviando conforme la sesión se alarga, que es el defecto clásico de generar imagen encima de imagen.

Por encima va un modelo de lenguaje que hace de cerebro. Recibe el clic, razona qué tendría que ocurrir a continuación y escribe el [prompt](https://www.digitalbrain.news/guias/que-es-un-prompt/) que alimenta el siguiente lote de fotogramas. La empresa lo resume en una frase: al eliminar la representación intermedia, se conserva el estado visual completo.

## Qué han enseñado y qué han medido

Las demostraciones van por el lado táctil. Una tienda de ropa donde arrastras una camiseta del perchero sobre una foto y se queda puesta. Una radiografía de una mano que puedes mover y que responde según el ángulo. Una ensalada que se construye soltando ingredientes dentro del bol. También una combustión interactiva, un faro con la cámara girando, una cocina y herramientas de transferencia de estilo sobre un cuadro.

Runway acompaña las demos con dos estudios. El primero mide fidelidad de reconstrucción sobre 30 interfaces de distinta complejidad, desde páginas planas hasta escenas naturales, comparando contra Fable 5, GPT-4o y [Gemini](https://www.digitalbrain.news/guias/que-es-gemini/) 2.5 Pro con métricas de similitud estructural (SSIM) y rasgos DINOv3\. La conclusión que sale de ahí la publican sin maquillar: cuanta más complejidad visual tiene la pantalla, más información se pierde por el camino.

El segundo es el estudio de preferencia, del que salen el 61% y el 71%. Conviene leer bien contra qué compiten esas cifras: contra interfaces escritas en código por Opus 5 a partir de la misma instrucción, y en interacciones cortas donde lo que juzga el evaluador es si la pantalla resulta creíble mientras la toca.

## Lo que Runway admite que todavía no funciona

Esta parte del anuncio es la más útil para cualquiera que esté pensando en meter algo así en un producto.

El texto legible sigue siendo, en palabras de Runway, uno de los problemas más difíciles. Un modelo de vídeo dibuja letras que parecen letras, y en una interfaz eso no basta. Para vistas cargadas de texto la empresa apunta a un enfoque híbrido, pausando la generación para que un modelo de imagen renderice esa parte.

La segunda es la fiabilidad, y la frase que usan resume el problema de la industria entera: una respuesta convincente y equivocada es peor que ninguna respuesta. Hoy el sistema se ancla a los fotogramas de partida que se le dan, para no inventarse lo que muestra.

La tercera es la coherencia en sesiones largas, que sigue como investigación abierta. Y la cuarta, la accesibilidad: la integración con lectores de pantalla y con las APIs de accesibilidad está sin hacer. Una interfaz que solo existe como píxeles es, hoy por hoy, una interfaz que un lector de pantalla no sabe leer.

## Por qué importa a quien monta producto

Lo que cambia aquí es el cálculo de cuánto cuesta montar y mantener una interfaz. Llevamos treinta años definiendo cada pantalla de antemano, y si esto llega a funcionar en producción, esa parte del trabajo se deja de hacer a mano en las pantallas exploratorias: demos comerciales, configuradores de producto, catálogos donde el usuario prueba cosas antes de decidir.

Ahora el otro lado. Cualquiera que haya mantenido un panel interno sabe dónde está el trabajo de verdad, y no es que la pantalla salga bonita el primer día. Es que el botón haga exactamente lo mismo en el clic 200 que en el clic 1, que el estado se guarde, que se pueda recuperar después de un error y que el dato que se ve sea el dato que hay en la base de datos. Un pedido, una factura o un stock no admiten una pantalla convincente y equivocada. Ahí Solaris, a día de hoy, no compite.

Para una empresa española que ya usa IA en sus procesos, la lectura de hoy es de calendario. Está en acceso anticipado por solicitud, sin precio y sin fecha. Lo que sí conviene mirar es la dirección: la velocidad y el coste de los modelos de vídeo están bajando lo bastante rápido como para que ideas que hace un año no salían a cuenta empiecen a salir. Runway no va sola en esa curva. Google acaba de meter [vídeo de hasta 40 segundos en Gemini Omni 1.1 Flash](https://www.digitalbrain.news/noticias/google-gemini-omni-1-1-flash-video-40-segundos/), y el mismo día que salió Solaris, [Clipto levantaba 15 millones a una valoración de 250](https://www.digitalbrain.news/noticias/clipto-250-millones-busqueda-video-ia/) por buscar dentro del vídeo con IA.

Fuente original: [runway.com](https://runway.com/news/research/introducing-solaris?ref=digitalbrain.news)

---

**Relacionado**

[![Runway lanza Dev, una sola API para vídeo, imagen, audio y avatares en tiempo real](https://storage.ghost.io/c/6d/e3/6de31f63-d0a8-45df-9c6a-481016520347/content/images/size/w300/format/webp/2026/07/runway-dev-api-video-imagen-audio-avatares.jpg)Runway lanza Dev, una sola API para vídeo, imagen, audio y avatares en tiempo real](https://www.digitalbrain.news/noticias/runway-dev-api-video-imagen-audio-avatares/)[![Photon-1 aprende a manejar un ordenador viendo vídeo y con 30 veces menos cómputo](https://storage.ghost.io/c/6d/e3/6de31f63-d0a8-45df-9c6a-481016520347/content/images/size/w300/format/webp/2026/07/photon-1-induction-labs-modelo-imaginacion-video.jpg)Photon-1 aprende a manejar un ordenador viendo vídeo y con 30 veces menos cómputo](https://www.digitalbrain.news/noticias/photon-1-induction-labs-modelo-imaginacion-video/)[![World Labs presenta Atlas, su modelo del mundo con vídeo 1440p de un minuto](https://storage.ghost.io/c/6d/e3/6de31f63-d0a8-45df-9c6a-481016520347/content/images/size/w300/format/webp/2026/09/world-labs-atlas-modelo-mundo-1440p.jpg)World Labs presenta Atlas, su modelo del mundo con vídeo 1440p de un minuto](https://www.digitalbrain.news/noticias/world-labs-atlas-modelo-mundo-1440p/)