Ineffable Intelligence ha hecho oficial su colaboración de ingeniería con Nvidia. Es la startup londinense que David Silver, el investigador detrás de AlphaGo y AlphaZero, sacó de la sombra el 27 de abril de 2026 tras dejar DeepMind. Levantó 1.100 millones de dólares en una ronda seed a una valoración de 5.100 millones, la mayor seed de la historia de Europa.
Puntos clave
- Ineffable la funda David Silver, profesor en UCL y hasta hace poco jefe del equipo de reinforcement learning de DeepMind (AlphaGo, AlphaZero, AlphaStar).
- Tesis: sistemas que aprenden por experiencia y prueba y error, sin depender de datos etiquetados por humanos.
- Seed de 1.100 millones a 5.100 de valoración, colíderada por Sequoia y Lightspeed, con Nvidia, Google, DST Global, Index y el fondo soberano de IA de Reino Unido dentro.
- Con Nvidia co-diseñan la infraestructura para RL a gran escala. El trabajo arranca sobre Grace Blackwell y apunta a la siguiente generación, Vera Rubin.
La tesis en una frase
Construir sistemas que aprenden por prueba y error, no por imitación de datos humanos. Es la misma filosofía que llevó a AlphaZero a superar a AlphaGo: sacar al humano del lazo de entrenamiento y dejar que el sistema descubra estrategias que nadie había escrito. Silver lleva años defendiendo que el techo del aprendizaje supervisado es bajo y que el reinforcement learning puro es la vía hacia capacidades de verdad nuevas.
Qué aporta Nvidia
La colaboración es a nivel de ingeniería, no comercial. Construyen juntos pipelines de entrenamiento de RL, empezando por la plataforma Grace Blackwell y con Vera Rubin (la generación que viene) como siguiente objetivo. El RL a escala frontera tiene un patrón de cómputo distinto del pre-entrenamiento clásico: mucho más cómputo generando experiencia durante el entrenamiento, menos en lotes gigantes de backprop. Ese patrón se beneficia de afinar el hardware a esa forma concreta de trabajar, y ahí es donde entra Nvidia con su equipo de ingeniería, no con un contrato de venta de chips sin más.
La lógica de Nvidia es clara. Ya está en todos los hyperscalers grandes (Microsoft, Google, Meta, Amazon). El siguiente escalón de clientes son las startups que definen el próximo paradigma. Anthropic tira también de chips de Amazon, OpenAI coquetea con silicio propio, y varios laboratorios exploran alternativas. Si el futuro de la frontera pasa por RL puro, a Nvidia le interesa estar dentro de quien lo construye desde el día uno, no llegar cuando el estándar ya esté cerrado.
El tamaño de la ronda dice algo por sí solo. 1.100 millones en seed, la mayor de Europa, para una empresa sin producto, se explica por dos cosas: el historial de Silver y la convicción de que el reinforcement learning es la siguiente palanca. Es la misma apuesta que hizo DeepMind hace una década, ahora con capital privado y con prisa.
Por qué importa para un founder español
Seamos honestos: es una noticia de research e infraestructura, no de producto. Ineffable no ha lanzado modelo ni API, y la tesis es prometedora pero no demostrada a escala. Hay más equipos empujando líneas parecidas de RL y entrenamiento automatizado en paralelo.
Esta semana no cambia nada en tu día a día. A medio plazo marca dirección. Si Ineffable u otros demuestran que un sistema entrenado por puro RL supera a los modelos actuales en tareas concretas, la lista de modelos que pagas por API en 2027 puede moverse bastante. La lectura práctica es la de siempre: no ates tu producto a un solo modelo como si fuera para siempre, porque el mejor por euro va a cambiar más de una vez.
Relacionado
