Reka libera 10.312 horas de vídeo doméstico en primera persona con licencia Apache 2.0

Reka libera 10.312 horas de vídeo doméstico en primera persona con licencia Apache 2.0
Fuente: reka.ai

Reka ha publicado 10.312 horas de vídeo doméstico grabado en primera persona con licencia Apache 2.0, que permite uso comercial y redistribución. Está en Hugging Face sin restricción de acceso.

Unas 1.670 de esas horas están en 4K nativo. El resto, en calidades menores.

Puntos clave

  • 10.312 horas totales. Aproximadamente 1.670 en 4K nativo.
  • Contenido: tareas domésticas sin guion grabadas con cámara de móvil montada en la cabeza. Lavar ropa, recoger la cocina, ordenar espacios, mantenimiento rutinario.
  • Licencia Apache 2.0. Uso comercial y redistribución permitidos.
  • Recogido a través de Claru, el motor de datos de Reka, con una red de más de 100.000 colaboradores pagados que superan una prueba de calificación, graban en su propia casa y cobran por hora aceptada.
  • Dos niveles de publicación: crudo (las 10.312 horas sin filtrar, para procesar a tu manera) y procesado (clips con descripción individual, deduplicados y con control de calidad).

Para qué sirve esto

El objetivo declarado son los modelos del mundo y los modelos visión-lenguaje-acción, que es lo que hace falta para que un robot doméstico funcione fuera de un laboratorio.

El problema de ese campo nunca ha sido la arquitectura. Ha sido que los datos existentes se grabaron en entornos controlados, con iluminación buena y objetos ordenados. Una cocina real a las nueve de la noche no se parece a eso.

Por eso el valor está en la palabra "sin guion". Manos que tapan la vista, movimientos bruscos, objetos a medio camino, luz mala. Reka lo dice explícitamente: datos grabados en los entornos caóticos donde ocurre el comportamiento real.

La licencia Apache 2.0 es la otra mitad de la noticia. Muchos datasets grandes se publican con licencias de solo investigación, lo que los deja fuera de cualquier producto. Este se puede usar comercialmente.

Por qué importa

Para la mayoría de empresas esto no es accionable hoy. Es un ladrillo de infraestructura para quien construye robótica o visión por computador.

Lo que sí es interesante para cualquiera es el modelo de recogida. Más de 100.000 personas pagadas por hora aceptada de grabación en su propia casa, con una prueba de calificación previa. Es el trabajo de datos convertido en marketplace, y es la parte del negocio de la IA de la que menos se habla.

Si tu empresa tiene datos propios de un dominio concreto (imágenes de producto, grabaciones de servicio técnico, histórico de incidencias), ese activo se parece más a esto de lo que parece. La ventaja competitiva no está en el modelo que uses, que es el mismo que usa tu competencia. Está en el dato que tú tienes y ellos no.


Relacionado