Perplexity y Harvard miden el salto de búsqueda a agente: 26 minutos del agente equivalen a 269 minutos de un humano con Search

Perplexity y Harvard miden el salto de búsqueda a agente: 26 minutos del agente equivalen a 269 minutos de un humano con Sear
Fuente: research.perplexity.ai

Perplexity y Harvard Business School publicaron el 8 de junio el working paper 26-040, el primer estudio académico que mide a escala el cambio de búsqueda asistida a agente autónomo. El dato que abre el paper resume bien la magnitud: una sesión media del agente Perplexity Computer dura 26 minutos de trabajo de máquina. Una consulta media de Search dura 33 segundos. Brecha de 48 veces en autonomía, y de 40 veces si se mide por la mediana.

Contexto del estudio

El paper analiza más de 84.000 sesiones de agente en 18 dominios profesionales. Los coautores son tres empleados de Perplexity (Kate Zyskowski, Noah Yonack y Jerry Ma) y Jeremy Yang, de Harvard Business School. Se publicó como preprint en arXiv el 5 de junio y se presentó oficialmente el 8. No está revisado por pares todavía, y conviene tener presente que Perplexity está midiendo su propio producto.

Con esa salvedad sobre la mesa, los hallazgos son consistentes con lo que ya se observa en equipos que adoptan agentes serios en flujo diario. Y el tamaño de la muestra ayuda a fiarse del patrón: 10.000 pares de consultas para el análisis de tiempos, 8.000 usuarios para el cruce entre ocupaciones y 100.000 consultas para clasificar casos de uso.

Lo técnico

En tareas pareadas (mismo objetivo dado a Search y a Computer), Computer + humano recorta el 87% del tiempo total, de 269 minutos estimados a 36, y el 94% del coste frente a Search + humano. En programación el salto es aún mayor: de 596 minutos a 48, un 92% menos de tiempo y un 96% menos de coste. El truco está en cómo se reparte el reloj: el agente tarda más en responder, pero el humano apenas dedica unos minutos a supervisar. Los propios usuarios reportan una aceleración mediana de 25 veces.

El segundo dato importante es de scope. Cada consulta lanzada al agente toca 2.40 dominios distintos de conocimiento (clasificación O*NET) de media, frente a 1.74 en Search, un 38% más. El 59% del trabajo con Computer cruza ocupaciones distintas, frente al 50% con Search. Una misma sesión empieza analizando datos financieros, sigue redactando un email comercial y termina generando una presentación. Cosas que antes habrían pasado por tres personas distintas.

Y hay un salto en el tipo de tarea, no solo en el volumen. El 76% de las consultas a Computer implican cognición de orden superior (frente al 55% en Search) y el 50% son de nivel crear (frente al 26%). El agente no se usa para buscar un dato, se usa para producir un entregable.

El cuarto dato es cualitativo: el rol del humano cambia de ejecutor a supervisor. Menos tiempo operando el flujo, más tiempo especificando objetivos, aportando contexto, verificando outputs y pidiendo extensiones. Y aun así la calidad sube: la tasa de insatisfacción significativa cae del 2.9% en Search al 1.3% en Computer, un 55% menos.

Por qué importa

Cuando una herramienta quita el coste de hacer, la gente empieza a pedir cosas que antes no se atrevía a abordar. Una persona del equipo financiero no se sienta a hacer un análisis competitivo para marketing si tiene que dedicarle cuatro horas. Sí lo lanza si un agente le devuelve un primer draft en treinta minutos.

Es el mismo patrón que vemos en empresas aplicando Claude internamente. Lo que cambia no es solo cuánto se tarda en lo que hacíamos antes, sino qué clase de cosas tiene sentido intentar. El dato de crear (50% de las consultas) es la señal fuerte: la gente ya no pide resúmenes, pide productos terminados.

Qué hacer

  • El ROI del agente no se ve en el ahorro de minutos sobre tareas existentes. Se ve en los proyectos nuevos que entran en agenda porque ahora caben. Pregúntate qué tareas tiene tu empresa descartadas por coste de tiempo que entrarían si el coste fuera 1/8 del actual.
  • Anticipa el cruce de departamentos. Con el 59% del trabajo cruzando ocupaciones distintas, las paredes entre áreas se rebajan. Cuando operaciones puede generar un análisis comercial decente con un agente, o el organigrama se hace más fluido, o aparecen fricciones nuevas.
  • Mide los porcentajes con grano de sal pero no descartes el patrón. Es la observación más sólida hasta la fecha de un cambio que ya se nota en cualquier equipo que use agentes a diario.

Relacionado