Perplexity saca pplx, un CLI que mete su buscador en la terminal de los agentes

Perplexity saca pplx, un CLI que mete su buscador en la terminal de los agentes
Fuente: github.com

Perplexity ha publicado pplx, el cliente de línea de comandos oficial de su Search API, y lo ha construido pensando en agentes de código antes que en personas. Es un binario único con dos comandos que escupen JSON, sin interfaz interactiva ni colores en la terminal.

Puntos clave

  • Dos comandos: `pplx search web` para búsqueda en vivo y `pplx content fetch` para sacar el texto limpio de una URL.
  • Éxito es código de salida 0 con un objeto JSON en stdout. Fallo es código 1 con un objeto de error en stderr.
  • Solo tres plataformas: macOS con Apple Silicon, Linux x86_64 y Linux arm64. No hay build de Windows ni de Mac Intel.
  • La Search API cuesta 5 dólares por cada 1.000 peticiones, con tope de 50 consultas por segundo en todos los planes.

Por qué un CLI y no una librería

Un agente de código como Claude Code o Codex ya sabe ejecutar comandos en la terminal. No sabe, de serie, buscar en internet con resultados frescos.

Ahí está la jugada. En lugar de pedirle al desarrollador que instale un SDK y escriba código de integración, Perplexity le da un ejecutable que el agente puede llamar igual que llama a `grep` o a `curl`. El contrato es el de cualquier herramienta Unix: entrada por argumentos, salida por stdout, errores por stderr, código de salida que dice si fue bien.

Las búsquedas devuelven un objeto con `hits`, y dentro cada resultado trae `url`, `title`, `domain` y `snippet`, más un `total`. Los errores llegan estructurados, con `code`, `message`, `command` y a veces un `hint`. Un modelo puede leer eso y decidir qué hacer sin que nadie le explique el formato.

El detalle que revela para quién está hecho

La función más reveladora es el control de contexto. Hay tres piezas: `--output-dir` guarda el resultado completo en un fichero JSON, `--stdout-preview` trunca los campos largos en la salida por pantalla, y la variable `PPLX_OUTPUT_DIR` fija el directorio por defecto.

Ese trío existe por un problema muy concreto: si un agente busca diez cosas y cada búsqueda le mete 20.000 tokens de resultados en la ventana de contexto, se queda sin sitio para trabajar. Con esto guarda el resultado entero en disco, ve solo un resumen y lee el fichero completo únicamente si lo necesita.

Es el tipo de detalle que solo pones cuando has visto a un agente quedarse sin contexto a mitad de tarea.

Instalación y letra pequeña

El instalador es el habitual: un `curl` que descarga el script, verifica el SHA-256 del binario y lo deja en `~/.local/bin/pplx`. La verificación de checksum es correcta y conviene que sea el estándar en cualquier cosa que se instale así.

El recorte de plataformas es agresivo. Tres targets y fuera: Apple Silicon, Linux x86_64 y Linux arm64. Sin Windows, sin Mac Intel. Si tu equipo trabaja en Windows, la vía es WSL o nada.

El precio, 5 dólares por 1.000 peticiones, sale a medio céntimo por búsqueda. Suena barato hasta que cuentas que un agente en bucle puede lanzar treinta consultas para resolver una tarea. Ahí ya son 15 céntimos por tarea, y multiplicado por un equipo que trabaja todo el día empieza a ser una línea del presupuesto. El tope de 50 consultas por segundo es común a todos los planes, así que no se compra prioridad pagando más.

Por qué importa

Si en tu empresa alguien ya trabaja con agentes de código, esto quita una fricción real: los modelos tienen fecha de corte de conocimiento y todo lo que sea documentación reciente, cambios de API o precios actuales lo tienen que buscar fuera.

Lo interesante no es el producto en sí, es el patrón. Las herramientas de IA están empezando a diseñarse para que las use otro programa, no una persona. Salida JSON, códigos de salida limpios, control de cuánto texto devuelves. Si estás construyendo algo interno para tu equipo, ese es el formato al que conviene apuntar desde el primer día, aunque de momento lo ejecutes tú a mano.


Relacionado