Saltar al contenido
OPS // KITitspentest.sh

R-GAU

gau

Obtiene URLs conocidas de un dominio desde Wayback Machine, Common Crawl y AlienVault OTX.

Sitio oficialVolver al catálogo

RESUMEN

gau ("getallurls") consulta archivos externos — Wayback Machine, Common Crawl, AlienVault OTX y opcionalmente URLScan — en busca de cada URL que hayan indexado alguna vez bajo un dominio dado, e imprime la lista. Como solo habla con servicios de archivo de terceros, no con el objetivo, es uno de los pocos pasos de reconocimiento que genera tráfico cero contra el activo real.

La salida suele sacar a la luz parámetros antiguos, endpoints de API obsoletos, archivos de respaldo y rutas que ya no aparecen en un rastreo fresco pero que pueden seguir vivas o revelar cómo estaba estructurada la aplicación antes — contexto útil antes de empezar la enumeración activa.

CASOS DE USO

Casos de uso en un engagement

  • 01

    Sacar a la luz endpoints y parámetros antiguos u olvidados que no son visibles en un rastreo fresco.

  • 02

    Construir una lista semilla de URLs para fuzzing de parámetros sin generar tráfico al objetivo primero.

  • 03

    Encontrar archivos de respaldo, versiones antiguas de API o rutas de debug que existieron públicamente.

  • 04

    Cruzar URLs archivadas con un rastreo actual (katana) para detectar qué ha cambiado.

PRIMEROS PASOS

Cuando quieres una lista pasiva y rápida de URLs históricas e indexadas por terceros de un dominio, sin enviar tráfico al objetivo.

  1. Confirma que el dominio está en alcance — aunque las consultas van a archivos de terceros, no al objetivo.
  2. Instala gau vía go install o un binario precompilado de releases.
  3. Ejecútalo contra el dominio objetivo y guarda la lista de URLs en bruto.
  4. Deduplica y filtra la lista por extensión o patrón de ruta según lo relevante.
  5. Reverifica la vida de las URLs interesantes con httpx antes de tratarlas como vigentes.
echo target.example.com | gau --subs > urls.txt

ANTES DE USARLA

Qué revisar antes de lanzarla

Los resultados vienen de archivos históricos, así que una gran parte de las URLs apunta a páginas, parámetros o subdominios obsoletos o dados de baja — reverifica con httpx antes de actuar sobre cualquiera de ellas.

Las URLs archivadas pueden incluir parámetros de aspecto sensible de hace años; trata los datos antiguos con el mismo cuidado que un hallazgo en vivo.

Al ser puramente pasivo contra servicios de terceros, gau no dice nada sobre el comportamiento actual — es un generador de pistas, no un paso de confirmación.

SIGUE EXPLORANDO

Ver toda la fase →