Saltar al contenido

Crossair

Actualités

Descubre cómo explorar fácilmente todas las páginas de un sitio dedicado al empleo

Un sitio dedicado al empleo publica y retira anuncios de manera continua. A diferencia de un sitio de exhibición cuyas páginas permanecen estables durante…

Femme professionnelle naviguant sur un site d'emploi depuis son bureau en open space

Un sitio dedicado al empleo publica y retira anuncios de manera continua. A diferencia de un sitio vitrina cuyas páginas permanecen estables durante meses, un portal de ofertas de empleo ve su contenido cambiar cada día: nuevas publicaciones, puestos ocupados, fichas archivadas. Explorar todas estas páginas supone entender cómo están organizadas, indexadas y a veces ocultas.

Sitemap XML en un sitio de empleo: lo que realmente revela esta página técnica

El sitemap XML es un archivo que lista las URL que un sitio desea hacer visibles a los motores de búsqueda. En un portal de empleo, este archivo juega un papel particular porque los anuncios tienen una vida útil corta.

Cuando una oferta expira, la URL correspondiente debe ser retirada del sitemap o devolver un código HTTP adecuado. Sin esta actualización, los motores continúan indexando páginas obsoletas, lo que degrada la experiencia de navegación para los candidatos.

Acceder al sitemap de un sitio de empleo permite distinguir rápidamente las páginas activas (ofertas en curso, fichas de profesiones, páginas de categorías) de las páginas estáticas (aviso legal, acerca de). Para acceder, generalmente basta con añadir /sitemap/ o /sitemap.xml al final del nombre de dominio. De hecho, al consultar este tipo de página se puede ver todas las páginas de Tous un Job y medir la extensión real del catálogo de ofertas propuesto.

Joven consultando las páginas de un sitio de empleo en una tableta en su salón

Indexing API y datos estructurados JobPosting: el mecanismo reservado para ofertas de empleo

Google recomienda a los sitios que publican ofertas de empleo utilizar la Indexing API en lugar de esperar el paso clásico de Googlebot. Este mecanismo permite informar directamente a Google que una página ha sido publicada, modificada o eliminada.

El interés es evidente: un anuncio publicado el lunes por la mañana puede aparecer en los resultados de búsqueda mucho más rápido que con un simple sitemap. Sin embargo, el sitemap sigue siendo necesario para cubrir todo el sitio.

Las limitaciones concretas de la Indexing API

La API prevé un cupo inicial destinado a pruebas y a la integración. Para un uso a gran escala, se requiere una aprobación adicional. Según Search Engine Journal (septiembre de 2026), varios sitios de empleo han informado sobre retrasos o la ausencia de respuesta respecto a estas solicitudes de aumento de cupo.

Este desfase entre la recomendación oficial de Google y la realidad operativa crea una situación frustrante para los editores de pequeña o mediana tamaño. Los grandes portales cuentan con los recursos técnicos para gestionar estas limitaciones, mientras que los sitios más modestos siguen dependiendo del rastreo clásico.

En cuanto a los datos estructurados, el marcado JobPosting (schema.org) permite a los motores identificar el título del puesto, el lugar, el salario y la fecha de publicación directamente en el código de la página. Este marcado alimenta los cuadros “ofertas de empleo” que aparecen en los resultados de Google.

Páginas huérfanas y anuncios expirados: las zonas invisibles de un sitio de empleo

En un sitio de empleo activo, una proporción significativa de páginas no es accesible ni desde el menú principal, ni desde los resultados de búsqueda interna. Estas páginas huérfanas existen técnicamente pero no están vinculadas a ninguna otra página del sitio.

Aparecen típicamente en tres casos:

  • Una oferta ha sido retirada del listado principal pero su URL sigue activa, sin redirección ni código 410 (Gone)
  • Una página de categoría ha sido renombrada o reestructurada, dejando antiguas URL sin enlace entrante
  • Un formulario de candidatura o una página de confirmación persiste después del cierre del reclutamiento

Por qué el simple noindex no siempre es suficiente

Agregar una etiqueta noindex impide que la página aparezca en los resultados de búsqueda, pero sigue presente físicamente en el servidor. Google puede seguir visitándola sin indexarla, lo que consume presupuesto de rastreo.

Para las ofertas expiradas, la eliminación definitiva con un código 410 o una redirección 301 hacia una página de ofertas similares sigue siendo el método más limpio. Un código 410 indica explícitamente que el recurso ya no existe, lo que acelera la limpieza del índice.

Hombre de mediana edad explorando la navegación completa de un sitio dedicado al empleo en un ordenador de escritorio

Herramientas para explorar todas las páginas de un sitio de empleo en línea

Varias enfoques permiten elaborar un inventario completo de las URL de un portal de empleo, cada uno con sus fortalezas y sus puntos ciegos.

  • El operador de búsqueda site: en Google (por ejemplo site:ejemplo.fr) muestra las páginas indexadas, pero ignora las bloqueadas por el archivo robots.txt o marcadas como noindex
  • El archivo robots.txt, accesible en la raíz del sitio, indica qué directorios están prohibidos para el rastreo. En un sitio de empleo, algunos directorios (espacio candidato, back-office) figuran lógicamente
  • Un crawler como Screaming Frog o Xenu recorre el sitio enlace por enlace y genera una lista exhaustiva de las URL accesibles, incluidas las páginas no indexadas pero técnicamente vinculadas
  • La Google Search Console, accesible únicamente para el propietario del sitio, proporciona la lista de páginas indexadas, aquellas con errores y las excluidas voluntariamente

Combinar el sitemap con un crawler externo ofrece la vista más completa. El sitemap muestra lo que el sitio quiere hacer visible. El crawler muestra lo que es realmente accesible siguiendo los enlaces.

Datos estructurados y navegación faceteada: la arquitectura oculta de los portales de empleo

Los sitios de empleo utilizan masivamente la navegación faceteada: filtros por ciudad, tipo de contrato, sector de actividad, nivel de experiencia. Cada combinación de filtros genera potencialmente una URL distinta.

Un portal que ofrece filtros por región, por profesión y por tipo de contrato puede teóricamente crear miles de combinaciones de URL. La mayoría de estas páginas filtradas son excluidas voluntariamente de la indexación para evitar contenido duplicado, pero existen en el servidor.

Para un candidato, entender esta mecánica permite navegar de manera más eficiente. En lugar de recorrer los resultados página por página, modificar directamente los parámetros de la URL permite acceder a combinaciones de filtros precisas que la interfaz no siempre ofrece de manera evidente.

La estructura de un sitio de empleo refleja un compromiso permanente entre exhaustividad y legibilidad. El sitemap, los datos estructurados y la gestión de las páginas expiradas forman un ecosistema técnico cuya calidad determina directamente la facilidad con la que un candidato encuentra la oferta que le corresponde.

Descubre cómo explorar fácilmente todas las páginas de un sitio dedicado al empleo