Generador de sitemap

Pega una lista de direcciones y el sitemap se crea en tu navegador. O deja que el modo de rastreo opcional reúna las páginas de un sitio web público: esa parte funciona a través del servidor de ToolCMB, que lee el sitio página a página.

  • XML + índice de sitemaps
  • Desde una lista: en el navegador
  • Rastreo: desde nuestro servidor
  • Descarga en ZIP y .gz
El rastreo de un sitio web funciona a través de nuestro servidor

Un sitemap a partir de una lista de direcciones se crea íntegramente en tu navegador: no se envía nada. Solo el modo opcional «Rastrear un sitio web» usa el servidor de ToolCMB: lee una a una las páginas públicas del sitio que indiques y devuelve los enlaces que encuentra. No guardamos las direcciones ni el resultado.

Pega una lista, una columna de una hoja de cálculo o un sitemap.xml existente, o abre un archivo .txt, .csv o .xml. Una fecha después de la dirección (separada por un tabulador o una coma) se usa como «última modificación».

Opciones

Google usa la «última modificación» cuando es precisa e ignora la frecuencia de cambio y la prioridad. Deja ambas en «Ninguno» salvo que otro buscador u otra herramienta las necesite.

Formato

50.000 como máximo. Las listas más largas se dividen.

Necesaria para el índice cuando la lista se divide. Vacío = la raíz del sitio.

Resultado

    Sube el archivo a la raíz de tu sitio, añade la línea Sitemap a robots.txt y envía la dirección en Google Search Console y Bing Webmaster Tools.

    Cómo funciona

    Cómo crear un sitemap XML

    Dos orígenes, un mismo resultado.

    1. 1

      Pega una lista o rastrea el sitio

      Una lista de direcciones, una columna de una hoja de cálculo o un sitemap.xml antiguo se procesan en tu navegador. Para «Rastrear un sitio web», introduce una dirección de inicio: nuestro servidor descarga entonces las páginas públicas una a una y devuelve los enlaces que encuentra.

    2. 2

      Elige las opciones

      Decide cómo se rellena la «última modificación», si se eliminan los duplicados y los parámetros de seguimiento, y si quieres XML o un archivo de texto sin formato.

    3. 3

      Descarga y envía

      Guarda sitemap.xml (o un ZIP si la lista se ha dividido), súbelo a tu sitio, copia la línea Sitemap para robots.txt y envía la dirección a los buscadores.

    Por qué ToolCMB

    Un sitemap válido, reúnas como reúnas las direcciones

    Sigue el protocolo de sitemaps.org y sus límites.

    Desde una lista

    Acepta una dirección por línea, una tabla con fechas o un sitemap XML existente, pegados o abiertos como archivo .txt, .csv o .xml. Una fecha detrás de la dirección se convierte en la «última modificación».

    Modo de rastreo

    Sigue los enlaces del mismo dominio desde tu dirección de inicio, hasta 50, 100, 250 o 500 páginas, con patrones de exclusión, un botón para detenerlo y un registro de cada página.

    Solo páginas indexables

    El rastreo puede respetar robots.txt y dejar fuera las páginas marcadas con noindex o cuya canonical apunta a otra dirección, para que el sitemap enumere lo que debe indexarse.

    División e índice

    Las listas que superan tu límite (como máximo 50.000 direcciones o 50 MB por archivo) se dividen en varios archivos más un índice de sitemaps, que se descargan en un solo ZIP.

    Lastmod, changefreq, priority

    Conserva las fechas indicadas, pon la de hoy donde falte o fija una fecha para todas. La frecuencia de cambio y la prioridad están disponibles, con una nota que recuerda que Google las ignora.

    Comprobaciones

    Señala líneas no válidas, hosts mezclados, mezcla de http y https, direcciones de más de 2048 caracteres y duplicados antes de que descargues.

    Claridad sobre lo que se envía

    La comprobación se hace en nuestro servidor porque un navegador no tiene permitido hacerla. Solo se envía la dirección que introduces, y no se guarda.

    Gratis y sin registro

    Sin cuenta, sin límites y sin marca de agua: en el móvil, la tableta o el ordenador.

    Qué es un sitemap XML y qué debe incluir

    Un sitemap XML es un archivo que enumera las direcciones de un sitio web que quieres dar a conocer a los buscadores, cada una en un elemento <loc> y, opcionalmente, con una fecha <lastmod>. Ayuda a los rastreadores a descubrir páginas más rápido, sobre todo en sitios nuevos, sitios grandes y sitios cuyas páginas están mal enlazadas internamente. Un sitemap es una sugerencia, no una garantía: no fuerza la indexación ni mejora por sí solo el posicionamiento. Los sitios pequeños y bien enlazados suelen rastrearse por completo sin él.

    El protocolo de sitemaps.org fija límites estrictos: un archivo puede contener como máximo 50.000 direcciones y 50 MB sin comprimir. Los sitios más grandes usan varios archivos y un índice de sitemaps que los enumera; solo se envía el índice. Las direcciones deben ser absolutas y pertenecer al host en el que se aloja el sitemap, y los caracteres especiales como & deben escaparse: el generador lo hace por ti. Google usa lastmod cuando comprueba que es fiable e ignora changefreq y priority.

    Un buen sitemap contiene solo páginas canónicas e indexables que responden con el estado 200. Los errores habituales son incluir redirecciones, páginas de error, páginas con noindex o direcciones bloqueadas en robots.txt; mezclar http y https o www y sin www; y poner la fecha de hoy a todas las páginas en cada exportación, lo que enseña a los buscadores a desconfiar de las fechas. No incluyas variantes con parámetros de una misma página. Y mantén el archivo al día: un sitemap que se genera una vez y no se actualiza nunca pierde su valor enseguida.

    Elementos del sitemap y cómo se usan

    ElementoSignificadoLo usa Google
    <code>&lt;loc&gt;</code>Dirección completa de la página (obligatorio)Sí
    <code>&lt;lastmod&gt;</code>Fecha del último cambio significativoSí, cuando es fiable de forma constante
    <code>&lt;changefreq&gt;</code>Con qué frecuencia se espera que cambie la páginaNo
    <code>&lt;priority&gt;</code>Importancia de 0.0 a 1.0 dentro del sitioNo
    <code>&lt;image:image&gt;</code>Imágenes que pertenecen a la páginaSí, para la búsqueda de imágenes

    Consejos

    • Anuncia el sitemap con una línea Sitemap: en robots.txt: el Generador de robots.txt la escribe por ti.
    • Comprueba una muestra de las direcciones incluidas con el Comprobador de estado HTTP: todas deben responder 200 y ninguna debe redirigir (consulta el Comprobador de redirecciones).
    • Incluye solo direcciones canónicas. El Generador de URL canónica limpia una lista entera y marca los duplicados.
    • El rastreo lee como máximo 500 páginas por ejecución. En un sitio más grande, rastrea las secciones por separado empezando en una subcarpeta, o exporta la lista de direcciones desde tu CMS y pégala.
    Preguntas frecuentes

    Preguntas frecuentes

    ¿No encuentras tu respuesta? Escríbenos: respondemos rápido.

    ¿Dónde subo el sitemap?

    Normalmente a la raíz del sitio, de modo que se abra en https://your-domain.com/sitemap.xml. Un sitemap solo puede incluir direcciones de su propia carpeta y de las inferiores, y por eso la raíz es el lugar seguro. Después, añade la dirección a robots.txt y envíala en Google Search Console y Bing Webmaster Tools.

    ¿Cuántas URL puede contener un sitemap?

    Hasta 50.000 direcciones y 50 MB sin comprimir por archivo. Por encima de eso, divide la lista en varios archivos y refiérete a ellos en un índice de sitemaps. Este generador hace la división y escribe el índice.

    ¿Un sitemap mejora mi posicionamiento?

    No directamente. Ayuda a los buscadores a encontrar y volver a rastrear tus páginas, lo que importa sobre todo en sitios nuevos, grandes o poco enlazados. Que una página se indexe y la posición que ocupe dependen de la propia página.

    ¿Debo indicar priority y changefreq?

    Para Google no hay diferencia: ignora ambos valores. Omítelos salvo que otro buscador u otra herramienta que uses los pida. Una fecha lastmod fiable es el único valor opcional que merece la pena mantener.

    ¿Qué se envía a vuestro servidor?

    Solo la dirección o el nombre de dominio que introduces. Un navegador no tiene permitido hacer por sí mismo este tipo de petición, así que nuestro servidor la hace por ti y devuelve el resultado. No guardamos ni la dirección ni el resultado, y el contenido de las páginas comprobadas nunca se transmite.

    ¿Qué límites tiene el modo de rastreo?

    Una ejecución lee como máximo 500 páginas de un sitio web público, sigue solo los enlaces del mismo dominio y se pausa cuando se alcanza el número de peticiones por minuto. Se rechazan las direcciones de redes privadas e internas. El rastreo lee el HTML que entrega el servidor, así que no encuentra los enlaces creados únicamente con JavaScript. El modo de lista no tiene ninguno de estos límites, salvo las 50.000 direcciones por archivo del protocolo.

    Más herramientas SEO y web gratuitas

    Genera etiquetas y archivos, comprueba códigos de estado, redirecciones, DNS y certificados: gratis y sin cuenta.

    Ver todas las herramientas