También disponible en: English · Português · Français · العربية
Validador de sitemap XML
Pega un sitemap y compruébalo frente a los límites de 50.000 URL y 52.428.800 bytes, el formato de fecha obligatorio y los elementos que no hacen nada.
¿Qué es un sitemap XML?
Un sitemap XML es un archivo que enumera las páginas de tu sitio que te gustaría que conociera un buscador. Su elemento raíz es urlset, cada página es un elemento url, y el único hijo obligatorio de cada uno es loc: la dirección completa de la página. Se permiten otros tres hijos: lastmod, changefreq y priority.
Hay un segundo tipo de archivo, el índice de sitemaps, que enumera otros sitemaps en vez de páginas. Usa sitemapindex como raíz y elementos sitemap dentro, y es a lo que se recurre cuando un solo archivo ya no basta. Este validador reconoce los dos y te dice cuál has pegado.
El protocolo fija dos límites duros para un solo archivo de sitemap, y son de esas cosas que un verificador puede zanjar en vez de opinar: no más de 50.000 URL y no más de 50MB, que el protocolo deletrea como 52.428.800 bytes. Si superas cualquiera de los dos, toca partir el archivo y enumerar los trozos en un índice.
Cómo usarlo
- Pega el contenido de tu sitemap. El texto del archivo, no su dirección: un navegador no puede ir a buscar tu sitemap, así que esto comprueba exactamente lo que pongas en la caja. Los cuatro botones de ejemplo cubren un sitemap normal, un índice, una fecha mal formada y una URL relativa.
- Compara los dos recuentos con los dos límites. Entradas y bytes se muestran junto a las cifras que fija el protocolo, así que ves cuánto margen te queda antes de tener que partir el archivo.
- Lee los hallazgos. Los errores son cosas que te van a costar entradas o el archivo entero. Los avisos son válidos pero juegan en tu contra. Las notas son válidas y sencillamente no hacen nada, y en un sitemap típico hay más de las que casi nadie espera.
Dos de los cuatro elementos no hacen nada
Casi todos los sitemaps escritos a mano ponen priority y changefreq en cada entrada, normalmente con cuidado: la portada se lleva un 1.0, la página de contacto un 0.5, el blog es daily y la de quiénes somos es yearly. La documentación de Google es tajante sobre el resultado: Google ignora los valores de priority y changefreq. Los descarta los dos.
Lo más llamativo es que el propio protocolo ya había matizado lo de priority mucho antes. El documento de sitemaps.org que define el elemento dice que la prioridad que asignes a una página no es probable que influya en la posición de tus URL en los resultados de un buscador. La especificación que inventó el campo te avisó de que probablemente no haría nada.
Nada de eso los convierte en errores, y esta página no los marca como tales. Son XML válido que no te cuesta más que los bytes que ocupan, y eso solo importa si andas cerca del límite de 50MB, donde quitar los dos de un archivo grande es una forma rápida de ganar sitio. Salen como notas porque un verificador que se calla al respecto te deja afinando algo que no tiene efecto.
lastmod es el que sí puede jugar en tu contra
El tercer elemento opcional es distinto y merece un momento. Google dice que usa lastmod si el valor es coherente y verificablemente exacto, por ejemplo comparándolo con cuándo cambió la página de verdad. Eso es una condición, y la condición va de tu historial más que de una entrada suelta.
Así que un sitemap que sella cada URL con la fecha de hoy, que es lo que hacen por defecto muchísimos generadores, no es que no ayude. Es una afirmación de que todas las páginas del sitio cambiaron hoy, comprobable contra las propias páginas, y suspenderla le enseña al rastreador que tu lastmod no es de fiar. Por eso esta página marca como aviso un lastmod idéntico en todas las entradas en vez de pasarlo por alto: es el único de los elementos opcionales que puede dejarte peor que si lo omitieras.
El formato también es más estricto de lo que parece. El protocolo pide W3C Datetime, que admite un simple AAAA-MM-DD, pero un valor con hora tiene que llevar zona horaria. 2026-07-14T09:30:00 no es válido; 2026-07-14T09:30:00Z sí lo es, y 2026-07-14 a secas también. Una hora local sin zona es la forma más habitual de equivocarse aquí, porque es lo que produce por defecto casi cualquier formateador de fechas.
Límites declarados
Esto comprueba el texto que pegas y no puede ir a buscar nada. No sabe si tu sitemap está accesible en la dirección que crees, si robots.txt apunta a él, ni si alguna de las URL de dentro resuelve. Un sitemap puede ser perfectamente válido y enumerar quinientas páginas que devuelven 404.
Los dos números que informa son medidas de lo que has pegado y de nada más, y conviene ser precisos. El tamaño es la longitud en bytes UTF-8 exactamente de lo que hay en la caja —que es la medida correcta, porque el límite del protocolo se aplica al archivo sin comprimir aunque se sirva con gzip— pero si solo pegaste una parte de tu sitemap, el número describe la caja y no el archivo. El recuento de entradas es de elementos url y no de elementos loc, así que una entrada a la que le falta la ubicación sigue contando para las 50.000, que es como se comporta el límite de verdad.
Tampoco puede decirte si tus URL pintan algo en un sitemap. Enumerar una página no hace que un buscador la indexe, y un sitemap lleno de páginas pobres o duplicadas es un sitemap que se va a ignorar en gran parte. El archivo es una sugerencia, no una orden, y ningún validador cambia eso.
Algo que a propósito no hace es comprobar tu XML con un analizador completo. Busca los elementos que define el protocolo, así que un documento con etiquetas descuadradas puede aun así dar un recuento de aspecto sensato. Si quieres comprobar que está bien formado, pasa antes el archivo por un formateador de XML —este sitio tiene uno— y vuelve luego aquí.
¿Por qué es gratis?
La comprobación es análisis de texto y corre en tu navegador. No hay ningún servidor de por medio, así que no hay nada que cobrar ni cuenta que crear.
No se sube nada y no se guarda nada. Recarga la página y habrá olvidado tu sitemap.