SEO
Validador de Sitemap XML
Detecta errores de estructura, URLs inválidas, formatos de fecha incorrectos y duplicados en tu sitemap. Compatible con urlset y sitemapindex.
Hoy cualquier IA puede explicarte qué es un sitemap XML en segundos. Pero no todos tienen un plan pagado, tokens disponibles todo el tiempo, o saben cómo pedírselo bien. Este validador existe para eso: revisión real de tu propio sitemap, al instante — y de paso, más abajo te explicamos cómo distingue errores de advertencias.
Solo se permiten URLs https://. El sitemap se descarga en el servidor y no se almacena.
Pega el contenido completo de tu sitemap XML.
Procesando…
Cómo funciona la validación por dentro
Error vs. advertencia — no es lo mismo
error = estructura mínima rota (XML inválido, falta <loc>, <loc> no es una URL) — advertencia = cumple la estructura pero se desvía de una recomendación (namespace, formato de fecha, rango de priority)
— Un sitemap con errores probablemente Google no lo pueda leer en absoluto. Un sitemap con solo advertencias sí lo puede leer, pero puede ignorar el valor de ese campo puntual: por ejemplo, un lastmod con formato inválido simplemente no se usará como señal de rastreo, aunque el resto del sitemap funcione bien.
Formatos de lastmod aceptados
AAAA-MM-DD, o AAAA-MM-DDThh:mm:ssZ (o con offset ±hh:mm), o AAAA-MM-DDThh:mmZ
— Ejemplo válido: 2026-07-18 o 2026-07-18T14:30:00-04:00. Un error común es escribir la fecha como 18/07/2026: no cumple ninguno de los 3 formatos aceptados y genera advertencia.
Protección contra SSRF al validar por URL
al validar desde URL, se bloquean direcciones IP privadas/reservadas y se fija la resolución DNS antes de descargar
— Es una protección de seguridad poco visible pero real: sin ella, alguien podría intentar usar el validador para hacer que el servidor se conecte a direcciones internas de la red (192.168.x.x, 10.x.x.x, 127.0.0.1, etc.) camufladas detrás de un dominio público. Por eso el validador resuelve el DNS una sola vez, verifica que la IP sea pública, y fuerza esa misma IP en la descarga real — así un atacante no puede cambiar la respuesta DNS entre la verificación y la descarga (ataque conocido como «DNS rebinding»).
Preguntas frecuentes
Un sitemap XML es un archivo que le indica a los motores de búsqueda —Google, Bing, etc.— qué páginas existen en tu sitio y cuáles son las más importantes. No es obligatorio para que tus páginas aparezcan en Google, pero sí es muy útil cuando el sitio es grande, tiene páginas con pocos enlaces internos, o el contenido se actualiza frecuentemente. El estándar es definido por sitemaps.org y Google lo respeta desde 2005.
urlset es el sitemap normal: contiene una lista de URLs de tu sitio (máximo 50.000 por archivo y 50 MB sin comprimir). sitemapindex es un archivo que apunta a otros sitemaps —útil cuando tienes más de 50.000 URLs o quieres organizar el sitemap en secciones (posts, productos, categorías). Google lee primero el sitemapindex y luego descarga cada sitemap referenciado de forma independiente.
- lastmod — fecha de la última modificación de la página (formato YYYY-MM-DD). Es el campo más útil: Google lo usa como señal para decidir cuándo volver a rastrear esa URL. Si no es preciso, pierde valor.
- changefreq — con qué frecuencia cambia la página:
always,hourly,daily,weekly,monthly,yearly,never. Google lo toma como una pista, no como una instrucción. - priority — importancia relativa de la URL respecto al resto del sitio, entre
0.0y1.0(por defecto0.5). Solo tiene sentido dentro de tu propio sitio; Google no la compara entre sitios.
Google puede rechazar o ignorar un sitemap con errores de formato XML, namespace incorrecto o URLs mal formadas. Esto no significa que tus páginas desaparezcan del índice —Google las puede encontrar de otras formas—, pero sí que el sitemap deja de cumplir su función principal: guiar al crawler hacia el contenido que te importa. Errores como URLs duplicadas o valores
priority fuera de rango (p.ej. 1.5) también generan advertencias en Google Search Console.
Las ubicaciones más comunes son
https://tudominio.com/sitemap.xml y https://tudominio.com/sitemap_index.xml. WordPress con Yoast SEO lo pone en /sitemap_index.xml; con Rank Math en /sitemap_index.xml también. Shopify lo genera en /sitemap.xml automáticamente. Si no lo encuentras, revisa el archivo robots.txt de tu sitio: la línea Sitemap: indica la URL exacta.
Cada archivo sitemap puede contener hasta 50.000 URLs y pesar como máximo 50 MB sin comprimir (o 50 MB comprimido en .gz). Si tu sitio supera ese número, debes usar un sitemapindex que apunte a múltiples archivos sitemap. Puedes tener hasta 500 sitemaps en un índice. Estas cifras aplican por sitemap, no por sitio.
Si tu sitemap está publicado como un archivo comprimido (
sitemap.xml.gz), esta herramienta no lo descomprime automáticamente al validarlo por URL — recibirá el contenido binario comprimido y lo reportará como XML inválido. La solución es descomprimir el archivo tú mismo (con cualquier herramienta que descomprima .gz) y pegar el XML resultante en la pestaña «Pegar XML».
No — esta herramienta valida la estructura del protocolo sitemaps.org estándar (
loc, lastmod, changefreq, priority), pero no valida extensiones como las etiquetas hreflang (xhtml:link) que usan los sitios multiidioma. Un sitemap con hreflang mal configurado puede pasar esta validación sin advertencias, aunque tenga errores de segmentación de idioma que herramientas como Google Search Console sí detectan.
Esta herramienta valida únicamente la estructura del archivo XML según el protocolo sitemaps.org: que el XML sea válido, que cada URL tenga
<loc>, que las fechas y valores tengan el formato correcto. Google Search Console va más allá: verifica además si cada URL individual responde con código 200, si está bloqueada por robots.txt, si tiene una etiqueta noindex, o si declara una URL canónica distinta. Un sitemap puede pasar esta validación sin errores y aun así tener URLs marcadas como problemáticas en Search Console, porque son dos capas de verificación distintas.