Google explicó por qué Search Console marca un sitemap como «No se ha podido obtener» aunque el archivo sea válido. Lo contaron John Mueller y Martin Splitt en el pódcast Search Off the Record, publicado el 1 de octubre de 2026. Dos causas habituales: la carga del servidor y la poca demanda de rastreo, ligada a la calidad del sitio.
Lo que se sabe
- Quién y dónde: John Mueller y Martin Splitt, del equipo de Search Relations de Google, en el episodio 114 de Search Off the Record, «Do sitemaps still matter?», publicado el 1 de octubre de 2026.
- La pregunta: Splitt planteó el caso de un sitemap válido, público y enlazado desde robots.txt que aun así aparece con ese aviso, según la transcripción que publica Search Engine Journal.
- Primera causa, la carga del host: Mueller dijo que a veces Google no tiene tiempo de rastrear el archivo porque está ocupado con otras cosas, y que eso también se muestra como «No se ha podido obtener», según Search Engine Journal.
- Segunda causa, la demanda de rastreo: si los sistemas de Google no ven necesidad de rastrear mucho de un sitio, se saltan el sitemap. Mueller añadió que esa demanda se basa muy a menudo en la calidad percibida del sitio, según el mismo medio.
- El resumen de Google: la página oficial del episodio dice que, con un archivo válido y accesible, la causa suele ser el freno por carga del host o una demanda de rastreo baja ligada a la calidad percibida.
- Tiene vuelta atrás: si la calidad del sitio mejora de forma clara con el tiempo, Google volverá a usar ese sitemap, dijo Mueller según Search Engine Journal.
- Otros puntos del episodio, según su página oficial: Google dejó de usar las etiquetas priority y changefreq; la fecha lastmod solo cuenta si es fiable; cada archivo admite hasta 50.000 URLs y 50 MB sin comprimir; y llms.txt no sustituye al sitemap XML para los buscadores.
- Lo que no hay: ni el resumen oficial ni las frases publicadas dan cifras o umbrales. No se sabe cuánta carga frena el rastreo ni qué nivel de calidad hace que Google se salte un sitemap.
La transcripción oficial del episodio no se pudo abrir para esta noticia. Las frases de Mueller y Splitt salen de la que publica Search Engine Journal.
Qué cambia y qué no
No cambia cómo funciona Google ni hay una directriz nueva. La ayuda de Search Console ya incluye la poca demanda de rastreo entre los motivos de este aviso, junto al bloqueo por robots.txt, una acción manual sin resolver, una URL equivocada y los errores del servidor.
Cambia cómo leer el aviso. El texto es el mismo para un archivo roto y para un sitemap que Google decidió no leer todavía. Search Engine Journal critica justo eso: que el mensaje no dice el motivo real.
El aviso, por sí solo, tampoco significa que tus páginas hayan salido de Google. Según la ayuda, lo que Google leyó antes en un sitemap no se olvida por un fallo posterior. Y si el fallo se repite, Google lo intenta unos días más y después deja de intentarlo.
Cómo saber si te afecta
- Mira el estado. Abre el informe «Sitemaps» de Search Console. Los tres estados posibles son «Correcto», «No se ha podido obtener» y «El sitemap tenía X errores».
- Descarta lo técnico. La ayuda de Google da la lista: que robots.txt no bloquee el archivo, que la URL exista (ábrela en tu navegador) y que no haya una acción manual sin resolver. Corrige lo que falle y vuelve a enviar el sitemap.
- Haz la prueba en tiempo real. Pega la URL del sitemap en la herramienta de inspección de URLs y pulsa «Prueba en tiempo real». En «Disponibilidad de la página» debe salir «¿Se permite el rastreo?» = «Sí» y «Obtención de página» = «Correcto».
- Mira el servidor. Google limita cuánto rastrea de cada servidor: su documentación lo llama límite de capacidad de rastreo o carga del host. En Configuración de la propiedad > Estadísticas de rastreo, el «Estado del host» dice si hubo problemas de disponibilidad. Si los hay, llévale ese dato a tu proveedor de hosting.
- Si todo lo técnico está bien, piensa en la demanda. La ayuda de Google lo resume así: cuanta más calidad tenga el contenido del sitio, mayor será la demanda de rastreo. Eso no se arregla tocando el XML. Revisa antes las páginas duplicadas, vacías o sin interés para nadie.
- Cuida el archivo. La página del episodio recomienda incluir solo URLs canónicas, sin parámetros de seguimiento, y una fecha lastmod real. Si pones la fecha de hoy en todas las páginas, Google puede ignorar ese dato.
- No lo desactives. El mismo resumen aconseja mantener activo el sitemap que genera tu gestor de contenidos, también en webs pequeñas: no perjudica y ayuda a descubrir páginas cuando el sitio crece.
Relacionado: Cuánto tarda Google en rastrear e indexar, según sus datos
Fuentes
- Google, Search Off the Record, episodio «Do sitemaps still matter?», 1 de octubre de 2026 (en inglés)
- Google, ayuda de Search Console, «Gestionar sitemaps con el informe "Sitemaps"»
- Google, «Crear y enviar un sitemap»
- Google, «Gestión del presupuesto de rastreo»
- Google, ayuda de Search Console, informe «Estadísticas de rastreo»
- Search Engine Journal, 6 de octubre de 2026 (en inglés)
Actualizaciones: si Google cambia el texto del aviso en Search Console o su documentación sobre este error, se añadirá aquí con su enlace.