El SEO técnico se está simplificando por defecto, pero las decisiones relacionadas con los bots, los archivos LLMs.txt y los datos estructurados se están volviendo más complejas.
El Web Almanac 2025 presenta datos que confirman la mejora continua en fundamentos técnicos de SEO: la adopción de HTTPS supera el 91%, las etiquetas <title> alcanzan casi el 99% de uso y las meta etiquetas viewport alrededor del 93%. Sin embargo, persisten desafíos, como la brecha en rendimiento móvil y la falta de implementación de etiquetas canónicas en cerca de un tercio de las páginas.
Las plataformas CMS y sus plugins consolidan prácticas predeterminadas (robots.txt, sitemaps, datos estructurados, etc.), aunque aún se observan rastros de estándares obsoletos (como la referencia a “msnbot” o el uso de AMP) en los datos de la web.
Por otro lado, la influencia de la IA aparece en nuevas dinámicas: robots.txt se emplea cada vez más como documento de políticas y surgen archivos llms.txt con adopción creciente (alrededor del 2% de sitios con un archivo válido).
Incluso los esquemas estructurados de tipo FAQPage están en alza pese a las restricciones en los resultados de Google. En conjunto, el SEO en 2026 será una evolución incremental: con mejores estándares técnicos de base y una capa adicional de decisiones impulsadas por la IA.
Contenidos
Introducción
Determinar el estado actual del SEO es complejo, pues hay múltiples opiniones. Para aportar un análisis fundamentado, el autor utilizó los datos del Web Almanac 2025, que ofrece información rigurosa sobre el web y su desempeño SEO. A partir de los hallazgos del capítulo SEO 2025 de este estudio, es posible identificar tendencias emergentes durante 2025 y proyectar sus implicaciones para el SEO en 2026. Este artículo resume esas tendencias clave sin especular más allá de los datos presentados.
Estándares de SEO en aumento
Los datos más recientes muestran una mejora sostenida en los estándares técnicos de SEO. Por ejemplo, la adopción de HTTPS superó el 91% de los sitios muestreados El uso de etiquetas <title> es prácticamente universal (~99%), y las meta etiquetas viewport ya están en más del 93% de las páginas.
La implementación de la etiqueta canonical subió al 67% en 2025 (desde ~65% en 2024) Además, la validez del HTML ha mejorado; por ejemplo, los elementos inválidos en <head> cayeron del 10.6% al 10.1% en desktop (y del 10.9% al 10.3% en móvil) Las tasas de error en robots.txt han disminuido (por ejemplo, los errores 404 bajaron del 14% al 13%) , y el uso de meta robots (index/follow) creció levemente hasta el 46.2% en 2025
Estos valores reflejan cambios constantes y positivos: la web se ve más segura y fácil de rastrear No obstante, aún hay trabajo por delante en 2026, incluso si las métricas básicas parecen estables
| Métrica SEO | 2024 | 2025 |
| HTTPS adoptado | no especificado | >91% |
| Etiqueta <title> | no especificado | ~99% |
| Meta viewport | no especificado | >93% |
| <link rel=”canonical”> | 65% | 67% |
| HTML inválido en <head> (desktop) | 10.6% | 10.1% |
| Errores 404 en robots.txt | 14% | 13% |
| Meta robots (index/follow) | 45.5% | 46.2% |
Tabla: Comparativa de métricas técnicas SEO (Web Almanac 2025, comparado con datos previos)
A pesar de estos avances, algunos sitios aún no cumplen con todas las mejores prácticas. Sin embargo, el panorama general es alentador: los estándares de SEO básicos siguen mejorando año tras año, principalmente impulsados por configuraciones predeterminadas y mejoras en plataformas web
Consolidación de los “predeterminados” de SEO
Los sistemas de gestión de contenido (CMS) y sus plugins SEO tienen un rol fundamental al establecer las prácticas predeterminadas del sector Cada vez más sitios web usan un CMS (por ejemplo, WordPress es dominante), y los plugins de SEO típicos de estas plataformas imponen ciertos elementos por defecto. Entre los componentes claves que se están convirtiendo en estándar de la industria destacan:
- robots.txt
- sitemap.xml
- Etiquetas canonical
- HTML semántico
- Datos estructurados
Estos elementos suelen estar disponibles en muchos CMS o requieren solo configuraciones básicas , lo que aumenta la probabilidad de que se conviertan en buenas prácticas generalizadas.
Implicaciones para 2026:
- Colaborar con los creadores de plataformas y herramientas SEO será crucial para influir en la dirección futura del SEO.
- Las herramientas SEO continuarán aplicando buenas prácticas y podrían integrar funciones de IA en segundo plano, acelerando análisis y sugerencias.
- El uso de datos estructurados posiblemente se impulsará no solo por las recompensas en resultados de búsqueda, sino también para obtener conjuntos de datos más predecibles y recuperables.
En resumen, las configuraciones por defecto en CMS y plugins están elevando el nivel mínimo de calidad técnica de muchos sitios, aunque no garantizan por sí solas una web perfecta.
Prácticas obsoletas, pero no olvidadas
Aunque la atención suele centrarse en nuevas características, los datos muestran que varios estándares antiguos siguen presentes en la web:
- En las declaraciones de meta robots aún aparece “msnbot” entre los cinco más comunes, pese a que se eliminó hace más de 16 años.
- El uso de AMP ha caído drásticamente, pero todavía se encuentra en más de 38,000 páginas de inicio (y el proyecto amp.dev no ha tenido actividad reciente).
- Los valores de meta robots más comunes siguen siendo “index” y “follow”, que son implícitos por defecto y, en la práctica, suelen ser ignorados tanto en desktop como en móvil.
Estos ejemplos ilustran que las actualizaciones en la web se producen de forma gradual; es probable que rastros de prácticas obsoletas persistan en los datos durante años.
Más trabajo pendiente
No todos los aspectos avanzan al mismo ritmo: ciertos indicadores no muestran mejoras relevantes o aún necesitan atención:
- Brecha de rendimiento móvil: Aunque mejora, persiste una diferencia notable entre experiencia desktop y móvil.
- Contenido duplicado: Alrededor del 33% de las páginas analizadas carecen de etiqueta canonical, lo que dificulta la gestión de contenido duplicado.
- Configuraciones avanzadas: Prácticamente no han cambiado desde el año anterior: aproximadamente el 67% de las imágenes no tienen atributos de carga (loading), y más del 91% de los iframes tampoco los especifican.
- Estándares anticuados: Como se indicó, muchos no desaparecen fácilmente.
Parte de la responsabilidad recae en los propios CMS y sus temas, cuyos puntajes medianos de rendimiento (por Lighthouse) siguen rezagados especialmente en móvil. Por otro lado, el estudio señala que una oportunidad importante de SEO técnico es que un sitio promedio construido con un CMS moderno y unos 30 minutos de configuración cuidadosa podría alcanzar estándares SEO altos.
Para 2026, se prevé que:
- Las brechas en rendimiento entre desktop y móvil continuarán cerrándose, pero de forma lenta.
- Persistirán vestigios de estructuras y decisiones previas en el código de la web, incluso si gran parte del enfoque del sector se dirige hacia la IA.
- En términos generales, predominará una “actividad normal” de SEO, con cambios graduales y constantes más que transformaciones radicales.
El concepto de la web “poniéndose al día”
La frase “la web se está poniendo al día” resume la dinámica actual de la industria. Existe una distinción clara entre la velocidad de la conversación en el sector de la búsqueda y la velocidad del cambio real en la infraestructura de internet.
A menudo se dice que el SEO cambia rápidamente, pero los datos sugieren que es la discusión sobre el SEO la que se mueve a gran velocidad, mientras que la web en sí misma cambia a un ritmo mucho más pausado y constante. El progreso observado en 2026 es el resultado de años de evangelización sobre HTTPS, etiquetas canónicas y validez de código que finalmente se han filtrado hacia la masa crítica de sitios web a través de actualizaciones de plataformas.
Este proceso de “puesta al día” se caracteriza por:
Un movimiento constante hacia un entorno más seguro y rastreable.
La consolidación de estándares impulsada por los CMS.
Una mejora incremental que a menudo ocurre de manera inadvertida para los usuarios finales y propietarios de sitios pequeños.
Sin embargo, el “largo rabo” (long tail) de la red sigue siendo desordenado. Mientras que los sitios líderes adoptan configuraciones avanzadas para la IA, una gran parte de la web todavía lucha con problemas básicos o mantiene configuraciones obsoletas que complican el panorama general.
Impacto de la IA en SEO
El análisis del Web Almanac buscó también cómo la IA influye en el SEO. Se observaron dos desarrollos importantes: robots.txt se está usando cada vez más como un documento de políticas (no solo para controlar rastreadores tradicionales) y la creación/adopción de llms.txt (destinado a bots de IA) es una señal de decisiones orientadas a LLM. Esto indica que la IA está añadiendo una capa nueva de consideraciones técnicas en el SEO.
La evolución del archivo robots.txt
Uno de los cambios más significativos observados en el último año es la transformación del archivo robots.txt. Lo que originalmente era una herramienta de “limpieza doméstica” para gestionar el presupuesto de rastreo se ha convertido en 2026 en un documento de política estratégica.
Este archivo ahora sirve como la interfaz principal donde las organizaciones deciden qué bots de IA están autorizados a ingerir su contenido y bajo qué condiciones. La gestión de este “muro de permisos” requiere un entendimiento profundo de la cadena de valor del contenido y de cómo la presencia o ausencia en los conjuntos de datos de los LLM puede afectar la visibilidad de una marca a largo plazo.
Tradicionalmente, robots.txt se empleaba para controlar rastreadores como Googlebot o Bingbot, asegurando que no bloquearan contenido por accidente. Ahora esa función se expande: ya no solo se usa para “mantenimiento de rastreo”, sino como una superficie de políticas web.
Por ejemplo, en 2025 se reportó un aumento notable de rastreadores asociados a IA en los archivos robots.txt analizados:
| Bot de IA | 2024 Desktop | 2025 Desktop | 2024 Móvil | 2025 Móvil |
| Gptbot | 2.9% | 4.5% | 2.7% | 4.2% |
| Ccbot | 2.7% | 3.5% | 2.4% | 3.2% |
| Petalbot | – | 4.0% | – | 4.4% |
| Claudebot | 1.9% | 3.6% | 1.6% | 3.4% |
Tabla: Participación de rastreadores recientes en robots.txt (datos 2024 vs 2025).
Estos porcentajes reflejan un crecimiento significativo: por ejemplo, Gptbot creció ~55% de 2024 a 2025. Esto plantea nuevos dilemas para 2026:
- Las empresas que ya gestionan bots deberán actualizar sus estrategias de rastreo IA.
- Las que no lo hacen sentirán presión para hacerlo.
- Robots.txt seguirá siendo la vía más clara y sencilla para manejar rastreadores, buenos o malos.
En 2026, los SEO estarán involucrados en debates de gestión de bots que abarcarán marketing, tecnología y seguridad. Preguntas como “¿qué bots debemos permitir?” afectarán presupuestos, ingresos y experiencia de usuario, por lo que el seguimiento de estos desarrollos será crucial.
LLMs.txt
LLMs.txt es un estándar web en desarrollo diseñado para guiar el comportamiento de rastreadores de modelos de lenguaje (LLM) y facilitar que obtengan contenido para generar respuestas. Es un archivo controversial y debatido, pero su importancia radica en el hecho de que muchos sitios ya lo consideran:
Al iniciar 2025, solo el 0.015% de los sitios tenía llms.txt. Sin embargo, los datos de todo el web indican que algo más del 2% de los sitios ya cuenta con un archivo llms.txt válido De estos archivos, el 39.6% proviene del plugin All in One SEO (AIOSEO) y el 3.6% de Yoast SEO Este número es bajo en términos absolutos, pero mucho más alto de lo que se esperaba, sugiriendo una aceleración en la adopción.
La razón principal de este crecimiento son plugins SEO que facilitan su habilitación. De hecho, la adopción de llms.txt ha seguido aumentando desde que se empezó a recolectar datos. Para 2026 se espera:es
- Más herramientas y plugins ofrecerán soporte para llms.txt si aún no lo hacen.
- Plugins como Yoast o Rank Math (que no activan llms.txt por defecto) representan oportunidades de crecimiento: muchos SEO podrían decidir habilitarlo aunque su eficacia no esté probada.
- La tasa de adopción continuará subiendo, aunque es difícil saber si llegará a considerarse una práctica recomendada aceptada.
En resumen, llms.txt funciona como un barómetro de la mentalidad orientada a la IA en SEO: incluso si su valor real es incierto, su creciente uso indica que la comunidad SEO está experimentando con esta nueva herramienta.
Recomendaciones para la gobernanza de bots
Es imperativo que las organizaciones realicen una auditoría exhaustiva de su política de bots. No se trata simplemente de bloquear o permitir, sino de entender cómo la exposición de los datos a diferentes LLM puede influir en la autoridad de la marca y en la captación de tráfico derivado. La implementación de llms.txt debe considerarse no como un gasto técnico, sino como una inversión en la precisión de la representación de la marca en los resultados generativos.
Crecimiento del esquema FAQ
Otro fenómeno interesante es el aumento en el uso del esquema FAQPage. Aunque Google anunció que limitaría la aparición de fragmentos FAQ en los resultados de búsqueda, esto no frenó la implementación del esquema. Las ediciones recientes del Web Almanac muestran que la adopción de FAQPage sigue creciendo. Esto sugiere que, en entornos de búsqueda impulsados por IA, las respuestas estructuradas (como FAQs) están siendo muy valoradas.
De hecho, se señala que el uso de FAQPage está en alza “mientras la búsqueda por IA cita fuertemente contenido de FAQ en sus respuestas”. Aunque puede haber correlación en lugar de causalidad, el incremento sostenido de este esquema indica que las estrategias SEO están cambiando con la IA: los FAQ proporcionan respuestas directas y estructuradas que la IA aprovecha.
Es probable que en 2026 continúe el crecimiento de esquemas de datos estructurados como FAQPage, aun si no se observan mejoras inmediatas en los resultados de búsqueda. En este contexto, justificar la implementación de datos estructurados es más fácil cuando se optimiza para la web en general, no solo para Google.
Enfoque en la retrievability y el valor del FAQ
La optimización de contenidos debe priorizar estructuras que la IA pueda “digerir” fácilmente. Esto incluye la adopción agresiva de esquemas que faciliten respuestas directas. El hecho de que la IA cite con frecuencia el contenido de FAQ sugiere que las marcas deben estructurar su conocimiento experto de manera que sea fácilmente extraíble, convirtiéndose en la fuente de verdad para los modelos de lenguaje.
No es una reescritura: una nueva capa sobre el SEO
¿Transformará la IA la web en 2026? Según los datos, no será un cambio radical, aunque la IA tendrá cada vez más peso. La conversación sobre SEO avanza rápido, pero los cambios reales en la web son graduales. El Web Almanac 2025 muestra que la higiene básica del SEO sigue mejorando año tras año, principalmente a través de configuraciones predeterminadas y comportamiento de las plataformas más que por optimizaciones deliberadas.
Al mismo tiempo, aún perduran estándares obsoletos y las configuraciones avanzadas varían mucho de un sitio a otro, lo que indica que el progreso es real pero incremental.
Lo que ha cambiado de forma significativa es la intención detrás del SEO. Como señala el autor, “robots.txt ya no es solo housekeeping de rastreo; se está convirtiendo en una superficie de políticas”, llms.txt introduce una nueva clase de decisiones y los patrones FAQ vuelven a subir no por características en SERPs, sino por el valor de respuestas estructuradas.
Así, 2026 no será recordado como el año en que el SEO terminó o renació, sino como el año en que se definió mejor la capa de búsqueda IA: una especie de “parche” adicional, no una reescritura fundamental.
Implicaciones para profesionales SEO:
- Mantener las buenas prácticas básicas (HTTPS, etiquetas meta, sitemaps, canónicos, etc.) como base sólida.
- Colaborar y adaptarse con CMS y herramientas SEO, aprovechando sus actualizaciones e incorporando IA en flujos de trabajo.
- Desarrollar estrategias de gestión de bots: definir qué rastreadores permitir o bloquear mediante robots.txt y considerar la adopción de llms.txt según convenga
- Aprovechar datos estructurados (como FAQPage) pensando más allá de Google, ya que cobran valor en entornos de búsqueda IA.
- Enfocarse en mejoras continuas: los avances serán incrementales, por lo que es clave monitorear tendencias y ajustar tácticas sin perder de vista lo comprobado.
Con estos lineamientos, los profesionales de SEO pueden prepararse para un 2026 donde la IA añade complejidad, pero sin perder el rumbo de las prácticas SEO fundamentales.
Conclusiones sobre la evolución del SEO
El análisis de la situación en abril de 2026 confirma que la web ha alcanzado un nivel de madurez técnica que antes parecía inalcanzable. Con una adopción de HTTPS superior al 91% y una casi total implementación de etiquetas de título, los fundamentos de una red rastreable están firmemente establecidos. No obstante, esta base sólida es solo el punto de partida para los nuevos retos que plantea la inteligencia artificial.
La transición hacia la gestión de la influencia de la IA, el uso de archivos de política como llms.txt y la optimización de la “recuperabilidad” de los datos marcan la frontera actual del SEO. La web se está “poniendo al día” con los estándares del pasado, pero al hacerlo, se encuentra con un nuevo conjunto de requisitos impuestos por el consumo de información por parte de máquinas.
Aquellos que logren equilibrar la limpieza técnica de su legado con una postura proactiva hacia la integración con la IA serán quienes definan el éxito en el entorno de búsqueda de 2026 y los años venideros.
Fuentes: Search Engine Land – “SEO in 2026: Higher standards, AI influence, and a web still catching up” ( https://searchengineland.com/seo-2026-higher-standards-ai-influence-web-catching-up-473540 ).
2025 Web Almanac SEO chapter ( https://almanac.httparchive.org/en/2025/seo ).










