AI Trust AuditBETA
    Volver al resumen
    Estudios y benchmarks

    Lo que los rastreadores de IA ven – y lo que no

    GEO Expert5. mayo 20267 min de lectura
    Lo que los rastreadores de IA ven – y lo que no

    Mucho de lo que se da por sentado en el día a día del SEO es invisible para los LLM en modo conversación. El nuevo estudio de Writesonic 2026 ha analizado seis grandes rastreadores de LLM (ChatGPT, Claude, Gemini-Conversation, Perplexity, Bing Copilot, Google AI Overviews) y confirma: todos los contenidos deben entregarse de forma que sigan siendo comprensibles sin JavaScript, sin necesidad de hacer mucho scroll y sin metadatos en el head.

    Los tres niveles de rastreadores (HTML-only / Headless / Full-Browser)

    Para clasificarlos, ayuda utilizar una cuadrícula sencilla en la que los actuales rastreadores de LLM suelen caer en los niveles 1-2:

    • Nivel 1: Parser solo HTML – leen HTML estático, siguen enlaces de forma limitada, no ejecutan JavaScript y no hacen scroll.
    • Nivel 2: Headless Light – pueden parsear HTML de forma más robusta, tienen en cuenta fallbacks individuales (por ejemplo, <noscript>), pero sin renderizado real ni scroll.
    • Nivel 3: Navegador completo – ejecutan JavaScript y un renderizado complejo, y hacen scroll. Sin embargo, en el estudio predominan los comportamientos de los niveles 1-2.

    Lo que los 6 LLM ven de forma fiable — y lo que no

    Las pruebas de Writesonic revelan patrones claros:

    • 3 de cada 6 LLM no ejecutan JavaScript. El contenido solo JS (SPA, reseñas inyectadas en el lado del cliente, contenido con carga diferida o lazy-load) permanece invisible.
    • 0 de cada 6 LLM leen JSON-LD en modo de conversación en vivo. Importante: JSON-LD sigue siendo relevante para el índice de búsqueda de Google; son dos mundos distintos.
    • 0 de cada 6 LLM leen la meta-description o las etiquetas OG en modo conversación.
    • 5 de cada 6 LLM leen la etiqueta <title> de forma fiable. Por lo tanto, es el elemento de cabecera más importante para la lectura de los LLM.
    • 0 de cada 6 LLM hacen scroll. El contenido "below the fold" (debajo del primer pantallazo) y las imágenes/bloques de texto cargados por lazy-load son ignorados.
    • 4 de cada 6 LLM leen fallbacks de <noscript>.
    • El contenido oculto por CSS (por ejemplo, display:none, acordeones) es visible; el pseudocontenido ::before/::after es invisible.
    • Los Microdatos en el cuerpo (body) se leen mejor que el JSON-LD en el head.

    La etiqueta Title es el nuevo oro — recomendación práctica

    Si 5 de cada 6 rastreadores leen el título de forma fiable, este se convierte en la palanca central. Recomendaciones:

    • Preciso, denso en información, de menos de 60 caracteres; evite frases vacías.
    • Propuesta de estructura: Tema principal | beneficio concreto | marca.
    • Varíe según el tipo de página (categoría, producto, guía), pero mantenga la terminología consistente.
    • Coloque los términos más potentes primero; el nombre de la marca al final, a menos que haya una fuerte demanda de marca.
    • Sincronice semánticamente el H1 y el Title sin que sea una copia exacta: el Title sintetiza, el H1 explica.

    El JSON-LD no ha muerto, pero los Microdatos ganan en la lectura de LLM

    El estudio muestra que: En el modo conversación no se lee el JSON-LD, mientras que los microdatos en el body sí suelen leerse. Recomendación de acción:

    • Mantenga el JSON-LD para el índice de búsqueda (productos, FAQs, organización, breadcrumbs).
    • Refleje los datos críticos adicionalmente como microdatos directamente en el cuerpo visible (precios, disponibilidad, valoraciones), con un contenido idéntico al del JSON-LD.
    • Evite contradicciones entre los datos estructurados y el texto visible.
    • Utilice elementos HTML semánticos (article, header, nav, main, footer) para estructurar limpiamente el contenido del cuerpo para los parsers.

    Lazy Loading y Below-the-fold — los asesinos subestimados

    Dado que 0 de cada 6 LLM hacen scroll, los mecanismos de lazy-load dejan fuera de la percepción contenidos centrales. Consecuencias:

    • Coloque la declaración principal, los USP del producto, los precios y las llamadas a la acción primarias por encima de la altura del primer viewport.
    • Cargue las imágenes y contenidos de texto relevantes para el "hero" sin lazy-load (o con un fallback inline en el servidor). No utilice inyección puramente en el cliente para los contenidos principales.
    • Ofrezca fallbacks de <noscript> para activos críticos (por ejemplo, imágenes estáticas de productos, extractos de texto).
    • Compruebe las SPA y los widgets de reseñas: sin renderizado en el servidor, permanecen invisibles.

    Cómo lo aplica nuestra auditoría

    Estamos ampliando las auditorías técnicas con cuatro verificaciones específicas y ajustando las ponderaciones de forma moderada:

    • title_tag_present: Comprueba la existencia, longitud y precisión de la etiqueta title por URL.
    • lazy_loaded_main_content: Advertencia si el contenido esencial se carga exclusivamente por lazy-load o solo es visible tras la interacción.
    • noscript_fallback_present: Registra si existe un fallback <noscript> para módulos de texto/imágenes críticos.
    • css_generated_critical_content: Reporta riesgo si se genera copia relevante a través de pseudoelementos CSS (::before/::after). La ponderación de las señales individuales on-page se desplaza moderadamente a favor del HTML above-the-fold y la calidad del marcado semántico.

    Conclusión y 5 medidas concretas para gestores de tiendas

    El estudio separa las señales de SEO clásicas de lo que los LLM captan realmente en modo diálogo. Apueste por contenidos robustos, entregados primero en HTML, y asegure la información crítica contra las limitaciones de renderizado. Cinco medidas de prioridad:

    1. Refinar el programa de títulos: Cada página de categoría y cada producto recibe un título preciso, corto y orientado al beneficio.
    2. Reforzar el Above-the-fold: USP, precio, disponibilidad, CTA primaria y un párrafo descriptivo directamente en el HTML renderizado por el servidor.
    3. Mejora progresiva en lugar de solo JS: Operar las SPA y widgets con SSR/ISR o fallbacks estáticos; no inyectar copia crítica vía JavaScript.
    4. Duplicar datos estructurados: Mantener JSON-LD, pero marcar la información clave adicionalmente como microdatos en el cuerpo.
    5. Verificación de fallback y CSS: Fallbacks <noscript> para módulos centrales; no emitir textos críticos para el negocio en ::before/::after.

    Los resultados de Writesonic proporcionan así directrices claras: lo que no está en el HTML inicial y por encima del pliegue (fold), no existe para muchos LLM. Ajuste sus plantillas en consecuencia y valídelo regularmente con comprobaciones reales de rastreadores.