SEO técnico en la era de la IA: de rankear a que la IA te cite

Pasé meses construyendo thatseoagent, una herramienta que audita SEO pensada para la era de la IA. No te voy a aburrir con la arquitectura por dentro. Lo interesante fue la pregunta que construirla me obligó a responder: qué significa el SEO técnico ahora que el objetivo ya no es solo aparecer en la lista azul de Google, sino que un sistema de IA (ChatGPT, Perplexity, Claude, los AI Overviews) te lea, te extraiga y te cite. Esto es lo que cambió, y lo que sigue igual.
Lo que cambió: de rankear a ser citado
El SEO técnico clásico sigue siendo la base. Pero el objetivo final se movió, y con él, casi todo lo demás:
| SEO clásico | SEO en la era de la IA | |
|---|---|---|
| Meta | Rankear en la página 1 | Ser citado en una respuesta generada |
| Unidad | La página completa | El pasaje extraíble (40 a 60 palabras) |
| Consulta | Una keyword por página | Un cluster temático completo |
| Quién lee | Un humano que hace clic | Un humano y un agente que lee el DOM |
| Confianza | Backlinks + E-E-A-T | E-E-A-T + consenso de terceros |
La regla que me quedó grabada: escribe para personas, organiza para que la máquina extraiga. No son objetivos opuestos.
La base no negociable (esto no cambió)
Antes de pensar en IA, hay cosas que tienen que estar impecables, porque un fallo aquí invalida todo lo demás: si Google no puede rastrear, renderizar e indexar tu página, ningún sistema de IA la va a citar.
- Rastreable e indexable:
robots.txtsin bloqueos accidentales, sitemap solo con URLs canónicas y 200, arquitectura plana (lo importante a 3 clics de la home), sin huérfanas ni cadenas de redirects. - Canonical autorreferente y consistencia de protocolo y dominio (HTTPS, www o no-www, slash final).
- Core Web Vitals en verde. Y ahora importa el doble: un agente que renderiza tu página necesita ver contenido real rápido, no una pantalla en blanco esperando a que carguen cuatro frameworks.
Nada de esto es nuevo. Lo nuevo es que ahora es el precio de entrada para algo más grande.
Deja entrar a los bots de IA
Este es el punto que más gente pasa por alto. Cada plataforma de IA tiene su propio crawler, y si lo bloqueas en robots.txt, esa plataforma no puede citarte. Punto.
| Bot | Plataforma |
|---|---|
GPTBot, ChatGPT-User |
OpenAI (ChatGPT) |
PerplexityBot |
Perplexity |
ClaudeBot, anthropic-ai |
Anthropic (Claude) |
Google-Extended |
Gemini y AI Overviews |
Bingbot |
Copilot (vía Bing) |
Es una decisión de negocio: bloquear evita que entrenen con tu contenido, pero también evita la cita. Un punto medio razonable es bloquear solo los crawlers de entrenamiento puro y dejar pasar los que alimentan las respuestas.
Del keyword al cluster: el query fan-out
Los sistemas de IA de Google no responden solo la consulta que el usuario escribió: generan varias consultas relacionadas a la vez y sintetizan sobre todas. Google lo documenta y lo ejemplifica en su guía de optimización para funciones generativas: "cómo arreglar un césped lleno de malezas" dispara sub-consultas sobre los mejores herbicidas, cómo quitar malezas sin químicos y cómo prevenirlas.
La implicación es directa: una página por keyword ya no alcanza. Tienes que cubrir el cluster temático completo, porque la autoridad sobre un tema pesa más que el long-tail exacto (la IA entiende sinónimos). Cuando planifico contenido ahora, primero listo las 5 a 10 consultas a las que la IA va a hacer fan-out, y me aseguro de cubrirlas.
Estructura para que la máquina extraiga
La IA no cita páginas, cita pasajes. Cada afirmación clave tiene que funcionar sola, fuera de contexto. Lo que aplico:
- Lead directo: cada sección empieza respondiendo, no dando rodeos.
- Bloques de 40 a 60 palabras para el pasaje que quieres que se cite.
- Encabezados que imitan la consulta (el H2 con la pregunta tal como la escribe la gente).
- Tablas para comparativas, listas numeradas para procesos. La prosa densa no se extrae bien.
Detalle importante de Google, y conviene citarlo literal porque circula mucha desinformación: "no necesitas crear archivos legibles por máquina, archivos de texto para IA, ni markup para aparecer en estas funciones. Tampoco hay datos estructurados especiales de schema.org que debas añadir". Esos patrones extraíbles ayudan sobre todo a los otros motores (ChatGPT, Claude, Perplexity) y no le hacen daño a Google.
Eso no significa que servir contenido legible por máquina no sirva de nada, significa que Google no lo pide. Los agentes que leen fuera de Google sí lo agradecen, y ahí es donde entra servir markdown por content negotiation: un agente que pide tu página con Accept: text/markdown recibe el texto sin el ruido del HTML.
Quién está detrás: entidad y E-E-A-T
La IA quiere saber quién eres antes de citarte. Eso se construye por capas: primero que el Knowledge Graph te reconozca como entidad (schema Organization, sameAs a tus perfiles, presencia en directorios), luego páginas que lo prueben (about, autor con credenciales, contacto), y de ahí a que te citen en tu categoría y en contenido informativo. Sin señales de entidad, eres una página anónima, y las páginas anónimas no se citan.
Citar no es recomendar (la parte incómoda)
Aquí está el matiz que más cuesta aceptar. Que la IA te cite significa que tu contenido fue útil como fuente. Que te recomiende (que entres en la lista corta del comprador) es otra cosa, y la gobierna el consenso de toda la web: reviews, foros, prensa, analistas. Eso es en gran parte independiente de tu propio contenido.
La escalera de visibilidad es: recuperado, citado, mencionado, recomendado. Y cuidado con los listicles autopromocionales tipo "los mejores [tu categoría]": para marcas emergentes suelen salir mal, porque la IA termina recomendando al competidor con más consenso externo, aunque el artículo lo publiques tú.
Cierre
El SEO técnico no murió con la IA: se volvió el cimiento de algo más grande. La base de siempre (rastreo, indexación, velocidad, semántica) ahora habilita un objetivo nuevo, ser citado y, con suerte, recomendado por los sistemas que cada vez más gente usa en lugar de la búsqueda tradicional. Es exactamente el trabajo que hago cuando alguien me contrata para SEO técnico: dejar la base impecable y organizar el sitio para que tanto Google como la IA puedan encontrarlo, entenderlo y citarlo.
Preguntas frecuentes
¿El SEO técnico sigue sirviendo con la IA?
Sí, más que nunca. Es el cimiento: si un buscador no puede rastrear, renderizar e indexar tu página, ningún sistema de IA la va a citar. Lo que cambió es el objetivo final, de rankear a ser citado.
¿Tengo que bloquear los bots de IA en robots.txt?
Depende de tu estrategia. Bloquearlos evita que entrenen con tu contenido, pero también evita que te citen en sus respuestas. Si quieres visibilidad en ChatGPT, Perplexity o los AI Overviews, tienes que dejarlos entrar.
¿Qué es el query fan-out?
Cuando la IA no responde solo la consulta escrita, sino que genera varias consultas relacionadas a la vez y sintetiza sobre todas. Por eso conviene cubrir el cluster temático completo en vez de una página por keyword.
¿Necesito schema y ficheros especiales para que Google me cite?
Google dice que para sus AI Overviews no hacen falta: basta contenido útil, HTML semántico y E-E-A-T. El schema y los ficheros legibles por máquina ayudan sobre todo a los otros motores y a los agentes, y no perjudican.