Qué es el SEO para IA (GEO) y cómo se trabaja
El SEO para IA, también llamado GEO (generative engine optimization), es el conjunto de decisiones técnicas y editoriales que hacen que un contenido pueda ser recuperado y citado por sistemas generativos como ChatGPT, Gemini, Perplexity o los resúmenes de Google. Se apoya en tres condiciones comprobables: acceso de sus rastreadores al contenido, respuestas autónomas y extraíbles dentro de la página, y entidades declaradas mediante datos estructurados y menciones externas verificables.

Por Pol Serrate · CEO y Cofounder
SEO specialist, CRM y automatización de procesos con IA. Con más de 9 años de experiencia en marketing orgánico y estrategia digital.
Ver perfil de Pol Serrate
Buena parte de lo que se publica sobre GEO son afirmaciones sin mecanismo detrás: listas de recomendaciones que nadie explica cómo se comprueban. Este artículo separa lo que se puede verificar de lo que hoy no se puede, porque esa distinción es la parte útil del tema.
Qué es el SEO para IA
La diferencia con el SEO clásico está en el destinatario. El SEO tradicional trabaja para que una página aparezca en una lista de resultados y reciba un clic. El GEO trabaja para que el contenido sea recuperado, entendido y citado dentro de una respuesta que el sistema redacta, con o sin clic posterior.
Eso cambia la unidad de trabajo. En SEO la unidad es la página. En GEO la unidad es el fragmento: el bloque de texto que responde una pregunta completa y que puede extraerse sin el resto de la página alrededor. Un artículo excelente cuya respuesta está repartida en seis párrafos rinde peor que uno mediocre que la concentra en tres frases bajo un encabezado claro.
Y cambia también qué cuenta como resultado. La mención de marca dentro de una respuesta y la recomendación explícita no son lo mismo, aunque suelan presentarse juntas. Ser citado como fuente de un dato es frecuente y medible. Ser recomendado como proveedor es otra cosa, depende de factores que están fuera de la propia web, y prometerlo no es defendible.
Diferencias entre SEO y GEO
| SEO | GEO | |
|---|---|---|
| Objetivo | Posición en la lista de resultados | Citación dentro de la respuesta |
| Unidad de trabajo | La página | El fragmento que responde |
| Resultado esperado | Clic y visita | Mención, con o sin visita |
| Medición | Search Console: impresiones, clics, posición | Registros de servidor, referencias, consultas propias |
| Señal principal | Enlaces y relevancia | Extraibilidad y consistencia de entidad |
| Papel de terceros | Enlaces entrantes | Menciones en fuentes que el sistema recupera |
| Control sobre el resultado | Parcial | Menor |
La tabla puede sugerir que son disciplinas separadas y no lo son. Un contenido que no está indexado en un buscador tampoco entra en la mayoría de sistemas generativos, porque la mayoría se apoyan en un índice de búsqueda para encontrar de qué hablar. El GEO se construye encima del SEO, no al lado.
Cómo decide un modelo generativo a quién cita
Un modelo de lenguaje no consulta una base de datos de webs cuando responde. Lo que ocurre en los productos que citan fuentes es un proceso en tres pasos:
- Recuperación. El sistema convierte la pregunta del usuario en una o varias consultas de búsqueda y recupera un conjunto de documentos. Unos usan su propio índice, otros el de un buscador, otros ambos.
- Selección. De esos documentos extrae los fragmentos que considera que responden. Aquí es donde un contenido bien estructurado gana terreno: si la respuesta está contenida en un bloque autónomo, ese bloque es candidato directo.
- Redacción y atribución. Con los fragmentos seleccionados redacta una respuesta y atribuye las fuentes de las que ha tomado la información.
De ese proceso se deducen las tres condiciones del principio. Si el rastreador no accede al contenido, no hay recuperación. Si el contenido no contiene respuestas autónomas, hay recuperación pero no selección. Si la entidad no está declarada de forma consistente, el sistema puede usar la información sin saber a quién atribuirla.
Hay un cuarto factor que no está en la propia web y pesa bastante: lo que otras fuentes dicen. Los sistemas recuperan también comparativas, directorios, foros y notas de prensa. Una marca que no aparece en ninguna de esas fuentes tiene menos ocasiones de ser recuperada, por muy bien construida que esté su web.
Qué sistemas generativos citan fuentes y en qué se diferencian
Tratarlos como un bloque único lleva a conclusiones equivocadas, porque no recuperan igual ni citan igual.
| Sistema | De dónde recupera | Cómo cita | Qué implica |
|---|---|---|---|
| Resúmenes de un buscador | Su propio índice | Enlaces junto al resumen | Estar indexado y posicionado sigue siendo la vía |
| Asistentes conversacionales con búsqueda | Índice propio, de terceros o ambos | Fuentes numeradas | El acceso del rastreador correspondiente es condición previa |
| Buscadores conversacionales | Índice propio con rastreo continuo | Citación por frase | Premian el contenido reciente y bien estructurado |
| Asistentes sin búsqueda activa | Solo lo aprendido en el entrenamiento | Rara vez citan | La web no influye en tiempo real |
La última fila explica una confusión frecuente. Cuando un asistente responde sin buscar, contesta con lo que quedó en su entrenamiento, que tiene una fecha de corte y no se actualiza. Que una marca aparezca o no en esa respuesta depende de la presencia acumulada en el material de entrenamiento, y ahí no hay ninguna acción técnica que produzca efecto a corto plazo.
Donde sí lo hay es en los tres primeros casos, que son los que recuperan contenido en el momento de responder. Por eso la primera pregunta de un análisis serio es cuál de estos escenarios importa para el negocio concreto, en lugar de tratarlos todos igual.
Condiciones técnicas para aparecer en respuestas de IA
Las que se pueden comprobar y corregir:
Acceso de los rastreadores. Cada sistema tiene sus agentes y robots.txt los gobierna. Conviene revisar cuáles están permitidos y con qué finalidad: los hay dedicados a recuperación para búsqueda, a navegación iniciada por el usuario y a recopilación para entrenamiento. Bloquear el de entrenamiento y permitir el de búsqueda es una decisión legítima y distinta de bloquearlos todos. Un bloqueo indiscriminado equivale a no existir para esos sistemas.
Contenido servido en HTML. Si la respuesta solo aparece después de ejecutar código en el navegador, buena parte de los rastreadores no la ve. La generación en servidor o en tiempo de construcción resuelve esto.
Fragmentos autónomos. Cada encabezado debe formar con el párrafo siguiente una unidad que responda algo completo. Es la misma disciplina que produce fragmentos destacados, aplicada de forma sistemática.
Datos estructurados. El marcado permite declarar de qué trata la página, quién la firma y a qué organización pertenece. Su valor está en establecer la entidad sin ambigüedad, más que en actuar como señal directa de citación.
Autoría verificable. Un artículo firmado por una persona identificable, con una página propia y una trayectoria comprobable, aporta un anclaje que un texto anónimo no tiene.
Consistencia de entidad. El mismo nombre, la misma descripción y los mismos datos identificativos en la web, en los perfiles externos y en los directorios donde aparezca la marca.
Presencia en fuentes de terceros. Comparativas, listados sectoriales y menciones en publicaciones. Es la parte más lenta y la que menos depende del trabajo técnico.
Sobre el archivo llms.txt conviene decir que publicarlo es barato y no perjudica, pero ningún proveedor grande ha confirmado que lo use como fuente, y Google Search lo ha descartado de forma explícita para sus funciones generativas. Está tratado con detalle en otro artículo.
Cómo medir si ChatGPT o Perplexity mencionan tu marca
Esta es la parte que separa un servicio de GEO de una declaración de intenciones. Cuatro mediciones, ninguna perfecta, todas ejecutables:
Registros del servidor. Es la medición más directa y la menos usada. Filtrando por agente de usuario se ve qué rastreadores de sistemas generativos han pasado por el sitio, con qué frecuencia y qué URL han pedido. Responde a la pregunta previa a todas las demás: si el contenido está siendo recuperado o si el trabajo se está haciendo sobre un sitio que esos sistemas no visitan.
Consultas propias, repetidas y registradas. Se define un conjunto de preguntas que un comprador real haría (entre veinte y cuarenta, no tres), se lanzan en cada sistema con una periodicidad fija y se anota si la marca aparece, en qué posición y con qué formulación. Es trabajo manual o automatizable, y es la única forma de tener una serie temporal comparable. Conviene registrar también qué fuentes se citan en lugar de la marca: eso indica dónde hay que estar.
Tráfico de referencia. Las visitas procedentes de los dominios de estos sistemas aparecen como referencia en la herramienta de analítica. Mide solo la parte que termina en clic, que es una fracción, pero es un dato limpio y con histórico.
Herramientas de búsqueda del propio buscador. Las impresiones procedentes de resúmenes generativos se contabilizan junto al resto del tráfico de búsqueda, sin desglose específico. Eso limita lo que se puede concluir, y conviene decirlo en lugar de presentar cifras como si el desglose existiera.
Ninguna de las cuatro da una posición como la que da un informe de SEO. Lo que dan, combinadas, es una serie temporal que permite saber si el trabajo está produciendo efecto. Cualquier servicio que prometa más que eso está prometiendo algo que hoy no se puede medir.
Qué parte del SEO tradicional sigue siendo necesaria
Casi toda. Y esto es lo que más contradice el marco de "el SEO ha muerto, ahora toca GEO".
Los sistemas generativos que citan fuentes se apoyan en índices de búsqueda para encontrarlas. Un sitio que no está indexado, que tarda en responder, que tiene la arquitectura confusa o que no resuelve la intención de búsqueda tiene el mismo problema en los dos escenarios. La indexación, el rendimiento, la estructura de URL, el enlazado interno y la calidad del contenido siguen siendo la base.
Lo que el GEO añade es una capa de exigencia adicional sobre esa base: la respuesta tiene que ser extraíble, la entidad tiene que ser inequívoca y la marca tiene que aparecer en fuentes que el sistema recupere. Nada de eso funciona sobre un sitio con problemas técnicos sin resolver.
Qué no se puede controlar ni prometer
- Aparecer en una respuesta concreta. No hay mecanismo para forzarlo ni forma de garantizarlo.
- La estabilidad de lo conseguido. Una marca citada este mes puede no serlo el siguiente sin que nada haya cambiado en su web. Los sistemas se actualizan sin previo aviso y sin registro público de cambios.
- Cómo se describe la marca. El sistema redacta con lo que encuentra, incluidas fuentes ajenas.
- El reparto entre mención y visita. Una respuesta que resuelve la duda del usuario puede no generar ningún clic aunque cite la fuente.
- Los factores de selección. Ningún proveedor ha publicado cómo pondera. Lo que hay son observaciones agregadas, no documentación.
Un servicio de GEO puede comprometerse a las condiciones técnicas, al método y a la medición. Comprometerse a la visibilidad en modelos generativos no es defendible con lo que hoy se conoce.
Preguntas frecuentes sobre SEO para IA
¿Cómo se llama el SEO para IA?
GEO, de generative engine optimization u optimización para motores generativos. También aparece como AEO (answer engine optimization) y, con menos frecuencia, como SEO para LLM.
¿Cómo hacer SEO para la IA?
Garantizando el acceso de los rastreadores en robots.txt, sirviendo el contenido en HTML, estructurando cada sección como una respuesta autónoma, declarando la entidad con datos estructurados y autoría verificable, y trabajando la presencia en las fuentes de terceros que estos sistemas recuperan.
¿Qué es SEO AI?
Es otra denominación del mismo trabajo. Conviene distinguirlo de usar inteligencia artificial como herramienta para producir contenido, que es una cosa distinta.
¿Cuáles son los 4 tipos de SEO?
Habitualmente se distinguen SEO técnico, SEO de contenidos (u on page), SEO externo (u off page) y SEO local. El GEO se apoya en los cuatro y añade requisitos propios de extraibilidad y de entidad, en lugar de constituir una quinta categoría separada.
¿El SEO es gratuito?
No aparece coste de compra de espacio, a diferencia de la publicidad, pero sí coste de trabajo: análisis, corrección técnica, producción de contenido y medición. Lo mismo se aplica al GEO.
¿Qué diferencia hay entre SEO y GEO?
El SEO busca posición en una lista de resultados y clic. El GEO busca citación dentro de una respuesta redactada por el sistema. El segundo se construye sobre el primero.
¿El GEO sustituye al SEO?
No. Los sistemas generativos que citan fuentes se apoyan en índices de búsqueda, así que un sitio invisible para un buscador también lo es para ellos.
¿Se pueden garantizar resultados en GEO?
No. Se puede comprometer el cumplimiento de las condiciones técnicas, el método de trabajo y la medición periódica. La aparición en una respuesta concreta no depende de nadie.