Para que ChatGPT, Gemini o Perplexity te mencionen, tu sitio tiene que cumplir tres condiciones: que los crawlers de cada motor puedan leerlo, que el contenido se pueda extraer y citar sin ambigüedad, y que otras fuentes confirmen quién sos. La tercera es la que más se ignora y la que más pesa: un motor de IA no le cree a una empresa que solo habla de sí misma.
Lo sabemos porque auditamos nuestro propio sitio con esa lupa. Acá va qué revisar, en qué orden, y lo que encontramos en casa, incluidos los errores.
¿Cómo deciden los motores de IA a quién citar?
Un motor de IA puede responder de dos formas. De memoria, con lo que aprendió durante su entrenamiento. O buscando en vivo, cuando consulta la web en el momento y cita las fuentes que encontró. Cada forma depende de un crawler distinto.
OpenAI lo documenta con claridad en su página de crawlers: GPTBot recorre la web para entrenar los modelos, OAI-SearchBot es el que usa ChatGPT para buscar y citar, y ChatGPT-User es el que entra cuando un usuario le pide que visite una página. Permitir o bloquear cada uno tiene consecuencias distintas.
Google, por su parte, aclara en su documentación sobre funciones de IA en la búsqueda que para aparecer en AI Overviews rigen las mismas bases que para el SEO: que la página esté indexada y que sea útil. No hay un truco aparte. Si querés el panorama completo, está en GEO y SEO en 2026.
¿Pueden los crawlers de IA leer tu sitio?
Parece obvio y es donde más sorpresas aparecen. Tener Allow en el robots.txt no garantiza el acceso: el servidor, el firewall o el hosting pueden bloquear a un crawler aunque el robots.txt lo invite a pasar.
Nos pasó a nosotros. Nuestro robots.txt permitía explícitamente a GPTBot, pero al probar el acceso con el identificador de cada crawler, el hosting le devolvía un error a GPTBot mientras dejaba pasar a todos los demás. Lo verificamos alternando pedidos desde la misma conexión: no era un límite general, era un bloqueo específico a ese crawler.
La consecuencia práctica tuvo un matiz importante: como OAI-SearchBot sí entraba, ChatGPT podía encontrarnos y citarnos cuando buscaba en vivo; lo que no podía era aprendernos de memoria. Es un techo, no una pared, pero conviene saber cuál de las dos cosas tenés.
El otro frente es el JavaScript. Los crawlers de IA, en general, leen el HTML tal como sale del servidor y no ejecutan scripts. Todo lo que aparece recién cuando corre el JavaScript —textos que se cargan después, números que se animan desde cero— para ellos no existe, o existe con el valor inicial. Google explica cómo procesa su propio buscador el JavaScript en su guía de SEO para JavaScript; lo más seguro es que el contenido importante esté en el HTML desde el principio.
¿Qué hace que un contenido sea citable?
Un motor de IA arma su respuesta con fragmentos. Si tu contenido no se puede cortar en fragmentos que se entiendan solos, no lo va a usar. Lo que funciona:
- La respuesta al principio. Las primeras dos o tres oraciones de cada página tienen que responder la pregunta principal, sin introducción.
- Encabezados en forma de pregunta. Los motores descomponen la consulta del usuario en subpreguntas y buscan encabezados que coincidan. Cuando auditamos nuestras páginas principales, casi ninguna tenía un subtítulo formulado como pregunta: eran frases de marca, no las preguntas que hace la gente.
- Párrafos que se entienden solos. Cada bloque tiene que tener sentido si alguien lo lee aislado del resto.
- Datos con fuente. Una afirmación con un número y su origen es mucho más citable que un adjetivo.
- Datos estructurados. Marcar las preguntas frecuentes, los artículos y la organización con schema. Google explica para qué sirven en su introducción a los datos estructurados.
En nuestras páginas de servicio, las preguntas frecuentes ya existían como acordeón visible, pero sin el marcado que las identifica como tales. Generamos ese marcado a partir del contenido que ya estaba en pantalla, sin tocar el diseño, y hoy todas nuestras páginas comerciales lo tienen.
¿Por qué importa que otras fuentes hablen de vos?
Cuando buscamos nuestro propio nombre, casi todos los resultados eran de nuestro sitio. Para un motor de IA, eso es una empresa que habla sola.
La prueba de que las fuentes externas mandan la tuvimos en casa. En las consultas sobre Odoo aparecíamos con mucha más frecuencia que en cualquier otro tema, y la razón no era nuestro contenido sino el directorio oficial de partners de Odoo, una fuente de mucha autoridad que confirma quiénes somos y qué hacemos como partner de implementación de Odoo. En cambio, cuando buscamos lo mismo que buscaría un cliente —”mejores agencias de marketing en Córdoba”—, las respuestas se armaban con rankings y directorios de agencias en los que no figurábamos.
La conclusión es incómoda pero clara: estar en las fuentes que los motores leen para cada pregunta vale más que publicar un artículo más. Directorios del rubro, perfiles de partner, medios sectoriales y reseñas en Google son las piezas que un modelo usa para decidir si te menciona.
¿Qué es la consistencia de entidad?
Los motores de IA cruzan datos entre fuentes para decidir si una empresa es confiable: nombre, dirección, teléfono, qué hace, dónde opera. Si las fuentes no coinciden, bajan la confianza.
En nuestro caso, distintas fuentes mostraban direcciones distintas. No era un error: tenemos dos sedes en Córdoba. Pero declaradas de forma incompleta, para un motor parecían una contradicción. Lo resolvimos declarando las dos sedes en el marcado de Organization de schema.org, junto con el fundador, las áreas en las que trabajamos y los perfiles oficiales de la empresa, para que cualquier motor lea una sola entidad coherente.
Si tu empresa se llama igual o parecido a otra —nos pasa: hay otras empresas “Olpa” en otros países—, la consistencia es todavía más importante. Rubro, ciudad y país tienen que repetirse igual en todas las fuentes para que el motor no las confunda. Es el mismo principio que rige el SEO local.
¿Sirve el archivo llms.txt?
El llms.txt es una propuesta de estándar: un archivo en la raíz del sitio que resume en texto plano qué es la empresa y cuáles son sus páginas importantes, pensado para que un modelo de lenguaje lo lea sin recorrer todo el sitio.
Nosotros lo tenemos, con el catálogo completo de servicios y artículos, y se actualiza solo cada vez que publicamos. ¿Garantiza que te citen? No. Es una ayuda para los motores que lo leen, no un reemplazo de lo anterior. Si hubiera que priorizar, va después de que los crawlers puedan entrar, el contenido sea citable y la entidad sea consistente.
¿Cómo se mide si aparecés en ChatGPT?
No hay un Search Console para los motores de IA, así que la medición es más artesanal:
- Un set fijo de preguntas que haría tu cliente, de marca y de categoría (“¿qué empresas hacen tal cosa en Córdoba?”).
- Las mismas preguntas todos los meses en cada motor, registrando si aparecés, en qué posición, con qué tono y a qué fuente te atribuyen.
- El porcentaje de preguntas en las que aparecés, por motor y en total.
- El tráfico que llega desde los motores, que en GA4 aparece como referencias desde dominios como chatgpt.com o perplexity.ai.
Una aclaración honesta: algunos motores exigen cuenta o frenan las consultas automatizadas, así que parte de esta medición es manual. Conviene aceptarlo y hacerla igual, antes que no medir.
¿Dónde ayuda la inteligencia artificial?
La medición mensual se puede automatizar en buena parte: un script que hace el mismo set de preguntas a los motores que lo permiten, guarda las respuestas y usa un modelo de lenguaje para clasificar cada una —si te menciona, en qué lugar, con qué tono, junto a qué competidores—. El resultado es un tablero que muestra la tendencia mes a mes sin que nadie tenga que copiar y pegar respuestas.
¿Qué revisar en tu sitio, en orden?
- ¿Los crawlers de IA reciben tu sitio? Probalo con el identificador de cada uno, no solo mirando el robots.txt.
- ¿Tu contenido importante está en el HTML, sin depender del JavaScript?
- ¿Cada página responde su pregunta principal en las primeras oraciones?
- ¿Tus subtítulos son las preguntas que hace tu cliente?
- ¿Tenés marcado de Organization, Article y preguntas frecuentes?
- ¿Tu nombre, dirección y teléfono coinciden en el sitio, Google, redes y directorios?
- ¿Estás en los directorios y rankings que los motores leen para tu rubro?
- ¿Medís todos los meses las mismas preguntas en cada motor?
Preguntas frecuentes
¿El GEO reemplaza al SEO? No. Comparten la base —contenido útil, sitio rastreable, datos estructurados— y el GEO suma requisitos propios. Buena parte de lo que citan los motores sale de páginas que ya posicionan bien en Google. Lo comparamos en GEO vs. SEO.
¿Se puede pagar para aparecer en las respuestas de ChatGPT? Las menciones en las respuestas no se compran. Lo que se puede hacer es trabajar para ser la fuente más clara y confiable sobre tu tema, y estar en los lugares que los motores consultan.
¿Conviene bloquear a los crawlers de IA? Depende del negocio. Un medio que vive de su contenido puede tener motivos para bloquear el entrenamiento. Una empresa que vende servicios casi siempre gana más apareciendo en las respuestas que protegiendo sus textos.
¿Cuánto tarda en notarse? Los cambios técnicos —acceso de crawlers, marcado, consistencia— se reflejan cuando los motores vuelven a recorrer el sitio, lo que puede llevar semanas. Las menciones externas son lo más lento y lo que más pesa.
¿Sirve para una PyME local? Sí. Cuando alguien le pregunta a un motor por un servicio en su ciudad, la respuesta se arma con perfiles de Google, reseñas y directorios locales. Una PyME con esos datos en orden compite mejor de lo que cree. Así lo trabajamos en nuestro servicio de posicionamiento en motores de IA.