Criterio para invertir en IA
GEO: qué pide de verdad la IA para citarte y qué te venden de más
Google publicó qué hace falta para aparecer en AI Overviews, y es menos de lo que se cobra por ello. Qué contratar, qué ignorar y cómo revisarlo.
Para que Google o ChatGPT te citen no hace falta ningún archivo nuevo. Lo dice la documentación de Google: no hay que crear archivos legibles por máquina, ni archivos de texto para IA, ni marcado especial. Lo que hace falta es estar indexado, dejar que se muestre un fragmento y no bloquear al rastreador que toca.
Puntos clave
- Google publicó que no hacen falta archivos ni marcado nuevos para aparecer en AI Overviews. Buena parte del catálogo de GEO se cae con esa frase.
- Lo que sí exige es lo de siempre: que la página esté indexada y pueda mostrarse con un fragmento.
- En ChatGPT hay dos rastreadores distintos con permisos independientes. Bloquear el equivocado te borra de sus respuestas.
- Antes de firmar, pide que te digan qué archivo van a tocar y dónde lo documenta el fabricante.
¿Qué dice Google que hace falta?
Nada que no estuvieras haciendo ya. Su documentación de Search Central lo pone sin rodeos:
You don't need to create new machine readable files, AI text files, or markup to appear in these features. There's also no special schema.org structured data that you need to add.
Es decir: no hacen falta archivos legibles por máquina, ni archivos de texto para IA, ni marcado nuevo, ni structured data específico. La condición para aparecer como enlace de apoyo en AI Overviews o AI Mode es que la página esté indexada y pueda mostrarse en Google con un fragmento.
Eso deja el trabajo donde siempre estuvo. Si la página está bloqueada por
robots.txt, no aparece. Si lleva noindex, no aparece. Si tiene nosnippet,
tampoco, porque el fragmento es justo lo que la función necesita. Son las mismas
tres cosas que llevan quince años decidiendo si sales en un resultado normal.
¿Entonces el llms.txt no sirve para nada?
Sirve para lo que sirve cualquier archivo que nadie ha dicho que lee. No hay un buscador importante que haya publicado que lo consulte, y Google dice explícitamente lo contrario en la frase de arriba.
Déjalo si ya lo tienes. Ponerlo cuesta cinco minutos, no rompe nada y existe la posibilidad de que algún día alguien lo lea. El problema empieza cuando alguien cobra por instalarlo, y sobre todo cuando lo vende como la razón por la que vas a aparecer en ChatGPT. Eso es cobrar por una hipótesis.
La diferencia entre las dos posturas se nota al preguntar. Un proveedor que propone el archivo como apuesta barata te lo dirá así. Uno que lo vende como mecanismo te va a enseñar un gráfico de tráfico que empezó a subir después de instalarlo, que es la forma más vieja que existe de confundir una coincidencia con una causa.
¿Y del lado de ChatGPT?
Aquí sí hay una decisión técnica real, y casi todo el mundo la toma al revés.
OpenAI tiene tres rastreadores. GPTBot recoge contenido que puede acabar entrenando sus modelos. OAI-SearchBot es el que hace que tu sitio aparezca en las búsquedas de ChatGPT. ChatGPT-User entra cuando alguien, dentro de una conversación, pide abrir una página concreta.
Lo importante es que no van juntos. La documentación de OpenAI dice:
Each setting is independent of the others – for example, a webmaster can allow OAI-SearchBot in order to appear in search results while disallowing GPTBot.
Se puede permitir el de búsqueda y bloquear el de entrenamiento. Aparecer en las respuestas sin alimentar el modelo. Eso es exactamente lo que quiere la mayoría de las empresas con las que trabajo, y casi ninguna lo tiene configurado así, porque en algún momento alguien metió una regla de bloqueo amplia para «protegerse de la IA» y se llevó por delante la visibilidad.
Un sitio que bloquea OAI-SearchBot no sale en las respuestas de búsqueda de ChatGPT. Punto. No es una penalización ni un castigo por calidad: es una puerta cerrada por decisión propia, casi siempre sin saberlo.
¿Qué te venden y qué dice el fabricante?
| Lo que se vende o se cree | Lo que dice quien fabrica el buscador |
|---|---|
Hace falta un llms.txt en la raíz | Google: no hacen falta archivos legibles por máquina ni archivos de texto para IA |
| Hace falta structured data específico para IA | Google: no hay structured data de schema.org especial que añadir |
| Hay optimizaciones propias del GEO que no son SEO | Google: no hay requisitos adicionales ni optimizaciones especiales |
| Bloquear los bots de OpenAI protege el contenido sin costo | OpenAI: los permisos son independientes, y bloquear OAI-SearchBot te saca de sus respuestas |
Fuentes: Google Search Central, AI features and your website y OpenAI, Crawlers and user agents, leídas en la documentación de cada fabricante.
Las cuatro filas de la derecha son citas de quien construye el sistema. Las de la izquierda son cosas que he visto en propuestas comerciales este año.
¿En qué sí vale la pena gastar?
En lo que la documentación no puede darte, que es el contenido.
Estar indexado y permitir el fragmento son condiciones necesarias. No son suficientes. Entre todas las páginas elegibles, el sistema elige unas pocas, y ni Google ni OpenAI publican cómo. Ahí es donde se compite, y se compite con cosas viejas.
Responder una pregunta concreta en el primer párrafo, sin calentamiento, de forma que el pasaje se entienda solo. Un modelo que va a citarte extrae un fragmento, no lee el artículo entero: si tu respuesta empieza en el tercer subtítulo, no la encuentra.
Decir algo que no esté ya en otros veinte sitios. Un dato propio, un procedimiento que hiciste, una cifra de tu operación. Si tu artículo es el resumen número veintiuno del mismo tema, no hay archivo que lo salve.
Y poner el número junto a su fuente. Una afirmación rastreable vale más que tres sin origen, tanto para un lector como para un sistema que tiene que decidir si se fía. Es la misma razón por la que aquí solo citamos lo que hemos leído en la fuente.
Nada de eso es configuración. Es trabajo editorial, cuesta tiempo y no se factura como una instalación de media hora, que es probablemente por lo que se vende menos.
¿Cómo reviso a un proveedor sin ser técnico?
Con dos preguntas que no requieren saber nada de rastreadores.
La primera: ¿qué archivo vas a tocar y dónde lo documenta el fabricante? Si la respuesta es un enlace a la documentación de Google o de OpenAI, vas bien. Si es un enlace al blog de otra agencia, acabas de encontrar el problema.
La segunda: ¿cómo vamos a saber si funcionó? No vale «más visibilidad en IA». Vale una lista de preguntas concretas que tu comprador haría, revisadas antes y después. Si nadie escribe esa lista al principio, dentro de seis meses la conversación va a ser sobre sensaciones.
Es el mismo criterio que aplicamos a cualquier compra de IA, y lo desarrollamos en la guía de dónde entra la IA en tu operación y dónde no. Cambia la tecnología y no cambian las preguntas: qué se compra, cómo se mide y quién responde si no pasa nada.
Lo que yo haría esta semana
Abrir el robots.txt y mirar si hay alguna regla que mencione a OpenAI. Si
bloquea OAI-SearchBot, decidir si eso es lo que se quería. Casi nunca lo es.
Después, tomar las cinco preguntas que un cliente hace antes de comprarte y comprobar si tu sitio las responde en el primer párrafo de alguna página. Si no, ahí está el trabajo, y no cuesta licencia.
Si quieres que revisemos cómo está configurado tu sitio y qué preguntas estás dejando sin responder, el diagnóstico inicial no tiene costo. Y si lo que buscas es el lado de captación, el motor de demanda B2B explica dónde encaja todo esto en el resto del embudo.
Preguntas frecuentes
¿Sirve de algo el archivo llms.txt? Google dice por escrito que no hacen falta archivos legibles por máquina ni archivos de texto para IA para aparecer en sus funciones de IA. Ningún buscador importante ha publicado que lo lea. Ponerlo cuesta cinco minutos y no hace daño, pero pagar por ello es pagar por una hipótesis.
¿Bloquear GPTBot me saca de ChatGPT? No. GPTBot es el rastreador de entrenamiento y OAI-SearchBot es el de búsqueda, y sus permisos son independientes. El que te saca de las respuestas de ChatGPT es bloquear OAI-SearchBot. El error caro es meter una regla que los bloquee a los dos creyendo que solo sales del entrenamiento.
¿Necesito structured data especial para la IA? No existe. La documentación de Google dice que no hay structured data de schema.org específico que haya que añadir para estas funciones. El marcado estándar sigue sirviendo para lo de siempre, pero no hay una versión para IA que instalar aparte.
¿Entonces el GEO es humo? El trabajo es real, el catálogo no siempre. Ser citable depende de estar indexado, responder preguntas concretas de forma autocontenida y decir cosas que no estén ya en otros veinte sitios. Eso es trabajo editorial, no configuración.
Recurso gratuito
Diagnóstico para IA
Analiza tu sitio en seis categorías y te dice qué encuentran los rastreadores de IA y los buscadores, con datos reales de Google.

Escrito por
César Medina
RevOps y arquitectura de HubSpot
Llevo la operación de marketing y ventas de empresas B2B al punto en el que el CRM deja de ser un archivero y empieza a mover pipeline. Trabajo sobre HubSpot: arquitectura, automatización y los procesos que hacen que un equipo lo use de verdad. Escribo aquí lo que aprendo implementando, no lo que dice el folleto.
LinkedIn(se abre en una pestaña nueva)