# GEO: qué pide de verdad la IA para citarte y qué te venden de más

> Google publicó qué hace falta para aparecer en AI Overviews, y es menos de lo que se cobra por ello. Qué contratar, qué ignorar y cómo revisarlo.

- Autor: César Medina
- Publicado: 2026-09-24
- Tema: Criterio para invertir en IA
- Lectura: 8 min
- Palabras clave: GEO optimización para IA, llms.txt, aparecer en AI Overviews

Para que Google o ChatGPT te citen no hace falta ningún archivo nuevo. Lo dice
la documentación de Google: no hay que crear archivos legibles por máquina, ni
archivos de texto para IA, ni marcado especial. Lo que hace falta es estar
indexado, dejar que se muestre un fragmento y no bloquear al rastreador que
toca.

> **Puntos clave**
>
> - Google publicó que no hacen falta archivos ni marcado nuevos para aparecer en AI Overviews. Buena parte del catálogo de GEO se cae con esa frase.
> - Lo que sí exige es lo de siempre: que la página esté indexada y pueda mostrarse con un fragmento.
> - En ChatGPT hay dos rastreadores distintos con permisos independientes. Bloquear el equivocado te borra de sus respuestas.
> - Antes de firmar, pide que te digan qué archivo van a tocar y dónde lo documenta el fabricante.

## ¿Qué dice Google que hace falta?

Nada que no estuvieras haciendo ya. Su documentación de Search Central lo pone
sin rodeos:

> You don't need to create new machine readable files, AI text files, or markup
> to appear in these features. There's also no special schema.org structured
> data that you need to add.

Es decir: no hacen falta archivos legibles por máquina, ni archivos de texto
para IA, ni marcado nuevo, ni structured data específico. La condición para
aparecer como enlace de apoyo en AI Overviews o AI Mode es que la página esté
indexada y pueda mostrarse en Google con un fragmento.

Eso deja el trabajo donde siempre estuvo. Si la página está bloqueada por
`robots.txt`, no aparece. Si lleva `noindex`, no aparece. Si tiene `nosnippet`,
tampoco, porque el fragmento es justo lo que la función necesita. Son las mismas
tres cosas que llevan quince años decidiendo si sales en un resultado normal.

## ¿Entonces el llms.txt no sirve para nada?

Sirve para lo que sirve cualquier archivo que nadie ha dicho que lee. No hay un
buscador importante que haya publicado que lo consulte, y Google dice
explícitamente lo contrario en la frase de arriba.

Déjalo si ya lo tienes. Ponerlo cuesta cinco minutos, no rompe nada y existe la
posibilidad de que algún día alguien lo lea. El problema empieza cuando alguien
cobra por instalarlo, y sobre todo cuando lo vende como la razón por la que vas
a aparecer en ChatGPT. Eso es cobrar por una hipótesis.

La diferencia entre las dos posturas se nota al preguntar. Un proveedor que
propone el archivo como apuesta barata te lo dirá así. Uno que lo vende como
mecanismo te va a enseñar un gráfico de tráfico que empezó a subir después de
instalarlo, que es la forma más vieja que existe de confundir una coincidencia
con una causa.

## ¿Y del lado de ChatGPT?

Aquí sí hay una decisión técnica real, y casi todo el mundo la toma al revés.

OpenAI tiene tres rastreadores. **GPTBot** recoge contenido que puede acabar
entrenando sus modelos. **OAI-SearchBot** es el que hace que tu sitio aparezca
en las búsquedas de ChatGPT. **ChatGPT-User** entra cuando alguien, dentro de
una conversación, pide abrir una página concreta.

Lo importante es que no van juntos. La documentación de OpenAI dice:

> Each setting is independent of the others – for example, a webmaster can allow
> OAI-SearchBot in order to appear in search results while disallowing GPTBot.

Se puede permitir el de búsqueda y bloquear el de entrenamiento. Aparecer en las
respuestas sin alimentar el modelo. Eso es exactamente lo que quiere la mayoría
de las empresas con las que trabajo, y casi ninguna lo tiene configurado así,
porque en algún momento alguien metió una regla de bloqueo amplia para
«protegerse de la IA» y se llevó por delante la visibilidad.

Un sitio que bloquea OAI-SearchBot no sale en las respuestas de búsqueda de
ChatGPT. Punto. No es una penalización ni un castigo por calidad: es una puerta
cerrada por decisión propia, casi siempre sin saberlo.

## ¿Qué te venden y qué dice el fabricante?

| Lo que se vende o se cree | Lo que dice quien fabrica el buscador |
| --- | --- |
| Hace falta un `llms.txt` en la raíz | Google: no hacen falta archivos legibles por máquina ni archivos de texto para IA |
| Hace falta structured data específico para IA | Google: no hay structured data de schema.org especial que añadir |
| Hay optimizaciones propias del GEO que no son SEO | Google: no hay requisitos adicionales ni optimizaciones especiales |
| Bloquear los bots de OpenAI protege el contenido sin costo | OpenAI: los permisos son independientes, y bloquear OAI-SearchBot te saca de sus respuestas |

Fuentes: [Google Search Central, *AI features and your website*](https://developers.google.com/search/docs/appearance/ai-features) y [OpenAI, *Crawlers and user agents*](https://developers.openai.com/api/docs/bots), leídas en la documentación de cada fabricante.

Las cuatro filas de la derecha son citas de quien construye el sistema. Las de
la izquierda son cosas que he visto en propuestas comerciales este año.

## ¿En qué sí vale la pena gastar?

En lo que la documentación no puede darte, que es el contenido.

Estar indexado y permitir el fragmento son condiciones necesarias. No son
suficientes. Entre todas las páginas elegibles, el sistema elige unas pocas, y
ni Google ni OpenAI publican cómo. Ahí es donde se compite, y se compite con
cosas viejas.

Responder una pregunta concreta en el primer párrafo, sin calentamiento, de
forma que el pasaje se entienda solo. Un modelo que va a citarte extrae un
fragmento, no lee el artículo entero: si tu respuesta empieza en el tercer
subtítulo, no la encuentra.

Decir algo que no esté ya en otros veinte sitios. Un dato propio, un
procedimiento que hiciste, una cifra de tu operación. Si tu artículo es el
resumen número veintiuno del mismo tema, no hay archivo que lo salve.

Y poner el número junto a su fuente. Una afirmación rastreable vale más que
tres sin origen, tanto para un lector como para un sistema que tiene que decidir
si se fía. Es la misma razón por la que aquí solo citamos lo que hemos leído en
la fuente.

Nada de eso es configuración. Es trabajo editorial, cuesta tiempo y no se
factura como una instalación de media hora, que es probablemente por lo que se
vende menos.

## ¿Cómo reviso a un proveedor sin ser técnico?

Con dos preguntas que no requieren saber nada de rastreadores.

La primera: **¿qué archivo vas a tocar y dónde lo documenta el fabricante?** Si
la respuesta es un enlace a la documentación de Google o de OpenAI, vas bien. Si
es un enlace al blog de otra agencia, acabas de encontrar el problema.

La segunda: **¿cómo vamos a saber si funcionó?** No vale «más visibilidad en
IA». Vale una lista de preguntas concretas que tu comprador haría, revisadas
antes y después. Si nadie escribe esa lista al principio, dentro de seis meses
la conversación va a ser sobre sensaciones.

Es el mismo criterio que aplicamos a cualquier compra de IA, y lo desarrollamos
en la guía de [dónde entra la IA en tu operación y dónde no](/blog/donde-entra-la-ia).
Cambia la tecnología y no cambian las preguntas: qué se compra, cómo se mide y
quién responde si no pasa nada.

## Lo que yo haría esta semana

Abrir el `robots.txt` y mirar si hay alguna regla que mencione a OpenAI. Si
bloquea `OAI-SearchBot`, decidir si eso es lo que se quería. Casi nunca lo es.

Después, tomar las cinco preguntas que un cliente hace antes de comprarte y
comprobar si tu sitio las responde en el primer párrafo de alguna página. Si no,
ahí está el trabajo, y no cuesta licencia.

Si quieres que revisemos cómo está configurado tu sitio y qué preguntas estás
dejando sin responder, el [diagnóstico inicial no tiene costo](/contacto). Y si
lo que buscas es el lado de captación, el
[motor de demanda B2B](/blog/motor-de-demanda-b2b) explica dónde encaja todo
esto en el resto del embudo.

## Preguntas frecuentes

**¿Sirve de algo el archivo llms.txt?**
Google dice por escrito que no hacen falta archivos legibles por máquina ni
archivos de texto para IA para aparecer en sus funciones de IA. Ningún buscador
importante ha publicado que lo lea. Ponerlo cuesta cinco minutos y no hace daño,
pero pagar por ello es pagar por una hipótesis.

**¿Bloquear GPTBot me saca de ChatGPT?**
No. GPTBot es el rastreador de entrenamiento y OAI-SearchBot es el de búsqueda,
y sus permisos son independientes. El que te saca de las respuestas de ChatGPT
es bloquear OAI-SearchBot. El error caro es meter una regla que los bloquee a
los dos creyendo que solo sales del entrenamiento.

**¿Necesito structured data especial para la IA?**
No existe. La documentación de Google dice que no hay structured data de
schema.org específico que haya que añadir para estas funciones. El marcado
estándar sigue sirviendo para lo de siempre, pero no hay una versión para IA que
instalar aparte.

**¿Entonces el GEO es humo?**
El trabajo es real, el catálogo no siempre. Ser citable depende de estar
indexado, responder preguntas concretas de forma autocontenida y decir cosas que
no estén ya en otros veinte sitios. Eso es trabajo editorial, no configuración.

## Preguntas frecuentes

### ¿Sirve de algo el archivo llms.txt?

Google dice por escrito que no hacen falta archivos legibles por máquina ni archivos de texto para IA para aparecer en sus funciones de IA. Ningún buscador importante ha publicado que lo lea. Ponerlo cuesta cinco minutos y no hace daño, pero pagar por ello es pagar por una hipótesis.

### ¿Bloquear GPTBot me saca de ChatGPT?

No. GPTBot es el rastreador de entrenamiento y OAI-SearchBot es el de búsqueda, y sus permisos son independientes. El que te saca de las respuestas de ChatGPT es bloquear OAI-SearchBot. El error caro es meter una regla que los bloquee a los dos creyendo que solo sales del entrenamiento.

### ¿Necesito structured data especial para la IA?

No existe. La documentación de Google dice que no hay structured data de schema.org específico que haya que añadir para estas funciones. El marcado estándar sigue sirviendo para lo de siempre, pero no hay una versión para IA que instalar aparte.

### ¿Entonces el GEO es humo?

El trabajo es real, el catálogo no siempre. Ser citable depende de estar indexado, responder preguntas concretas de forma autocontenida y decir cosas que no estén ya en otros veinte sitios. Eso es trabajo editorial, no configuración.

## Recurso gratuito

[Diagnóstico para IA](https://c2suite.com/recursos/preparacion-ia) — Analiza tu sitio en seis categorías y te dice qué encuentran los rastreadores de IA y los buscadores, con datos reales de Google.

---

Fuente: https://c2suite.com/blog/geo-que-pide-la-ia

Puedes citar y resumir este contenido atribuyéndolo a C2Suite y enlazando a la URL de origen.
