4dim / Notas
Lo que Google, Bing y OpenAI dicen de cómo citan
Tres documentos oficiales, leídos enteros: Google dice que no hay optimizaciones especiales, Bing solo cita lo que indexa y desde febrero de 2026 lo mide, OpenAI advierte que sus citas pueden estar mal. Y llms.txt: qué es y qué nadie ha prometido.
Tres documentos oficiales, y mucho ruido alrededor
Si te preguntas qué hay que hacer para que ChatGPT, Copilot o el resumen de Google citen tu web, esta nota reúne lo único que está documentado. Y señala lo que no lo está.
Hay una industria nueva vendiendo «optimización para motores generativos», y casi todo lo que publica es especulación. Lo que sí existe son tres documentos oficiales, cortos, de quienes operan los motores. Los leímos enteros el 13 de septiembre de 2026. Esto es lo que dicen, sin adornos.
Google: «no hay requisitos adicionales»
La página «AI features and your website» de Google Search Central se actualizó el 10 de diciembre de 2025, y es explícita: «There are no additional requirements to appear in AI Overviews or AI Mode, nor other special optimizations necessary».
Dicho en corto: no hay nada aparte que hacer. Se aplican las mismas prácticas que para la Búsqueda de siempre, es decir, requisitos técnicos, políticas contra el spam y contenido hecho para personas.
El mismo documento deja dos detalles útiles. El primero: para poder aparecer, la página tiene que estar indexada y ser elegible para mostrarse con fragmento en la Búsqueda normal. Sin eso, nada.
El segundo es una técnica que Google llama query fan-out. Las funciones de IA parten la pregunta en varias búsquedas sobre subtemas y combinan lo que encuentran, lo que les permite «mostrar un conjunto más amplio y diverso de enlaces útiles». Una página que responde con precisión a una subpregunta concreta tiene ahí una oportunidad que en la lista de diez resultados no tenía.
Bing y Copilot: solo lo que Bing indexa
Copilot traduce la pregunta del usuario en consultas cortas contra el índice de Bing. Recupera fragmentos de las páginas que Bing conoce y compone la respuesta con citas numeradas.
Lo que Bing no tiene indexado no existe para Copilot en ese momento. La consecuencia es incómoda para quien solo mira Google: hay que registrar el sitio en Bing Webmaster Tools y comprobar que Bing lo rastrea.
Desde febrero de 2026, esa herramienta trae un informe llamado «AI Performance», todavía en vista previa. Dice cuántas veces se citó el sitio, cuántas páginas distintas al día, qué consultas lanzó el asistente para fundamentar su respuesta y qué URL concretas citó.
Es, hasta donde sabemos, la única medición oficial de citas en un asistente de IA que un sitio puede consultar hoy.
OpenAI: citas que pueden estar mal
El centro de ayuda de OpenAI describe cómo cita ChatGPT. Busca en la web por su cuenta «si la pregunta puede beneficiarse de información de la web», muestra las citas dentro de la respuesta y abre un panel «Sources» con las referencias.
Y advierte, con sus palabras, que los resultados y las citas «may be incomplete, outdated or incorrect»: pueden estar incompletos, anticuados o equivocados. Por eso recomienda abrir la fuente, comprobar que respalda la respuesta y mirar su fecha de publicación.
Esa advertencia es también una pista. Si el propio motor le pide al lector que mire la fecha, la fecha tiene que estar en la página y escrita de forma que una máquina la lea.
llms.txt: qué es y qué no es
Circula la idea de que un archivo /llms.txt en la raíz del sitio hace que las IA te lean mejor. Los hechos son estos.
Es una propuesta comunitaria de Jeremy Howard, publicada el 3 de septiembre de 2024 en llmstxt.org. Define un archivo en Markdown, un formato de texto sencillo, con un resumen del sitio y enlaces a su documentación. La han adoptado varias plataformas de documentación técnica.
No es un estándar de ningún organismo, y ninguno de los tres motores documenta que le dé trato alguno. Google dice explícitamente que no hay optimizaciones especiales. Poner el archivo no hace daño; contar con él para algo es contar con algo que nadie ha prometido.
Lo único que los tres motores documentan es lo mismo que pedían antes de existir: estar indexado, decir cosas ciertas y fechadas, y ser legible por una máquina.
Lo que hacemos nosotros con eso
- Cifras con su fuente y su fecha de consulta en el propio texto, no en un pie.
- La fecha de cada nota en una etiqueta
<time dateTime>, legible para quien indexa. - Cada apartado con su ancla, para que una subpregunta pueda citar un apartado y no la página entera.
- Tablas con cabeceras semánticas cuando hay datos, que es lo que un extractor lee mejor.
- Datos estructurados para que la cita, cuando ocurra, sea correcta: quién escribe, de qué fecha, sobre qué servicio.
- Sitio registrado en Bing Webmaster Tools, y el informe de citas revisado cada mes.
Qué hacer entonces
- Leer los tres documentos. Son cortos, y desmontan casi todo lo que se vende.
- Comprobar que el sitio está indexado en Google y en Bing. Sin eso no hay cita posible.
- Publicar lo que se sabe de primera mano, con fecha. Es lo que un motor no puede sacar de otro sitio.
- Medir con lo único oficial que existe: Search Console para Google, «AI Performance» para Copilot.
- Desconfiar de quien garantice apariciones en respuestas de IA. Nadie las controla, ni siquiera quien las genera.
Esta nota sale de nuestro trabajo en Desarrollo web.