Inventariar superficies
Separe páginas públicas, recursos necesarios para mostrar el contenido, zonas privadas y variantes sin valor propio.

GUÍA / PROTOCOLO
Una política clara parte del uso previsto para cada página pública, no de una lista de nombres de robots.
Respuesta directa
Defina qué páginas pueden descubrirse, cuáles pueden aparecer en búsquedas y cuáles deben excluirse de un uso determinado. Exprese estas decisiones en robots.txt, directivas de página y respuestas del servidor; después compruebe el acceso real.
01 / Método de control
Separe páginas públicas, recursos necesarios para mostrar el contenido, zonas privadas y variantes sin valor propio.
Determine el acceso para búsqueda clásica, búsqueda con IA y recopilación para entrenamiento según los agentes documentados por cada operador.
Revise estado HTTP, robots.txt, redirecciones, meta robots o X-Robots-Tag y HTML servido, también en cada idioma.
Compare registros del servidor, herramientas para webmasters y tráfico referido. Una visita no demuestra indexación ni cita.
02 / Pruebas que conservar
Conserve versión, fecha y motivo de cada directiva.
Anote página exacta, estado, canonical y reglas de página.
Distinga agentes declarados para búsqueda, vistas previas y entrenamiento.
Documente lo accesible y lo que aparece en las herramientas disponibles.
03 / FAQ
No. Permite el acceso necesario para una posible aparición en la búsqueda de ChatGPT, sin garantizarla.
Sí, cuando el operador documenta agentes distintos. Compruebe nombres y comportamiento en la documentación oficial.
04 / Referencias oficiales