Rastreador

ParcharBot

ParcharBot es el rastreador de Parchar.ai. Recolecta agendas culturales publicas para armar una cartelera de eventos con atribucion y enlace de vuelta a la fuente original. Esta pagina explica que hace, como identificarlo y como excluirlo.

Como identificarlo

En tus logs aparece con este User-Agent:

ParcharBot/1.0 (+https://parchar.ai/bot)

Si tu WAF bloquea agentes declarados, el rastreador puede reintentar con un User-Agent de navegador generico. Aun en ese caso seguimos evaluando tu robots.txt contra el token ParcharBot: una regla dirigida a nosotros se respeta sin importar la cabecera del reintento.

Que hace

  • Lee paginas publicas de agenda, cartelera y detalle de evento.
  • Extrae datos factuales: titulo, fecha, lugar, ciudad, categoria y enlace original.
  • Publica la ficha con atribucion visible y enlace de vuelta a tu sitio.
  • Prefiere feeds oficiales (RSS, ICS, JSON-LD, APIs publicas) cuando existen.

Que NO hace

  • No entra a areas con login, ni a contenido de pago o tras muro de suscripcion.
  • No recolecta datos personales de asistentes ni contenido de perfiles de usuarios.
  • No republica articulos completos ni reemplaza tu pagina: la ficha enlaza a la fuente.
  • No compra ni revende tus datos como base de datos aparte.

Frecuencia

La cadencia por defecto es de una visita cada 24 horas por fuente, y baja automaticamente cuando el sitio publica poco o responde lento. Las peticiones son secuenciales por dominio, no en paralelo. Si declaras Crawl-delay en tu robots.txt, lo respetamos.

Como excluirnos

Respetamos robots.txt. Para bloquearnos por completo agrega esto a https://tudominio.com/robots.txt:

User-agent: ParcharBot
Disallow: /

Tambien puedes excluir solo una seccion (por ejemplo Disallow: /privado/). Los cambios se toman en cuenta en menos de 24 horas, que es lo que dura nuestra cache de robots.txt.

Pedidos de exclusion o retiro

Si prefieres escribirnos, o quieres que retiremos contenido ya publicado, escribe a hola@parchar.ai con el dominio y el alcance del pedido. Atendemos solicitudes de exclusion en un plazo de 5 dias habiles: dejamos de rastrear el dominio y despublicamos las fichas que provienen de el.

Para dudas de privacidad o datos personales, el canal es privacidad@parchar.ai. Los demas canales estan en /contacto.

Prefieres que te leamos mejor

Si publicas un feed (RSS o ICS) o marcado schema.org/Event, lo usamos con prioridad: es mas barato para tu servidor y mas preciso para nosotros. Escribenos y lo conectamos.

Nuestra politica completa de rastreo, atribucion y exclusion vive en /metodologia y en el repositorio del proyecto.