# Robots.txt for https://copareo.com # Auto-generated by seo-repair.py # 2026-09-14 03:00:31 User-agent: * Allow: / Allow: /blog Allow: /blog/ Allow: /en/ Allow: /tarifs Allow: /annuaire Allow: /secure-line-bouclier Allow: /pro Allow: /conseils-experts Allow: /calculatrice-pension-alimentaire Allow: /mentions-legales # Pages privées / dépréciées / SPA-only (ne pas indexer) Disallow: /api/ # Corpus SOURCE des articles, servi en JSON brut (lot G de l'audit multilingue, # 06/09/2026) : /blog-en/*.json et /blog-articles/*.json exposaient un duplicata # indexable de chaque page rendue, sans X-Robots-Tag. 114 fichiers côté anglais. Disallow: /blog-en/ Disallow: /blog-articles/ Disallow: /auth/ Disallow: /dashboard Disallow: /admin Disallow: /reset-password Disallow: /verify-email Disallow: /signup Disallow: /login Disallow: /forgot-password Disallow: /confirm-email Disallow: /email-confirm Disallow: /pwa-welcome Disallow: /avocat Disallow: /partenaire/ Disallow: /influenceur/ Disallow: /notification-settings Disallow: /notifications Disallow: /settings Disallow: /calendar Disallow: /messages Disallow: /finances Disallow: /tasks Disallow: /documents Disallow: /enfants Disallow: /onboarding Disallow: /payment Disallow: /subscription Disallow: /welcome Disallow: /invitation Disallow: /accept-invitation Disallow: /v2-test Disallow: /test-tasks Disallow: /cockpit Disallow: /video-studio Disallow: /assistant-ia Disallow: /alerts Disallow: /activities Sitemap: https://copareo.com/sitemap.xml Sitemap: https://copareo.com/sitemap-en.xml # NOTE (audit SEO 2026-06-18) : PAS de bloc « User-agent: Googlebot » dédié. # Un groupe spécifique sans Disallow fait IGNORER à Googlebot l'intégralité des # Disallow du groupe « * » (spec robots.txt : un robot n'applique QUE le groupe # le plus spécifique qui le matche). L'ancien bloc Googlebot ne listait que des # Allow → Googlebot pouvait crawler /login /signup /dashboard /admin /settings… # Googlebot suit désormais le groupe « * » ci-dessus (Allow / + Disallow privés). # Block specific aggressive bots User-agent: AhrefsBot Disallow: / User-agent: SemrushBot Disallow: / User-agent: MJ12bot Disallow: / # ============================================================================= # AI crawlers — explicit ALLOW (training + citation encouraged) # See /llms.txt and /.well-known/ai.txt for content usage declaration. # ============================================================================= User-agent: GPTBot Allow: / Allow: /blog/ Allow: /secure-line-bouclier Allow: /tarifs User-agent: ChatGPT-User Allow: / User-agent: OAI-SearchBot Allow: / User-agent: ClaudeBot Allow: / Allow: /blog/ User-agent: anthropic-ai Allow: / User-agent: Claude-Web Allow: / User-agent: PerplexityBot Allow: / Allow: /blog/ User-agent: Perplexity-User Allow: / User-agent: Google-Extended Allow: / Allow: /blog/ User-agent: CCBot Allow: / Allow: /blog/ User-agent: cohere-ai Allow: / User-agent: Bytespider Allow: / User-agent: FacebookBot Allow: / User-agent: Amazonbot Allow: / User-agent: Applebot Allow: / User-agent: Applebot-Extended Allow: / User-agent: DuckAssistBot Allow: / User-agent: MistralAI-User Allow: / User-agent: YouBot Allow: / User-agent: Diffbot Allow: /