# Robots.txt for gorepliq.com # Optimized for SEO and GEO (Generative Engine Optimization) # Allow all major search engine crawlers User-agent: * Allow: / # Disallow non-public routes (these should never be indexed) Disallow: /api/ Disallow: /admin/ Disallow: /admin-login Disallow: /_next/ Disallow: /private/ Disallow: /dashboard/ Disallow: /onboarding/ Disallow: /settings/ Disallow: /reports/ Disallow: /brand-kit/ Disallow: /checkout/ Disallow: /setup/ Disallow: /partner/ Disallow: /partner-login Disallow: /atelier-review/ Disallow: /new-home Disallow: /register Disallow: /login Disallow: /verify-email Disallow: /account-type Disallow: /brand Disallow: /analyzing Disallow: /topics Disallow: /topics-prompts Disallow: /prompts Disallow: /generating Disallow: /report Disallow: /brands Disallow: /prompt-library Disallow: /prospect Disallow: /studio Disallow: /r/ # Offre agence (grille de gros revendeur) : page orpheline partagée par lien, # jamais indexée. Les chemins sont préfixés par la locale, d'où les 4 variantes : # un « Disallow: /partenaires » seul ne couvrirait pas « /fr/partenaires ». Disallow: /partenaires Disallow: /fr/partenaires Disallow: /en/partenaires Disallow: /de/partenaires Disallow: /it/partenaires # Note: blog tag/category filters (?tag=, ?category=) are crawlable on purpose. # They self-canonicalize to /{locale}/blog via generateMetadata in # apps/web/app/[locale]/blog/page.tsx — Google MUST be able to fetch them # to read the canonical tag. Blocking via robots.txt previously caused # "Page en double sans canonical" in Search Console (~76 URLs, avril 2026). # opengraph-image routes are intentionally crawlable: they return image/png # (not HTML, so no "duplicate page" risk) and must be fetchable by Googlebot # for Google Discover / Article rich-result image eligibility. The Article # JSON-LD image points here (cf. app/[locale]/blog/[slug]/page.tsx). # ───────────────────────────────────────────────────────────────────────────── # LES ROBOTS D'IA SUIVENT LE GROUPE « * », ET C'EST VOLONTAIRE. # # Ce fichier déclarait ici neuf groupes nommés — GPTBot, ChatGPT-User, # Google-Extended, Anthropic-AI, Claude-Web, PerplexityBot, Cohere-ai, CCBot, # Amazonbot — chacun réduit à « Allow: / ». # # L'INTENTION ÉTAIT BONNE ET L'EFFET ÉTAIT L'INVERSE. Un robot n'applique qu'UN # SEUL groupe : le plus spécifique qui le désigne, et il ignore tous les autres. # Ces neuf robots lisaient donc « Allow: / » et rien d'autre — pas une seule des # interdictions ci-dessus. Ils étaient autorisés sur /r/ (les rapports de # campagne des clients), sur /partenaires (la grille de gros, pourtant protégée # par mot de passe et interdite dans les quatre langues), sur /dashboard/, # /partner/, /prospect/ et /studio. # # Sans groupe nommé, ils retombent sur « * », qui dit « Allow: / » PUIS les # interdictions. Ils gardent donc l'accès à tout le site public, et perdent # l'accès aux espaces privés. C'est ce qu'on voulait depuis le début. # # NE PAS RÉINTRODUIRE de groupe nommé sans y recopier la liste des Disallow. # Un « User-agent: X » suivi du seul « Allow: / » rouvre exactement ce trou. # (Constaté et refermé le 18/09/2026. Peec AI, référence de la catégorie, n'a # pas non plus de groupe nommé : quatre lignes, « * », « Allow: / », sitemap.) # Documents de référence destinés aux systèmes d'IA : # https://www.gorepliq.com/fr/facts # https://www.gorepliq.com/fr/ai-instructions (+ .md) # https://www.gorepliq.com/fr/entity-map (+ .md) # https://www.gorepliq.com/llms.txt # Sitemap location Sitemap: https://www.gorepliq.com/sitemap.xml # Host directive (canonical domain) Host: https://www.gorepliq.com