User-agent: * Allow: / # Zones techniques et privees Disallow: /admin/ Disallow: /system/ Disallow: /temp/ Disallow: /files/files/ Disallow: /go-link Disallow: /install.php # Pages de CV : elles demandent une connexion, mais renvoient 200 avec le titre # du CV et sans balise noindex. On evite qu'elles entrent dans l'index. Disallow: /resume/ Disallow: /my-resume-details/ # Parametres de recherche : ils produisent autant d'URL differentes que de # combinaisons — c'est du contenu duplique. # ⚠️ Cela n'empeche EN RIEN la recherche de fonctionner : robots.txt ne # s'adresse qu'aux robots d'indexation, jamais au navigateur d'un visiteur. # # ⚠️ Les directives sont SENSIBLES A LA CASSE : `searchId` et `searchID` # sont deux motifs differents, d'ou les doublons ci-dessous. Disallow: /*searchID= Disallow: /*searchId= Disallow: /*backPage= # Recherche par mots-cles : chaque mot cherche fabrique une adresse. Elles # repondent 200 et se canonisent vers /jobs/ — ce n'est donc pas une erreur, # mais c'est autant de budget d'exploration depense pour rien. # ⚠️ Trois formes existent : `keyword=`, `keywords=` et le champ encode # `keywords%5Ball_words%5D=`. Le motif ci-dessous les couvre toutes. # ⚠️ Verifie le 18/09/2026 : aucune adresse des sitemaps ne contient la chaine # « keyword », le motif ne bloque donc rien de legitime. Disallow: /*keyword # Variantes du formulaire d'inscription : `?user_group_id=Employer` et # `?user_group_id=JobSeeker` servent le meme formulaire sous deux adresses de # plus. `/registration/` etait la DEUXIEME page la plus liee des deux sites — # 19 791 liens internes sur Jobsquare, 159 332 sur Tanit — donc le robot y # revient sans cesse. # ⚠️ On ferme le PARAMETRE, pas la page : `/registration/` nue est declaree # dans le sitemap, l'interdire creerait une contradiction que la Search # Console signale (« URL envoyee bloquee par robots.txt »). # ⚠️ Verifie le 18/09/2026 : aucune adresse des sitemaps ne contient # « user_group_id ». Disallow: /*user_group_id= # ⚠️ EXCEPTION VOULUE (18/09/2026), a l'inverse de la veille. Les cartes des # listes ne fabriquent plus d'adresse a parametres, mais des millions # d'anciennes — /job/ID/slug/?backPage=1&searchID= — sont encore # dans l'index. Tant qu'on les bloque, Google ne peut pas aller voir la # redirection 301 qui les ferait disparaitre : un blocage FIGE l'index, il # ne le nettoie pas. On laisse donc passer sur les FICHES, le temps que ce # passif se resorbe. # Google applique la regle la plus LONGUE : `Allow: /job/*searchID=` (15) # l'emporte sur `Disallow: /*searchID=` (12). Une liste `/jobs/?searchID=` # ne correspond a aucun Allow — apres `/job` vient un `s`, pas un `/` — et # reste interdite, comme /trainings, /companies/, /cities/, /regions/. Allow: /job/*searchID= Allow: /job/*searchId= Allow: /job/*backPage= Allow: /training/*searchID= Allow: /training/*searchId= Allow: /training/*backPage= # Espace personnel, formulaires et apercus : aucun interet dans un moteur. # C'est la que partait le plus gros du budget d'exploration — 34 % des # visites de Googlebot sur le seul /edit-resume/, qui repond 200 avec le # formulaire de CV. Aucun de ces chemins n'est dans les sitemaps. Disallow: /edit-resume/ Disallow: /add-listing/ Disallow: /my-listings/ Disallow: /my-job-details/ Disallow: /job-preview/ Disallow: /resume-preview/ Disallow: /training-preview/ # Robot du moteur Petal : trafic sans interet pour nos deux marches. User-agent: PetalBot Disallow: / Sitemap: https://www.jobsquare.ma/sitemap_index.xml