Pour les sites WordPress en 2026. Vérifiez votre visibilité dans ChatGPT, Claude et Perplexity.
La majorité des audits GEO vendus en 2026 vous font dépenser pour des fichiers magiques qui n'apportent rien. Cette checklist va à l'essentiel : ce qui change vraiment votre visibilité dans les IA selon les sources officielles (Google, Anthropic, OpenAI) et les études récentes (Ahrefs mai 2026, Williams-Cook février 2026).
Vous aurez besoin d'un accès admin WordPress, d'un accès cPanel ou FTP (au besoin), d'un navigateur en mode incognito et de 30 minutes au calme.
C'est le seul fichier qui change vraiment la visibilité IA. Priorité absolue.
Ouvrir dans un navigateur :
https://votresite.com/robots.txt
Ces user-agents doivent être autorisés, pas bloqués. Cliquez sur chaque nom pour la documentation officielle :
| User-agent | Rôle | Statut souhaité |
|---|---|---|
OAI-SearchBot | Index ChatGPT search | Allow |
ChatGPT-User | Fetch ChatGPT utilisateur | Allow |
Claude-SearchBot | Index Claude search | Allow |
Claude-User | Fetch Claude utilisateur | Allow |
PerplexityBot | Index Perplexity | Allow |
User-agent: * suivie de Disallow: /Disallow: /Ces bots servent à entraîner les futurs modèles avec votre contenu. Décision personnelle : bloquer si vous voulez protéger votre IP, laisser passer si vous êtes OK avec ça.
| User-agent | Rôle |
|---|---|
GPTBot | OpenAI training |
ClaudeBot | Anthropic training |
Google-Extended | Google Gemini training |
CCBot | Common Crawl |
Si votre robots.txt contient ces deux noms, supprimez-les. Anthropic ne les utilise plus depuis 2025 :
Claude-Web (déprécié)anthropic-ai (déprécié)User-agent: *
Allow: /
User-agent: GPTBot
Disallow: /
User-agent: ClaudeBot
Disallow: /
User-agent: Google-Extended
Disallow: /
User-agent: CCBot
Disallow: /
Sitemap: https://votresite.com/sitemap.xml
À ajuster : si vous voulez accepter les training bots, retirez les blocs Disallow correspondants. Les bots de recherche IA (non listés) restent autorisés par défaut via la règle User-agent: *.
Les LLMs s'appuient sur l'index web. Un site mal indexé dans Google est invisible dans ChatGPT aussi.
Ouvrir Google Search Console. Si vous n'avez pas de compte, c'est la priorité absolue avant toute autre chose.
Probablement : accueil, page services principale, page contact.
Tester votre accueil sur PageSpeed Insights.
Les LLMs citent ce que les autres disent de vous, pas ce que vous dites de vous-même.
Accéder à votre fiche via business.google.com.
Selon votre industrie :
| Industrie | Plateforme principale |
|---|---|
| E-commerce général | Trustpilot |
| SaaS / Logiciel B2B | G2, Capterra |
| Santé / suppléments | Healthline, WebMD |
| Cabinet de droit | Avvo, Lawyer.com |
| Restaurant | Yelp, TripAdvisor |
| Hébergement | Booking, TripAdvisor |
| Embauche active | Glassdoor |
Ouvrir ChatGPT en navigation privée ou dans un navigateur où vous n'êtes pas connecté. Tester aussi sur Claude et Perplexity pour comparer. Poser ces 3 questions :
llms.txt payé. Google (Mueller, Illyes), OpenAI et Anthropic disent qu'ils ne l'utilisent pas.Trois scénarios concrets pour robots.txt, un modèle DIY pour llms.txt, et un Schema.org minimal pour Google classique.
Vous voulez être trouvé dans ChatGPT et Claude quand un client local cherche votre service. Vous n'avez pas de raison de bloquer les bots d'entraînement (vous n'avez pas de contenu propriétaire à protéger).
User-agent: *
Allow: /
Sitemap: https://votresite.com/sitemap.xml
C'est tout. Configuration permissive, tous les bots autorisés. Vous maximisez votre visibilité IA.
Vous avez des fiches produits, des descriptions originales, des photos professionnelles que vous ne voulez pas voir aspirées pour entraîner les futurs modèles. Mais vous voulez rester citable par les IA en temps réel.
User-agent: *
Allow: /
# Bloquer les bots d'entraînement
User-agent: GPTBot
Disallow: /
User-agent: ClaudeBot
Disallow: /
User-agent: Google-Extended
Disallow: /
User-agent: CCBot
Disallow: /
# Ne pas indexer les pages internes
Disallow: /wp-admin/
Disallow: /wp-includes/
Disallow: /?s=
Disallow: /panier/
Disallow: /commande/
Disallow: /mon-compte/
Sitemap: https://votresite.com/sitemap.xml
Ici, les bots de recherche IA (OAI-SearchBot, Claude-SearchBot, etc.) restent autorisés via la règle User-agent: *. Seuls les bots d'entraînement sont bloqués.
Votre documentation produit est votre meilleure source d'acquisition. Vous voulez que ChatGPT cite vos pages de documentation, mais vous protégez les zones privées et les pages de démo.
User-agent: *
Allow: /
Allow: /docs/
Allow: /blog/
Allow: /pricing/
# Bloquer zones privées
Disallow: /app/
Disallow: /dashboard/
Disallow: /api/
Disallow: /admin/
# Permettre training bots (notre doc publique aide la communauté)
# Décommentez les lignes ci-dessous si vous voulez bloquer
# User-agent: GPTBot
# Disallow: /
Sitemap: https://votresite.com/sitemap.xml
Sitemap: https://votresite.com/blog-sitemap.xml
Configuration courante en SaaS : permissif sur le contenu marketing et documentation, restrictif sur l'application interne.
Rappel : Google, OpenAI et Anthropic disent qu'ils ne l'utilisent pas. L'étude ALLMO sur 94 000 URLs n'a montré aucun gain mesurable. Si vous voulez tout de même le faire par hygiène, voici le format minimal proposé par Jeremy Howard.
Le fichier se place à la racine : https://votresite.com/llms.txt
# Nom de l'entreprise
> Une phrase qui résume ce que fait votre entreprise.
## Pages principales
- [Accueil](https://votresite.com/) : description courte de la page
- [Services](https://votresite.com/services/) : description courte
- [À propos](https://votresite.com/a-propos/) : description courte
- [Contact](https://votresite.com/contact/) : description courte
## Ressources
- [Blog](https://votresite.com/blog/) : articles sur [vos sujets]
- [Études de cas](https://votresite.com/cas/) : exemples concrets
## Pour les modèles de langage
Cette entreprise se spécialise dans [domaine précis] depuis [année].
Service principal : [phrase claire en 1 ligne].
Localisation : [ville, province].
Disponibilité : [heures d'ouverture].
Format Markdown simple. Pas plus compliqué que ça. Personne ne devrait vous facturer plus de 30 minutes pour le préparer.
Schema reste utile pour le SEO Google classique : rich snippets, Knowledge Graph, entity disambiguation. Pas un levier IA, mais à faire quand même.
À placer dans le <head> de votre page d'accueil :
<script type="application/ld+json">
{
"@context": "https://schema.org",
"@type": "Organization",
"name": "Nom de votre entreprise",
"url": "https://votresite.com",
"logo": "https://votresite.com/logo.png",
"description": "Description courte de l'entreprise.",
"sameAs": [
"https://www.linkedin.com/company/votreentreprise",
"https://www.facebook.com/votreentreprise"
],
"contactPoint": {
"@type": "ContactPoint",
"telephone": "+1-819-555-0100",
"contactType": "customer service",
"areaServed": "CA-QC",
"availableLanguage": ["French", "English"]
}
}
</script>
Le tableau sameAs est important : il pointe vers vos profils officiels (LinkedIn, Facebook, etc.) et aide Google à identifier votre entité de manière fiable.
Si vous avez une adresse physique et servez une zone géographique précise, ajoutez ce schema sur votre page d'accueil ou page contact.
<script type="application/ld+json">
{
"@context": "https://schema.org",
"@type": "LocalBusiness",
"name": "Nom de votre entreprise",
"image": "https://votresite.com/photo-bureau.jpg",
"url": "https://votresite.com",
"telephone": "+1-819-555-0100",
"priceRange": "$$",
"address": {
"@type": "PostalAddress",
"streetAddress": "123 rue Principale",
"addressLocality": "Sherbrooke",
"addressRegion": "QC",
"postalCode": "J1H 1A1",
"addressCountry": "CA"
},
"geo": {
"@type": "GeoCoordinates",
"latitude": 45.4042,
"longitude": -71.8929
},
"openingHoursSpecification": [
{
"@type": "OpeningHoursSpecification",
"dayOfWeek": ["Monday","Tuesday","Wednesday","Thursday","Friday"],
"opens": "09:00",
"closes": "17:00"
}
]
}
</script>
Pour un type plus spécifique, remplacer LocalBusiness par : Restaurant, LegalService, Plumber, Dentist, Store, etc. La liste complète est sur schema.org/LocalBusiness.
Pour modifier robots.txt :
robots.txt à la racine du site (même niveau que wp-config.php). Le fichier physique a priorité sur les fichiers virtuels générés par les plugins.Pour ajouter llms.txt :
llms.txt, le téléverser à la racine via cPanel ou FTP.https://votresite.com/llms.txt doit afficher le contenu.Pour ajouter Schema.org :
functions.php du thème enfant, ou via un plugin comme « Insert Headers and Footers ».Pour vider les caches après modification :
/robots.txt.Tous les outils, documentations officielles et plateformes mentionnés dans la checklist, regroupés ici pour éviter de chercher.
Si vous avez identifié des problèmes et que vous voulez un coup de main pour corriger votre robots.txt, votre SEO de base ou votre réputation tierce, je peux vous accompagner. L'audit robots.txt est inclus dans tous mes forfaits de maintenance WordPress.
Me contacterChecklist préparée par Annie Bergeron, développeuse web et créatrice de plugins WordPress à Sherbrooke, QC. Version 1.0, 11 mai 2026.