La bonne nouvelle : la moitié du travail est technique et peut être réalisée en trois semaines. L'autre moitié est éditoriale et prend trois mois. La très bonne nouvelle : en 2026, moins de 5 % des sites francophones ont commencé.
01 Publier un fichier llms.txt
Ce que c'est
Un fichier texte à la racine du domaine, sur le modèle du robots.txt, qui indique aux moteurs génératifs quelles pages sont prioritaires et comment lire votre site. Format proposé par Answer.AI en septembre 2024.
Pourquoi
Adopté par Anthropic et Mintlify. Non confirmé par OpenAI, Google ou Perplexity à date, mais signal d'intention fort et coût nul. Sur les baromètres GeoPeak, les sites qui publient un llms.txt scorent en moyenne 12 points de plus.
Comment
Créer
/llms.txt à la racine. En-tête H1 avec le nom de la marque, un blockquote de synthèse (2-3 phrases), puis des sections H2 listant les pages clés. Voir
llmstxt.org et l'exemple
llms.txt de GeoPeak.
Erreur classique
Générer un fichier automatique de 800 lignes qui reproduit le sitemap. llms.txt doit être éditorial, pas exhaustif. Vingt liens choisis valent mieux que huit cents.
02 Ouvrir robots.txt aux bots IA
Ce que c'est
Le fichier /robots.txt qui autorise ou bloque les crawlers. Depuis 2023, chaque moteur génératif a lancé ses propres bots.
Pourquoi
Un site qui bloque GPTBot ne peut mécaniquement pas être cité par ChatGPT. Sur le baromètre avocats parisiens 2026, Dentons finit dernier (5/100) uniquement parce que son robots.txt bloque activement les trois familles de bots.
Comment
Ajouter explicitement les User-agents suivants avec
Allow: / :
GPTBot,
ChatGPT-User,
OAI-SearchBot,
PerplexityBot,
Perplexity-User,
Google-Extended,
ClaudeBot. Voir les
spécifications OpenAI.
Erreur classique
Bloquer par défaut « pour protéger le contenu ». Choix stratégique légitime, mais il ferme la porte à toute citation générative. Ne pas bloquer par ignorance.
03 Baliser JSON-LD Organization
Ce que c'est
Un bloc <script type="application/ld+json"> qui décrit votre organisation en schema.org : nom, url, logo, adresse, fondateurs, profils sociaux.
Pourquoi
Les LLM lisent le JSON-LD comme un bulletin d'identité fiable. Un site avec JSON-LD Organization + LocalBusiness + Person (auteurs) est 3 à 5 fois plus cité qu'un site sans, à contenu équivalent.
Erreur classique
Copier un JSON-LD trouvé sur un tutoriel sans mettre à jour les champs. Les LLM détectent les incohérences (adresse, logo, url) et les pénalisent.
04 Structurer une FAQPage
Ce que c'est
Une section FAQ visible sur la page, doublée d'un bloc JSON-LD de type FAQPage avec chaque paire question/réponse en Question/Answer.
Pourquoi
FAQPage est le format le plus cité par les IA en 2026. Chaque réponse est directement liftable : le LLM peut la ré-utiliser mot pour mot dans sa réponse à un utilisateur.
Comment
6 à 12 questions par page pilier. Réponses de 30 à 80 mots, autonomes (compréhensibles hors contexte). Dupliquer strictement le texte en HTML visible et en JSON-LD.
Erreur classique
Écrire des réponses marketing (« Notre solution unique… »). Les IA préfèrent les réponses factuelles, chiffrées, sourcées.
05 Renforcer la structure H1 / H2 / H3
Ce que c'est
Une hiérarchie de titres cohérente : un seul H1 par page, des H2 pour les sections principales, des H3 pour les sous-parties.
Pourquoi
Les LLM utilisent la structure de titres comme un index. Une page sans H2 est traitée comme un bloc opaque et rarement citée en profondeur.
Comment
Un H1 par page, aligné avec la balise title. Des H2 tous les 200-400 mots. Des H3 pour les listes numérotées ou les sous-cas. Éviter les H4 sauf glossaire.
Erreur classique
Utiliser des H2/H3 pour styliser visuellement plutôt que pour structurer. Réserver la sémantique HTML au sens ; le style se fait en CSS.
06 Publier des définitions liftables
Ce que c'est
Une définition claire, courte, en tête de page pilier : « X est [catégorie] qui [fonction] pour [utilisateur]. » Idéalement en balise <dl> avec <dt> et <dd>.
Pourquoi
Aggarwal et al. (KDD 2024) ont montré que les LLM extraient préférentiellement les définitions structurées. Une bonne définition est citée telle quelle par ChatGPT sur les requêtes « qu'est-ce que X ».
Comment
Formuler en 40 à 80 mots. Nommer le concept, la catégorie, la fonction, l'utilisateur. Placer avant le premier H2. Baliser en dl/dt/dd.
Erreur classique
Commencer par une accroche marketing (« Dans un monde où l'IA transforme… »). Les LLM sautent l'accroche et cherchent la définition.
07 Structurer les listes et tableaux
Ce que c'est
Utiliser les balises <ol>, <ul>, <table> plutôt que du texte suivi avec des tirets manuels.
Pourquoi
Les LLM extraient les structures balisées avec 2 à 4 fois plus de précision. Un comparatif en tableau HTML est cité mot pour mot ; le même comparatif en paragraphe est reformulé, souvent avec des erreurs.
Comment
Pour les étapes : <ol>. Pour les caractéristiques : <ul>. Pour les comparaisons : <table> avec thead, th scope="col", tbody.
Erreur classique
Utiliser des divs stylées pour imiter un tableau. Le LLM ne voit pas le style ; il voit du div soup.
08 Ajouter des dates de publication et de mise à jour
Ce que c'est
Baliser datePublished et dateModified en JSON-LD Article, et afficher la date visible sur la page.
Pourquoi
La fraîcheur est un signal fort pour Google AI Overviews et Perplexity. Une page datée de 2026 est priorisée sur une page sans date, même si son contenu est identique.
Comment
Format ISO 8601 dans le JSON-LD (2026-09-01). Date visible en français au-dessus ou en dessous du H1. Mettre à jour dateModified à chaque révision substantielle.
Erreur classique
Antidater les articles pour paraître frais. Détecté par les moteurs (via l'archive.org ou le crawl historique) et pénalisé.
09 Construire l'autorité E-E-A-T
Ce que c'est
Experience, Expertise, Authoritativeness, Trustworthiness — grille Google reprise par tous les moteurs génératifs pour évaluer l'autorité d'une source.
Pourquoi
C'est le levier n°1 sur ChatGPT et AIO. Un site anonyme, sans auteur nommé, sans historique vérifiable, ne passe pas le seuil de citation, même avec un contenu excellent.
Comment
Nommer chaque auteur. Publier une page auteur avec bio, titre, publications antérieures, profils LinkedIn/ORCID/Wikipedia. Baliser Person en JSON-LD et lier via author dans les Articles.
Erreur classique
« Écrit par la rédaction ». Aucun signal d'autorité. Nommer un humain, même junior.
10 Publier sur Reddit et forums métier
Ce que c'est
Participer aux discussions Reddit, Hacker News, Stack Overflow, forums métier — pas pour spammer, pour contribuer à des fils de qualité en signant votre marque.
Pourquoi
Perplexity cite Reddit à 6,6 % — c'est sa source dominante. Google AI Overviews cite Reddit à 2,2 %. ChatGPT commence à intégrer Reddit dans son index depuis 2024.
Comment
Identifier 3 à 5 subreddits pertinents. Publier des réponses substantielles (200+ mots), citer votre expertise sans lien commercial systématique. Créer un compte au nom de la marque + un compte personnel pour les fondateurs.
Erreur classique
Poster des liens de blog en boucle. Les modérateurs bannissent, l'autorité est perdue.
11 Obtenir des citations Wikipedia
Ce que c'est
Faire apparaître votre marque, votre fondateur ou vos publications dans une entrée Wikipedia — comme référence, source ou lien externe.
Pourquoi
Wikipedia est la source n°1 de ChatGPT (7,8 %). Une citation Wikipedia devient un pont vers votre site sur des dizaines de requêtes connexes. C'est le levier le plus difficile et le plus rentable.
Comment
Identifier les entrées pertinentes à votre secteur. Produire du contenu de niveau académique (études, données originales, méthodologies documentées) qui rend votre citation légitime. Proposer des ajouts documentés en page de discussion, jamais des liens promo.
Erreur classique
Créer sa propre entrée Wikipedia. Détectée en 24h par les patrouilleurs, supprimée, marque bannie. Toujours passer par un tiers.
12 Mesurer, réitérer, publier
Ce que c'est
Interroger mensuellement ChatGPT, Perplexity et AIO sur vos 20 à 50 requêtes cibles. Suivre le taux de citation, la position, le concurrent cité à votre place.
Pourquoi
Le paysage bouge chaque mois. GPT-5, Perplexity Sonar, Gemini 2.5 changent leurs sources sans préavis. Sans mesure continue, impossible de savoir si un correctif fonctionne.
Comment
Via les API publiques (OpenAI, Perplexity, SerpAPI pour AIO) ou via un outil dédié comme
Vigie GEO. Un fichier CSV par mois, versionné, permet de tracer les gains et les régressions.
Erreur classique
Auditer une fois, appliquer, oublier. Un site optimisé en janvier peut redevenir invisible en juillet si Perplexity change son mix de sources.
Cas d'usage vérifiés
Trois exemples publics qui illustrent les extrêmes du spectre. Sources vérifiables via une simple requête à ChatGPT ou Perplexity.
Cité massivement
Wikipedia (wikipedia.org)
Ce qui fonctionne : structure H1/H2/H3 impeccable, autorité E-E-A-T maximale, JSON-LD complet, fraîcheur permanente. ChatGPT cite Wikipedia dans 7,8 % de ses réponses — source n°1.
Cité systématiquement
arXiv (arxiv.org)
Ce qui fonctionne : métadonnées académiques, PDF crawlables, dates strictes, auteurs vérifiables, DOI. Cité par ChatGPT et Perplexity sur toute requête technique pointue.
Cas contrasté
Y Combinator (ycombinator.com)
Ce qui manque : peu de contenu long form, structure H2 rare, autorité éditoriale portée par les startups plus que par YC lui-même. Cité pour la marque, rarement pour le fond.
Questions fréquentes
Pourquoi n'apparaît-on pas dans ChatGPT ? — Trois causes dominent en 2026 : robots.txt bloque GPTBot, aucun schema JSON-LD, autorité E-E-A-T trop faible.
Combien de temps pour être cité par les IA ? — Les correctifs techniques (llms.txt, JSON-LD, robots.txt) sont indexés en 1 à 3 semaines. Les correctifs éditoriaux et l'autorité E-E-A-T produisent leurs effets en 30 à 90 jours.
llms.txt est-il obligatoire ? — Non, mais son coût de publication est nul et son signal d'intention est fort. Adopté par Anthropic et Mintlify. Non confirmé par OpenAI, Google ou Perplexity à date.
Faut-il ouvrir robots.txt aux bots IA ? — Oui, si vous voulez être cité. Un site qui bloque GPTBot ne peut mécaniquement pas être cité par ChatGPT.
Le SEO classique aide-t-il encore ? — Partiellement. Google AI Overviews reste corrélé au ranking Google historique. ChatGPT et Perplexity valorisent d'autres signaux : Wikipedia, Reddit, autorité E-E-A-T, structure éditoriale, fraîcheur.
Vous voulez savoir où vous en êtes ?
Audit express gratuit en 3 minutes. Score par moteur, top 5 des correctifs prioritaires, livraison instantanée par email. Aucune carte requise.