« Alexandre, comment référencer un nouveau site web et par où commencer ? »

Alexandre Montenon

Par Alexandre

Spécialiste SEO/GEO chez Rcweb

Quand je dois référencer un nouveau site web, je commence toujours au même endroit : la technique. Le site doit être lisible par les moteurs et indexable. Ensuite viennent les outils de suivi, puis l’identité du site.

La rédaction des contenus et la recherche de mentions externes arrivent ensuite. Cet ordre compte énormément, puisque chaque étape repose sur la précédente. Le référencement classique et la visibilité dans ChatGPT, Perplexity, Claude ou Google AI Overviews partagent d’ailleurs la même base.

Les premiers effets visibles sur les pages peuvent arriver en quelques semaines. Pour la reconnaissance d’une marque par les IA, je travaille plutôt avec une fourchette de 3 à 9 mois.

Par Alexandre Montenon, consultant GEO à Lyon

Par où commencer pour référencer un nouveau site web ?

Mon premier réflexe consiste à vérifier que Google, Bing et les crawlers des IA peuvent réellement lire les pages. Un blocage technique suffit à rendre tout le travail éditorial invisible.

C’est particulièrement vrai côté IA. Un site qui bloque OAI-SearchBot reste absent des réponses de recherche de ChatGPT. Avant de travailler le contenu, je veux donc savoir si les robots arrivent jusqu’à lui.

Pour référencer un nouveau site web, je suis cet ordre. Chaque étape dépend directement de celle qui la précède.

ÉtapeActionOutilDélai avant effet visible
1. Accès techniqueVérifier robots.txt, balise noindex et contenu présent dans le HTML initialcurl, navigateur, logs serveurImmédiat
2. Outils de suiviOuvrir Search Console et Bing Webmaster Tools, puis déclarer le sitemapSearch Console, Bing Webmaster ToolsQuelques jours à quelques semaines
3. Identité du siteCréer une page « qui sommes-nous », renseigner Organization et harmoniser les profilsJSON-LD, Wikidata, réseaux sociauxSemaines, puis 3 à 9 mois pour la reconnaissance
4. ContenuCréer les pages qui répondent aux vraies questions, avec chiffres et sourcesÉditeur de contenuQuelques semaines
5. Preuves externesTravailler les avis clients, annuaires sectoriels, mentions et vidéosPlateformes d’avis, annuaires, YouTube6 à 12 mois
6. MesureCréer une baseline puis suivre son évolution chaque moisOutils de suivi, GA4Baseline au premier mois

Comment vérifier que Google et les IA peuvent lire votre site ?

Je vérifie trois éléments : le fichier robots.txt, les éventuels blocages du pare-feu et la présence du texte directement dans le HTML initial. Ce contrôle mérite vraiment quelques minutes.

Un robots.txt peut parfaitement autoriser un crawler tandis qu’un pare-feu, un WAF ou une limite de débit lui renvoie des erreurs 403 ou 429. Le robot se retrouve alors traité comme un trafic suspect.

Voilà les vérifications que je réalise :

  1. Autoriser les agents de recherche dans le robots.txt. Je vérifie Googlebot, OAI-SearchBot pour la recherche ChatGPT, Claude-SearchBot et PerplexityBot. J’ajoute aussi ChatGPT-User et Claude-User pour les requêtes lancées directement par un utilisateur.
  2. Décider du sort des agents d’entraînement. GPTBot, ClaudeBot et Google-Extended peuvent être bloqués pour protéger le contenu. Dans ce cas, la marque entre moins facilement dans la mémoire des modèles. Pour une entreprise qui commercialise un produit ou un service, le dossier GEO recommande généralement leur autorisation.
  3. Tester le rendu sans JavaScript. Les crawlers IA rendent le JavaScript avec davantage de limites que Googlebot. Le texte destiné à être cité gagne donc à figurer directement dans le HTML initial. Une commande curl, puis une recherche de la phrase visée, permet de le vérifier.
  4. Regarder les journaux serveur. Je cherche surtout les codes 403 et 429 servis aux agents IA.
  5. Retirer les protections anti-robots du contenu public. Même logique avec les CAPTCHA et les murs d’inscription placés devant les pages destinées à être citées.

Faut-il ouvrir Google Search Console et Bing Webmaster Tools ?

Oui. Quand je veux référencer un nouveau site web, ce sont les deux premiers outils que j’ouvre. Ils commencent à conserver l’historique du domaine dès le départ et permettent de suivre l’indexation des URL.

Google recommande d’utiliser Search Console pour suivre les performances du site et de déclarer un sitemap. Ce fichier facilite la découverte des URL par Google, même si son utilisation reste facultative.

Rapport d’indexation des pages dans Google Search Console avec le nombre de pages indexées et non indexées
Le rapport d’indexation de Google Search Console permet de visualiser les pages connues, indexées et écartées. Source : Google Search Console.

Chaque outil apporte ensuite une lecture différente :

  • Search Console : elle montre l’état d’indexation des pages. Depuis juin 2026, un rapport couvre aussi les fonctionnalités d’IA générative. Il remonte les impressions dans AI Overviews et AI Mode, avec une visibilité encore limitée côté clics, taux de clic et requêtes.
  • Bing Webmaster Tools : son rapport « AI Performance », lancé en février 2026, remonte de vraies citations, avec les pages citées et les requêtes de reformulation, ou grounding queries. Bing indique ainsi qu’une page a servi de source, tandis que Google montre son apparition dans une interface IA.
  • IndexNow : ce protocole gratuit et ouvert signale aux moteurs participants, dont Bing, l’ajout, la modification ou la suppression d’une page. De nombreux CMS l’intègrent déjà.
Tableau de bord AI Performance de Bing Webmaster Tools avec citations, pages citées et grounding queries
AI Performance affiche notamment les citations, les pages citées et les grounding queries. Source : Microsoft Bing.

En France, le calendrier compte aussi. AI Overviews est déployé depuis le 22 juillet 2026. Les données Search Console liées à ces surfaces restaient donc vides auparavant pour une audience française. L’historique démarre à partir de cette période.

Combien de temps faut-il pour qu’un nouveau site soit indexé ?

Google peut découvrir et parcourir un nouveau site en quelques jours à quelques semaines. L’indexation, elle, reste incertaine. Une demande de crawl entraîne une nouvelle visite potentielle de Google, plutôt qu’une inclusion immédiate dans son index.

Je garde trois règles en tête :

  • Le quota reste limité. L’outil d’inspection d’URL de Search Console vise surtout les pages individuelles et fonctionne avec un nombre limité de demandes.
  • Multiplier les demandes de crawl de la même URL apporte peu. Une demande suffit.
  • Pour plusieurs pages, le sitemap devient plus adapté. C’est d’ailleurs la méthode recommandée par Google.

Pour vérifier l’indexation, je tape simplement site:votresite.fr dans Google. Si le domaine reste invisible après plusieurs semaines, je reviens au contrôle technique du départ.

Outil d’inspection d’URL dans Google Search Console indiquant qu’une page est indexée
L’inspection d’URL montre notamment si la page est indexée, si son crawl est autorisé et si Google a pu la récupérer. Source : Google Search Console.

Google précise également que certains changements produisent leurs effets en quelques heures, tandis que d’autres demandent plusieurs mois. J’attends donc plusieurs semaines avant d’évaluer sérieusement leur impact.

Comment donner une identité claire à un nouveau site ?

À ce stade, je veux que Google et les modèles comprennent exactement qui se trouve derrière le site. Je crée donc une page « qui sommes-nous » détaillée, je déclare l’organisation en données structurées et j’utilise le même nom et la même description sur tous les profils.

Les modèles d’IA travaillent avec des entités : un nom, des attributs vérifiables et des relations confirmées par plusieurs sources indépendantes. Des dénominations différentes peuvent fragmenter cette entité et réduire la force des signaux.

Je classe les cinq principaux signaux d’entité de cette manière :

SignalCoûtDélaiImpact
Page « qui sommes-nous » complète avec raison sociale, activité, adresse, équipe et date de créationFaibleImmédiatÉlevé
Bloc sameAs en JSON-LD reliant tous les profilsTrès faibleSemainesÉlevé
Fiche WikidataFaibleSemainesÉlevé
Page WikipédiaImpossible à forcerMois à annéesTrès élevé, avec une notoriété réelle
Mentions tierces cohérentesÉlevé6 à 12 moisLe plus fort à terme

Les trois premiers points peuvent se régler en une journée de travail. Pour Wikipédia, je laisse la notoriété réelle décider : une page supprimée ou signalée pour conflit d’intérêts peut devenir contre-productive.

Google présente les données structurées comme facultatives pour ses fonctions de recherche générative. Je les utilise donc surtout pour réduire les ambiguïtés autour d’une entité.

Quel contenu publier en premier pour référencer un nouveau site web ?

Pour référencer un nouveau site web, je commence par les pages qui répondent aux cinq grandes questions d’achat d’une catégorie : définition, comparaison, alternatives, cas d’usage et décision.

Ce découpage correspond à l’analyse Semrush × Kevin Indig menée sur 1 094 catégories suivies dans ChatGPT entre janvier et juin 2026. Seulement 15,2 % des catégories disposaient alors d’un « propriétaire » clairement identifiable. L’espace reste donc très largement ouvert, avec les limites liées à une étude réalisée sur le marché américain.

Quand je rédige, je garde ensuite quelques règles très concrètes :

Publier énormément de pages apporte relativement peu. La corrélation entre le nombre de pages d’un site et sa visibilité IA tourne autour de 0,194 dans l’analyse Ahrefs menée sur 75 000 marques.

Google privilégie de son côté un contenu qualifié de « non commodité » : une expérience directe, un point de vue ou une information propre au site plutôt qu’une simple synthèse de contenus déjà disponibles.

Faut-il s’inscrire dans des annuaires et chercher des liens ?

Oui, avec une sélection serrée. Pour référencer un nouveau site web, je vise surtout les annuaires sectoriels et les profils réellement consultés par les clients.

Les liens pris isolément affichent une corrélation limitée avec la visibilité IA. Ahrefs mesure environ 0,218 pour les backlinks, contre 0,66 à 0,71 pour les mentions de marque sur le web. Ce qui m’intéresse davantage, c’est donc de voir la marque nommée dans un contexte précis, sur des pages déjà reprises par les moteurs.

Le dossier GEO va dans le même sens : une présence à jour et correctement catégorisée dans des comparateurs ou annuaires spécialisés peut avoir davantage d’intérêt qu’un article de blog supplémentaire.

Pour cette partie, je peux m’appuyer sur le guide Référencer un nouveau site de Soumission-annuaires.fr. Je conserve les mêmes critères de sélection : pertinence thématique, mise à jour régulière et audience réellement liée à l’activité.

Le nom, l’adresse et la description de l’entreprise doivent également rester identiques à ceux utilisés sur la page « qui sommes-nous ».

J’ajoute ensuite trois autres sources de preuve externe :

  1. Les avis clients. L’analyse Seer × Trustpilot menée sur 800 000 réponses IA en mai 2026 montre que les profils actifs sur des plateformes d’avis tierces augmentent la probabilité de citation. Un profil vide crée un signal d’absence, tandis qu’un avis négatif isolé peut être repris et amplifié.
  2. YouTube. Les mentions de marque sur YouTube atteignent une corrélation d’environ 0,737 avec la visibilité IA dans l’étude Ahrefs. Je nomme donc la marque oralement dans la vidéo, puisque la transcription retient les éléments réellement prononcés.
  3. La presse et les communautés. Je privilégie des comptes identifiés et des mentions authentiques. Google classe les mentions artificielles parmi les tactiques inefficaces.

Ces chiffres restent des corrélations. Je les utilise comme des indications de direction, plutôt que comme des preuves de causalité.

Comment mesurer les performances d’un nouveau site ?

Dès le premier mois, je crée une baseline. Ensuite, je reprends exactement la même liste de prompts à chaque mesure. Ce point de départ me permet d’observer si les actions mises en place font réellement évoluer la visibilité.

Mon protocole minimal tient en cinq étapes :

  1. Je rédige 20 à 30 prompts, avec environ cinq prompts par catégorie prioritaire, puis je conserve cette liste.
  2. J’exécute chaque prompt trois à cinq fois sur ChatGPT, Perplexity, Claude, Gemini et Google, dans une session propre. Les réponses varient naturellement d’une exécution à l’autre.
  3. Je relève quatre indicateurs : part de mentions, part de citations, sentiment et sources tierces utilisées.
  4. Je crée dans GA4 un segment de trafic IA basé sur les referrers chatgpt.com, perplexity.ai, gemini.google.com, claude.ai et copilot.microsoft.com.
  5. Je laisse passer 6 à 12 semaines entre deux mesures. Sur un petit échantillon, un écart inférieur à 10 points reste trop faible pour être considéré comme significatif.

Je traite aussi le trafic comme une variable incertaine. ChatGPT représentait environ 0,21 % du trafic web contre 39,98 % pour Google dans les données Ahrefs de février 2026.

L’intérêt du référencement IA se situe surtout au moment du choix. Dans les tests de Growth Memo, 74 % des utilisateurs ont retenu la marque la plus souvent mentionnée.

Plan d’action sur 90 jours pour un nouveau site

Quand je dois référencer un nouveau site web, je répartis le travail sur trois périodes. Cela me permet de traiter la technique, le contenu puis les preuves externes dans leur ordre logique.

PériodeActions prioritaires
Jours 1 à 30Auditer le robots.txt et les journaux serveur ; ouvrir Search Console et Bing Webmaster Tools ; déposer le sitemap ; créer la page « qui sommes-nous » et le JSON-LD Organization ; établir la baseline
Jours 31 à 60Publier les pages de la catégorie : définition, comparaison, alternatives, cas d’usage et décision ; ajouter une FAQ, des dates visibles et des sources ; créer la fiche Wikidata
Jours 61 à 90Ouvrir les profils d’avis ; sélectionner quelques annuaires sectoriels ; lancer un programme de mentions via la vidéo, la presse et les communautés ; refaire la mesure puis la comparer à la baseline

FAQ

Je retrouve souvent les mêmes questions au moment de référencer un nouveau site web. Voici les réponses que je donne le plus souvent.

Faut-il soumettre son site à Google pour qu’il soit référencé ?

La soumission reste facultative, tout en étant recommandée. Google peut découvrir un domaine grâce aux liens qui pointent vers lui, tandis qu’un sitemap déclaré dans Search Console facilite la découverte des URL. L’outil d’inspection d’URL reste plutôt destiné aux pages individuelles et fonctionne avec un quota.

Un fichier llms.txt aide-t-il un nouveau site à être cité ?

Google indique qu’il ignore les fichiers llms.txt et les balisages « spéciaux » dans Google Search. Ahrefs a analysé 137 210 domaines et observé que, parmi environ 38 000 sites disposant d’un fichier valide, 97 % avaient reçu zéro requête vers ce fichier en mai 2026.

Faut-il réécrire ses pages spécialement pour les IA ?

Une version séparée pensée uniquement pour l’IA apporte peu d’intérêt. Google classe la réécriture spécifique pour l’IA et le découpage artificiel parmi les pratiques inutiles.

Une page structurée pour un lecteur humain, avec un titre sous forme de question, une réponse placée rapidement et des chiffres sourcés, crée naturellement des blocs faciles à citer.

Faut-il acheter des backlinks pour un nouveau site ?

Le dossier GEO classe l’achat massif de liens parmi les tactiques inefficaces. Les backlinks affichent une corrélation d’environ 0,218 avec la visibilité IA, largement derrière les mentions de marque. Je privilégie donc les mentions qualitatives placées dans un contexte thématique cohérent.

Combien de temps avant de voir des effets ?

Les améliorations structurelles d’une page peuvent produire des effets en quelques semaines. La reconnaissance d’une entité demande généralement 3 à 9 mois, tandis que les mentions tierces se construisent plutôt sur 6 à 12 mois. Ces fourchettes restent indicatives.

Limites de cet article

Je garde une réserve importante sur les chiffres de corrélation cités ici. Ahrefs, Semrush et Seer éditent eux-mêmes des outils liés à la visibilité IA et disposent donc d’un intérêt commercial sur ce marché. J’utilise leurs travaux pour identifier des tendances, avec le recul nécessaire.

Plusieurs études concernent également le marché américain. Les sources indépendantes présentes dans cet article correspondent aux publications académiques et à la documentation officielle des plateformes.

Enfin, les recommandations publiées par Google décrivent le fonctionnement de Google. Leur portée ne couvre directement ni ChatGPT, ni Perplexity, ni Claude.

Le lien vers Soumission-annuaires.fr constitue une ressource complémentaire dont le contenu était inaccessible au moment de la rédaction initiale.

Sources

Je regroupe ici les documentations, études et ressources utilisées dans l’article afin de conserver un accès direct aux données citées.

Documentation officielle

Études

Ressource complémentaire