- L'extension de domaine ne prédit pas le taux de citation. L'étude de mai 2026 d'Otterly.AI sur 1 028 959 URL citées a révélé que .COM, .ORG, .IO et .AI ont tous obtenu en moyenne 1,7 citation par URL.
- Le jeu de données de Profound d'août 2024 à juin 2025 a placé .COM à 80.41% des citations de Chat GPT. Le taux et le partage répondent à des questions différentes.
- Les URLs propres comptent. Les URLs sans chaîne de requête ont obtenu en moyenne 2,1 citations contre 1,6 pour les URLs avec paramètres.
- Différents assistants s'appuient sur différentes sources. Wikipedia représente 7.8% des citations de Chat GPT; Reddit représente 6.6% de celles de Perplexity.
De plus en plus de gens interrogent un assistant IA à propos d'un produit avant même de voir une page de résultats de recherche. Cela a produit beaucoup de conseils sur les domaines et la visibilité IA, dont une grande partie est confiante et très peu sourcée.
Cet article s'appuie sur les études qui existent réellement. Nous examinons ce que quatre ensembles de données disent sur les extensions de domaine, la structure des URL, les types de pages et où chaque assistant obtient ses informations. Là où les données sont claires, nous le soulignons. Là où elles s'arrêtent, nous le disons aussi, plutôt que de combler le vide avec une supposition.
Si vous choisissez un domaine, consolidez un portefeuille ou essayez de comprendre pourquoi un assistant décrit votre entreprise différemment d'un autre, c'est ce que les preuves soutiennent.
Première étape : les robots IA explorent votre page
Rien de tout cela ne fonctionne si les robots ne peuvent pas vous atteindre.
Et ce n'est pas un bot. Open AI en gère trois, chacune remplissant une fonction différente:
- GPTBot collecte du contenu utilisé pour entraîner des modèles.
- OAI-Search Bot construit l'index derrière les résultats de recherche Chat GPT.
- Utilisateur Chat GPT récupère des pages en direct pendant une session.
Vous contrôlez chacun séparément dans robots.txt. Cela signifie que vous pouvez laisser OAI-Search Bot entrer pour apparaître dans les résultats de recherche, tout en bloquant GPTBot pour garder votre contenu hors de l'entraînement.
Cela signifie aussi que bloquer l'un ne vous dit rien sur les deux autres. C'est la partie que les gens comprennent mal.
Ces trois robots correspondent à trois choses différentes qui sont généralement regroupées sous le terme "visibilité IA" :
- Formation . Contenu collecté en masse et associé à votre domaine au fil du temps.
- Récupération . Extraits en direct ou indexés provenant d'hôtes spécifiques.
- Citation . Le petit nombre de sources récupérées qu'une réponse affiche réellement.
Presque tous les conseils publiés ciblent le dernier. Bloquez le mauvais bot et vous avez discrètement coupé les deux premiers, ce qui est un problème différent avec une solution différente.
Pourquoi votre domaine fonctionne comme une ancre d'entité
Cette section est un argument, pas un constat. Aucune étude publiée ne mesure comment les systèmes d'IA lient un nom de marque à un domaine, alors traitez ce qui suit comme un raisonnement plutôt que comme une preuve.
Votre nom de marque est écrit de plusieurs manières sur votre propre site. Votre nom légal diffère de votre nom commercial. Les identifiants sociaux varient selon la plateforme. Un domaine enregistré est unique par conception et résout à un seul propriétaire, ce qui en fait la chaîne publique la plus cohérente pointant vers votre entreprise.
L'étude de Semrush de juillet 2025 a analysé 5,000 mots-clés sélectionnés aléatoirement et plus de 150,000 citations uniques sur quatre plateformes : Google AI Mode, Google AI Overviews, Chat GPT et Perplexity. Elle a mesuré à quel point les citations de chacun chevauchaient les 10 premiers résultats organiques de Google.
Source : Semrush
| Plateforme | Chevauchement de domaine avec le top 10 de Google | Chevauchement d'URL |
| Perplexité | Plus de 91 % | 82% |
| Aperçus IA de Google | Environ 86% | Environ 67% |
| Mode IA de Google | Environ 54% | Environ 35% |
| Chat GPT | Environ 45% | Environ 28% |
Perplexité s'alignait le plus étroitement, ce qui suggère qu'il s'appuie fortement sur le top 10 de Google pour choisir quoi citer.
Aperçus IA s'est également largement appuyé sur l'index traditionnel de Google.
Mode IA avait une relation plus lâche, indiquant une récupération plus indépendante.
Chat GPT avait la plus faible corrélation des quatre, faisant écho à Semrush's découverte antérieure selon laquelle Chat GPT s'aligne plus étroitement avec Bing qu'avec Google.
Remarquez ce qui se passe avec les deux colonnes. Sur chaque plateforme, le chevauchement des domaines dépasse largement celui des URL. Semrush attribue cela au fait que les LLM extraient différentes pages des mêmes domaines de confiance, allant plus profondément dans les sous-pages, les articles de blog et les articles d'aide, plutôt que le contenu de type page d'accueil qui a tendance à se classer.
Ils ont également constaté que plus le nombre de classements dans le top 10 d'un domaine augmentait, plus sa présence dans les citations IA augmentait, avec une forte corrélation au niveau du domaine. C'est ce qui se rapproche le plus d'une preuve directe de l'argument de cette section : le domaine, et non la page, est l'unité que ces systèmes semblent faire confiance.
Ce que disent les données de l'étude URL AI Citation 2026
L'étude d'Otterly a testé quelque chose d'adjacent, et le résultat est plus utile qu'une supposition sur les noms ne l'aurait été.
Il a examiné le type de page. Pas le domaine, pas l'extension, mais quel genre de page se trouve à l'URL. Voici ce qui est revenu :
| Type de page | Citations moyennes |
| Pages de guide (chemin /guide/) | 2.7 |
| Articles de blog | 2.0 |
| Ligne de base (toutes les pages) | 1.9 |
| Actualités | 1.7 |
| Produit/Service | 1.6 |
| Pages de tarification | 1.5 |
Source : Loutre
C'est un écart de 80% entre le haut et le bas. Pour comparaison, l'écart entre les extensions de domaine était nul.
Ce qu'il faut en retenir
Votre nom compte pour la façon dont les gens le lisent, s'en souviennent et le tapent. Ce sont de vraies raisons de payer pour un bon nom.
Mais si la question est spécifiquement "est-ce que ce nom me fera plus citer," la réponse honnête est que personne ne le sait, et ce que l'on peut mesurer pointe ailleurs. Un guide publié sur un domaine descriptif simple surpasse une page de tarification sur un domaine joli et de marque. Ce que vous publiez a un poids mesurable plus important que le support sur lequel vous le publiez.
Votre TLD affecte-t-il les citations IA ?
Réponse courte: non, pas comme signal de sélection.
L'étude
Otterly.AI a réalisé la plus grande analyse de ce genre que nous ayons vue. Ils ont examiné 1 028 959 URL citées et 1 932 200 citations individuelles sur six plateformes :
- Chat GPT
- Aperçus IA de Google
- Mode IA de Google
- Perplexité
- Gemini
- Microsoft Copilot
Les données ont été collectées sur une période de 24 heures en mai 2026.
| TLD | URLs dans l'échantillon | Citations moyennes |
| .COM | 528 314 | 1.7 |
| Autre | 374 657 | 1.7 |
| .UK | 43,331 | 3.0 |
| .ORG | 32,395 | 1.7 |
| .NET | 12,549 | 1.6 |
| .IO | 11,235 | 1.7 |
| .AI | 8,326 | 1.7 |
| .CO | 6,170 | 1.6 |
| .EDU | 6,095 | 1.5 |
| .GOV | 5,887 | 1.5 |
Quatre des plus grandes extensions ont obtenu exactement le même nombre. La commerciale, celle à but non lucratif, celle de la start-up tech et celle de l'IA.
Il vaut la peine de s'arrêter sur les deux dernières lignes. On a tendance à supposer que .EDU et .GOV portent une crédibilité automatique. Dans cet ensemble de données, ils sont arrivés légèrement en dessous de .COM.
Une extension a cassé le schéma
Les domaines .UK ont obtenu en moyenne 3.0 citations sur 43,331 URLs, près du double de tout le reste.
Les auteurs de l'étude ont déclaré qu'ils ne pouvaient pas l'expliquer. Leur fenêtre était de 24 heures, donc il est difficile de considérer cela comme une règle.
Sans données au niveau des requêtes, ils ne pouvaient pas dire si les domaines .UK sont réellement favorisés, si les requêtes axées sur le Royaume-Uni dominaient ce jour-là, ou si une poignée de requêtes à fort volume faussait la moyenne.
Pourquoi d'autres études semblent en désaccord
Vous verrez ailleurs des chiffres montrant que .COM domine outrageusement les citations IA. Ces chiffres sont réels. Mais ils répondent à une question différente.
Taux de citation demande : l'extension prédit-elle si une page est citée ? Dans les données d'Otterly, non. Les quatre principales extensions ont obtenu une moyenne de 1.7.
Part de citations demande : quelles extensions composent la plupart des citations existantes ? Profound, suivi de 680 millions de citations entre août 2024 et juin 2025, a placé .COM à 80.41% des citations de Chat GPT et .ORG à 11.29%. Dans l'échantillon d'Otterly, .COM représentait 51.3% des URLs à lui seul.
Les deux sont vrais. .COM domine les totaux parce que la majeure partie du web vit sur .COM. C'est un effet de volume, pas une préférence.
Ce qu'il faut en retenir
Choisissez votre extension pour des raisons humaines, comme:
- Comment cela se lit sur une carte de visite
- Si les gens feront une faute de frappe.
- Ce que vos acheteurs s'attendent à voir.
- Ce que vous pouvez défendre.
- Ne le choisissez pas pour la visibilité machine.
Les données que vous trouvez dans les études que nous avons mentionnées ne soutiennent pas ces raisons logiques.
Ce que les données disent sur la structure des URL
Otterly a testé 15 attributs différents d'URL, tels que la profondeur du chemin, la longueur de l'URL, etc.. Presque tous sont revenus vides, ce qui signifie que la structure de l'URL n'est pas si importante pour la visibilité IA.
Les corrélations
| Attribut | Corrélation avec les citations |
| Profondeur du chemin | +0.002 |
| Longueur de l'URL | -0.025 |
| Longueur du domaine | -0.007 |
| Nombre de traits d'union | -0.013 |
Chacun de ces éléments est fonctionnellement nul.
En clair : une page située à cinq niveaux de profondeur a été citée à peu près aussi souvent qu'une page à la racine. Une URL de 120 caractères a performé comme une URL de 40 caractères. Les traits d'union n'ont fait aucune différence. Pas plus qu'un domaine court.
Si une restructuration de dossier est sur votre feuille de route sous la rubrique de Visibilité IA, retire-le.
La structure des URL compte toujours en SEO traditionnel, alors assurez-vous d'y prêter attention.
La seule chose qui a été enregistrée
Des URL propres valent mieux que des URL en désordre.
Les URL sans chaîne de requête ont obtenu en moyenne 2,1 citations. Les URL avec paramètres ou balises de suivi ont obtenu 1,6. C'est un écart de 24%, mesuré sur 430 628 URL avec paramètres.
C'est le seul changement au niveau de l'URL que les données soutiennent réellement, et ce n'est pas un travail compliqué :
- Définissez rel="canonical" pointant vers la version propre de chaque page.
- Gardez les paramètres de suivi hors des liens internes.
- Retirez-les de toute URL que vous prévoyez de partager ou de référencer.
Encore une chose à savoir
Avant de fixer des objectifs autour des nombres de citations, regardez comment les nombres sont répartis.
L'URL médiane dans l'étude était citée exactement une fois. La moyenne était de 1,9. Et 15,8% des URLs représentaient la moitié de toutes les citations.
C'est une loi de puissance, la même forme que l'on voit dans les backlinks et les partages sociaux. La plupart des pages sont citées une fois et plus jamais. Un petit groupe est cité constamment.
Donc "nous avons été cités" n'est pas vraiment le jalon. Ce qui l'est, c'est d'obtenir qu'une page fasse partie de ce groupe cité à plusieurs reprises.
Sources sur lesquelles chaque plateforme s'appuie
Être reconnu par un assistant ne signifie pas être reconnu par les autres. Ils construisent leur image du monde à partir de différents endroits.
Le test du titre
Les données de Profound montrent que chaque plateforme penche dans une direction différente :
| Plateforme | Source principale | Part des citations de cette plateforme |
| Chat GPT | Wikipédia | 7.8% |
| Aperçus IA de Google | 2.2% | |
| Perplexité | 6.6% |
Ne regardez que les dix sources les plus citées de chaque plateforme, et vous constaterez que Wikipédia représente 47,9% dans le top dix de Chat GPT. Reddit représente 46,7% dans celui de Perplexity.
En d'autres termes, lorsque Chat GPT cherche une source bien connue, environ la moitié du temps, il se tourne vers Wikipédia. Quand Perplexity fait de même, environ la moitié du temps, il se tourne vers Reddit.
Les quatre sources que tout le monde utilise
Certaines sources apparaissent quel que soit le secteur.
Search Engine Land a analysé plus de 800 domaines dans 11 secteurs en octobre 2025, en utilisant les réponses de Google AI Mode, Perplexity et la recherche Chat GPT. Quatre domaines sont apparus dans les 50 URL les plus citées de chaque secteur:
| Source | Mentions approximatives dans tous les secteurs |
| ~66 000 | |
| Wikipédia | ~25 000 |
| You Tube | ~19,000 |
| Forbes | ~10,000 |
| Linked In | ~9,000 |
| Quora | ~8,000 |
Si votre marque n'a aucune présence sur aucun de ces éléments, c'est une lacune structurelle. Peu importe votre secteur d'activité.
Les classements alimentent toujours les citations
La même analyse a constaté que la diversité des mots-clés organiques était corrélée à la visibilité IA à 0,41. Les backlinks arrivaient plus bas, à 0,37.
Aucun des deux chiffres n'est décisif en soi. Mais la direction est assez claire : se classer pour un large éventail de requêtes donne à ces systèmes plus de chances de vous trouver. La visibilité dans la recherche traditionnelle n'a pas cessé d'être importante. Elle est devenue un intrant plutôt que la destination.
Ce qu'il faut en retenir
Trois questions, dans l'ordre :
- Où vos acheteurs font-ils réellement leurs recherches? S'ils utilisent Chat GPT, une couverture de type référence vous apporte plus que l'activité communautaire. S'ils utilisent Perplexity, l'inverse est plus proche de la vérité.
- Êtes-vous présent dans les quatre universels? Reddit, Wikipedia, You Tube et Forbes apparaissent partout. Leur absence n'est pas quelque chose que le travail sur site peut corriger.
- Vous positionnez-vous largement, pas seulement en haut? La largeur était plus fortement corrélée que les backlinks. Une empreinte étendue donne à ces systèmes plus de points d'entrée.
Comment auditer quel domaine l'IA considère comme votre marque
Ces étapes sont procédurales plutôt que fondées sur des preuves. Elles vous indiquent quelle est votre configuration actuelle; elles ne promettent pas de résultat de citation.
- Confirmez votre hôte canonique . Vérifiez ce que le DNS, les redirections et les balises canoniques déclarent actuellement.
- Confirmer l'accès au robot d'exploration . Vérifiez que les robots d'IA peuvent atteindre vos pages principales, et vérifiez chacune séparément. Les trois robots d'Open AI sont contrôlés indépendamment, donc autoriser l'un ne dit rien sur les autres. Vérifiez les règles CDN et WAF, pas seulement robots.txt. Notez qu'Open AI indique que les modifications de robots.txt peuvent prendre environ 24 heures pour affecter les résultats de recherche.
- Confirmer la cohérence de l'identifiant . Votre domaine, nom de marque et nom légal doivent apparaître à l'identique sur votre site, dans les données structurées et sur les profils tiers.
- Interroger les plateformes . Demandez à chaque assistant qui est votre entreprise et enregistrez quel nom d'hôte revient.
Si vous ne savez pas par où commencer, Semrush propose un excellent cours pour débutants. Vous pouvez en savoir plus sur la recherche IA et tester comment les plateformes IA citent et voient votre marque.
Ce que cela signifie quand vous achetez un nom de domaine
Ce qui se trouve sur le domaine compte plus que le domaine lui-même. Le type de page a fait varier les citations de 80 % du meilleur au pire dans l'échantillon Otterly. L'extension ne les a pas du tout fait varier. Un guide sur un nom ordinaire surpassera une page de tarification sur un excellent nom.
La présence spécifique à chaque plateforme compte. Une marque documentée sur Wikipédia et absente de Reddit sera lue différemment par Chat GPT que par Perplexity, étant donné la manière dont les deux sourcent leurs informations.
Prêt à mettre votre site en ligne et à commencer à travailler sur le contenu qui vous fera citer par l'IA ? Utilisez notre créateur de site web gratuit pour créer votre site web.
FAQ
Mon extension de domaine influe-t-elle sur la citation de mon site web par l'IA ?
Pas comme signal de sélection. L'analyse d'Otterly de mai 2026 sur plus d'un million d'URL citées a constaté que .COM, .ORG, .IO et .AI ont tous en moyenne 1,7 citations par URL. Les totaux de citations penchent fortement vers .COM parce que la plupart du contenu web s'y trouve, ce qui est un effet de volume plutôt qu'une préférence. L'étude a couvert une fenêtre de 24 heures, donc traitez-la comme solide mais pas définitive.
Dois-je restructurer mes URLs pour être cité plus souvent ?
Non. La profondeur du chemin corrélait avec la fréquence de citation à +0.002 et la longueur de l'URL à -0.025, les deux étant effectivement nuls. Le seul facteur structurel qui a compté était les chaînes de requête : les URL avec paramètres obtenaient en moyenne 1.6 citations contre 2.1 pour les URL propres. Servez des URL canoniques propres et concentrez vos efforts ailleurs.
Quel type de page est le plus cité ?
Dans l'échantillon Otterly, les pages sous un chemin /guide/ ont obtenu en moyenne 2.7 citations contre une référence de 1.9, le plus élevé de tous les types de pages testés. Les articles de blog sont arrivés ensuite avec 2.0. Les pages de tarification ont obtenu les moins bons résultats avec 1.5. L'écart entre le haut et le bas était de 80%, bien plus grand que tout ce que la structure d'URL produisait.
Sur quelles sources ma marque doit-elle se concentrer pour être plus citée ?
L'analyse de Search Engine Land portant sur plus de 800 domaines répartis dans 11 secteurs a révélé que Reddit, Wikipedia, You Tube et Forbes figurent parmi les 50 URL les plus citées dans chaque secteur. Au-delà de ces exceptions, les tendances sectorielles divergent fortement, les citations dans le secteur de la santé se concentrant autour de sources évaluées par des pairs et gouvernementales, tandis que le secteur du divertissement s'appuie sur des plateformes communautaires. Cette étude a également constaté que la diversité des mots-clés était plus fortement corrélée à la visibilité dans l'IA que ne l'étaient les backlinks.