Bing a annoncé une nouvelle inconfortable au secteur du SEO en décembre 2025 : quand un site publie plusieurs pages quasi identiques sur un même sujet, les modèles IA derrière ses résultats de recherche ne les moyennent pas et ne récompensent pas l'effort. Ils regroupent les pages en un seul cluster et choisissent une version pour le représenter, parfois une page obsolète, parfois une variante de paramètre égarée que personne ne voulait positionner. Pendant dix ans, la cannibalisation était un problème Google que l'on pouvait souvent ignorer si le trafic total tenait bon. Dès qu'un modèle de langage fait la sélection à la place d'un algorithme de classement, cela devient un problème de citation, et les citations sont précisément ce sur quoi repose la visibilité IA.
Ce que signifie la cannibalisation de contenu quand un moteur IA fait le classement
La cannibalisation de contenu se produit lorsque deux pages ou plus d'un même domaine ciblent la même intention de requête d'assez près pour qu'un système de récupération ne puisse pas déterminer laquelle fait autorité. En SEO classique, cela divisait les signaux de classement entre les pages. En Generative Engine Optimization (GEO), cela divise quelque chose de plus précis : la confiance du modèle quant à savoir quelle page unique mérite d'être la source qu'il cite.
La plupart des marques ont construit leurs bibliothèques de contenu pour un monde façonné par Google, où cinq articles pratiques légèrement différents ressemblaient à cinq chances distinctes de se positionner. Comme VizibleAI l'a expliqué, le GEO et le SEO traditionnel récompensent des types de pages très différents, et un moteur IA ne voit pas cinq chances dans un cas comme celui-ci : il voit une seule intention répartie sur cinq URL, et il doit choisir.
Cannibalisation de contenu en GEO : lorsque plusieurs pages d'un même domaine répondent à la même requête d'assez près pour qu'un système de récupération les fasse fusionner en un seul cluster et n'en cite qu'une, indépendamment de la page que la marque voulait réellement voir apparaître.
Comment un moteur IA décide quelle page quasi identique citer
Les systèmes de récupération découpent une page en passages plus petits selon un procédé appelé chunking, génèrent un embedding pour chaque passage, puis comparent ces embeddings à la requête. Quand plusieurs pages d'un même domaine produisent des embeddings quasi identiques, le modèle les traite comme une seule entité et n'en garde qu'un seul représentant.
Fabrice Canel et Krishna Madhavan, de Bing, ont décrit exactement ce comportement sur le Bing Webmaster Blog en décembre 2025 : les URL quasi identiques sont regroupées en clusters, et le modèle « peut sélectionner une version obsolète ou qui n'est pas celle que vous visiez ». Cette phrase, à elle seule, est aujourd'hui l'une des indications les plus utiles, et les moins confortables, qu'un moteur de recherche ait publiées sur le GEO cette année.
Cette imprévisibilité va plus loin que l'aveu d'un seul éditeur. L'analyse d'Ahrefs de mars 2026 portant sur 863 000 mots-clés et 4 millions d'URL citées dans les AI Overviews a révélé que seulement 37,9 % des pages citées se classaient encore dans le top 10 classique de Google, contre environ 76 % un an plus tôt. La sélection des citations s'éloigne de plus en plus des signaux de classement classiques, ce qui est exactement le mécanisme que VizibleAI a détaillé dans son article sur la façon dont les moteurs IA découpent réellement votre contenu avant de le citer, et cela fait de la consolidation de vos propres pages concurrentes l'une des rares variables encore entièrement sous le contrôle d'une marque.
Le mythe selon lequel publier plus de pages augmente les chances d'être cité
Plus de contenu signifiait autrefois plus de surface pour se positionner sur un mot-clé. L'audit d'Ahrefs de septembre 2026 sur les citations dans les AI Overviews montre l'inverse pour la plupart des sites : la couverture large des citations se concentre sur une poignée de domaines géants, tandis que les sites de taille moyenne sont cités à partir d'une fraction restreinte de leurs propres pages plutôt qu'une large sélection.
Byrdie, classé 45e en part de citations, comptait environ 2 700 pages individuelles citées. YouTube, en tête, en comptait bien plus d'un million. Cet écart n'est pas proportionnel au volume publié par chaque domaine, il est proportionnel au degré de distinction réelle de chaque page pour le modèle qui choisit. Bharath Ravishankar, de Search Engine Land, a rapporté en avril 2026 que les sites publiant des pages qui se chevauchent sur un même mot-clé se retrouvent typiquement avec « deux pages qui se partagent les impressions sur des requêtes identiques, sans qu'aucune ne se positionne fortement ». Un moteur IA ne partage même pas les impressions. Il élimine toutes les pages sauf celle qu'il a choisie.
Comment repérer les pages cannibalisées avant qu'un moteur IA ne choisisse la mauvaise
Commencez par Google Search Console plutôt que par un crawler. Les pages qui se positionnent sur la même requête mais apparaissent rarement toutes deux dans le même ensemble de résultats, ou qui portent des titres et méta-descriptions presque identiques, sont le signe le plus net d'une concurrence interne sur un sujet.
Le cadre de désherbage de contenu de Search Engine Land recommande de signaler pour révision manuelle toute page ayant reçu moins de 100 clics organiques sur six mois, puis de vérifier si une page sœur plus solide couvre déjà le même terrain avant de modifier, fusionner ou supprimer quoi que ce soit. Pour une marque qui audite déjà sa visibilité IA, cet exercice sert aussi à détecter la cannibalisation. Le guide d'audit GEO de VizibleAI détaille comment noter chaque page selon son potentiel de citation, et les pages qui obtiennent des scores similaires entre elles se cannibalisent généralement plutôt qu'elles ne se complètent.
Consolider sans perdre ce qui fonctionne déjà
Ne supprimez pas en premier. Mettez en place une balise canonique sur la variante la plus faible, intégrez à la page forte tout ce qu'il lui manque, puis redirigez en 301 ce qui reste afin que le link equity et l'historique de crawl soient transférés plutôt que remis à zéro.
Une balise canonique, associée au type de données structurées présenté dans le guide de schéma JSON-LD de VizibleAI, donne à Google comme à un crawler IA un signal explicite sur la page qui fait foi. Cela compte d'autant plus aujourd'hui que les moteurs déduisent eux-mêmes la réponse dès que ce signal manque. Consolider ne consiste pas à publier moins d'articles pour le principe. Il s'agit de s'assurer que chaque page encore en ligne répond à une question qu'aucune autre page du site ne répond déjà.
Ce que cela vous coûte en AI Share of Voice
Chaque citation qu'un moteur IA attribue à la mauvaise version, ou à une version obsolète, de votre propre page est une citation qui aurait dû revenir à votre meilleure page, et elle compte tout de même dans votre AI Share of Voice, car cette métrique mesure si la marque apparaît, pas quelle URL a été choisie pour la représenter.
Une marque qui fait tourner cinq articles explicatifs quasi identiques sur un même terme peut sembler présente dans son suivi d'AI Share of Voice tout en perdant réellement du terrain, car le trafic, la confiance et le link equity reviennent tous à la page que le modèle a fini par choisir, rarement celle que la marque aurait elle-même privilégiée. Le guide de VizibleAI pour mesurer l'AI Share of Voice explique comment distinguer de vrais gains de visibilité de ce type de gain fragmenté et auto-infligé. Consolider le cluster en une seule page concentre sur la page réellement conçue pour convertir tout ce que les versions fragmentées gagnaient séparément.
Questions fréquemment posées
Qu'est-ce que la cannibalisation de contenu dans la visibilité de recherche IA ?
C'est quand deux pages ou plus d'un même site ciblent la même intention de requête d'assez près pour que le système de récupération d'un moteur IA ne parvienne pas à les distinguer. Au lieu de récompenser ce contenu supplémentaire, le modèle regroupe les pages et n'en cite qu'une, si bien que les autres pages ne contribuent en rien à la visibilité, même si un vrai temps a été investi pour les produire.
Comment les moteurs IA décident-ils quelle page en double citer ?
Ils découpent les pages en passages, génèrent un embedding pour chacun, puis les comparent à la requête. Quand plusieurs pages d'un même domaine produisent des embeddings quasi identiques, le modèle les traite comme une seule entité et n'en garde qu'un représentant, souvent la version la plus facile à analyser ou la plus récente, pas nécessairement la page que la marque voulait positionner.
Publier plus de contenu sur le même sujet améliore-t-il la visibilité IA ?
Généralement non. Les données de citation d'Ahrefs de septembre 2026 montrent que la plupart des sites sont cités à partir d'une fraction restreinte de leurs pages plutôt que largement à travers beaucoup d'entre elles, si bien que plusieurs articles qui se chevauchent sur un même mot-clé ont tendance à se concurrencer pour cette place restreinte plutôt qu'à la multiplier.
Faut-il supprimer ou rediriger les pages cannibalisées ?
Redirigez, et seulement après avoir consolidé. Intégrez les liens de la page la plus faible et tout ce qu'il manque à la version la plus forte dans la page que vous conservez, ajoutez une balise canonique si les deux doivent rester en ligne pour une raison précise, puis redirigez en 301 ce qui reste. Supprimer directement sans rediriger prive la page des backlinks et de l'historique de crawl qu'elle avait déjà acquis.
Comment vérifier si mon propre contenu se cannibalise lui-même ?
Récupérez vos requêtes dans Google Search Console et repérez les pages qui se positionnent sur les mêmes termes mais apparaissent rarement toutes deux dans un même ensemble de résultats, ou qui partagent des titres et méta-descriptions presque identiques. Moins de 100 clics organiques sur six mois pour l'une ou l'autre page est un signal fort qu'il est temps de les fusionner.



