Deux pages de votre site se battent pour la même requête. L'une est en position 4, l'autre en position 9. Vous perdez sur les deux tableaux. Et le pire, c'est que vous ne l'avez probablement pas décidé : c'est arrivé tout seul, à force de publier.
J'ai découvert ce phénomène de façon brutale sur un site client : 41 pages se disputaient le même champ sémantique autour de « logiciel de facturation ». Le trafic ne s'effondrait pas, il stagnait — ce qui est bien plus pervers, parce qu'on ne voit rien venir. Il a fallu un audit croisé entre Search Console et un crawl complet pour mettre le doigt dessus.
Éviter le duplicate content et gérer la cannibalisation SEO ne sont pas deux chantiers distincts, même si on les présente souvent côte à côte. Le second est le symptôme visible du premier quand il se produit à l'intérieur d'un même domaine. Voici comment je traite les deux, avec les seuils que j'utilise réellement et les erreurs que j'ai commises.
Points clés à retenir
- La cannibalisation n'est pas une duplication de texte : deux pages peuvent avoir un contenu totalement différent et se nuire mutuellement.
- Un arbre de décision chiffré (volume, écart de position, backlinks) évite les débats sans fin en réunion.
- Sur les gros sites, la détection manuelle est intenable : il faut un crawl automatisé et une priorisation par impact.
- La balise canonique n'est pas un outil de fusion — c'est un indice, pas une consigne.
- La cannibalisation entre le blog et les pages commerciales est la plus fréquente, et la moins traitée.
Comprendre la cannibalisation SEO avant de vouloir la combattre
Une question qu'on me pose systématiquement en audit : « mais comment je sais si c'est de la cannibalisation ou juste deux pages qui se ressemblent ? »
La distinction est simple une fois qu'on l'a en tête. Le duplicate content est un problème de contenu : le même texte (ou presque) apparaît à deux endroits. La cannibalisation est un problème d'intention : deux URL de votre site répondent à la même requête, même si leurs textes n'ont rien en commun.
Conséquence directe : vous pouvez avoir zéro duplication technique et une cannibalisation sévère. C'est le cas le plus courant, et celui qui échappe aux outils de détection de duplication classiques.
Pourquoi Google ne « sanctionne » pas la cannibalisation
Il faut arrêter avec cette idée de punition. Google ne pénalise pas la cannibalisation. Il fait son travail : il choisit, pour chaque requête, la page qui lui semble la plus pertinente. Si vous en avez quatre qui se valent, il en affiche une et ignore les autres. Résultat : trois pages invisibles, et un signal de qualité dilué parce que les backlinks, les clics et l'engagement se répartissent sur plusieurs URL au lieu de converger vers une seule.
Le vrai coût est là. Pas une pénalité, mais une dispersion d'autorité.
Le cas de la cannibalisation volontaire
Oui, ça existe, et c'est parfois défendable. Quand je cible deux intentions proches mais distinctes — par exemple « créer une facture » (transactionnel, on veut un outil) et « modèle de facture gratuit » (informationnel, on veut un fichier) — j'accepte un recouvrement partiel. Les deux pages se chevauchent sur certaines requêtes, mais leurs intentions dominantes diffèrent.
Le danger est de croire qu'on maîtrise ce recouvrement alors qu'on le subit. Règle que je m'applique : si je ne peux pas nommer en une phrase l'intention unique de chaque page, ce n'est pas de la cannibalisation volontaire, c'est un doublon déguisé.
Détecter la cannibalisation sans y passer des semaines
La méthode manuelle m'a coûté trois jours sur un site de 200 pages. Sur un site de 3 000, elle est hors de question. Voici ce qui fonctionne, du plus rapide au plus industriel.
Le croisement requêtes / pages dans Search Console
C'est le point de départ. Exportez vos données de performance sur 90 jours, avec les dimensions « requête » et « page ». Filtrez sur les requêtes qui remontent au moins 3 URL différentes. Ce sont vos candidates.
Le signal qui ne trompe pas : une page oscille entre la position 3 et la position 11 sur les mêmes requêtes, semaine après semaine. Cette instabilité trahit une hésitation de l'algorithme entre plusieurs de vos pages. Je l'ai constaté sur une catégorie e-commerce qui alternait entre deux URL de listing pour la même expression — corrigé en une après-midi, +18 % de clics sur le cluster en six semaines.
Attention au piège : une requête qui remonte plusieurs URL n'est pas forcément un problème. Si les URL sont sur des intentions clairement séparées (une page produit, une page guide), c'est sain. Le conflit commence quand les positions sont proches et se disputent les mêmes clics.
Le crawl automatisé pour les gros sites
Au-delà de 500 URL, passez au crawl. Un outil type Screaming Frog ou une extraction maison, avec un script qui compare les balises title, les H1 et les intentions déclarées, puis qui croise le résultat avec les données de position. Ce qui m'a le plus servi : générer une table unique « URL / requête / position / clics » et détecter les groupes où plusieurs URL partagent plus de 60 % de leurs requêtes.
Franchement, la première version de mon script était mauvaise. J'avais oublié de dédupliquer les requêtes de marque — le nom du client apparaissait sur toutes les pages, ce qui déclenchait des faux positifs à la pelle. Corrigé en excluant les requêtes de marque du calcul. Évident après coup.
Quand fusionner, quand rediriger, quand canoniser ?
Voici l'arbre de décision que j'utilise. Il n'est pas parfait, mais il coupe court aux débats.
| Situation | Écart de position | Action |
|---|---|---|
| Même intention, deux pages, l'une domine nettement | Écart supérieur à 5 places | Redirection 301 de la faible vers la forte |
| Même intention, positions proches, contenus complémentaires | Écart inférieur à 3 places | Fusion en une page enrichie |
| Contenu quasi identique, paramètres d'URL | — | Balise canonique |
| Page sans trafic ni backlink, hors stratégie | — | Suppression ou désoptimisation |
| Intentions réellement distinctes | — | Ne rien faire, différencier les title et H1 |
Pourquoi la balise canonique ne suffit pas
Erreur que j'ai faite pendant longtemps : traiter la canonique comme une redirection. Ce n'est pas la même chose. La canonique est un indice que vous donnez à Google, pas une obligation. Si la page canonisée reçoit des liens internes, du trafic ou du maillage, Google peut décider de l'indexer quand même. La redirection, elle, est une consigne technique qui ne souffre pas d'interprétation.
Ma règle : canonique pour les variantes techniques (paramètres de tri, pagination, versions imprimables). Redirection 301 pour deux pages éditoriales concurrentes. Fusion quand les deux apportent du contenu que l'autre n'a pas.
Le cas des backlinks qui compliquent tout
Une page en position 12 peut porter 40 backlinks. Une autre en position 3 n'en a aucun. Vous ne pouvez pas simplement rediriger la première vers la seconde sans réfléchir : vous déplacez l'autorité, mais vous perdez potentiellement la page que des sites externes ont choisi de citer.
Ce que je fais dans ce cas : je regarde la nature des liens. S'ils proviennent de sources thématiquement proches du sujet de la page cible, la redirection est propre. S'ils pointent vers un angle différent, je conserve la page et je la repositionne sur son angle réel — souvent une intention voisine que je n'avais pas identifiée.
Éviter la cannibalisation entre vos propres canaux
Le conflit le plus invisible n'est pas entre deux pages de votre site. Il est entre votre site et le reste de votre écosystème.
Exemple concret : une newsletter qui publie un article complet sur une requête que votre blog cible déjà. Le contenu est dupliqué sur une plateforme tierce, qui peut se positionner dessus. Même logique pour une fiche marketplace qui reprend mot pour mot votre description produit. Ou pour une campagne SEA qui achète le mot-clé exact de votre meilleure page organique — ce n'est pas de la cannibalisation au sens strict, mais vous payez pour un clic que vous auriez eu gratuitement.
Les règles que j'applique
- Newsletter : version courte, angle personnel, renvoi vers l'article du site. Jamais le texte intégral.
- Marketplace : description réécrite, plus factuelle, avec les specs en priorité — les moteurs des plateformes et Google n'attendent pas la même chose.
- SEA / SEO : je ne surenchéris pas sur une requête où ma page organique est déjà dans les trois premiers résultats, sauf intention commerciale forte où l'annonce apporte un plus (prix, disponibilité, urgence).
- Pages commerciales vs blog : la page catégorie cible le transactionnel, l'article cible le « comment faire ». Si un article commence à ranker sur une requête d'achat, je le réoriente vers la catégorie par un maillage explicite.
Prévenir plutôt que guérir
La meilleure correction reste celle qu'on n'a pas à faire. Sur les projets que je structure depuis le départ, j'impose trois règles simples.
Un mot-clé principal, une URL. Pas un mot-clé par page au sens strict — un axe d'intention par URL. Avant toute publication, je vérifie si une page existante couvre déjà cette intention. Si oui, j'enrichis l'existante au lieu d'en créer une nouvelle. Ce réflexe seul m'a évité des dizaines de doublons.
Un maillage qui désigne un gagnant. Quand deux pages traitent de sujets proches, l'une doit recevoir plus de liens internes que l'autre. Le maillage interne est un vote : si vous votez pour les deux, vous ne votez pour aucune.
Une revue trimestrielle. Tous les trois mois, je sors la liste des requêtes qui remontent plusieurs URL et je traite les nouveaux cas. Dix minutes par trimestre, contre trois jours d'audit quand le problème s'accumule.
Faut-il supprimer ou désoptimiser une page en doublon ?
La suppression est rarement la bonne réponse, sauf si la page n'a ni trafic, ni backlink, ni utilité pour l'utilisateur. La désoptimisation — retirer le mot-clé du title, du H1 et des ancres internes — est souvent plus sûre : elle fait baisser la page dans les résultats sans casser les liens existants. Je ne supprime que quand je suis certain qu'aucune valeur ne se perdra. Dans le doute, je désoptimise et j'observe sur un mois.
Il y a quelque chose d'un peu contre-intuitif dans tout ça : la cannibalisation est un problème qui s'aggrave quand on travaille bien. Plus vous publiez, plus vous créez de recouvrements possibles. Le site qui stagne n'a pas forcément un problème de contenu — il a parfois juste oublié de désigner, parmi ses propres pages, laquelle doit gagner.
La prochaine fois que vous ouvrez votre Search Console et que vous voyez une position qui fait du yoyo sur une requête importante, ne cherchez pas du côté de Google. Cherchez chez vous.