# Pourquoi Google a créé la balise canonical en 2009, et ce qu’elle a réglé

> Avant 2009, il n'existait aucun moyen standard de signaler qu'une URL était une copie d'une autre. Retour sur le problème que la balise canonical a résolu.

- Auteur : WordPress Développement
- Publié le : 2020-09-25
- Mis à jour le : 2020-09-25
- Catégorie : SEO &amp; GEO
- URL : https://www.wpmoderne.fr/seo/pourquoi-google-a-cree-canonical-2009/

## L’essentiel

- Avant 2009, aucun mécanisme standard ne signalait le contenu dupliqué
- La balise canonical a été annoncée conjointement par Google, Yahoo et Microsoft
- Elle consolide les signaux de plusieurs URL vers une seule adresse de référence

« Comment ce moteur choisit-il quelle version d'une page afficher quand plusieurs URL renvoient un contenu identique ? » C'est exactement la question à laquelle les moteurs de recherche n'avaient aucune réponse standardisée avant 2009. Chacun bricolait sa propre heuristique, avec des résultats très inégaux d'un moteur à l'autre.

La balise `<link rel="canonical">`, annoncée en février 2009 conjointement par Google, Yahoo et Microsoft, a mis fin à cette incertitude en donnant aux propriétaires de sites un moyen direct de désigner eux-mêmes l'URL de référence. Comprendre le problème qu'elle a résolu aide à mieux l'utiliser aujourd'hui, plutôt que de la poser par réflexe sur chaque page.

## Le problème avant 2009 : le contenu dupliqué non maîtrisé

Un site e-commerce des années 2000 générait facilement plusieurs URL pour un même produit : une version avec paramètre de tri (`?tri=prix`), une version avec identifiant de session, une version imprimable, une version accessible avec et sans le `www`. Pour un moteur de recherche, ces URL étaient autant de pages distinctes contenant un texte quasi identique.

Le moteur devait alors deviner laquelle indexer, laquelle ignorer, et comment répartir la popularité des liens entrants qui pointaient tantôt vers l'une, tantôt vers l'autre. Cette dilution du signal entre plusieurs URL équivalentes pénalisait le positionnement de la page « légitime », sans qu'aucun signal explicite ne vienne clarifier la situation.

## Ce que la balise canonical a changé

> L'essentiel à retenir : Avant 2009, aucun mécanisme standard ne signalait le contenu dupliqué ; La balise canonical a été annoncée conjointement par Google, Yahoo et Microsoft ; Elle consolide les signaux de plusieurs URL vers une seule adresse de référence

En ajoutant une simple ligne dans le `<head>` d'une page, un site pouvait désormais déclarer explicitement quelle URL faisait référence :

```
<link rel="canonical" href="https://exemple.fr/produit-42/" />
```

Trois moteurs concurrents acceptaient ce signal de la même façon, ce qui en a fait un standard de facto immédiatement utile. Les liens entrants, le contenu et les signaux de pertinence de toutes les variantes d'une même page pouvaient dès lors être consolidés vers une seule adresse, plutôt que dispersés entre plusieurs URL concurrentes entre elles.

## Sur WordPress, un mécanisme intégré depuis longtemps

Sans aucune extension, WordPress affiche une balise canonical par défaut sur les articles et pages, via la fonction `rel_canonical()` accrochée au hook `wp_head`. Cette balise pointe simplement vers l'URL permanente de l'article, ce qui règle déjà les cas les plus simples de duplication par paramètre d'URL ou par variante d'affichage.

Pour les cas plus spécifiques, comme des pages générées par un filtre personnalisé, le filtre `get_canonical_url` permet d'ajuster cette valeur :

```
add_filter( 'get_canonical_url', function( $canonical_url, $post ) {
    if ( 'produit' === $post->post_type ) {
        return home_url( '/catalogue/' . $post->post_name . '/' );
    }
    return $canonical_url;
}, 10, 2 );
```

## Ce que l'absence de standard provoquait concrètement

Avant 2009, certains sites tentaient de contourner le problème en interdisant purement l'accès aux URL dupliquées via `robots.txt`, ce qui réglait la duplication mais coupait aussi toute transmission de popularité vers la page conservée. D'autres choisissaient d'utiliser une redirection 301 systématique, ce qui n'était pas toujours souhaitable lorsque la variante devait rester accessible pour une raison fonctionnelle, comme un tri de liste ou une pagination interne. La balise canonical a offert une troisième option, plus souple : garder la page accessible telle quelle, tout en indiquant clairement quelle URL devait recevoir le crédit de référencement.

## Ce que canonical ne règle pas

- Ce n'est qu'une suggestion, pas une redirection : Google peut choisir une autre URL de référence s'il juge le signal incohérent
- Elle ne remplace pas une redirection 301 lorsque l'ancienne URL n'a plus vocation à exister du tout
- Elle doit pointer vers une URL qui répond réellement en 200, jamais vers une page qui redirige ou renvoie une erreur

> Une manière simple de vérifier la cohérence d'un site : chaque variante d'une page doit désigner la même URL canonique, jamais elle-même si elle est censée être une copie.

## En résumé

La balise canonical n'est pas un ornement technique ajouté par habitude dans le `<head>` : elle répond à un problème très concret de dispersion des signaux entre plusieurs URL équivalentes, qui n'avait aucune solution standardisée avant 2009. La comprendre comme un outil de consolidation, plutôt que comme une simple case à cocher, permet de l'utiliser correctement dans des situations plus complexes, comme les pages à facettes ou les contenus syndiqués.
