Aller au contenu

Algorithmes Google

Tous les backlinks ne se valent pas : ce que Google stocke

Les documents internes de Google classent chaque lien selon la qualité de la page qui le fait — sur trois niveaux nommés. Et certains liens sont jetés avant même d’être comptés.

« Un lien de qualité vaut mieux que cent liens pourris » est le conseil le plus répété du référencement, et le moins démontré : personne ne dit ce que « qualité » recouvre côté Google. La documentation interne publiée en 2024 ne donne pas de barème, mais elle nomme les champs — et l’un d’eux classe explicitement chaque lien selon la page qui le fait. Voici ce que ces champs établissent, et où ils s’arrêtent.

Chaque lien porte la qualité de sa page source, sur trois niveaux

C’est le champ le plus explicite de tout le dossier sur les liens, et il est rarement cité en entier. AnchorsAnchor.sourceType :

« is to record the quality of the anchor’s source page and is correlated with but not identical to the index tier of the source page. […] Anchors marked TYPE_HIGH_QUALITY are from base documents. Anchors marked TYPE_MEDIUM_QUALITY are from documents of medium quality (roughly but not exactly supplemental tier documents). Anchors marked TYPE_LOW_QUALITY are from documents of low quality (roughly but not exactly blackhole documents). »

En français : ce champ enregistre la qualité de la page source du lien ; elle est corrélée, sans être identique, au niveau d’index de cette page. Les liens marqués haute qualité viennent de documents de base ; ceux marqués qualité moyenne, de documents à peu près équivalents au niveau supplémentaire ; ceux marqués basse qualité, de documents à peu près équivalents au niveau dit blackhole.

Les trois niveaux de qualite de la page source d un lien Un lien arrive étiqueté par la page qui le fait Valeurs du champ sourceType, citées verbatim dans le commentaire. VALEUR DU CHAMP D’OÙ VIENT LE LIEN IMPORTANCE TYPE_HIGH_QUALITY documents de base le plus important TYPE_MEDIUM_QUALITY à peu près le niveau supplémentaire intermédiaire TYPE_LOW_QUALITY à peu près le niveau dit blackhole le moins important « une valeur de source_type plus basse indique un lien plus important » — commentaire du champ Le commentaire nomme les trois valeurs. Il ne dit pas comment une page est affectée à un niveau.
Les trois valeurs du champ sourceType, qui enregistre la qualité de la page source d’un lien. Le commentaire nomme les trois niveaux ; il ne dit pas comment une page y est affectée.

Le commentaire ajoute une précision d’ingénieur qui vaut d’être lue : « the source_type can also be used as an importance indicator of an anchor (a lower source_type value indicates a more important anchor) » — le type de source sert aussi d’indicateur d’importance du lien, une valeur plus basse indiquant un lien plus important.

Ce que ça établit. Un lien n’entre pas dans le système comme une unité neutre : il arrive étiqueté par le niveau d’index de la page qui l’émet, sur trois valeurs nommées. Et cette étiquette sert d’indicateur d’importance.

Ce que ça n’établit pas. Comment une page est affectée à un niveau, quel écart sépare les trois valeurs, et ce que le champ pèse dans le classement. Rien de tout cela n’est dans le commentaire.

Des liens sont jetés avant même d’être comptés

Deux champs, dans la structure qui agrège les liens d’un document, comptent des liens écartés. Anchors.localAnchorsDropped : « The total # of local non-homepage anchors dropped in AnchorAccumulator. » — le nombre total de liens internes, hors page d’accueil, écartés à l’accumulation. Et Anchors.homepageAnchorsDropped, qui compte la même chose pour les liens venus de pages d’accueil.

Un troisième, IndexingDocjoinerAnchorStatistics.droppedHomepageAnchorCount, porte le même objet — sans aucun commentaire.

Les liens ecartes a l accumulation sont comptes Tous les liens collectés ne sont pas retenus Trois champs comptent les liens écartés à l’étape d’accumulation. liens collectés tous les liens vus vers le document accumulation certains liens sont écartés ici liens retenus ceux qui entrent dans le calcul et les écartés sont comptés localAnchorsDropped liens internes hors page d’accueil homepageAnchorsDropped liens venus d’une page d’accueil Les compteurs existent. La règle selon laquelle un lien est écarté n’est nulle part dans les commentaires.
Les liens écartés à l’étape d’accumulation sont comptés par des champs dédiés. La règle selon laquelle un lien est écarté n’apparaît dans aucun commentaire.

L’existence d’un compteur de liens jetés dit deux choses. D’abord que tous les liens collectés ne sont pas retenus : il existe une étape d’accumulation où certains sont écartés. Ensuite que le nombre de liens jetés est lui-même conservé comme une donnée — ce n’est pas un déchet, c’est un compte.

Le commentaire ne dit pas selon quelle règle un lien est écarté. C’est la limite dure de cette section.

Plusieurs liens depuis la même page vers le même site sont comptés à part

AnchorsAnchor.parallelLinks : « The number of additional links from the same source page to the same target domain. Not populated if is_local is true. » — le nombre de liens supplémentaires depuis la même page source vers le même domaine cible ; non renseigné si le lien est interne.

Ce champ répond à une question ancienne : que se passe-t-il quand une page pointe cinq fois vers votre site ? Les documents disent que les liens supplémentaires sont comptés séparément, dans un champ dédié. Ils ne disent ni qu’ils sont ignorés, ni qu’ils comptent à plein.

La précision finale est celle qui intéresse le plus : le champ n’est pas renseigné pour les liens internes. Le compte des liens parallèles concerne donc les liens entrants d’un autre domaine, et le maillage interne relève d’une autre mécanique — traitée dans la méthode de maillage interne en cinq étapes.

Deux marqueurs collés à la source du lien

AnchorsAnchor.expired : « true iff exp domain » — vrai si et seulement si le domaine est expiré. Cinq mots. Le champ existe, il est booléen, et le sujet est traité plus largement dans l’article consacré au nom de domaine.

AnchorsAnchor.isLocal : « The bit ~roughly~ indicates whether an anchor’s source and target pages are on the same domain. » — le bit indique à peu près si la source et la cible sont sur le même domaine. Les tildes autour de « roughly » sont dans le commentaire d’origine : l’ingénieur signale lui-même que le bit n’est pas fiable au sens strict.

Ces deux marqueurs disent que la nature de la source est conservée avec le lien, pas recalculée au moment de servir.

Ce que « qualité d’un lien » veut dire dans ces documents

Deux champs de la même structure portent des noms qui ressemblent à une réponse : locality et bucket. Leur commentaire déçoit et instruit à la fois : « For ranking purposes, the quality of an anchor is measured by its « locality » and « bucket ». » — pour le classement, la qualité d’un lien se mesure par sa « localité » et son « seau ». La suite du commentaire renvoie à un fichier interne, quality/anchors/definitions.h, qui n’a pas fuité.

C’est donc écrit noir sur blanc : la qualité d’un lien est mesurée par deux dimensions nommées, dont la définition n’est pas publique. bucket n’a lui-même aucun commentaire propre.

Deux autres champs stockent une date. firstseenDate : le nombre de jours depuis fin 1994 où le lien a été vu pour la première fois, sur quinze bits au plus. creationDate : « used for history – the first and last time we have seen this anchor » — utilisé pour l’historique, la première et la dernière fois que ce lien a été vu. L’historique d’un lien est donc conservé, sa disparition comprise.

Cet article détaille un point de la page qui demande s’il faut encore faire du netlinking. Voir aussi le texte d’ancre et ses démotions.

Ce qui est documenté, ce qui est déduit, ce qui reste inconnu

Affirmation Statut Source
Chaque lien porte un type de source sur trois valeurs : haute, moyenne, basse qualité Documenté Commentaire de sourceType
Ce type est corrélé au niveau d’index de la page source, sans lui être identique Documenté Idem
Le type de source sert aussi d’indicateur d’importance du lien Documenté Idem
Des liens sont écartés à l’accumulation, et leur nombre est compté Documenté Commentaires de localAnchorsDropped et homepageAnchorsDropped
Les liens supplémentaires d’une même page vers un même domaine sont comptés dans un champ dédié Documenté Commentaire de parallelLinks
Ce compte n’existe pas pour les liens internes Documenté Idem
Un booléen marque le domaine expiré Documenté Commentaire de expired
La qualité d’un lien est mesurée par sa « localité » et son « seau » Documenté Commentaire de locality
La première et la dernière apparition d’un lien sont conservées Documenté Commentaires de firstseenDate et creationDate
bucket et droppedHomepageAnchorCount n’ont aucun commentaire Mesuré Relevé des commentaires du dépôt
« Les liens d’une même page au-delà du premier sont ignorés » Non documenté Le champ compte les liens supplémentaires ; il ne dit pas ce qu’on en fait
La règle selon laquelle un lien est écarté Non documenté Les compteurs existent, la condition n’est nulle part
La définition de « localité » et de « seau » Non documenté Le commentaire renvoie à un fichier interne qui n’a pas fuité
Le poids de l’un quelconque de ces champs dans le classement Non documenté Aucune source publique ne le donne

Limites de cet article. Le dépôt décrit l’état d’un système interne au premier trimestre 2024 et n’a pas été mis à jour depuis : rien ne garantit que ces champs soient encore renseignés aujourd’hui. Un nom de champ et son commentaire établissent une existence, parfois une méthode générale, jamais un effet mesurable sur un site donné.

Questions fréquentes

Comment savoir si mes liens viennent de pages « haute qualité » ? Vous ne pouvez pas. Le type de source est une valeur interne, corrélée à un niveau d’index qu’aucun outil extérieur n’observe. Ce que les documents établissent, c’est que la distinction existe et qu’elle est stockée avec le lien.

Un lien depuis une page de mauvaise qualité fait-il du tort ? Le commentaire dit qu’un lien depuis une page de basse qualité est marqué comme tel et compte comme moins important. Il ne dit nulle part qu’il soustrait quoi que ce soit. Importance moindre et pénalité sont deux choses différentes, et une seule des deux est documentée ici.

Mettre plusieurs liens vers le même site depuis une page, est-ce utile ? Le champ parallelLinks compte ces liens supplémentaires séparément, ce qui indique au minimum qu’ils ne sont pas traités comme le premier. Aucune source publique ne dit ce qu’ils valent.

Un vieux lien vaut-il plus qu’un lien récent ? Les documents stockent la date de première apparition d’un lien et l’historique de ses apparitions. Ils n’en tirent aucune règle écrite. Déduire qu’un lien ancien pèse davantage serait aller au-delà du texte.

Sources

  • Miroir public du client Elixir ContentWarehouse, instantané du 27 mars 2024 — sur github.com

Grégory Florin

Expert SEO et auteur sur learnSEO.

Laisser un commentaire

Votre adresse e-mail ne sera pas publiée. Les champs obligatoires sont indiqués avec *