Pénalités Google : pourquoi elles se multiplient au lieu de s'additionner
Le leak de Google croisé au code ouvert d'Anthropic montre que les pénalités de ranking se multiplient. Un seul signal faible suffit à effondrer un site.
Quand un site perd la quasi-totalité de sa visibilité du jour au lendemain, on cherche la cause unique. C'est une erreur de modèle. En croisant les 14 014 attributs du leak ContentWarehouse avec un cas réel, une régularité s'impose : les pénalités ne s'additionnent pas, elles se multiplient. Voici ce que cela change pour vos audits.
Un site perd une grande partie de son trafic. L'audit commence. On cherche la cause.
Une cause. Au singulier.
C'est le réflexe de presque tous les audits SEO : isoler le coupable, le problème principal, le levier qui explique tout. On raisonne en addition. On empile des griefs : la vitesse ici, les backlinks toxiques là, le contenu dupliqué ailleurs. On totalise, on classe, on priorise.
Le leak Google de mai 2024 montre que ce raisonnement passe à côté de la mécanique réelle. Les pénalités Google ne s'additionnent pas. Elles se multiplient.
Et quand des facteurs se multiplient, une seule faille suffit à tout effondrer.
Le réflexe additif, et pourquoi il s'écroule
Quand j'ai croisé les 14 014 attributs du leak ContentWarehouse avec le repo open source claude-code d'Anthropic — 18 sous-modules documentés dans son fichier PARITY.md —, un schéma est apparu. Les deux systèmes décrivent la qualité de la même façon : pas une note, un produit de facteurs.
Le modèle additif que la plupart des audits emploient ressemble à ceci :
Score = baseline − (pénalité A + pénalité B + pénalité C)
Intuitif. Faux.
Sa faiblesse se voit sur un cas extrême. Prenez un site avec un problème de qualité sévère sur une seule dimension. En additif, vous retirez une part, le site descend, mais il reste dans la course. Le modèle prédit un trafic résiduel confortable.
La réalité observée, elle, montre des sites qui ne descendent pas : ils tombent. D'un coup. Sur une marche.
Le modèle additif ne peut pas produire cette marche. Le modèle multiplicatif, oui.
Une chaîne, pas une pile
Voici l'analogie qui rend la différence évidente.
Le modèle additif imagine la qualité comme une pile de jetons. Chaque bon point ajoute un jeton, chaque pénalité en retire un. Si la pile perd quelques jetons, elle reste haute. Vous pouvez en retirer beaucoup avant que la pile ne disparaisse. C'est rassurant, et c'est ainsi que la plupart des gens pensent leur SEO.
Le modèle multiplicatif imagine la qualité comme une chaîne. Chaque dimension est un maillon. La solidité de la chaîne entière n'est jamais la somme des maillons. C'est le maillon le plus faible.
Une chaîne avec de nombreux maillons en acier et un seul maillon en carton ne tient pas presque toute sa charge. Elle tient ce que tient le carton. Près de zéro.
C'est exactement le comportement d'un produit. Multipliez entre eux des facteurs tous proches de 1, mais légèrement inférieurs, et répétez l'opération sur beaucoup de dimensions : le produit glisse doucement vers le bas, sans qu'aucun facteur ne soit catastrophique. Accumulation douce. Maintenant glissez un seul facteur très bas dans le produit. Tout le résultat plonge avec lui. Un maillon. Toute la chaîne.
La pile pardonne. La chaîne ne pardonne pas. Le leak décrit une chaîne.
La preuve HouseFresh : 0,09
HouseFresh est le cas qui tranche le débat. Un site de tests de purificateurs d'air, effondré dans les SERP, puis en recovery. J'ai cherché quelle formule reproduit son score réel.
La formule multiplicative :
Q = baseline × ∏(1 − δ_k)
Chaque δ_k est une dégradation sur une dimension de qualité : δ₁ pour la première, δ₂ pour la deuxième, et ainsi de suite. On ne soustrait pas les dégradations. On multiplie ce qui reste après chacune : (1 − δ₁) × (1 − δ₂) × (1 − δ₃)…
Avec cette formule, le score HouseFresh tombe à 0,09. Une marche, exactement comme observée.
Le modèle additif appliqué aux mêmes dégradations prédit, lui, un score nul ou négatif — un site qui n'existe plus. HouseFresh existait toujours et remontait. Seul le multiplicatif colle à la réalité.
La différence n'est pas cosmétique. Voici un repère, et un seul.
Valeurs purement illustratives, non issues de l'étude : si trois dimensions perdent chacune la moitié de leur force, le modèle multiplicatif donne 0,5 × 0,5 × 0,5 = 0,125 — un site abîmé mais vivant. Le modèle additif, lui, soustrait trois fois 0,5 et tombe sous zéro — un site mort.
Sur le terrain, c'est le premier comportement qu'on observe. Le second n'existe pas.
Et le 0,09 dit autre chose de précieux : il y a un chemin de retour. Ce score n'est pas un zéro. Relevez le facteur qui l'a tiré vers le bas, et le produit remonte mécaniquement. La recovery de HouseFresh n'est pas un miracle. C'est de l'arithmétique inversée.
38 dimensions de qualité, pas une note
Le leak nomme une structure précise : compressed_quality_signals. À l'intérieur, 38 dimensions distinctes de qualité.
Google ne calcule pas « une » note de qualité. Il en calcule 38, sur des axes différents, puis les combine. Et la combinaison est multiplicative.
Le mot « compressed » dans le nom n'est pas anodin. Ces 38 signaux sont condensés pour tenir dans une structure exploitable à l'échelle de l'index entier. Google stocke ce produit de qualité sur chaque document, en permanence, prêt à être pondéré au moment du ranking. La qualité n'est pas recalculée à la volée. Elle est portée par le document, comme une étiquette à 38 cases.
Ces 38 axes ne mesurent pas la même chose. Certains regardent le contenu lui-même. D'autres regardent le site qui l'héberge. D'autres encore regardent l'auteur, les entités citées, la cohérence thématique, la fiabilité historique du domaine. Chaque axe est une question différente posée au même document. Et le résultat final multiplie les 38 réponses.
Le système qui orchestre ça porte un nom dans le leak : NSR, Neural Site Ranking. Il s'appuie sur 17 modules d'embeddings — 17 façons de représenter et comparer le contenu, l'auteur, le site, les entités. C'est une architecture, pas un curseur. Chaque module transforme un aspect du site en vecteur, puis ces vecteurs nourrissent l'évaluation des dimensions. Dix-sept représentations parallèles d'un même site, qui convergent vers le produit de qualité.
Le croisement avec le repo Anthropic donne un point de parité mesurable : sur l'opérateur OP_11, la correspondance entre la logique Google et la logique Anthropic atteint 0,63. Deux systèmes construits par deux entreprises différentes convergent vers la même mécanique de pondération. Ce n'est pas une coïncidence de vocabulaire. C'est une convergence d'ingénierie. Quand deux équipes qui ne se parlent pas réinventent la même structure, c'est généralement que la structure est la bonne réponse au problème.
38 dimensions multipliées entre elles : voilà pourquoi un site peut être excellent sur presque tous les axes et s'effondrer quand un seul tombe au plus bas. Un facteur multiplicatif proche de zéro tire tout le produit vers le bas. C'est le maillon faible, traduit en mathématiques. Et c'est aussi pourquoi un excellent contenu ne sauve pas un site dont la fiabilité de domaine s'est effondrée : le grand facteur est annulé par le petit.
Trois décisions d'audit qui changent
Si les pénalités se multiplient, l'audit ne se mène plus pareil.
1. Chercher le facteur le plus bas, pas la somme des problèmes. En additif, on hiérarchise par poids : on attaque le problème qui coûte le plus de points. En multiplicatif, on attaque la dimension la plus proche de zéro. Un axe très bas plombe tout le produit ; le réparer fait remonter le score entier. Plusieurs axes presque parfaits ne vous coûtent presque rien. La priorité s'inverse. Concrètement, l'auditeur ne dresse plus une liste de courses. Il cherche le point unique qui multiplie le moins, et il commence par là.
2. Arrêter d'empiler les correctifs sans hiérarchie. Corriger dix petites choses pendant qu'une dimension reste au plancher ne change rien au résultat. Le produit reste écrasé par son facteur le plus bas. C'est l'erreur la plus coûteuse en SEO : passer des semaines à polir des maillons en acier pendant que le maillon en carton tient toujours la chaîne. On gagne en s'attaquant d'abord au point qui bloque la multiplication, puis seulement ensuite aux gains marginaux. Exemple hypothétique : un site qui investit tout son budget dans la vitesse de chargement alors que son facteur le plus bas est la fiabilité éditoriale ne verra rien bouger — il optimise un facteur déjà élevé et ignore celui qui écrase le produit.
3. Lire un effondrement comme une marche, pas comme une pente. Quand un site chute brutalement, ce n'est pas l'accumulation lente de petits défauts. C'est une dimension qui vient de basculer sous un seuil. On cherche l'événement, le facteur unique qui est passé près de zéro — pas une longue liste de griefs mineurs. La forme de la courbe est l'indice : une pente douce raconte une accumulation, une marche raconte un facteur qui a chuté. C'est exactement ce que raconte le 0,09 de HouseFresh. Et c'est une bonne nouvelle pour l'auditeur : une marche a une cause identifiable, donc une réparation ciblée.
Ces trois décisions transforment l'audit. On passe de « inventorier tous les problèmes » à « identifier le facteur qui multiplie le moins ». C'est plus rapide, plus juste, et ça concentre l'effort là où il paie.
La limite : saturation à 57 %
Une démonstration honnête nomme ses limites. Celle-ci en a une, et elle est chiffrable.
Le leak ne donne pas tout. En appliquant un calcul de Shannon sur l'information réellement exploitable, le système CRAPS sature à 57%. C'est la borne informationnelle du leak : au-delà, les données disponibles ne permettent plus de reconstruire la mécanique avec certitude.
Ce que la saturation 57% implique pour un auditeur
Ce nombre n'est pas une réserve théorique. Il change la posture de travail.
D'abord, il fixe une frontière entre ce qu'on affirme et ce qu'on suppose. La structure est solide : la qualité est un produit multiplicatif de dimensions, point. Les détails — pondérations exactes, seuils précis, ordre d'importance des 38 axes — relèvent du reste, hors du leak. Un bon auditeur sait dans quelle zone il parle. Il affirme la mécanique, il ne devine pas les coefficients.
Ensuite, ça impose l'humilité sur les seuils. On sait qu'un facteur près de zéro écrase le produit. On ne connaît pas le point exact où une dimension bascule sous le seuil critique. Donc on ne promet pas un gain de places chiffré. On dit : ce facteur est votre maillon faible, le relever fait remonter tout le produit. L'un est de l'ingénierie. L'autre est du marketing.
Enfin, le 57% protège contre le sur-ajustement. Reconstruire un modèle qui colle parfaitement au leak reviendrait à inventer la part manquante — donc à fabriquer du faux. La saturation est le garde-fou. Elle dit : voici jusqu'où les données portent, et pas un pas de plus.
C'est suffisant pour changer la façon d'auditer. Pas pour prétendre tout savoir. Et c'est précisément cette honnêteté qui sépare une démonstration d'une promesse.
Ce que ça change pour votre site
Votre site n'a pas une note de qualité. Il a un produit de 38 facteurs.
Tant qu'aucun ne s'effondre, vous tenez. Le jour où un seul touche le fond, tout le produit suit — même si tous les autres sont parfaits.
Alors la vraie question d'un audit n'est plus « combien de problèmes ai-je ? ». C'est : « quel est mon facteur le plus bas, et qu'est-ce qui le maintient près de zéro ? »
Vous savez quel est le vôtre ?