Google explique la connexion SEO de la qualité du site aux pages non indexées

Martin Splitt et John Mueller de Google ont discuté du rapport d’indexation des pages et de la manière dont il pourrait être utilisé pour identifier les problèmes d’indexation. Il est intéressant de voir comment ils ont lié la qualité à l’indexation, affirmant que la qualité ne concerne pas seulement le texte d’une page Web.

L’indexation se fait par étapes

Splitt et Mueller discutaient de problèmes qui pourraient affecter temporairement l’indexation, tels qu’un serveur qui ne répond pas, que les ordinateurs échouent, que les recherches DNS échouent parfois, de nombreuses raisons pour lesquelles Google pourrait ne pas être en mesure d’explorer un site, puis ont donné le conseil selon lequel tout n’a pas besoin d’être étudié.
Ensuite, ils ont mentionné que lorsqu’un site est nouveau, le rapport d’indexation des pages peut vous montrer les différentes étapes d’indexation par lesquelles passe une page.

Splitt a expliqué comment cela fonctionne :

« Et aussi, si vous ajoutez ou modifiez votre site, ou si votre site est très nouveau, vous pouvez également utiliser ce rapport pour voir un peu comment votre site passe par les différentes étapes.

Parce qu’à un moment donné, vous verrez des pages découvertes actuellement non indexées, ce qui vous indique que nous savons qu’elles existent, mais que nous ne les avons pas réellement visitées. Et si nous ne les avons pas visités, nous ne pouvons pas les mettre dans l’index alors que ceux explorés ne sont actuellement pas indexés, ce qui signifie que nous les avons visités et que nous ne les avons pas mis dans l’index. Et cela peut avoir toutes sortes de raisons différentes.

Le manque d’indexation n’est pas toujours un problème de qualité

À ce stade, la conversation s’est tournée vers les problèmes de qualité dans le contexte de l’indexation et la manière dont cela pourrait avoir un impact. Mueller a confirmé qu’il ne s’agit pas toujours de qualité.

Splitt a interrogé Mueller sur le statut non indexé dans le rapport d’indexation des pages :

« Diriez-vous que c’est souvent ou seulement parfois le signe d’un problème de qualité ? »

Müller répondit :

« Parfois. »

Fortes préoccupations concernant la qualité

Mueller a expliqué que le statut non indexé peut être déclenché si les systèmes de Google sont « sérieusement préoccupés » par la qualité. Cela semble étrange qu’un système soit dans un état d’inquiétude. Ce qu’il voulait probablement dire, c’est que si les scores de qualité ou un autre indicateur dépassent un seuil, cela peut signifier qu’il existe une « préoccupation » concernant la qualité liée au site.

Mueller a poursuivi sa réponse :

« Il est donc certain que si nos systèmes s’inquiètent sérieusement de la qualité du site Web, ils réduiront le nombre de pages dans l’index. Parce que si nous avons de fortes inquiétudes quant à la qualité globale, cela n’a pas beaucoup de sens que nos systèmes passent beaucoup de temps sur le site Web. « 

Nous ramperons donc probablement beaucoup moins. Nous indexerons beaucoup moins. Et puis vous verrez des choses comme exploré non indexé ou découvert non indexé, ce qui, de notre point de vue, est essentiellement notre système disant, nous sommes au courant et une fois que nous serons satisfaits, nous y jetterons un autre coup d’oeil et verrons si nous pouvons l’indexer.

Page non indexée pas toujours pour une raison technique

Il n’est pas rare qu’un propriétaire de site considère qu’il n’y a rien de mal avec son site, ce qui conduit à une incapacité à diagnostiquer un problème de qualité de page. Personne ne connaît un site aussi bien que le propriétaire du site ou le référenceur, et ils ont pris le temps de le rendre aussi parfait que possible. Il est donc compréhensible qu’une personne ne soit pas en mesure de voir qu’il existe de réels problèmes de qualité affectant un site.

Ce qui se passe, c’est que les gens essaient de trouver un problème technique pour expliquer pourquoi un site n’est pas indexé. Lorsque cela échoue, certaines personnes pensent qu’elles sont victimes d’un référencement négatif et entament un cycle de désaveu constant des « mauvais » liens, généralement sans amélioration.

Si cela ressemble à votre situation, vous devrez peut-être considérer sérieusement qu’il existe un problème de qualité affectant le site, ce qui peut sembler inconcevable car le site est « parfait ».

Mueller s’attaque à cet angle mort de qualité qui peut affecter tout propriétaire de site.

Mueller a poursuivi sa réponse :

« Ce n’est pas tellement que je dirais que vous devriez prendre ces situations et essayer de les résoudre. D’un point de vue technique, ce n’est pas que vous ayez besoin de résoudre ce problème technique parce que Google n’indexe pas cette page pour le moment. Mais plutôt, vous en avez presque besoin… lorsque vous reconnaissez un schéma plus large comme celui-ci, comme Google n’indexe pas beaucoup de vos pages, et qu’il n’y a aucune raison technique, vous devez presque prendre du recul et penser à la qualité globale.

Et penser à la qualité est vraiment un défi car, bien souvent, c’est votre site Web et votre bébé. Et bien sûr, c’est le meilleur bébé de tous les temps.

Visiteurs du site et qualité globale

À ce stade, Mueller ajoute quelque chose d’inattendu à la discussion. Il mentionne comment les visiteurs du site peuvent jeter un œil au site et déterminer rapidement qu’il manque de facteurs de qualité tels que le caractère unique. Il n’a pas dit que les systèmes de Google avaient déterminé que le site manquait de qualité ; il a dit que ce sont peut-être les gens qui prendront cette décision.

Il n’a pas explicitement déclaré que Google captait les signaux des utilisateurs indiquant des problèmes de qualité du site. Mais on dirait bien qu’il le sous-entend.

Mueller a poursuivi sa réponse :

« Mais prendre du recul et essayer de le regarder avec les yeux de quelqu’un qui n’est pas directement impliqué dans votre site Web, cela ouvre parfois des idées sur les domaines dans lesquels vous pouvez vous améliorer, où peut-être que si la majeure partie de votre site Web est générée par l’IA et qu’elle a fonctionné pendant un certain temps, il se peut que les gens regardent ce site généré par l’IA et se disent, eh bien, je peux dire que c’est généré par l’IA, il n’y a rien d’unique ou de précieux qui soit disponible ici pour moi.

Cela ne veut pas dire que tout le contenu généré par l’IA est mauvais, mais parfois vous parcourez simplement des sites Web sur lesquels vous vous dites que n’importe qui aurait pu écrire ceci. Cela ne me dit rien.

Martin Splitt a souligné à quel point il est difficile de reconnaître que vos meilleurs efforts ne sont peut-être pas aussi parfaits qu’il y paraît.

Splitt a dit :

« Ouais, c’est vrai.

Et je pense que ce qui rend cela difficile n’est pas seulement le fait que la façon dont vous l’avez écrit est évidemment celle que vous pensiez être la meilleure, et c’est pourquoi vous pensez que c’est de haute qualité, bien sûr. Il est donc vraiment très difficile de sortir de son propre point de vue.

Mais parfois, il y a aussi tellement d’autres choses qui sont tout aussi bonnes. Alors pourquoi l’ajouterions-nous à l’index ?

Et puis cela peut vous dire, peut-être que ce contenu n’est pas aussi précieux que je le pensais, c’est parce que d’autres personnes couvrent la même chose. Et puis, quelle est la valeur de cette version dans l’index ? »

La qualité globale n’est pas seulement une question de texte

Mueller a répondu à Splitt en mentionnant que la qualité n’est pas toujours une question de texte.

« Je pense que nous pourrions avoir un podcast complet sur la qualité. Je pense qu’une autre chose qui mérite d’être mentionnée en ce qui concerne la qualité est qu’il ne s’agit pas seulement du texte. Donc, souvent, les gens diront : eh bien, mon texte est unique ou mes articles sont bons.

Et ils sont regroupés dans une page difficile d’accès où quiconque, lorsqu’il essaie de le charger, comme si le ventilateur de son ordinateur tourne et se dit, oh mon Dieu, je dois m’enfuir pour m’assurer que mon ordinateur n’explose pas. Alors c’est peut-être un cas extrême.

Si vous n’avez qu’un seul point à retenir de ce podcast, ce devrait être celui-ci : Mueller dit que la qualité ne se limite pas au texte. Il a déclaré que la façon dont un utilisateur expérimente une page Web peut également faire partie de la qualité.

Expérience utilisateur et problèmes de qualité

Mueller a donné des exemples de types de problèmes de qualité non textuels qui peuvent avoir un impact négatif sur l’expérience utilisateur. Il n’a pas dit que ces problèmes pouvaient amener une personne à abandonner le site, mais les exemples qu’il a partagés sont le genre de choses qui peuvent amener un visiteur du site à appuyer sur le bouton de retour pour quitter la page Web.

C’est intéressant car c’est le genre de chose qui peut être détectée, un signal de comportement d’utilisateur. Il a utilisé l’exemple d’un site de recettes qui frustre les visiteurs de son site en rendant difficile la recherche de la recette. C’est un exemple d’une mauvaise expérience utilisateur comme preuve d’un problème de qualité.

Mueller appelle en fait l’expérience utilisateur par son nom, affirmant qu’ils doivent presque prendre en compte « l’expérience complète » pour la qualité.

Il a poursuivi :

« Mais vous avez tous vu ces pages où le texte est essentiellement là, mais il est presque caché, caché derrière des publicités, caché derrière des interstitiels, caché derrière d’autres choses qui bougent et vont et viennent, peut-être caché sous un tas de contenu de remplissage, que nous voyons parfois, par exemple, avec des recettes où il y a cette très longue histoire en haut dont peut-être la plupart des gens ne se soucient pas vraiment, et puis la recette arrive.

C’est tout le genre de choses où la qualité globale est bien plus que ce morceau de texte que vous dites, comme ceci est mon contenu principal, c’est ce que Google devrait compter pour mon site.

Et de notre point de vue, nous devons presque prendre en compte l’expérience complète sur une page car c’est ce que voient les utilisateurs.

Il ne s’agit pas que les utilisateurs accèdent à une page Web et activent un mode magique qui extrait simplement le texte, mais ils profitent plutôt de l’expérience complète de ce site Web avec toutes les animations 3D, 4D et tout.

Points à retenir

  • Google peut réduire l’exploration et l’indexation lorsque ses systèmes ont de fortes inquiétudes quant à la qualité globale d’un site Web.
  • Les propriétaires de sites et les référenceurs doivent enquêter sur les problèmes de qualité lorsque les pages ne sont pas indexées et qu’il n’y a aucun problème technique à blâmer.
  • La qualité dépend en partie de la question de savoir si les pages offrent des informations uniques et utiles. À mon avis, unique ne signifie pas que les mots sont littéralement différents de ceux d’un autre site. Unique signifie le sujet, la couverture, tous les éléments du contenu et la manière dont il est présenté à l’utilisateur.
  • Le contenu slop, à la fois généré par l’IA et généré par l’homme, peut déclencher un problème de qualité qui se manifeste par l’abandon de la page par les visiteurs du site.
  • Google prend en compte l’expérience de la page entière, y compris l’accessibilité, les performances, les annonces, les interstitiels, le contenu de remplissage et la facilité avec laquelle les utilisateurs peuvent accéder aux informations dont ils ont besoin.

John Mueller de Google a expliqué que des problèmes d’indexation répandus peuvent refléter des inquiétudes concernant la qualité globale d’un site. Il a laissé entendre que l’expérience utilisateur est un facteur pouvant influencer l’indexation. Le point à considérer est que des problèmes techniques peuvent ne pas être la raison pour laquelle un site n’est pas indexé et que le texte n’est pas toujours la raison non plus, ce qui est lié à l’expérience utilisateur.