Les rapports indiquent que la mise à jour anti-spam de Google est axée sur le contenu SEO AI

Des rapports en ligne suggèrent qu’au moins une partie de la mise à jour anti-spam d’août de Google visait à supprimer le contenu SEO généré par l’IA et expressément créé pour le classement des moteurs de recherche. Google a récemment publié un document de recherche sur la détection de ce type de spam, c’est donc un autre indice.

Contenu généré par l’IA et spam

Il est bien connu que ce n’est pas parce qu’un contenu a été créé avec l’IA qu’il est considéré comme du spam. Ce qui est peut-être moins compris, c’est que tout contenu créé de manière à être classé pour des mots-clés a tendance à remonter jusqu’à la limite entre le contenu normal et le spam, voire à franchir cette ligne.

Les rapports en ligne semblent indiquer que Google a mis en œuvre quelque chose de nouveau pour détecter le contenu généré par l’IA qui dépasse cette limite. Cela ne signifie pas que la mise à jour anti-spam d’août concernait uniquement le contenu généré par l’IA. Mais si les rapports sont exacts, ce type de contenu IA pourrait être la raison pour laquelle de nombreux sites ont perdu leur classement.

@OkaTakuma1 a tweeté ce qui suit :

« En ce qui concerne cette mise à jour du spam de Google, il semble que les sites publiant automatiquement avec Claude Code, codec, etc. soient filtrés et supprimés à tous les niveaux.

Il est possible qu’ils le détectent automatiquement en attachant une sorte de crédit AI, similaire aux images ou vidéos générées.

Cependant, les sites qui avaient initialement l’impression de publier manuellement petit à petit (comme l’image ci-jointe) et qui sont ensuite passés à l’automatisation LLM semblent survivre dans certains cas.

Les sites créés entièrement avec une automatisation complète dès le départ n’ont aucun « signal de confiance » de Google, tandis que les sites qui ont été exploités manuellement au début ont accumulé la confiance de domaine (économies de confiance) et les données d’engagement passées.

En conséquence, même s’ils passent ultérieurement à la publication automatisée LLM, l’évaluation de domaine existante agit comme un tampon, ce qui rend plus difficile pour eux de recevoir immédiatement des jugements de spam (ou des sanctions automatiques)…

La taille de l’échantillon est petite, ce n’est donc en aucun cas définitif – juste une tendance – mais à notre époque où vous n’avez même plus besoin d’ouvrir l’écran de l’éditeur WordPress, il y a de fortes chances qu’ils utilisent également les crédits d’IA pour le texte afin de déterminer des pénalités manuelles ou automatiques, n’est-ce pas ? »

Les utilisateurs font confiance aux sites Web. Ce n’est pas un signal de confiance. C’est un signal utilisateur.

Google n’utilise pas exactement de « signaux de confiance », mais Google utilise des signaux générés par les utilisateurs qui peuvent montrer qu’un site est approuvé par les utilisateurs. Je pense qu’il est utile de faire la distinction entre les signaux générés par l’utilisateur et un « signal de confiance » abstrait qui ne vous dit rien sur ce dont il s’agit.

Cette même personne a enchaîné avec un autre tweet disant qu’un journal japonais qui publie du contenu généré par l’IA n’a pas été détecté dans la récente mise à jour du spam, mais elle a également noté que tout le contenu est vérifié manuellement par des humains avant d’être publié.

Ils ont expliqué :

« …mais jusqu’à présent, il n’a reçu aucune sanction (bien entendu, nous effectuons des contrôles visuels manuels par des humains avant de publier des articles).

Dans la phase initiale, tirer parti des réseaux sociaux et des communiqués de presse pour sensibiliser, améliorer la capacité d’exploration et attirer des impressions pourrait être ce qui fonctionne.

Bien sûr, tout le monde n’est pas d’accord avec ce message car il est anecdotique.

Ce n’est pas de l’IA. C’est une IA générée en masse.

@seiichi_satoweb a suggéré que ce n’est pas que le contenu ait été généré par l’IA qui puisse poser problème, mais plutôt que l’IA ait été utilisée pour générer du contenu qui manipule les résultats de recherche.

Ils ont tweeté :

« Les entreprises exploitant des médias devraient consulter le classement du 18 au 21 août.

…S’il baisse, je pense que la première chose à soupçonner n’est pas la qualité des articles, mais la « méthode de production en série ».

Google définit l’utilisation malveillante de contenu généré en masse comme la génération d’un grand nombre de pages principalement pour manipuler les classements de recherche, et non pour aider les utilisateurs.

Il ne s’agit pas de savoir s’il a été créé avec l’IA générative, mais pourquoi il a été créé.

Les entreprises qui augmentent leur volume grâce à l’IA devraient absolument vérifier cela une fois. »

La pente de l’IA est un problème

Même sur les forums Blackhat World, les membres se plaignaient de la frustration de rencontrer une IA qui s’empare des résultats de recherche.

Un membre a écrit :

« Ils ont finalement réalisé que les déchets de l’IA prenaient le dessus.

J’ai récemment fait une recherche pour un didacticiel rapide sur la façon de modifier les paramètres d’une application et j’ai vu 4 sites consécutifs clairement créés avec l’IA pour créer des articles répondant à cela – tous avaient exactement la même apparence, même formatage IA des sous-titres et des puces, mauvais espacement entre les sections, 3 phrases essentiellement développées en 500 mots.

Les pages AI slop sont la nouvelle page d’entrée et Google a du mal à l’intégrer.

Un autre membre a répondu qu’ils ont tendance à ajouter des qualités uniques à leur contenu généré par l’IA afin qu’il ne s’agisse pas d’un contenu purement basé sur un modèle.

Votre kilométrage peut varier

Bien sûr, d’autres ont remarqué que leur contenu généré par l’IA s’était amélioré après la mise à jour, comme indiqué dans le privé Groupe Facebook Google SEO Mastermind.

Néanmoins, une règle empirique que tout le monde devrait suivre, quelle que soit la manière dont le contenu a été créé, est que le contenu fortement axé sur les mots-clés a souffert ces dernières années. La génération automatique de contenu pour capitaliser sur les tendances SEO aurait pu être l’une des cibles de la récente mise à jour du spam.

Google a récemment publié un document de recherche sur un nouveau système appelé S-CTS, qui signifie Scalable Cluster Termination System. Il s’agit d’un système permettant d’identifier et de mettre fin aux réseaux de spam générés par l’IA.