John Mueller de Google a répondu à une question relative à quelque chose qu’un Redditor utilisait et qui s’appelle llms-author.txt.
La personne qui a posté la question a du mal à trouver son nom car il est identique à celui de deux autres entités plus populaires, ce qui rend plus difficile pour les gens de la trouver et de découvrir ses services.
La question posée :
«Pendant des années, cela signifiait qu’une partie de mon signal «qui est cette personne» était diluée ou carrément erronée chaque fois qu’un modèle ou une fonction de recherche essayait de me résumer.
PREMIER PAS
Premièrement, un fichier llms-author.txt explicite, distinct du fichier llms.txt principal, indiquant le titre du poste, l’agence, le lieu et le domaine de pratique dans des phrases simples plutôt que de s’appuyer uniquement sur un schéma pour porter ce poids.
DEUXIÈME ÉTAPE
Deuxièmement, ajouter le nouvel en-tête Content-Signal (ai-train=no, search=yes, ai-input=yes) au robots.txt, principalement par curiosité de savoir si la déclaration d’intention au niveau de l’en-tête change quelque chose de mesurable.
Ce qu’ils voulaient savoir, c’est si quelqu’un avait effectué des tests contrôlés sur les en-têtes Content-Signal pour voir s’ils fonctionnaient.
LLMs-auteur.txt
Apparemment, le LLMs-author.txt n’est peut-être pas une chose réelle, car il n’y a pas de proposition officielle à ce sujet, et encore moins de véritable norme pour cela.
En-tête de signal de contenu
C’est un peu plus déroutant. Cloudflare avait proposé une directive Content-Signal pour robots.txt. Cloudflare a ensuite utilisé la même syntaxe Content-Signal qu’un en-tête de réponse HTTP généré automatiquement dans Markdown for Agents. Markdown for Agents est une fonctionnalité Cloudflare qui propose automatiquement une version Markdown d’une page Web chaque fois qu’un client Web la demande.
Ainsi, parmi les deux éléments utilisés par Redditor, aucun d’eux ne semble faire partie d’une proposition réelle.
Le point de vue de Google sur LLMs-Author.txt
John Mueller de Google a correctement qualifié le Content-Signal de Cloudflare de directive robots, ce qui est formellement la proposition.
Il a répondu :
«Je suppose que certaines choses…
* Google n’utilise pas llms.txt ou llms-author.txt. Je ne connais aucun autre robot / llm confirmant qu’ils les utilisent (autres que les outils de référencement).
* AFAIK, aucun des robots d’exploration/llms n’utilise les directives robots.txt « content-signal ». Il a été constitué par un CDN, autant que je sache, il n’a aucun effet pour un robot ou un llm. Son utilisation ajoute simplement du gonflement et une maintenance future à votre fichier robots.txt.
Vous pouvez également ajouter d’autres éléments arbitraires à votre fichier robots.txt, les robots utilisent simplement les directives qu’ils prennent en charge et ignorent le reste.
La solution du Redditor n’est peut-être pas le référencement technique
Le Redditor recherche une solution de référencement technique pour résoudre un problème qui dépasse largement le référencement technique. Les LLM, les chatbots et les moteurs de recherche s’appuient sur des signaux provenant du Web, notamment des données structurées. Mais dans cette situation, étant donné que le Web indique que ces autres entités portent le même nom, le problème du Redditor concerne réellement le Web et non un problème technique de référencement à résoudre. Ils peuvent trouver une solution satisfaisante à leur problème en se faisant mieux connaître sur le Web, peut-être en étant interviewés sur des vidéos, des podcasts et sur des pages Web. Peut-être devraient-ils faire des choses plus remarquables pour étendre leur empreinte numérique sur Internet.