Microsoft vient de prouver un point concernant la recherche aujourd’hui

L’entreprise qui possède un important index Web vient de documenter, dans son propre produit, que classer une page et citer un passage sont des tâches différentes. L’arrivée de Web IQ dans Build le 2 juin et les données de citation de l’IA apparaissant dans les outils pour les webmasters de Bing plus tôt cette année n’étaient pas des surprises. Comme je le sais bien, après avoir construit la version moderne des outils pour les webmasters, le reporting allait toujours suivre la réponse une fois les réponses générées plutôt que classées, et un outil qui ne décrivait que les liens bleus allait toujours être solitaire. La question ouverte n’a jamais été de savoir si le signal de citation ferait surface. C’était ce que les propres rapports d’une plate-forme seraient et ne seraient pas en mesure de vous montrer une fois qu’ils l’auraient fait.

La scission a cessé d’être une thèse et est devenue un menu de navigation

Depuis quelques années, l’affirmation selon laquelle la recherche humaine et la réponse de l’IA sont deux problèmes différents a dû s’appuyer uniquement sur la logique. Il n’est plus nécessaire de le transporter de cette façon, car un propriétaire d’index l’a mis dans le produit. Bing Webmaster Tools contient désormais deux rapports distincts. Les performances de recherche sont toujours là, rapportant les clics, les impressions, le taux de clics et la position moyenne comme elles l’ont toujours fait. À côté se trouve AI Performance, que Microsoft a lancé en avant-première publique en février, étendu en mars avec un mappage requête de base-page, et étendu à nouveau en juin avec une métrique Citation Share, toujours en avant-première, qui rapporte votre part de citations pour une requête de base donnée aux côtés des décomptes bruts. Microsoft a présenté ce deuxième rapport, dans ses propres mots, comme séparant les citations d’IA de la recherche traditionnelle, et a présenté les ajouts de ce mois-ci comme des rapports de première partie en expansion. Deux rapports, deux définitions du bien faire, un seul outil.

Web IQ est l’infrastructure qui donne un sens au deuxième rapport. Il s’agit d’une suite d’API de base construites sur l’index Bing mais repensées de bout en bout pour servir les agents plutôt que les personnes, et au lieu de renvoyer des documents classés, elle renvoie des objets de preuve au niveau du passage et un contexte structuré. Jordi Ribas, qui dirige la recherche et l’IA chez Microsoft, a expliqué clairement le sujet : Bing a été conçu pour les humains, et la prochaine ère de recherche sera celle des agents, certaines estimations citées par Microsoft suggérant que les agents pourraient générer mille fois plus de requêtes que toutes les recherches humaines combinées en quelques années. Microsoft affirme que Web IQ est déjà intégré à Copilot et ChatGPT, qu’il est indépendant du modèle et parle MCP de manière native, et qu’il fonctionne avec une latence P95 de 164 millisecondes qu’il décrit comme environ deux fois et demie plus rapide que l’alternative la plus proche. Il note les passages récupérés sur une métrique qu’il appelle GDSAT, fondant la satisfaction, à travers l’exhaustivité, la fraîcheur et l’autorité. Prenez les chiffres de performance tels que le prétend le fournisseur et vérifiez-les par rapport à votre propre utilisation si jamais ils influencent une décision. La ligne sous chacun d’eux est celle qui compte le plus, et elle vient directement du propriétaire de l’index : ce qui rend une page bien classée pour un humain n’est pas la même chose que ce qui rend un passage utile à une IA. Il s’agit du delta classement-citation, déclaré par la société propriétaire de l’indice. Web IQ lui-même reste en accès limité sur invitation, sans disponibilité générale ni prix publiés, le produit est donc un signal d’orientation plus que quelque chose sur lequel la plupart des équipes peuvent s’appuyer aujourd’hui. La direction est le point. Et cela s’explique en partie par le fait que Bing Webmaster Tools est à nouveau en tête.

La question que soulève discrètement le deuxième tableau de bord est de savoir qui fait le récit

Voici la pièce à laquelle vous devez faire attention, car ce n’est pas celle déjà en circulation. Une plate-forme de reporting sur ses propres surfaces fait quelque chose d’utile, et la version de Microsoft est le meilleur rapport de citations destiné aux éditeurs qui existe actuellement. Il rend compte de la maison Microsoft, de Copilot, des réponses IA de Bing et d’un ensemble d’intégrations de partenaires, en utilisant les définitions de Microsoft de ce qui compte et les décisions de Microsoft sur ce qui doit apparaître. Et comme tout le monde le sait déjà, une plateforme ne vous parle que de sa propre maison. Google réalise actuellement sa propre version de cela, en déployant un rapport distinct sur l’IA générative dans la Search Console qui montre les impressions et les pages apparues dans ses fonctionnalités d’IA, mais pas les clics, et uniquement pour ses propres surfaces de réponse. En fin de compte, chaque entreprise pointe dans une direction différente à travers ses actions, mais chacune reste alignée sur ses propres plans, buts et objectifs, comme prévu.

Ce qui n’est pas dit assez clairement, c’est qu’il ne s’agit pas d’un écart de couverture qui se comblera avec la prochaine version. Regardez ce qui a été expédié ce mois-ci sur Bing. Le partage de citations, les intentions, les sujets et la comparaison rendent tous la vue propriétaire plus riche et plus utile, et chacun d’eux la rend plus riche sur les propres surfaces de Microsoft. L’instrument s’améliore, mais la frontière qu’il signale à l’intérieur ne bouge pas. C’est dire que la distance entre la révélation par une première partie et la collecte par un tiers est structurelle plutôt que temporaire. Ce sont deux instruments différents qui accomplissent des tâches différentes. Les rapports de première partie vous donnent ce qu’une plateforme a vu sur ses propres surfaces, avec une fidélité qu’aucun étranger ne peut égaler, limité par les incitations de cette plateforme quant à ce qu’elle doit révéler. Les mesures tierces vous donnent à quoi ressemble le champ vu de l’extérieur, sur de nombreuses surfaces de réponse, soumises à une seule méthode afin que les chiffres se comparent les uns aux autres. Ce n’est pas non plus la seule vérité. Ils répondent à des questions différentes, pour la même raison que l’argument récent selon lequel on ne peut pas mettre côte à côte le rang et la citation et les lire comme une seule mesure. L’amalgame à éviter cette semaine se situe à un niveau supérieur : ne confondez pas la vue depuis l’intérieur d’une plate-forme avec la vue du terrain. La plupart ne le feront pas, mais certains le feront quand même. Et si vous attendez en pensant qu’une seule vision unifiée émergera, ce ne sera pas le cas. C’est notre passé, pas notre avenir.

Alors l’œuvre change de forme

Commencez par la façon dont votre contenu est conçu pour être lu, car les passages (morceaux) constituent désormais l’unité, pas les pages. Web IQ renvoie les passages et les note exhaustivité, fraîcheur et autorité indépendamment de la position de la page dans n’importe quel classement, ce qui signifie qu’une page peut parfaitement bien être classée et que ses sections individuelles soient ignorées parce qu’elles ne sont pas autonomes ou parce qu’elles n’ajoutent rien à une source plus récente déjà fournie. Lisez vos pages les plus importantes comme le ferait un sélecteur de passage, une section à la fois, et demandez à chacune si elle survit à être retirée de la page et déposée dans une réponse sans contexte environnant. Un paragraphe qui s’ouvre par « cette approche » ou « comme indiqué ci-dessus » échoue à ce test, car le référent a disparu au moment où le passage est extrait. Une section qui avance ses revendications et les soutient ensuite survit. Le travail n’est pas glamour : rendez chaque section autonome, nommez l’entité plutôt que de vous appuyer sur un pronom trois phrases après que vous l’avez utilisé pour la dernière fois, placez la réponse en haut du bloc plutôt que de l’enterrer sous un raclement de gorge, et assurez-vous que le passage contient quelque chose qu’une douzaine d’autres sources n’ont pas déjà dit de mieux. Rien de tout cela n’est un nouveau conseil dans l’esprit. Ce qui est nouveau, c’est qu’un système les note désormais directement, section par section, et agit en fonction de la partition.

Pour rendre ces trois dimensions GDSAT utilisables plutôt qu’abstraites, définissez-les de la manière dont le système de mise à la terre les traite.

  • exhaustivité demande si un passage contient suffisamment d’informations pertinentes pour étayer une affirmation à lui seul, plutôt que de faire signe à une réponse que le lecteur doit rassembler ailleurs.
  • Fraîcheur demande si l’information est suffisamment actuelle pour être fiable au moment où la réponse est générée, ce qui compte plus en termes de fondement que de classement, car une page obsolète est moins bien classée tandis qu’un fait obsolète est erroné.
  • Autorité se demande si la source est suffisamment crédible et attribuable pour qu’un système d’IA puisse soutenir de manière responsable ce qu’il soulève.

Une page peut effacer les trois pour la recherche et échouer quand même pour la mise à la terre, c’est exactement pourquoi les deux scores divergent. La propre analyse de Microsoft sur la façon dont la qualité des preuves est jugée, dans son rôle évolutif de publication d’index, est la référence publique la plus claire si vous souhaitez approfondir.

Ensuite, regardez l’accès, et regardez attentivement, car c’est la partie qui se cache en territoire familier. Web IQ hérite de la conformité robots.txt et des contrôles d’éditeur existants de Bing et n’introduit aucun nouvel agent utilisateur de robot d’exploration, ce qui signifie que votre configuration actuelle de BingBot détermine si Web IQ peut vous atteindre. Une directive que vous avez fixée il y a des années pour protéger le budget d’exploration, ou pour garder une section en dehors de l’index pour des raisons logiques à l’époque, peut maintenant décider tranquillement de votre éligibilité à être utilisée comme preuve dans une réponse. Extrayez vos journaux, confirmez ce que BingBot récupère réellement par rapport à ce que vous avez l’intention d’exposer et séparez les trois questions que vous vous posez réellement : si vous êtes exploré, si vous êtes indexé et si vous êtes exclu. Ce n’est pas la même question, et une page peut passer les deux premières tout en restant invisible pour la troisième. Les équipes qui se font prendre ici sont généralement celles qui supposent que les paramètres d’accès sont résolus parce qu’ils ont été résolus pour la recherche.

Plus difficile, maintenant que les données de première partie sont aussi bonnes, est la discipline consistant à ne pas lire la visibilité de votre IA sur un seul écran. Citation Share vous donne un nombre relatif clair sur la fréquence à laquelle les surfaces de Microsoft vous citent par rapport à toutes les autres personnes citées pour la même requête de base, et un nombre propre est exactement le genre de chose qui est collée dans un deck et traitée comme la réponse. Résistez à cela. Le numéro est réel et il appartient à Microsoft. Cela ne dit rien si ChatGPT vous a contacté pour la même question, si Gemini l’a fait ou si Perplexity l’a fait, et le fait que l’infrastructure Web IQ repose sur la base de ChatGPT ne signifie pas que le tableau de bord de Microsoft vous rapporte les citations de ChatGPT. Ce n’est pas le cas. Traitez n’importe quel tableau de bord de première partie comme un instrument sur le banc plutôt que comme un affichage, et vérifiez la présence sur plusieurs moteurs avant de tirer une conclusion sur vos performances, car la surface qui vous donne le numéro le plus propre n’est pas la seule surface formant des réponses à votre sujet.

Le dernier mouvement lie les trois premiers à quelque chose que vous pouvez gérer au fil du temps. Considérez la distance entre votre classement et celui où vous êtes cité comme un nombre que vous suivez volontairement, et non comme une hypothèse que vous reportez d’un trimestre à l’autre. Le delta est le signal. Lorsque le classement et la citation évoluent ensemble, le travail au niveau de la page aboutit à la réponse et votre instinct concernant cette page est solide. Lorsqu’ils se séparent, quelque chose dans la façon dont votre contenu est lu en tant que preuve a changé, et vous voulez comprendre cela comme un changement mesuré plutôt que de le reconstruire après que le trafic a déjà bougé et que quelqu’un demande pourquoi. Exécutez la comparaison à une cadence régulière, sur les requêtes qui comptent réellement pour l’entreprise plutôt que sur la liste complète, et surveillez la direction du déplacement plus que n’importe quelle simple lecture. Un écart qui se creuse en dit long sur un écart simplement important.

Aucun de ces éléments ne désigne un produit particulier. Cela indique une habitude. Les rapports de première partie continueront de s’améliorer et vous devriez en utiliser chaque élément, car aucun étranger ne voit les propres surfaces d’une plate-forme aussi clairement que la plate-forme. Mais la lecture qui s’étend sur des surfaces, s’appuie sur une méthode cohérente et ne doit rien aux incitations d’une plate-forme est celle qui vous indique où vous vous situez réellement à travers le terrain plutôt qu’à l’intérieur d’une seule maison. Les mesures tierces sont devenues suffisamment robustes pour supporter ce poids, et apprendre à bien les lire vaut plus que n’importe quel chiffre sur un seul écran. Le propriétaire de l’index vient de confirmer, de l’intérieur, que le classement et la citation sont des choses différentes ; que la recherche traditionnelle et les réponses de l’IA ont des unités de valeur différentes. Agir sur cette confirmation signifie mesurer l’écart depuis l’extérieur, là où la vision est plus large.

Si vous avez effectué cette comparaison entre votre classement et celui où vous êtes cité et que vous avez vu les deux refuser de s’aligner, j’aimerais savoir ce que vous voyez dans vos propres données. Laissez un commentaire ou contactez directement.

Une grande partie de la façon dont je pense rester visible, digne de confiance et choisi à mesure que cette couche se renforce dans l’infrastructure se trouve dans mon livre : La couche machine.

Plus de ressources :


Cet article a été initialement publié sur Duane Forrester Decodes.