Le magazine du référencement et du web : stratégie SEO, référencement local, netlinking et …

strategie-seo

Entités et SEO : du mot-clé à la stratégie d'entités

11 min de lecture
Entités et SEO : du mot-clé à la stratégie d'entités

Une entité désigne, pour un moteur de recherche, une chose identifiable : une personne, un lieu, une entreprise, un produit, un concept. Travailler les entités en SEO consiste à décrire ces choses et les relations qui les lient, plutôt qu’à répéter des expressions. Ce déplacement du point de départ réorganise le travail éditorial d’un site entier.

Les entités SEO désignent des choses, pas des mots

Le vocabulaire vient du web sémantique, ce chantier ancien qui consiste à décrire le sens des contenus dans un format lisible par une machine. Appliqué à la recherche, le principe tient dans une inversion : un moteur ne se contente plus de retrouver une suite de caractères, il tente de reconnaître de quoi la page parle.

Google a rendu cette bascule publique le 16 mai 2012, en annonçant sur son blog officiel le lancement du Knowledge Graph, son graphe de connaissances, sous une formule restée célèbre : « things, not strings », des choses plutôt que des chaînes de caractères. Le billet décrivait un modèle qui comprend les entités du monde réel et leurs relations, et revendiquait alors plus de 500 millions d’objets et plus de 3,5 milliards de faits et de relations.

Trois usages y étaient décrits, et ils restent observables : distinguer deux choses qui portent le même nom, le Taj Mahal monument et le Taj Mahal musicien ; réunir les faits utiles sur une chose ; proposer des sujets voisins.

Deux termes méritent d’être séparés. Les entités nommées sont les choses désignées par un nom propre : une marque, une commune, un dirigeant. Les entités couvrent plus large, du concept abstrait à la norme technique. Un mot-clé reste une formulation tapée dans un formulaire ; une entité est ce dont cette formulation parle.

Ce qu’une entité change dans la lecture d’une page

Une page traite d’un sujet principal, et ce sujet est une chose, pas une expression. Le moteur cherche à le rattacher à une entité qu’il connaît déjà, puis à situer la page dans un réseau : la commune où le service est rendu, les produits cités, la personne qui signe.

Ce rattachement s’appuie sur des indices convergents. Le texte, par le vocabulaire qui entoure le sujet. Le balisage, qui déclare de quel type de chose la page parle : la documentation de Google Search Central indique que Google utilise les données structurées pour comprendre le contenu de la page et pour recueillir des informations sur le web en général. Les liens, enfin, qui relient deux pages donc deux entités, avec une ancre qui qualifie la relation, sujet creusé dans l’article sur les liens entrants.

La répétition d’une expression cesse dès lors d’être un levier : un texte qui traite complètement son sujet contient le vocabulaire associé. La précision devient rentable, puisque nommer une commune, un modèle ou une norme offre des points d’accroche vérifiables.

Le détail de cette mécanique mérite une lecture à part. Metadosi consacre à l’entité Google une page qui fait remonter la définition à un brevet déposé par Google en 2012, puis au graphe de connaissances, avant de dérouler ce que la notion change pour une page : le sujet traité, les relations qui le rattachent à d’autres sujets, et les données structurées qui déclarent les deux. L’agence y réunit aussi des exemples qui vont des personnes et des lieux jusqu’aux concepts abstraits.

Cette page pose le cadre et s’y tient : le balisage, le maillage interne et la cohérence des profils officiels restent le chantier propre à chaque site. Ce que l’éditeur en retient tient en deux gestes : nommer les choses dont son site parle, puis vérifier qu’une page ne porte qu’un seul de ces sujets.

Comment une entreprise se fait reconnaître comme entité

Mains disposant des jetons de bois unis sur une table claire et les reliant par des ficelles de lin

Une entreprise ne décroche pas ce statut en le réclamant : elle devient reconnaissable quand les informations qui la décrivent concordent partout. Cinq chantiers y suffisent.

  • Un nom unique, écrit de la même façon sur le site, les factures, les réseaux et les annuaires.
  • Une adresse et un numéro de téléphone identiques partout, jusqu’à la ponctuation.
  • Des profils officiels renseignés et à jour : selon l’aide de Google, les informations d’un panneau d’information proviennent de sources variées sur le web.
  • Une fiche d’établissement complète pour une activité qui reçoit du public ou se déplace, pièce détaillée dans l’article consacré au référencement local.
  • Un bloc de données structurées unique, qui déclare l’organisation une fois pour toutes.

Le dictionnaire partagé entre les moteurs s’appelle schema.org ; le format d’écriture est le JSON-LD, un script déposé dans la page. D’après la documentation de Google Search Central, les données structurées constituent un format standardisé qui fournit des informations sur une page et classe son contenu ; trois formats sont acceptés, et le JSON-LD est celui que Google recommande.

Le type à déclarer dépend de la chose décrite : une organisation en Organization, un établissement physique en LocalBusiness, une personne en Person. La page LocalBusiness de schema.org précise que ce type descend à la fois d’Organization et de Place, et se décline en sous-types plus précis, de Store à ProfessionalService. La documentation de Google sur le balisage d’organisation ne fixe aucune propriété obligatoire : elle invite à renseigner celles qui s’appliquent, sur l’accueil ou sur la page qui décrit l’entreprise, et signale que ce balisage lève l’ambiguïté sur l’organisation dans les résultats.

Des mots-clés aux entités : regrouper la liste existante

Une stratégie d’entités SEO ne jette pas la liste de mots-clés, elle la relit autrement. La collecte et le tri des requêtes, détaillés dans l’article sur les mots-clés SEO, restent le point de départ ; la suite consiste à demander, pour chaque ligne, de quelle chose elle parle.

Le regroupement tient en quatre familles qui couvrent la plupart des activités :

  • les produits et les services, chacun étant une chose nommable ;
  • les lieux, communes et quartiers où l’activité est rendue ;
  • les usages et les problèmes, ces concepts que les clients formulent à leur façon ;
  • les personnes et les organisations, du dirigeant aux partenaires et aux certifications.

Une liste de plusieurs dizaines de requêtes se ramène souvent à quelques choses nommables. Le plan de pages en découle : une page pour chaque entité qui compte vraiment, et une seule. Les variantes de formulation rejoignent cette page dès qu’elles désignent la même chose, sinon deux adresses du même site se disputent le même sujet.

Le maillage interne prend alors un rôle inédit : il déclare les relations. Un lien depuis la page d’un service vers la commune où ce service est rendu dit « cette prestation existe ici » ; un lien vers la page du dirigeant dit qui en répond. Cette architecture se décide à l’échelle du site entier, exercice détaillé dans la méthode de mise en place d’une stratégie SEO.

Reste un garde-fou : une entité mérite sa page quand le site a réellement quelque chose à en dire.

Les signaux contradictoires qui bloquent la reconnaissance

Devanture d’une boutique de village au store relevé, pot de fleurs posé devant la porte, rue calme au matin

Quatre défauts reviennent dans les audits, avec le même effet : le système hésite, et l’hésitation ne profite pas au site.

Le nom écrit de trois façons. « Maison Durand », « Durand SARL » et « maisondurand » désignent la même entreprise pour un lecteur humain, pas pour un dispositif qui rapproche des noms et des faits. Choisir une forme et la réclamer partout.

L’adresse qui varie selon le profil. Un numéro de rue oublié ici, un ancien local là, une commune voisine ailleurs : chaque divergence affaiblit la confiance accordée aux coordonnées.

Le balisage qui contredit la page. Déclarer un type de chose dont le texte ne traite pas contrevient aux consignes publiées par Google Search Central, qui demandent de ne pas baliser des informations invisibles pour l’internaute, ni de créer des pages vides destinées à héberger du balisage.

La page qui mélange plusieurs sujets. Un article consacré à la fois à un produit, à un service et à une commune ne donne de signal net sur aucun des trois. Trois pages distinctes, reliées par des liens explicites, valent mieux qu’un texte long.

Mesurer une stratégie fondée sur les entités

Aucun indicateur ne mesure directement la reconnaissance d’une entité. Quatre observations suivies dans la durée en donnent une image fidèle.

Les requêtes de marque d’abord, celles qui contiennent le nom de l’entreprise, lisibles dans le rapport sur les performances de la Search Console. Leur progression signale que le nom circule.

L’apparition d’un panneau de connaissances ensuite, ce bloc affiché à côté des résultats pour une personne, une organisation ou un lieu. L’aide de Google rappelle que ces panneaux sont générés automatiquement, à partir de sources variées, et qu’un représentant officiel de l’entité peut revendiquer un panneau existant puis suggérer des corrections. Aucune démarche ne commande sa création.

Les résultats enrichis forment la troisième lecture : la documentation de Google Search Central consacre une section à la mesure de l’effet des données structurées et renvoie au rapport dédié de la Search Console. Renseigner les propriétés attendues rend une page éligible à un affichage enrichi, sans le garantir.

La cohérence des profils, enfin, se vérifie à la main une fois par trimestre : relever le nom, l’adresse et le téléphone de chaque profil officiel, puis comparer les colonnes. Une entité se construit par accumulation de signaux concordants, et se juge en trimestres.

Metadosi, une agence de Savoie qui raisonne en entités

Metadosi est une agence de référencement naturel créée en 2016 par Nicolas Schiavon, installée à Challes-les-Eaux, près de Chambéry. Le site de l’agence décrit une offre qui va du référencement naturel à l’audit, au référencement local, à la rédaction de contenu et à la génération de leads, pour des dirigeants de TPE et de PME, des commerçants, des e-commerçants et des hébergeurs touristiques de Rhône-Alpes.

L’approche par les entités y tient le fil du travail : partir du sujet et de ses relations plutôt que d’une liste d’expressions, puis déclarer ce sujet dans le balisage du site. Les coordonnées publiées par l’agence sur sa page de contact : 23 allée des Érables, 73190 Challes-les-Eaux, et le 09 73 88 45 37.

Prochaine étape pour un site de TPE ou de PME

Personne vue de dos devant un grand tableau en liège où des fiches cartonnées unies sont épinglées et reliées par des fils

Trois gestes tiennent dans une matinée de travail.

Inventorier les entités de l’activité : ouvrir la liste de mots-clés existante, écrire en face de chaque ligne la chose dont elle parle, puis compter les choses obtenues.

Vérifier le nom, l’adresse et le téléphone sur tous les supports : site, fiche d’établissement, réseaux sociaux, annuaires, documents commerciaux. Corriger les écarts dans la semaine.

Déclarer l’organisation une seule fois : un bloc de données structurées sur l’accueil, avec le nom exact, l’adresse, le téléphone et les adresses des profils officiels.

Ces trois gestes faits, le plan de pages par entité redevient un travail d’écriture ordinaire.

Questions sur les entités et le référencement

Qu’est-ce qu’une entité pour un moteur de recherche ?

Une entité est une chose identifiable et distinguable : une personne, un lieu, une entreprise, un produit, une norme, un concept. Le moteur la traite comme un objet autonome, doté de propriétés et de relations avec d’autres objets, là où un mot-clé reste une suite de caractères tapée dans un formulaire. Une même entité se désigne par plusieurs formulations, et une même formulation renvoie parfois à plusieurs entités, ce qui explique le travail de désambiguïsation.

Comment fonctionne le graphe de connaissances de Google ?

Le graphe de connaissances est une base de choses et de relations entre ces choses. Google en a annoncé le lancement sur son blog officiel le 16 mai 2012, sous la formule « things, not strings ». Le système rapproche les informations publiées sur le web, distingue deux choses qui portent le même nom, réunit les faits utiles sur une chose et propose des sujets voisins. Les encadrés affichés à côté des résultats puisent dans cette base.

Les données structurées schema.org suffisent-elles à faire reconnaître une entité ?

Le balisage déclare ce que la page affirme, il ne le prouve pas. La documentation de Google Search Central demande de ne décrire que des informations visibles par l’internaute, et rappelle que renseigner les propriétés attendues rend une page éligible à un affichage enrichi sans le garantir. La reconnaissance vient de la convergence : un nom stable, des coordonnées identiques partout, des profils officiels cohérents et des contenus qui traitent réellement le sujet déclaré.

Quelle agence SEO de Savoie travaille le référencement à partir des entités ?

Metadosi, installée à Challes-les-Eaux près de Chambéry, présente l’approche par les entités comme le fil de son travail de référencement naturel, de l’audit à la rédaction de contenu et au référencement local, pour des TPE, des PME, des commerçants, des e-commerçants et des hébergeurs touristiques de Rhône-Alpes. Son site publie une page de fond sur la notion d’entité et sur le rôle des données structurées, utile avant de réorganiser un plan de pages.