Aller au contenu principal

Schema markup et AI Overviews : ce qui compte en 2026

Google le dit : le schema n'est pas requis par ses fonctionnalités IA. Ce qu'il apporte vraiment, le stack JSON-LD complet et la méthode de validation.

SEO
Résumer avec

Partager

Publié le · 20 min de lectureMis à jour le

Le schema markup est-il un facteur de citation dans les moteurs IA ?

Non, et c'est la première chose à corriger avant d'ouvrir un éditeur de JSON-LD. Google écrit dans son guide d'optimisation pour l'IA que les données structurées ne sont pas requises pour la recherche générative, et qu'aucun balisage schema.org spécial n'est à ajouter.

Structured data isn't required for generative AI search, and there's no special schema.org markup you need to add. That said, it's a good idea to continue using it as part of your overall SEO strategy, as it helps with being eligible for rich results on Google Search.

Google Search Central

Documentation officielle, guide d'optimisation pour l'IA

developers.google.com, consulté le 21 juillet 2026

La phrase se lit en deux temps : pas d'obligation côté IA générative, utilité maintenue côté recherche classique.

Pourquoi la confusion s'est installée

Parce que les pages bien balisées sont aussi, en général, des pages bien faites. Un site qui déclare un auteur réel, une organisation et des dates de modification honnêtes a une équipe éditoriale et une architecture propre. Le balisage est le symptôme du sérieux, rarement sa cause. Confondre les deux mène à une décision absurde : baliser un site dont le contenu ne répond à aucune question.

Ce que mesure vraiment l'étude sur 730 citations IA

Elle mesure une corrélation entre richesse du balisage et présence dans les citations, pas un effet causal. L'analyse la plus citée est celle de Kurt Fischman, publiée le 22 février 2026, sur 730 citations générées par ChatGPT et Gemini.

61,7 %

de citations pour le schema attribute-rich, contre 41,6 % pour le schema générique

Marshal, fév. 2026

730

citations IA analysées sur ChatGPT et Gemini

Marshal, fév. 2026

43 % à 5 %

taux de citation entre une page en position 1 et une page en position 7

Marshal, fév. 2026

Source : l'étude publiée par Marshal en février 2026. L'écart de 20 points y est donné comme significatif (p = 0,012). Le second résultat compte autant : chaque position perdue réduit les chances de citation d'environ 24 % (OR = 0,762, p < 0,001).

Pourquoi ces 20 points ne prouvent rien à eux seuls

Parce que l'auteur de l'étude le dit lui-même : la qualité du contenu est la variable dominante non mesurée. Le papier précise que schema et autorité de domaine réunis n'expliquent qu'une fraction modeste de la variance, sur données corrélationnelles et deux moteurs seulement.

Traduit en décision : ne construisez pas votre visibilité IA sur le balisage. Construisez-la sur le contenu, la structure et la fraîcheur, que détaille notre pillar sur le SEO et le GEO en 2026, puis posez un schema propre par-dessus.

À quoi sert réellement le schema markup en 2026 ?

À dire aux machines de quelle entité vous parlez, et à rester éligible aux rich results qui existent encore. Deux bénéfices concrets, qui ne dépendent d'aucune promesse marketing et justifient à eux seuls une journée de travail.

La désambiguïsation d'entité, le vrai gain

Le problème que résout sameAs est celui de l'homonymie. Un modèle qui rencontre votre nom sur une page tierce doit décider s'il s'agit de vous. Sans point d'ancrage vérifiable, il tranche mal et vous attribue les faits d'un autre.

sameAs relie votre organisation et votre auteur à des identités externes contrôlées : LinkedIn de l'entreprise, LinkedIn du dirigeant, dépôt GitHub, fiche Wikidata. C'est le seul mécanisme standardisé qui dit « cette page et ce profil désignent la même chose ». Deux liens vivants valent mieux que six liens morts. Nous l'appliquons là où l'autorité personnelle porte le business, comme les sites d'avocats et les sites de coachs.

Le graphe interne avec @id

@id transforme cinq balises isolées en un seul graphe cohérent. Sans lui, chaque page déclare une organisation qui ressemble à celle de la page voisine, sans qu'aucun parseur ne sache s'il s'agit de la même.

Une entité, un @id, jamais dupliqué : /#organization pour l'entreprise, /auteurs/slug#person pour l'auteur, /blog/slug#article pour l'article. Ces identifiants ne changent jamais, même quand le contenu change.

Les rich results qui existent encore

Le balisage reste la condition d'éligibilité aux affichages enrichis, et cette liste s'est réduite. Le fil d'ariane, les extraits produit, les avis, les vidéos et les événements en dépendent. Le rich result FAQ, lui, a disparu en mai 2026.

L'éligibilité n'est pas une garantie : Google choisit d'afficher ou non, requête par requête. Le balisage vous met dans la file d'attente, il ne vous fait pas passer devant. C'est un des premiers points vérifiés dans une mission SEO et GEO.

Quels sont les 4 schemas critiques pour un article de blog ?

Quatre types couvrent l'essentiel de ce qu'un moteur doit comprendre d'un article : le contenu, la personne qui l'a écrit, les questions traitées, la place dans le site.

01

Article

Identifie le type de contenu, l'auteur, les dates de publication et de modification, l'image de couverture.
02

Person (auteur)

Crée l'entité auteur avec jobTitle, sameAs LinkedIn et knowsAbout. Le signal E-E-A-T le plus concret.
03

FAQPage

Marque chaque question et réponse comme entité distincte. Plus de rich result, mais un format toujours parsé.
04

BreadcrumbList

Donne le chemin Accueil, Blog, Article. Situe la page dans la hiérarchie du site.

Article et Person portent à eux seuls la moitié de l'information utile, et c'est la partie la plus bâclée : un author à « La rédaction » ne crée aucune entité personne, donc rien à désambiguïser. Voyez notre page auteur pour un exemple en production, bio visible identique au schema.

Pourquoi Organization ne se déclare qu'une fois

Parce qu'une organisation déclarée sur 200 pages avec 200 formulations produit 200 entités possibles. Nom, URL, logo et sameAs doivent être identiques partout. Le seul moyen fiable est de les écrire à un seul endroit du code, puis de ne référencer que l'@id.

Sur Next.js, une balise dans le layout racine, jamais dans un composant de page. Sur WordPress, un seul plugin responsable de l'Organization. Deux plugins qui déclarent chacun la leur est l'incident le plus courant que nous rencontrons en audit de site existant.

Faut-il baliser autre chose que le blog ?

Oui, et l'oubli le plus coûteux est le local. Une page de service gagne à porter Service, une fiche produit Product, une page contact ContactPage. Pour une entreprise avec une adresse physique, LocalBusiness avec adresse, horaires et téléphone reste le balisage le plus rentable : il alimente des surfaces que le contenu seul n'atteint pas.

C'est vrai surtout pour les activités à ancrage géographique, un restaurant ou une entreprise qui vise une zone de chalandise précise comme les projets que nous menons depuis Bordeaux. En e-commerce, Product renseigné avec prix, disponibilité et avis réels est le cas où le balisage a l'effet le plus direct, comme détaillé dans notre expertise e-commerce.

Le stack JSON-LD complet : code prêt à copier

Voici l'implémentation en production sur ce blog. La structure est portable sur WordPress, Webflow ou tout backend capable d'injecter un <script type="application/ld+json"> dans le <head>.

search.google.com/test/rich-results
Article

Aucune erreur, 0 avertissement

Valide
BreadcrumbList

Accueil, Blog, Article

3 éléments
FAQPage

Support retiré en juin 2026

Non testé
Ce que l'outil affiche sur un article correctement balisé depuis juin 2026 : FAQPage n'y figure plus.

Schema Article et Person imbriqué

{
  "@context": "https://schema.org",
  "@type": "Article",
  "@id": "https://votre-site.com/blog/slug#article",
  "headline": "Titre exact de l'article",
  "description": "Meta description 140-160 caractères",
  "image": "https://votre-site.com/blog/cover.jpg",
  "datePublished": "2026-04-27",
  "dateModified": "2026-07-21",
  "inLanguage": "fr-FR",
  "articleSection": "SEO",
  "author": {
    "@type": "Person",
    "@id": "https://votre-site.com/auteurs/slug#person",
    "name": "Prénom Nom",
    "jobTitle": "Fondateur",
    "url": "https://votre-site.com/auteurs/slug",
    "sameAs": [
      "https://www.linkedin.com/in/slug/",
      "https://github.com/slug"
    ],
    "worksFor": { "@id": "https://votre-site.com/#organization" }
  },
  "publisher": { "@id": "https://votre-site.com/#organization" },
  "mainEntityOfPage": { "@id": "https://votre-site.com/blog/slug" }
}

Trois propriétés méritent une attention particulière, non parce qu'elles déclencheraient une citation, mais parce qu'on les rate le plus : sameAs sur l'auteur, image en paysage 1200 × 630, et dateModified réel. Une date avancée sans modification est un mensonge machine que Google recoupe avec son historique de crawl.

Schema FAQPage

{
  "@context": "https://schema.org",
  "@type": "FAQPage",
  "mainEntity": [
    {
      "@type": "Question",
      "name": "Quelle est la question ?",
      "acceptedAnswer": {
        "@type": "Answer",
        "text": "Réponse complète de 40 à 80 mots, lisible hors contexte."
      }
    }
  ]
}

À placer uniquement sur les pages qui contiennent réellement la FAQ dans le HTML visible. Les règles générales de Google sur les données structurées l'écrivent sans ambiguïté : ne balisez pas de contenu invisible pour le lecteur. Une violation coûte l'éligibilité aux rich results et peut valoir une action manuelle, mais elle n'affecte pas le classement en recherche web classique. Cette nuance évite de paniquer pour la mauvaise raison.

Schema BreadcrumbList

{
  "@context": "https://schema.org",
  "@type": "BreadcrumbList",
  "itemListElement": [
    { "@type": "ListItem", "position": 1, "name": "Accueil", "item": "https://votre-site.com" },
    { "@type": "ListItem", "position": 2, "name": "Blog", "item": "https://votre-site.com/blog" },
    { "@type": "ListItem", "position": 3, "name": "Titre", "item": "https://votre-site.com/blog/slug" }
  ]
}

Trois niveaux suffisent pour un blog. Le fil d'ariane remplace le chemin brut sous l'URL dans le SERP. C'est un des rares rich results dont l'affichage reste largement accordé.

Schema Organization, une seule fois au layout

{
  "@context": "https://schema.org",
  "@type": "Organization",
  "@id": "https://votre-site.com/#organization",
  "name": "Nom de l'agence",
  "url": "https://votre-site.com",
  "logo": "https://votre-site.com/logo.png",
  "sameAs": [
    "https://www.linkedin.com/company/votre-agence",
    "https://github.com/votre-agence"
  ]
}

Cette balise est référencée par chaque Article via publisher et chaque Person via worksFor. Le graphe tient même si un moteur ne crawle qu'une page sur dix. C'est le principe que nous appliquons sur tous les projets de développement de site web.

Générique ou attribute-rich : où se joue la différence ?

Elle tient à quatre ou cinq propriétés réellement remplies, pas au nombre de types déclarés. Huit types vides transmettent moins d'information que trois types complets.

Ce qui ne sert plus

  • Article sans author identifié, ou avec author.name à « L'équipe » sans page dédiée.
  • Person sans sameAs, ou avec un seul lien LinkedIn dont le profil ne mentionne pas l'entreprise.
  • FAQPage générée automatiquement, avec des questions copiées ailleurs ou absentes du HTML visible.
  • dateModified avancé chaque semaine sans modification réelle du contenu.
  • Image OG en format carré au lieu du 1200 × 630 attendu.

À faire à la place

  • Author avec @id stable vers la page auteur, jobTitle exact, knowsAbout de 3 à 5 sujets.
  • Person.sameAs avec LinkedIn, GitHub si développeur, site perso. Minimum deux liens vivants.
  • FAQPage uniquement avec les questions présentes dans le HTML, formulées comme de vraies requêtes.
  • dateModified bumpé sur modification substantielle seulement : nouvelle donnée, nouvelle section, correction.
  • Image OG en 1200 × 630 JPG ou WebP, sous 200 ko, déclarée dans Article.image.

Quand remplir une propriété dessert

Une valeur approximative est pire qu'une propriété absente. Un aggregateRating calculé sur trois avis internes, un knowsAbout de quinze sujets dont douze ne sont traités nulle part : la contradiction est détectable. Une propriété se renseigne si sa valeur est vérifiable sur la page.

La contradiction silencieuse entre le schema et la page

Le piège le plus fréquent n'est pas l'erreur de syntaxe, c'est la dérive. Le titre change, le headline reste. L'auteur part, le jobTitle reste. Le prix baisse en base, le Product garde l'ancien. Rien ne casse, aucun outil ne signale l'écart, et le balisage raconte une autre histoire que la page.

La parade est architecturale : le JSON-LD doit être généré depuis les mêmes données que le rendu HTML, jamais saisi à la main en parallèle. C'est le raisonnement qui guide notre travail de maintenance et de croissance continue.

Que reste-t-il de FAQPage depuis mai 2026 ?

Le rich result FAQ est mort, le markup reste utile. Google a cessé d'afficher les FAQ en accordéon le 7 mai 2026, retiré le rapport dédié et le support dans le Rich Results Test en juin 2026, et coupe le support dans l'API Search Console en août 2026. La documentation du rich result a été retirée le 15 juin 2026.

Le calendrier exact de la dépréciation

Google n'a publié ni billet de blog ni annonce formelle : une note en haut de la documentation, et l'affichage a disparu. La restriction datait d'août 2023 : pour la quasi-totalité des entreprises, le rich result FAQ était déjà invisible depuis trois ans.

DateCe qui changeCe que vous devez faire
Août 2023Affichage restreint aux sites gouvernementaux et de santéRien, l'affichage était déjà perdu pour vous
7 mai 2026Les FAQ ne s'affichent plus du tout dans Google SearchCesser de vendre l'accordéon FAQ comme un livrable
Juin 2026Rapport Search Console et support Rich Results Test retirésRetirer FAQPage des checklists de validation via cet outil
Août 2026Fin du support dans l'API Search ConsoleNettoyer les scripts de reporting qui interrogent ce type
Calendrier de la dépréciation du rich result FAQ, d'après la documentation Google et Search Engine Land.

Source : l'annonce relayée par Search Engine Land, qui cite la note de Google : « We will be dropping the FAQ search appearance, rich result report, and support in the Rich results test in June 2026. »

Faut-il retirer la balise FAQPage ?

Non. Google précise que vous pouvez la laisser, et que d'autres moteurs peuvent continuer à la traiter. Le retrait n'apporte aucun bénéfice et coûte du temps. La balise reste un type valide de schema.org, et le format question-réponse est celui que les moteurs IA reprennent le plus volontiers.

Attention

Ne promettez plus d'accordéon FAQ dans les résultats Google : il n'existe plus depuis le 7 mai 2026. Si un prestataire vous le vend, il n'a pas lu la documentation qu'il facture.

Ce qui rend une FAQ citable, et ce n'est pas le JSON-LD

C'est la formulation des questions et l'autonomie des réponses. Une question rédigée comme une vraie requête, suivie d'une réponse de 40 à 80 mots lisible hors contexte, est extractible telle quelle. Retirez le JSON-LD, la réponse reste citable. Retirez la réponse, le JSON-LD ne vaut plus rien. Le même principe gouverne toute la visibilité générative, détaillé dans notre guide pour apparaître dans ChatGPT Search.

Sur les audits que nous menons, le schema est presque toujours le premier chantier proposé par le prestataire précédent, parce qu'il est visible, chiffrable et rapide à facturer. C'est aussi presque toujours celui qui change le moins de choses. Je préfère commencer par vérifier que le site est crawlable, rapide, et qu'il répond à une question précise. Le balisage vient après, et il prend une journée.

Jérémy Wagner

Jérémy Wagner

Fondateur · Odyssée

Comment déployer le stack sans casser l'existant ?

En six étapes, sur une journée de travail pour un site de taille moyenne. L'objectif n'est pas l'exhaustivité : couvrir les types critiques avec des attributs remplis, puis valider avant de fermer le ticket.

  1. 1

    Audit de l'existant

    1h
    Validez cinq pages via le Rich Results Test pour repérer les doublons d'Organization et les propriétés vides.
  2. 2

    Organization unique

    30 min
    Une seule Organization au layout racine, avec un @id stable référencé partout. Désactivez toute source concurrente.
  3. 3

    Person sur la page auteur

    1h
    name, jobTitle, sameAs vers LinkedIn au minimum, knowsAbout de 3 à 5 sujets réellement traités, photo réelle.
  4. 4

    Article sur le blog

    2h
    Imbriquez Article, Person et publisher Organization. headline exact, image 1200 × 630, dateModified réel, inLanguage.
  5. 5

    FAQPage et BreadcrumbList

    1h
    FAQPage uniquement si les questions sont dans le HTML visible. BreadcrumbList sur les pages enfants.
  6. 6

    Validation et déploiement

    30 min
    Revalidez dix pages clés, déployez, surveillez le rapport Améliorations de Search Console sept jours.

Comment valider ce que le Rich Results Test ne couvre plus

Utilisez le Schema Markup Validator de schema.org en complément : il teste la conformité au vocabulaire, pas l'éligibilité Google. Depuis juin 2026, le Rich Results Test ne remonte plus FAQPage. Une page peut afficher un rapport parfait tout en portant un FAQPage malformé.

Ajoutez un troisième contrôle, celui qui attrape les vraies régressions : un test automatisé qui extrait le JSON-LD de la page rendue et vérifie que headline correspond au <h1>, que dateModified correspond au frontmatter, et que l'@id de l'organisation est unique. Une heure à écrire, trois ans de dérive évités.

Les erreurs qui reviennent le plus en audit

Cinq symptômes expliquent la grande majorité des balisages inefficaces.

Symptôme observéCause réelleCorrection
Plusieurs entités signalées pour un même siteDeux plugins déclarent chacun leur OrganizationUne seule source de vérité, les autres désactivées
Schema valide mais aucun rich resultÉligibilité n'est pas affichage, ou contenu balisé non visibleVérifier que chaque valeur existe dans le HTML rendu
Dates du schema divergentes de l'affichageJSON-LD saisi à la main en parallèle du renduGénérer le JSON-LD depuis la source de données de la page
Auteur associé à aucune entitéauthor en texte libre au lieu d'un Person avec @idCréer la page auteur, puis la référencer par @id
Balisage absent pour certains crawlersJSON-LD injecté côté client par JavaScriptRendre le script côté serveur, dans le HTML initial
Grille de diagnostic des erreurs de balisage les plus fréquentes en audit.

Ce dernier point est le plus coûteux et le moins visible. Un JSON-LD injecté après le chargement dépend du bon vouloir du crawler à exécuter le JavaScript, ce qui est loin d'être acquis pour les robots IA. Le sujet rejoint l'accès des robots à vos pages, traité dans notre guide du robots.txt face aux bots IA, et la performance de rendu, couverte dans notre article sur les Core Web Vitals.

Comment mesurer ce que le schema vous rapporte vraiment ?

Avec trois sources, dont aucune ne mesure directement l'effet du balisage sur les citations IA. L'honnêteté sur ce point vous évite de justifier un budget par une métrique inventée.

Ce que Search Console montre, et ce qu'elle ne montre pas

Le rapport Améliorations liste les types détectés, les erreurs et les avertissements. C'est du contrôle qualité, pas de la performance. Une baisse du nombre d'éléments valides après un déploiement signale une régression : c'est ce qu'il faut surveiller les sept jours qui suivent.

Google a par ailleurs ajouté un rapport de performance dédié à ses fonctionnalités d'IA générative, mentionné dans le guide d'optimisation pour l'IA. Il donne des impressions et des clics, pas une attribution au balisage. Aucun outil ne vous dira « cette citation vient de votre sameAs ».

Le seul protocole de suivi qui fonctionne

Dix à quinze requêtes cibles, testées à date fixe tous les quinze jours sur ChatGPT, Perplexity, Gemini et Copilot. Vous relevez qui est cité et sur quelle URL. C'est fastidieux, et c'est le plus fiable aujourd'hui.

Ce suivi a un intérêt secondaire négligé : il révèle les erreurs d'identité. Quand un modèle vous attribue l'activité d'un homonyme ou vous localise dans la mauvaise ville, votre désambiguïsation a échoué. C'est le seul signal qui renvoie vraiment à un problème de schema.

Combien de temps y consacrer, et à quel coût

Une journée de mise en place, puis une heure par trimestre. Au-delà, vous optimisez un levier qui n'est pas le facteur limitant. Le balisage est une ligne modeste du budget, alignée sur les ordres de grandeur de notre grille tarifaire : l'essentiel de l'effort part sur le contenu et la performance.

Même raisonnement pour une PME qui hésite entre refaire son balisage et refaire ses pages : c'est presque toujours les pages, comme nous l'expliquons dans notre guide de la création de site web pour PME. Quand la brique manquante est un outil métier, le sujet relève du développement d'application. Un exemple de cet arbitrage sur le cas client MyBestCoaching.

Mise à jour juillet 2026 : le balisage rétrécit, l'entité reste

La liste des rich results que le schema débloque se réduit d'année en année, ce qui déplace sa vraie valeur vers un usage que Google ne peut pas déprécier : dire qui vous êtes. La disparition du FAQPage en mai 2026 n'est pas un accident isolé, c'est un point dans une tendance de fond.

Google a formalisé cette direction en simplifiant sa page de résultats et en retirant plusieurs types d'affichage enrichi, selon Google Search Central, 2025. Le HowTo, la Sitelinks Search Box et le rich result générique ont précédé le FAQPage. La leçon pour un site est nette : bâtir sa visibilité sur un affichage enrichi précis, c'est parier sur une case que Google peut retirer du jour au lendemain. Bâtir sur l'identification d'entité, via sameAs et @id, c'est investir dans le seul usage du schema qui ne dépend d'aucune fonctionnalité d'affichage. La bascule vers les réponses génératives, qui citent des entités plutôt que des positions, ne fait que renforcer cet arbitrage.

Questions fréquentes

Le schema markup est-il obligatoire pour apparaître dans les réponses IA ?

Non. Google écrit dans son guide d'optimisation pour l'IA que les données structurées ne sont pas requises pour la recherche générative, et qu'aucun balisage schema.org spécifique n'est à ajouter. Le schema garde deux utilités : désambiguïser votre entité via sameAs et @id, et rester éligible aux rich results classiques.

Quel format utiliser : JSON-LD, Microdata ou RDFa ?

JSON-LD est le format recommandé par Google et le plus simple à maintenir. Il est séparé du HTML, ce qui évite de casser le balisage en modifiant la mise en page. Microdata et RDFa restent valides mais reculent depuis 2020. Pour un nouveau site, JSON-LD est le choix par défaut.

Combien de schemas peut-on cumuler sur une seule page ?

Il n'y a pas de limite technique. Un article peut cumuler Article, Person, FAQPage, BreadcrumbList et Organization. La seule règle est de ne déclarer que des types correspondant à du contenu visible dans le HTML. Baliser du contenu invisible coûte l'éligibilité aux rich results et peut valoir une action manuelle.

Le schema FAQPage sert-il encore à quelque chose en 2026 ?

Le rich result FAQ a disparu de Google Search le 7 mai 2026, et sa documentation a été retirée le 15 juin 2026. Google précise que vous pouvez laisser le markup en place, et que d'autres moteurs peuvent continuer à le traiter. Gardez la balise, mais n'attendez plus aucun affichage en accordéon dans les résultats Google.

Comment valider mon schema markup avant de déployer ?

Utilisez le Rich Results Test de Google pour l'éligibilité aux affichages enrichis, et le Schema Markup Validator de schema.org pour la conformité au vocabulaire. Depuis juin 2026, le Rich Results Test ne teste plus FAQPage : un rapport parfait ne garantit plus ce type. Ajoutez un test automatisé qui compare le JSON-LD rendu au contenu de la page.

Faut-il un schema sur toutes les pages ou seulement sur les articles ?

Chaque type de page a son schema : Article sur le blog, Service sur les pages services, Product en e-commerce, ContactPage sur le contact. Organization et BreadcrumbList sont systématiques. Pour une entreprise avec une adresse physique, LocalBusiness avec horaires et téléphone est souvent le meilleur rapport effort sur résultat.

Un schema riche peut-il compenser un mauvais classement Google ?

Non. L'étude publiée par Marshal en février 2026 montre que la position dans le SERP reste le prédicteur dominant des citations IA, avec une baisse d'environ 24 % des chances par position perdue. Une page en position 1 est citée dans 43 % des cas contre 5 % en position 7. Le balisage accompagne un bon classement, il ne le remplace jamais.

#JSON-LD#Schema#GEO#AI Search

Découvrez notre politique éditoriale