Le Speakable Schema est un balisage structuré Schema.org qui indique à Google les sections d'un contenu adaptées à la lecture vocale par les assistants intelligents. Avec 27% des recherches mobiles vocales en 2024 (Google), les pages balisées voient leur temps de session augmenter de 15 à 25% et génèrent +18% de trafic assistant (Voicebot.ai, 2024).
Le Speakable Schema utilise la propriété speakable de Schema.org (introduite en 2019, supportée par Google depuis 2023) pour marquer les passages d'un article qui peuvent être lus à voix haute par Google Assistant, Alexa, ou Siri. Ces passages doivent être cohérents hors contexte visuel (pas de « comme indiqué dans le graphique ci-dessus »), concis (2-3 phrases idéales), et informatifs (réponse directe à une question). Le balisage s'applique aux types Article et WebPage via JSON-LD.
Les assistants vocaux extraient ces passages pour répondre aux requêtes « OK Google, qu'est-ce que le référencement naturel ? ». Une page avec Speakable Schema a 3,5x plus de chances d'être sélectionnée comme source vocale qu'une page sans balisage (Google, 2024). Le marché des assistants vocaux atteindra 8,4 milliards de dollars en 2025 (Statista), rendant le Speakable Schema stratégique pour la visibilité future.
Le Speakable Schema, c'est comme les passages surlignés en jaune dans un manuel scolaire. L'enseignant ne lit pas tout le chapitre à voix haute : il lit seulement les passages surlignés, ceux qui résument l'essentiel. Google Assistant fait pareil : il ne lit pas votre article de 1 500 mots — il lit les 2-3 phrases que vous avez marquées comme « dignes d'être dites à voix haute ».
Les passages speakables doivent répondre à trois critères : autonomie sémantique (compréhensible sans image/tableau), concision (30-50 mots, 2-3 phrases), et valeur informative (réponse directe à une question fréquente). Les sections éligibles sont : les introductions de paragraphes, les définitions, les listes à puces structurées, et les conclusions. Une page doit contenir 3 à 8 passages speakables pour couvrir les requêtes vocales les plus fréquentes sans surcharger le balisage.
La redaction vocale diffère de l'écriture web : phrases courtes (15-20 mots), vocabulaire simple (Flesch-Kincaid <60), pas de jargon technique non expliqué, pas de références visuelles (« voir ci-dessus »), et CTA adaptés à la voix (« Visitez notre site pour en savoir plus »). Les réponses vocales idéales font 29 mots en moyenne (Google, 2024). Un passage avec >50 mots a 60% moins de chances d'être sélectionné par l'assistant.
Le balisage utilise Schema.org/Article avec la propriété speakable pointant vers des sélecteurs CSS ou des IDs HTML. Exemple : { "@type": "Article", "speakable": { "@type": "SpeakableSpecification", "cssSelector": [".speakable-intro", ".speakable-conclusion"] } }. Après implémentation, la validation se fait via le Rich Results Test de Google et le Schema Markup Validator. Une erreur courante : marquer des passages contenant des données tabulaires ou des références d'images, ce qui rend la réponse vocale incompréhensible.
Un site de recettes de cuisine implémente le Speakable Schema sur 150 articles. Avant : les utilisateurs vocaux demandaient « Comment faire une béchamel ? » et Google lisait un extrait de 180 mots avec des références aux images des étapes. Après Speakable Schema : 3 passages balisés par recette (intro, étapes clés, conseil final) de 25-35 mots chacun. Résultats en 3 mois : +340% de trafic depuis Google Assistant, +22% de temps de session sur mobile, 18 recettes en position « réponse vocale privilégiée », et +15% de partages sociaux.
| Métrique | Définition | Valeur référence |
|---|---|---|
| % recherches vocales | Proportion de recherches effectuées par voix | 27% (mobile 2024), 50% (prévu 2027) |
| Longueur passage speakable | Nombre de mots dans un passage balisé | 25-35 mots (optimal), <50 (maximum) |
| Trafic assistant | % de visites provenant d'assistants vocaux | +18% (avec balisage vs sans) |
| Passages balisés par page | Nombre de sections speakables marquées | 3-8 (optimal), >10 (surcharge) |
| Score Flesch-Kincaid vocal | Indice de lisibilité pour la lecture à voix haute | < 60 (facile), 60-70 (standard) |