SpeakableSpecification: rendere il sito leggibile da voce e intelligenza artificiale

Cos’è la SpeakableSpecification e perché il nome è meno complicato di quanto sembri

SpeakableSpecification è un tipo di markup strutturato, definito dal vocabolario schema.org, che indica a un motore di ricerca o a un assistente vocale quali parti di una pagina sono adatte a essere lette ad alta voce. In pratica è un’etichetta che dice: “questo paragrafo, questo titolo, questa sintesi puoi leggerla così com’è, senza fraintendimenti”. Non è un widget da installare né un plugin: è codice che si aggiunge all’HTML della pagina, invisibile all’utente ma perfettamente leggibile dalle macchine.

Perché oggi conta più di ieri

Fino a qualche anno fa la SpeakableSpecification serviva quasi solo per gli smart speaker: Google Assistant o dispositivi simili che leggevano ad alta voce le notizie del giorno. Oggi lo scenario è cambiato. I motori di ricerca generano sempre più risposte sintetiche tramite intelligenza artificiale, e gli assistenti AI leggono, riassumono e citano contenuti dai siti web per costruire le loro risposte. Un contenuto ben marcato con Speakable ha più probabilità di essere estratto in modo corretto, perché il sistema sa esattamente quale porzione di testo rappresenta la risposta pulita e quale invece è solo contorno (menu, sidebar, pubblicità).

Chi viene citato dentro una risposta generata dall’intelligenza artificiale non ottiene solo visibilità simbolica: i marchi citati registrano un traffico organico e a pagamento sensibilmente più alto rispetto a chi non viene mai menzionato. La struttura del contenuto, quindi, non è più un dettaglio tecnico per addetti ai lavori: è una leva concreta per farsi notare, sia dalle persone sia dai sistemi che rispondono al posto loro.

Come si applica concretamente su un sito

Tecnicamente, la SpeakableSpecification si inserisce nel markup JSON-LD già presente (o da aggiungere) nella pagina, indicando tramite selettori CSS o XPath quali blocchi di testo sono “parlabili”: tipicamente il titolo, il sommario o le prime righe di un articolo. Non basta scriverla a caso: il testo indicato deve essere davvero autosufficiente, chiaro se letto fuori contesto, senza rimandi tipo “come vedi qui sotto” o “clicca per approfondire”, frasi che hanno senso solo se lette a schermo.

Questo obbliga a un lavoro editoriale preciso: frasi brevi, sintesi vere nei primi paragrafi, struttura logica che risponda subito alla domanda dell’utente. È lo stesso principio che rende un contenuto leggibile e ordinato per un lettore umano distratto: chi scrive bene per la voce, in realtà, scrive meglio anche per lo schermo.

Gli errori più comuni quando si prova a implementarla

Il primo errore è marcare blocchi di testo troppo lunghi o pieni di elenchi puntati, che una sintesi vocale legge in modo confuso. Il secondo è dimenticare di aggiornare il markup quando cambia il contenuto della pagina, lasciando indicazioni che puntano a testo non più esistente. Il terzo, più insidioso, è inserire la specifica su un sito che ha già problemi strutturali di base: markup mancante, HTML disordinato, tempi di caricamento lenti. In quel caso il piccolo intervento sulla lettura vocale non basta, perché il problema è a monte.

Da dove partire, senza inventarsi tecnico da soli

Prima di aggiungere una specifica come questa, ha senso capire in che condizioni si trova davvero il sito: markup strutturato esistente, velocità, accessibilità, coerenza dei contenuti. È esattamente quello che verifica il check-up completo del sito di Sempoint, un’analisi che fotografa lo stato tecnico e SEO della pagina e indica dove intervenire prima di aggiungere nuovi livelli di ottimizzazione come lo Speakable.

Un sito ben marcato, oltre a farsi leggere meglio dagli assistenti vocali, comunica anche in modo più coerente con le regole di accessibilità: la stessa cura che serve per il markup vocale è alla base del kit digitale WCAG 2.1 AA pensato da Sempoint per le aziende che devono mettersi in regola con l’accessibilità digitale, obbligatoria per molte imprese dal 2025. Non sono due mondi separati: un contenuto chiaro, ben strutturato e leggibile da una sintesi vocale è, quasi sempre, anche un contenuto più accessibile per le persone.

In sintesi

La SpeakableSpecification non è una moda passeggera legata agli smart speaker: è un tassello di come oggi i sistemi automatici leggono, capiscono e citano i contenuti dei siti web. Prima di implementarla conviene però avere un sito già solido su struttura, velocità e accessibilità. Un check-up tecnico è il primo passo concreto per sapere da dove cominciare, senza tirare a indovinare.

Dal blog

Sempoint 2

Questo sito usa Cookie di Analytics per raccogliere dati in forma aggregata e cookie di terze parti per migliorare l'esperienza utente. Generalmente i servizi non rilasciano cookie a meno che l'utente non usi espressamente il servizio