TL;DR Google indicizza anche i PDF, ma li tratta come un formato "povero": niente dati strutturati, immagini non indicizzabili, aggiornamenti lenti. I motori AI come ChatGPT, Gemini e Perplexity premiano contenuti testuali, strutturati e leggibili senza login. La soluzione pratica è una pagina WordPress come fonte primaria, con il PDF come allegato scaricabile. Servono dati strutturati (Product, Offer, FAQPage), contenuti answer-first, prezzi aggiornati e monitoraggio delle citazioni. Risultato: un listino trovato da Google e citabile dall'IA, senza perdere la comodità del download.
Se hai un listino o un catalogo in PDF e ti stai chiedendo se basta così, la risposta breve è: il PDF va bene come documento da scaricare, ma non è il posto giusto dove far vivere i tuoi prodotti. Per essere trovato da Google e, soprattutto, per essere raccomandato dai motori di risposta AI, ti serve una pagina WordPress. In questa guida vediamo perché e come farlo passo dopo passo, senza stravolgere il tuo sito.
PDF o pagina WordPress: cosa cambia davvero per listini e cataloghi
Partiamo da un punto fermo: Google indicizza i PDF dal 2001 e ne ha centinaia di milioni nel suo indice. Quindi no, non è vero che i PDF non vengono letti. Il problema è un altro: un PDF è un formato "povero" dal punto di vista dei segnali che puoi dargli.
Ecco le differenze che contano davvero quando parliamo di listino PDF, catalogo PDF e pagina HTML.
| Elemento | Pagina WordPress (HTML) | |
|---|---|---|
| Dati strutturati (JSON-LD) | Non possibili | Product, Offer, FAQPage, Organization |
| Canonical | Solo via header HTTP | Elemento HTML, semplice da gestire |
| Immagini indicizzabili | No | Sì, con alt text |
| Link interni | Limitati, senza nofollow | Completi e controllabili |
| Aggiornamento prezzi | Richiede nuovo upload | Immediato |
| Esperienza mobile | Layout fisso, poco leggibile | Responsive |
| Tracciamento | Solo come download | GA4, Search Console, pixel dedicati |
Il punto chiave è questo: l'indicizzazione non è la stessa cosa della citabilità. Google può leggere il tuo PDF, ma non può estrarne dati strutturati, non può mostrare le tue immagini nei risultati e lo ri-visita con meno frequenza. Una pagina HTML, invece, ti dà canonical, link interni, aggiornamento immediato e la possibilità di dire ai motori esattamente cosa stai vendendo.
Per l'IA il discorso è ancora più netto, e lo vediamo tra un momento.
Perché i motori AI premiano le pagine HTML (e non i PDF)
I crawler dei modelli AI sono in forte crescita. Basti pensare che GPTBot ha registrato un aumento delle richieste di oltre il 300% in un anno, e che i bot di Perplexity e Claude seguono lo stesso trend. Questi sistemi leggono il web in modo diverso da Google: cercano contenuti testuali, strutturati e "self-contained", cioè comprensibili da soli, senza bisogno di scaricare un file o fare login.
Un PDF con layout fisso è difficile da citare. Il testo può essere selezionabile, ma la struttura è rigida, i blocchi non sono modulari e spesso il contenuto non è accessibile senza download. Ecco perché i motori di risposta tendono a preferire le pagine HTML.
Le caratteristiche che una pagina deve avere per essere "premiata":
- Answer-first: la risposta arriva subito, nelle prime righe, non dopo tre paragrafi di premessa.
- Heading chiari: H2 e H3 che seguono le domande reali degli utenti.
- Specifiche tecniche: nomi prodotto, codici, misure, materiali, tutto in modo leggibile.
- Modularità: ogni sezione ha senso anche da sola, così può essere citata singolarmente.
- Definizioni di termini: spiegare i concetti chiave aiuta i modelli a capire di cosa parli.
- Accessibilità senza login: nessun paywall, nessuna registrazione per leggere i contenuti.
Qui entra in gioco il lavoro di GEO e AEO, cioè l'ottimizzazione per i motori generativi e per le risposte. Non è una moda: è il modo in cui i tuoi contenuti diventano materiale citabile. E la buona notizia è che questo lavoro non danneggia la SEO tradizionale, anzi la rafforza.
Cosa preparare prima di iniziare
Prima di mettere mano al sito, fai un check veloce delle risorse che ti servono:
- Accesso a WordPress con permessi di modifica pagine.
- I contenuti del listino: nomi prodotto, SKU o GTIN, prezzi IVA inclusa, disponibilità.
- Un plugin SEO per gestire meta tag, sitemap e dati strutturati.
- Un account Semly per monitorare prompt e citazioni AI.
- Il PDF attuale, da usare come riferimento e come download di supporto.
Quando questa strada non è adatta. Se il documento è puramente interno, riservato o non ha alcun valore di ricerca (per esempio un listino per un singolo cliente con condizioni private), non ha senso trasformarlo in pagina pubblica. In quel caso meglio proteggerlo con password o escluderlo dall'indicizzazione.
Come trasformare un listino PDF in pagine WordPress: passo dopo passo
Passo 1 — Mappa i contenuti del PDF
Obiettivo: capire cosa stai pubblicando e come organizzarlo.
Elenca tutti i prodotti o le categorie presenti nel PDF. Poi decidi la struttura degli URL. Una buona base è qualcosa come /catalogo/, /listino/ e /prodotto/nome-prodotto/. URL chiari aiutano sia Google sia gli utenti.
Attenzione: non copiare la struttura del PDF così com'è. Il PDF è pensato per la stampa, non per la navigazione web.
Passo 2 — Crea la pagina indice del catalogo
Obiettivo: dare una "casa" a tutto il catalogo.
Crea una pagina madre con un'introduzione answer-first: in due o tre frasi spiega cosa contiene il catalogo e a chi serve. Poi aggiungi i link alle categorie o ai singoli prodotti. Qui puoi anche mettere il download del PDF come supporto, ma non come unico contenuto.
Attenzione: la pagina indice deve funzionare anche senza il PDF. Il PDF è un extra, non la fonte principale.
Passo 3 — Costruisci le pagine prodotto o voce di listino
Obiettivo: rendere ogni prodotto comprensibile e citabile.
Per ogni voce, segui questa struttura:
- Titolo chiaro con il nome del prodotto.
- Prime 2 o 3 frasi con la tesi e il dato principale (prezzo, disponibilità, caratteristica distintiva).
- Specifiche tecniche complete.
- Prezzo e disponibilità aggiornati.
- Una call to action chiara.
Per approfondire, vale la pena vedere come si costruisce una scheda prodotto ideale per i modelli AI.
Attenzione: evita di riempire la pagina con testo generico. Meglio poche informazioni precise che tanti paragrafi vuoti.
Passo 4 — Aggiungi i dati strutturati
Obiettivo: parlare ai motori nella loro lingua.
Inserisci il markup JSON-LD con Product, Offer, FAQPage e Organization. Usa GTIN e SKU corretti e indica la disponibilità con InStock quando il prodotto è disponibile. I dati strutturati sono, in pratica, il linguaggio dei fatti: senza di essi l'IA capisce la tua offerta con molta meno precisione.
Attenzione: un codice GTIN sbagliato è peggio di nessun codice. Verifica sempre che corrisponda al prodotto reale.
Passo 5 — Collega il PDF come download di supporto
Obiettivo: mantenere la comodità del download senza perdere la pagina.
Metti il link al PDF dentro la pagina HTML e indica la pagina come versione canonica. Il PDF non deve essere la fonte primaria. E non usare il file robots.txt per nasconderlo: non funziona, l'URL può comunque comparire nei risultati senza descrizione. Se vuoi escluderlo, usa noindex o una password.
Attenzione: il canonical va impostato correttamente, altrimenti rischi che Google scelga il PDF al posto della pagina.
Passo 6 — Aggiorna prezzi e disponibilità
Obiettivo: mantenere il listino sempre attuale.
Se i prezzi cambiano spesso, usa una pagina dinamica o un feed aggiornato. Aggiungi un'indicazione di versione, tipo "Attuale dal: [data]". La freschezza conta: le pagine aggiornate negli ultimi 12 mesi hanno una probabilità doppia di ricevere citazioni.
Attenzione: un prezzo obsoleto non è solo un problema di SEO, è anche un problema di conformità. Ricorda che per i consumatori il prezzo deve essere finale e IVA inclusa.
Passo 7 — Misura le citazioni AI
Obiettivo: capire se il lavoro sta funzionando.
Monitora i prompt reali dei tuoi clienti, il Citation Rate e lo Share of Voice. Con Semly puoi seguire come il tuo brand appare nelle risposte di ChatGPT, Gemini e altri modelli, vedere quali fonti vengono citate e confrontarti con i concorrenti. Il Semly Pixel ti aiuta anche a tracciare il traffico che arriva da chatgpt.com e gemini.google.com.
Attenzione: la menzione non è la stessa cosa della citazione. Essere nominati in una risposta è utile, ma solo il link alla tua pagina porta traffico reale.
Punti di controllo: come capire se stai facendo bene
Usa questa checklist per verificare il lavoro:
- La pagina è indicizzata in Google Search Console.
- I dati strutturati sono validi e senza errori.
- Il prezzo mostrato è aggiornato.
- Il PDF è scaricabile ma non è la fonte primaria.
- I prompt rilevanti sono monitorati.
Segnali tipici di problemi:
- Pagina non indicizzata: controlla canonical, noindex e sitemap.
- Dati strutturati non validi: ricontrolla il JSON-LD.
- Prezzo obsoleto: passa a un aggiornamento dinamico.
- Il PDF è ancora in cima ai risultati: rafforza la pagina HTML e imposta il canonical.
Errori più comuni e come rimediare
- Usare robots.txt per nascondere un PDF. Non funziona. Usa noindex o una password.
- Lasciare il PDF come unica fonte. Crea una pagina HTML e indica quella come canonica.
- Dimenticare i dati strutturati. Aggiungi JSON-LD con Product, Offer e FAQPage.
- Prezzi non aggiornati. Passa a un aggiornamento dinamico o a un feed.
- Nessun monitoraggio. Attiva il controllo di prompt e citazioni per capire cosa succede davvero.
Co dalej: varianti e prossimi passi
Quando il catalogo principale è online, puoi ampliare il lavoro:
- Feed Google Shopping XML per portare i prodotti anche nei canali commerciali.
- llms.txt come indice curato delle tue pagine listino, utile ai modelli per orientarsi.
- FAQ su "come scegliere" per intercettare le domande in fase di decisione.
- Estensione ad altri cataloghi, come listini tecnici o schede di servizi.
Quando scegliere una strada diversa. Se il catalogo è pensato solo per la stampa o per un uso puramente offline, non serve trasformarlo in pagine web. In quel caso resta un documento, e va bene così.
Trasformare un listino PDF in pagine WordPress non è un lavoro complicato, ma richiede metodo. La pagina HTML diventa la tua fonte primaria, il PDF resta il tuo alleato per il download, e con i dati strutturati e il monitoraggio delle citazioni costruisci una visibilità che vale sia per Google sia per i motori AI. Con Semly puoi tenere sotto controllo tutto questo in un unico posto, così sai sempre se il tuo catalogo viene trovato e, soprattutto, se viene raccomandato.