{"id":7203,"date":"2026-07-09T11:08:00","date_gmt":"2026-07-09T09:08:00","guid":{"rendered":"https:\/\/rafaelpatron.com\/blog\/?p=7203"},"modified":"2026-07-09T11:08:00","modified_gmt":"2026-07-09T09:08:00","slug":"audit-tecnico-ai-sito-web","status":"publish","type":"post","link":"https:\/\/rafaelpatron.com\/blog\/seo\/audit-tecnico-ai-sito-web\/","title":{"rendered":"Audit tecnico AI di un sito: workflow operativo in 12 punti"},"content":{"rendered":"<p>Un sito che ranka su Google pu\u00f2 essere completamente invisibile a ChatGPT, Perplexity e Claude. Misurare la presenza nei chatbot e ottimizzare la lettura da parte dei crawler AI richiede un audit tecnico diverso dalla SEO tradizionale.<\/p>\n<p>Non \u00e8 una SEO 2.0. \u00c8 un esercizio parallelo, con priorit\u00e0 diverse, tool diversi, KPI diversi.<\/p>\n<p>Faccio audit tecnici AI da circa diciotto mesi su clienti di vari settori. I problemi che trovo sono molto ricorrenti. La checklist che segue copre il 90 per cento dei casi reali in cui un sito perde citazioni AI per ragioni tecniche risolvibili.<\/p>\n<div id=\"ez-toc-container\" class=\"ez-toc-v2_0_86 counter-flat ez-toc-counter ez-toc-grey ez-toc-container-direction\">\n<div class=\"ez-toc-title-container\">\n<p class=\"ez-toc-title\" style=\"cursor:inherit\">Indice dei contenuti<\/p>\n<span class=\"ez-toc-title-toggle\"><a href=\"#\" class=\"ez-toc-pull-right ez-toc-btn ez-toc-btn-xs ez-toc-btn-default ez-toc-toggle\" aria-label=\"Toggle Table of Content\"><span class=\"ez-toc-js-icon-con\"><span class=\"\"><span class=\"eztoc-hide\" style=\"display:none;\">Toggle<\/span><span class=\"ez-toc-icon-toggle-span\"><svg style=\"fill: #999;color:#999\" xmlns=\"http:\/\/www.w3.org\/2000\/svg\" class=\"list-377408\" width=\"20px\" height=\"20px\" viewBox=\"0 0 24 24\" fill=\"none\"><path d=\"M6 6H4v2h2V6zm14 0H8v2h12V6zM4 11h2v2H4v-2zm16 0H8v2h12v-2zM4 16h2v2H4v-2zm16 0H8v2h12v-2z\" fill=\"currentColor\"><\/path><\/svg><svg style=\"fill: #999;color:#999\" class=\"arrow-unsorted-368013\" xmlns=\"http:\/\/www.w3.org\/2000\/svg\" width=\"10px\" height=\"10px\" viewBox=\"0 0 24 24\" version=\"1.2\" baseProfile=\"tiny\"><path d=\"M18.2 9.3l-6.2-6.3-6.2 6.3c-.2.2-.3.4-.3.7s.1.5.3.7c.2.2.4.3.7.3h11c.3 0 .5-.1.7-.3.2-.2.3-.5.3-.7s-.1-.5-.3-.7zM5.8 14.7l6.2 6.3 6.2-6.3c.2-.2.3-.5.3-.7s-.1-.5-.3-.7c-.2-.2-.4-.3-.7-.3h-11c-.3 0-.5.1-.7.3-.2.2-.3.5-.3.7s.1.5.3.7z\"\/><\/svg><\/span><\/span><\/span><\/a><\/span><\/div>\n<nav><ul class='ez-toc-list ez-toc-list-level-1 ' ><li class='ez-toc-page-1'><a class=\"ez-toc-link ez-toc-heading-1\" href=\"https:\/\/rafaelpatron.com\/blog\/seo\/audit-tecnico-ai-sito-web\/#perche-serve-un-audit-specifico-per-le-ai\" >Perch\u00e9 serve un audit specifico per le AI<\/a><\/li><li class='ez-toc-page-1'><a class=\"ez-toc-link ez-toc-heading-2\" href=\"https:\/\/rafaelpatron.com\/blog\/seo\/audit-tecnico-ai-sito-web\/#la-checklist-in-dodici-punti\" >La checklist in dodici punti<\/a><\/li><li class='ez-toc-page-1'><a class=\"ez-toc-link ez-toc-heading-3\" href=\"https:\/\/rafaelpatron.com\/blog\/seo\/audit-tecnico-ai-sito-web\/#robotstxt-il-punto-numero-uno-per-ragione\" >Robots.txt, il punto numero uno per ragione<\/a><\/li><li class='ez-toc-page-1'><a class=\"ez-toc-link ez-toc-heading-4\" href=\"https:\/\/rafaelpatron.com\/blog\/seo\/audit-tecnico-ai-sito-web\/#server-side-rendering-lostacolo-invisibile\" >Server-side rendering, l&#8217;ostacolo invisibile<\/a><\/li><li class='ez-toc-page-1'><a class=\"ez-toc-link ez-toc-heading-5\" href=\"https:\/\/rafaelpatron.com\/blog\/seo\/audit-tecnico-ai-sito-web\/#log-server-il-punto-che-pochi-guardano\" >Log server, il punto che pochi guardano<\/a><\/li><li class='ez-toc-page-1'><a class=\"ez-toc-link ez-toc-heading-6\" href=\"https:\/\/rafaelpatron.com\/blog\/seo\/audit-tecnico-ai-sito-web\/#cadenza-e-ownership-dellaudit\" >Cadenza e ownership dell&#8217;audit<\/a><\/li><\/ul><\/nav><\/div>\n<h2><span class=\"ez-toc-section\" id=\"perche-serve-un-audit-specifico-per-le-ai\"><\/span>Perch\u00e9 serve un audit specifico per le AI<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>Una SEO audit tradizionale guarda crawlability, indicizzazione, segnali on-page, struttura, performance, backlink. Un audit AI guarda alcune di queste cose con priorit\u00e0 diverse, e aggiunge dimensioni nuove.<\/p>\n<p>Le dimensioni nuove: comportamento dei crawler AI specifici (GPTBot, ClaudeBot, PerplexityBot, Applebot-Extended), citazioni del sito nelle risposte chatbot, presenza nei dataset di training pubblici (Common Crawl, C4, RefinedWeb), leggibilit\u00e0 del contenuto senza JavaScript renderizzato, qualit\u00e0 degli structured data destinati agli LLM.<\/p>\n<p>Le priorit\u00e0 riviste: structured data prima della velocit\u00e0, authorship prima del backlink, contenuto in chiaro prima del design. Le tre cose che pesano di pi\u00f9 in audit AI sono quelle che pesano di meno in audit SEO classico.<\/p>\n<p>Niente di questo annulla la SEO classica. La integra. Un sito mal indicizzato su Google difficilmente verr\u00e0 letto bene da ChatGPT, perch\u00e9 molti modelli usano Common Crawl che \u00e8 correlato alla scopribilit\u00e0 Google. Quindi prima si sistema la <a href=\"https:\/\/rafaelpatron.com\/blog\/seo\/seo-on-page-fattori-ranking\/\">base SEO classica<\/a>, poi si aggiunge il layer AI.<\/p>\n<h2><span class=\"ez-toc-section\" id=\"la-checklist-in-dodici-punti\"><\/span>La checklist in dodici punti<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>I dodici passaggi, da eseguire in sequenza la prima volta e poi in ciclo trimestrale:<\/p>\n<ul>\n<li><strong>Robots.txt e politiche crawler AI<\/strong>. Verificare che GPTBot, ClaudeBot (Claude-Web e ClaudeBot), PerplexityBot, Applebot-Extended, Google-Extended, CCBot non siano bloccati per errore. Molti siti hanno robots.txt copiati da template del 2022 che escludono questi user agent senza intenzione. Verificare anche se ci sono direttive contraddittorie. Bloccare il crawler equivale a sparire dai chatbot in 6-12 mesi.<\/li>\n<li><strong>Sitemap XML aggiornata e referenziata<\/strong>. Sitemap che include tutti gli URL canonici, freschi, accessibili (codice 200). Referenziata nel robots.txt e dichiarata in Search Console. I crawler AI usano la sitemap come scorciatoia di discovery quando l&#8217;inferenza link-by-link costa troppo.<\/li>\n<li><strong>Server-side rendering verificato<\/strong>. Aprire una pagina pillar con JavaScript disabilitato. Il contenuto principale deve essere visibile. Se il sito \u00e8 una single-page app (React, Vue, Angular) senza SSR o pre-rendering, gli LLM vedono pagine vuote. Soluzioni: SSR nativo, static generation, o un servizio tipo Prerender.io per le pagine pubbliche.<\/li>\n<li><strong>Schema.org Article\/BlogPosting su tutti i pillar<\/strong>. JSON-LD nel head, validato con Rich Results Test. Author come Person con sameAs ricco. Organization come publisher con dati verificabili. datePublished e dateModified distinte e accurate.<\/li>\n<li><strong>Page autore popolata<\/strong>. Ogni autore citato negli Article markup deve avere una pagina dedicata, indicizzata, con biografia reale, foto, link a profili esterni, elenco articoli scritti. Senza pagina autore, il Person markup nell&#8217;Article \u00e8 un&#8217;asserzione non verificabile per gli LLM.<\/li>\n<li><strong>About e contatti trasparenti<\/strong>. Pagina \/chi-siamo\/ con sede legale, codice fiscale, contatti email reali (non solo form), profilo del team se applicabile. Per gli LLM \u00e8 un segnale di Trustworthiness. Per Google idem. Per gli utenti che fanno due ricerche prima di comprare, ancora pi\u00f9 importante.<\/li>\n<li><strong>Hreflang e lingue<\/strong>. Se il sito esiste in pi\u00f9 lingue, hreflang configurato correttamente, ogni versione linguistica con sua URL pulita, structured data nella lingua corretta. Gli LLM trattano le versioni linguistiche come asset distinti e premiano la coerenza di marcatura.<\/li>\n<li><strong>Velocit\u00e0 e Core Web Vitals<\/strong>. PageSpeed Insights pulito (LCP sotto 2,5 secondi, CLS sotto 0,1, INP sotto 200 ms). Conta meno per le AI rispetto a Google ranking, ma siti lenti vengono crawlati meno spesso anche dai bot AI, e quindi aggiornano meno il loro contenuto nei dataset.<\/li>\n<li><strong>HTTPS, HTTP\/2 o HTTP\/3<\/strong>. Certificato valido, redirect 301 da HTTP a HTTPS, da www a non-www (o viceversa) consistente. HTTP\/2 minimo, HTTP\/3 dove possibile. I bot AI moderni privilegiano connessioni pi\u00f9 rapide.<\/li>\n<li><strong>Monitoring citazioni nei chatbot<\/strong>. Configurazione di Otterly.ai o Profound (vedi anche il pezzo sul <a href=\"https:\/\/rafaelpatron.com\/blog\/ai\/chatgpt-marketing-aziende-italiane\/\">monitoraggio AI per aziende<\/a>) con un set di 20-30 prompt rilevanti per il settore. Misurazione settimanale. Senza questo monitoring, sei cieco su met\u00e0 dei segnali che contano.<\/li>\n<li><strong>Test manuale prompt su tre chatbot<\/strong>. Mensilmente, testare manualmente 5-10 prompt ad alto valore commerciale su ChatGPT, Perplexity e Gemini. Osservare quali fonti vengono citate. \u00c8 informazione qualitativa che Otterly non cattura nello stesso modo: il contesto della risposta, il tono delle citazioni, la posizione del tuo brand nella narrazione AI.<\/li>\n<li><strong>Log server analisi crawler AI<\/strong>. Estrarre dai log server le richieste di GPTBot, ClaudeBot, PerplexityBot degli ultimi 30 giorni. Quante volte hanno crawlato, quali URL, con quale codice di risposta. Se vedi solo errori 404 o 500 sulle pagine pillar, hai un problema tecnico. Se non vedi traffico crawler AI per niente, c&#8217;\u00e8 un problema pi\u00f9 grave da indagare a monte.<\/li>\n<\/ul>\n<p>Dodici punti. Tre ore di lavoro per un audit completo su un sito medio. Sei ore se il sito \u00e8 grande. Un giorno se ci sono problemi strutturali profondi da analizzare.<\/p>\n<h2><span class=\"ez-toc-section\" id=\"robotstxt-il-punto-numero-uno-per-ragione\"><\/span>Robots.txt, il punto numero uno per ragione<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>Tra i dodici passaggi, il primo \u00e8 anche quello dove ho trovato pi\u00f9 sorprese nei miei audit. Dei venti siti italiani che ho controllato nel 2025, otto avevano almeno un crawler AI bloccato per errore nel robots.txt.<\/p>\n<p>Gli scenari tipici: un consulente SEO ha aggiunto Disallow per GPTBot per &#8220;proteggere i contenuti dall&#8217;addestramento&#8221; senza chiedere al cliente. Un developer ha copiato un robots.txt da un blog di Stack Overflow del 2023. Un&#8217;agenzia ha messo in produzione una configurazione di test che bloccava tutti i bot AI. In nessuno di questi casi la scelta era stata consapevole e strategica.<\/p>\n<p>La domanda da fare al cliente prima di procedere: &#8220;Vuoi essere citato nei chatbot AI?&#8221;. Se la risposta \u00e8 s\u00ec, niente Disallow su GPTBot, ClaudeBot, PerplexityBot e Google-Extended. Se la risposta \u00e8 no (caso legittimo per alcuni publisher con paywall e accordi commerciali separati), allora Disallow esplicito e consapevole, documentato.<\/p>\n<p>Una distinzione operativa che vale la pena conoscere. Esistono due tipi di crawler AI: quelli che alimentano direttamente le risposte in tempo reale (ChatGPT-User, Claude-Web, PerplexityBot) e quelli che raccolgono dati per training futuro (GPTBot, ClaudeBot, Google-Extended, CCBot). Hanno trattamenti diversi nelle policy AI di alcune testate. Se un publisher non vuole che il suo contenuto entri nei dataset di training ma vuole essere citato in tempo reale, pu\u00f2 bloccare i secondi e permettere i primi. \u00c8 una scelta che richiede consapevolezza, non un copia-incolla.<\/p>\n<h2><span class=\"ez-toc-section\" id=\"server-side-rendering-lostacolo-invisibile\"><\/span>Server-side rendering, l&#8217;ostacolo invisibile<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>Il punto tre della checklist \u00e8 quello dove i siti moderni perdono di pi\u00f9. React, Next.js senza SSR configurato, Vue senza Nuxt, applicazioni single-page con routing client-side: tutto questo produce pagine che gli LLM leggono parzialmente o per niente.<\/p>\n<p>Verifica concreta in due minuti: aprire una pagina pillar in Chrome, F12, scheda Network, filtrare per &#8220;Doc&#8221;, ricaricare. Cliccare sulla prima richiesta, andare nella scheda Response. Quello che si vede l\u00ec \u00e8 (pi\u00f9 o meno) quello che vede un crawler senza JavaScript. Se il contenuto principale dell&#8217;articolo non c&#8217;\u00e8, hai un problema.<\/p>\n<p>Soluzioni in ordine di costo crescente. Pre-rendering statico per le pagine pubbliche tramite Next.js export, Nuxt static, Gatsby. Servizio terzo tipo Prerender.io che intercetta i bot e serve loro l&#8217;HTML renderizzato. Migrazione a SSR completo, che richiede settimane di lavoro per riarchitettare il routing e la gestione stato.<\/p>\n<h2><span class=\"ez-toc-section\" id=\"log-server-il-punto-che-pochi-guardano\"><\/span>Log server, il punto che pochi guardano<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>Il punto dodici, analisi log server, \u00e8 quello che d\u00e0 pi\u00f9 informazione a chi sa leggerla. \u00c8 anche quello che pochi fanno perch\u00e9 richiede accesso ai log raw del server, che non sempre l&#8217;agenzia o il consulente esterno ha.<\/p>\n<p>Cosa cercare nei log. User-agent dei bot AI noti (lista aggiornata su Anthropic, OpenAI, Google docs). Numero di hit settimanali per ogni bot. URL pi\u00f9 crawlati. Codici di risposta (qualsiasi cosa diversa da 200 \u00e8 da indagare). Distribuzione temporale (alcuni bot crawlano in burst, altri in modo continuo).<\/p>\n<p>Un caso reale. Cliente nel B2B SaaS, fatturato 4 milioni, blog con 80 articoli. Audit log ha rivelato che GPTBot crawlava regolarmente, ma ClaudeBot non era mai passato in tre mesi. Causa: regola firewall sul reverse proxy che bloccava IP range Anthropic come &#8220;traffico anomalo&#8221;. Risolto in due ore. Nei tre mesi successivi le citazioni del cliente in Claude sono cresciute da zero a sette su un set di 30 prompt monitorati.<\/p>\n<p>Questo tipo di problema \u00e8 invisibile dall&#8217;esterno e non lo trovi senza guardare i log. \u00c8 il valore vero di un audit fatto bene rispetto a un check superficiale.<\/p>\n<p>Secondo caso reale, di gennaio 2026. Cliente nel settore healthcare, presenza nazionale. Audit log mostra GPTBot che crawla regolarmente ma sempre con codice 403 sulle pagine pillar mediche. Causa: il WAF aveva una regola che bloccava user agent non standard sulle URL contenenti &#8220;diagnosi&#8221;, &#8220;sintomi&#8221; o &#8220;patologia&#8221;, come protezione anti-bot generica del 2021. Lista di parole costruita prima che esistessero crawler AI legittimi. Risolto whitelisting esplicito degli user agent AI noti. Sei settimane dopo, le citazioni del sito in ChatGPT su domande mediche sono passate da casuali a sistematiche.<\/p>\n<p>Pattern ricorrente: configurazioni di sicurezza datate che fanno collateral damage sui crawler AI senza che nessuno se ne accorga. WAF, anti-bot, CDN con regole troppo aggressive, geolocation block. Ognuna di queste pu\u00f2 bloccare crawler legittimi e nessuna lo segnala nelle dashboard di marketing. Solo i log lo mostrano.<\/p>\n<h2><span class=\"ez-toc-section\" id=\"cadenza-e-ownership-dellaudit\"><\/span>Cadenza e ownership dell&#8217;audit<span class=\"ez-toc-section-end\"><\/span><\/h2>\n<p>L&#8217;audit completo va eseguito una volta a setup, poi una volta a trimestre. I primi tre-quattro punti (robots.txt, sitemap, SSR, structured data) vanno controllati anche dopo ogni release importante del sito o dopo migrazioni infrastrutturali.<\/p>\n<p>Ownership tecnica: deve essere chiaro chi \u00e8 responsabile. In aziende strutturate, il SEO Manager con supporto del Dev Lead. In PMI, il consulente SEO esterno con accesso ai log. In freelance, il professionista stesso che gestisce sito e contenuti.<\/p>\n<p>Senza ownership chiara, l&#8217;audit viene fatto una volta e poi dimenticato. Sei mesi dopo, una migrazione cambia il robots.txt e nessuno se ne accorge. L&#8217;audit non \u00e8 un evento, \u00e8 una pratica trimestrale documentata.<\/p>\n<p>Una distinzione utile tra audit e monitoring. L&#8217;audit \u00e8 il check trimestrale strutturato sui dodici punti. Il monitoring \u00e8 il segnale di allarme continuo: tracciare giornalmente robots.txt change (con strumenti tipo ChangeTower o un semplice cron job che diffa il file), errori 5xx in Search Console, calo brusco delle citazioni in Otterly. Audit pi\u00f9 monitoring insieme coprono lo spettro: il monitoring intercetta i problemi acuti, l&#8217;audit intercetta i problemi cronici. Solo uno dei due non basta.<\/p>\n<p>Per chi vuole strutturare questo lavoro come servizio o per chi cerca un confronto operativo, <a href=\"https:\/\/aipia.it\/\">AIPIA<\/a> raccoglie professionisti che fanno audit AI come parte della loro offerta consulenziale, e che condividono benchmark, template e casi reali nelle attivit\u00e0 della community. \u00c8 il modo pi\u00f9 rapido per evitare di rifare errori che altri hanno gi\u00e0 fatto.<\/p>\n<p>Un sito che fa audit AI ogni tre mesi nel 2026 mantiene una visibilit\u00e0 nei chatbot stabile e crescente. Un sito che lo fa una volta e poi dimentica regredisce in sei-dodici mesi senza accorgersene. La SEO tecnica AI-ready non \u00e8 uno stato, \u00e8 un processo. Trattatela come tale.<\/p>\n","protected":false},"excerpt":{"rendered":"<p>Checklist operativa in 12 punti per un audit tecnico AI di un sito: robots.txt, sitemap, SSR, structured data, log server, monitoring chatbot e casi reali risolti.<\/p>\n","protected":false},"author":10,"featured_media":3359,"comment_status":"","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"_wds_title":"Audit AI sito web: workflow operativo in 12 punti","_wds_metadesc":"Audit tecnico AI di un sito in 12 step: robots.txt, SSR, structured data, log server, monitoring chatbot. Workflow operativo e casi reali.","_wds_focus-keywords":"audit ai sito web","_wds_canonical":"","wds_primary_category":0,"footnotes":"","_wds_robots-noindex":"0","_wds_robots-nofollow":"0","_wds_opengraph-title":"","_wds_opengraph-description":"","_wds_twitter-title":"","_wds_twitter-description":""},"categories":[465,105],"tags":[587,585,589,590,588,586],"class_list":["post-7203","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-aio","category-seo","tag-ai-audit","tag-audit","tag-claudebot","tag-crawler","tag-gptbot","tag-seo-audit"],"_links":{"self":[{"href":"https:\/\/rafaelpatron.com\/blog\/wp-json\/wp\/v2\/posts\/7203"}],"collection":[{"href":"https:\/\/rafaelpatron.com\/blog\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/rafaelpatron.com\/blog\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/rafaelpatron.com\/blog\/wp-json\/wp\/v2\/users\/10"}],"replies":[{"embeddable":true,"href":"https:\/\/rafaelpatron.com\/blog\/wp-json\/wp\/v2\/comments?post=7203"}],"version-history":[{"count":1,"href":"https:\/\/rafaelpatron.com\/blog\/wp-json\/wp\/v2\/posts\/7203\/revisions"}],"predecessor-version":[{"id":7316,"href":"https:\/\/rafaelpatron.com\/blog\/wp-json\/wp\/v2\/posts\/7203\/revisions\/7316"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/rafaelpatron.com\/blog\/wp-json\/wp\/v2\/media\/3359"}],"wp:attachment":[{"href":"https:\/\/rafaelpatron.com\/blog\/wp-json\/wp\/v2\/media?parent=7203"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/rafaelpatron.com\/blog\/wp-json\/wp\/v2\/categories?post=7203"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/rafaelpatron.com\/blog\/wp-json\/wp\/v2\/tags?post=7203"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}