I bot hanno superato gli esseri umani. Secondo il Thales 2026 Bad Bot Report, il 53% del traffico web è generato da bot contro il 47% di persone in carne e ossa, e Cloudflare conferma che per la prima volta il traffico automatizzato ha superato quello umano sulla sua rete. La risposta dell’industria non si è fatta attendere: dal 15 settembre 2026 Cloudflare blocca di default i crawler AI — quelli di addestramento e quelli agentici — sulle pagine che mostrano pubblicità, spingendo un modello in cui chi usa i contenuti paga chi li produce.

La mossa è comprensibile: i siti vivono di attenzione e i sistemi AI leggono senza restituire il clic. Ma c’è un problema di prospettiva. Mentre tutti costruiscono muri contro i bot, una fetta crescente di quel traffico automatizzato non è fatta di predoni: sono agenti AI personali che agiscono per conto di persone vere — prenotano, confrontano, comprano. Bloccare i bot oggi rischia di significare bloccare i clienti di domani.

La tesi è semplice e scomoda: il web va riprogettato per gli agenti AI, non solo per gli occhi. Dopo il mobile-first, serve l’agent-first. E Apple, con la stretta sugli App Intents, lo sta già imponendo agli sviluppatori iOS.

Assistente robotico: gli agenti AI leggeranno il web prima degli occhi umani
Il web del futuro sarà letto dagli agenti AI. Foto: Pexels.

Il muro: cosa sta succedendo ai bot

Cloudflare gestisce una fetta enorme del traffico mondiale e ha deciso di trasformare il file robots.txt — una richiesta di cortesia che i crawler potevano ignorare — in un muro vero. I bot vengono classificati in tre categorie:

  • Search: i crawler dei motori di ricerca, restano ammessi;
  • Agent: gli agenti AI che navigano e agiscono per conto degli utenti;
  • Training: i bot che raccolgono dati per addestrare i modelli.

Sulle pagine con pubblicità, le ultime due categorie sono bloccate di default per i nuovi domini e i clienti del piano gratuito, a meno che il proprietario del sito decida altrimenti. In parallelo, il vecchio pay per crawl diventa pay per use: gli editori vengono compensati quando il loro contenuto finisce dentro una risposta generata dall’AI, non per ogni singola visita del bot. I dettagli dell’annuncio sono su Media Copilot.

I numeri che hanno convinto Cloudflare sono brutali: il rapporto tra visite dei crawler e visite restituite ai siti è di 18 a 1 per Google, 1.500 a 1 per OpenAI e 60.000 a 1 per Anthropic, secondo i dati citati dal CEO Matthew Prince. Il patto implicito del web — accesso ai contenuti in cambio di lettori — si è rotto: l’AI legge e risponde senza far passare nessuno dalla porta.

Agente AI che interagisce con l'interfaccia di un sito web
Interfacce pensate per essere comprese dalle macchine. Illustrazione: jonalonso.com.

Il paradosso: i bot da temere meno sono i clienti di domani

Eppure, dentro quel 53% di traffico non umano c’è una categoria destinata a crescere in fretta: gli agenti AI personali. Non i bot malevoli che intasano i server o rubano contenuti, ma software che agisce con le credenziali e per conto di una persona reale — una delega digitale con nome e cognome.

Lo scenario è vicino: l’utente chiede al proprio assistente di trovare il volo più economico per una certa data, confrontare tre hotel, comprare un accessorio. L’assistente visita i siti, legge le pagine, compila i moduli, paga.

A quel punto la domanda per chi gestisce un sito non è più “come attiro occhi umani”, ma “come faccio a essere scelto dall’agente AI”.

Chi saprà accogliere gli agenti AI prima degli altri avrà l’attrito più basso al momento dell’acquisto. Due siti di prenotazione offrono lo stesso prezzo: uno espone dati puliti e un percorso d’acquisto leggibile dalle macchine, l’altro mette CAPTCHA, pop-up e banner a ogni passo. L’assistente sceglierà il primo. Sempre. Il tema di chi decide cosa fa un agente nel momento in cui si compra è stato affrontato su queste pagine nell’analisi sul Personal Agent Protocol: la partita si gioca sulla fiducia delegata, non sui muri.

Apple ha già scelto: App Intents o invisibilità

Il segnale più forte arriva da Cupertino. Al WWDC 2026, durante il Platforms State of the Union del 9 giugno, Apple ha formalmente deprecato SiriKit: App Intents è ora l’unico framework con cui Siri entra nelle app di terze parti. Con gli App Schemas, il riconoscimento del contesto sullo schermo e le azioni combinate tra app diverse, la nuova Siri concatena operazioni prese da più app per soddisfare una singola richiesta. La sessione 240 del WWDC26 entra nel dettaglio tecnico.

Il concetto, riassunto in una frase che circola tra gli sviluppatori, vale come avviso per tutto il web:

«L’app non è rotta. È invisibile.» Senza App Intents, Siri può solo aprire l’app per nome: non può eseguire azioni al suo interno, non può rispondere sui suoi contenuti, non può proporre le sue funzionalità. E nella catena di azioni che compone la risposta, un’app che non espone niente non è l’anello debole: non viene proprio presa in considerazione.

È esattamente la logica agent-first applicata alle app: non conta più solo l’interfaccia che vede l’utente, conta la superficie che l’app espone agli agenti AI. Chi non la costruisce sparisce dal percorso d’acquisto pur continuando a funzionare perfettamente. Il quadro completo della transizione è nel resoconto del WWDC 2026.

Codice e API: i dati strutturati che gli agenti AI preferiscono alle pagine web
Per un agente contano i dati strutturati, non i banner. Foto: Pexels.

Il nodo economico: chi paga i contenuti

L’obiezione è legittima e va presa sul serio: i siti vivono di pubblicità servita a occhi umani. Se a leggere è un agente che screma banner e pop-up, il modello economico crolla. Non è un’ipotesi: secondo una ricerca della Rutgers Business School e della Wharton School, gli editori che hanno bloccato i crawler AI hanno perso circa il 7% del traffico settimanale in sei settimane, senza una protezione proporzionata in cambio.

Ma il muro non risolve il problema, lo sposta. Bloccare tutto significa perdere due volte: niente compenso dai sistemi AI e niente visibilità presso gli agenti che comprano. La strada è reinventare il modello, non difendere quello vecchio:

  • pay per use alla Cloudflare: compenso quando il contenuto viene usato dentro una risposta;
  • llms.txt: un file alla radice del sito che offre ai modelli un riepilogo curato e leggibile dei contenuti — la proposta è su llmstxt.org e Chrome lo controlla già con un audit dedicato in Lighthouse;
  • API e affiliazioni pensate per gli agenti: se l’assistente completa l’acquisto tramite l’interfaccia dati del sito, la commissione resta al sito.

Il punto critico è distinguere: i bot malevoli vanno bloccati, sempre. Gli agenti AI che agiscono per conto di utenti identificati vanno accolti, misurati e monetizzati. Confondere le due categorie è l’errore strategico.

Cosa cambia per l’utente

  • Acquisti per delega: chiedere all’assistente di confrontare prezzi e comprare diventerà normale; i siti agent-friendly risponderanno in secondi, gli altri chiederanno di aprire il browser e fare tutto a mano.
  • Meno trappole visive: un agente AI non si distrae con pop-up, countdown fasulli e banner lampeggianti. I siti che vivono di questi trucchi li vedranno aggirati, non subiti.
  • Fiducia al posto dei CAPTCHA: l’agente AI agirà con delega esplicita dell’utente. I siti dovranno imparare a fidarsi di credenziali delegate invece di chiedere di dimostrare di essere umani cliccando sui semafori.
  • Più scelta reale: quando a confrontare è una macchina instancabile, vince davvero l’offerta migliore, non quella con il marketing più aggressivo.

Le domande più comuni

Bloccare i bot malevoli resta giusto?

Sì, senza discussione. Attacchi DDoS, scraping aggressivo, furto di contenuti e frodi automatizzate restano minacce da bloccare con ogni mezzo tecnico disponibile. La distinzione è netta: da una parte i bot che danneggiano infrastrutture e business, dall’altra gli agenti AI che agiscono per conto di utenti identificati, con delega esplicita e limiti dichiarati. Il primo gruppo va murato fuori, il secondo va accolto dentro con regole chiare. Chi li tratta allo stesso modo non sta facendo sicurezza: sta facendo autolesionismo commerciale.

I siti devono buttare via il design per gli umani?

No. Serve un doppio binario: pagine curate per le persone e interfacce dati per le macchine — API documentate, file llms.txt, azioni esposte come fa Apple con App Intents. È lo stesso principio del responsive design di dieci anni fa: un contenuto, più superfici di fruizione. Il sito resta bello per gli occhi e diventa leggibile per gli agenti AI. Chi parte ora con questo doppio binario arriva prima al momento in cui gli acquisti delegati diventeranno la norma.

Quando succederà davvero?

È già iniziato, solo che non ha fatto rumore. Cloudflare ha attivato i blocchi di default a settembre 2026, iOS 27 spinge gli App Intents come unico canale verso Siri e Chrome controlla llms.txt negli audit di Lighthouse. La transizione non arriverà con un annuncio in pompa magna: arriverà il giorno in cui l’assistente di qualcuno completerà un acquisto saltando il sito che non era pronto. Quel giorno, per quel sito, sarà troppo tardi per iniziare a pensarci.

Fonti

  1. Thales 2026 Bad Bot Report: i bot generano il 53% del traffico web — Help Net Security
  2. Cloudflare: blocco di default dei crawler AI dal 15 settembre 2026 — Novaknown
  3. Cloudflare: categorie di crawler e pay per use — Media Copilot
  4. llms.txt: lo standard per contenuti agent-friendly — llmstxt.org
  5. WWDC26 sessione 240: App Schemas e Siri — Apple Developer
  6. SiriKit deprecato: la transizione ad App Intents — SCAND via EIN Presswire

Lascia un commento

Cosa ne pensi?