Tech · 1 ottobre 2026 · 4 min di lettura

Reddit spegne i feed RSS e chiude le API pubbliche: la recinzione dei dati contro l'IA

In sintesi: Reddit ha annunciato la fine definitiva del supporto ai feed RSS a partire dal 13 novembre 2026 e la dismissione totale della propria API pubblica entro marzo 2027. La piattaforma motiva la decisione con la necessità di fermare lo scraping su vasta scala operato dai bot di intelligenza artificiale. La mossa, accompagnata da nuovi limiti d'accesso all'interfaccia storica Old Reddit, segna un ulteriore distacco dagli standard dell'open web a difesa dei redditizi accordi di licenza commerciale sui dati.

di Team Mocchi's

Reddit spegne i feed RSS e chiude le API pubbliche: la recinzione dei dati contro l'IA

La chiusura dei canali storici dell'open web

Reddit ha comunicato la dismissione definitiva dei propri feed RSS a partire dal 13 novembre 2026, affiancando alla misura una scadenza perentoria: la chiusura totale dell'API pubblica entro marzo 2027. Come riporta TechCrunch, l'azienda ha motivato la scelta definendo il protocollo RSS una «superficie comune per scraping su larga scala e abusi automatizzati». Lo standard che per oltre due decenni ha garantito l'interoperabilità dei contenuti sul web aperto viene così rimosso da una delle comunità online più frequentate al mondo.

Per i moderatori e gli sviluppatori indipendenti che facevano affidamento sui flussi di syndication per monitorare discussioni e automatizzare allerte, l'azienda suggerisce la migrazione verso l'infrastruttura proprietaria Devvit e specifiche integrazioni Discord. La decisione segue la drastica revisione delle tariffe API del 2023, ma sposta il conflitto su un piano ancora più radicale: l'eliminazione dei canali non autenticati attraverso cui i sistemi di estrazione dati continuavano a campionare conversazioni in tempo reale.

La stretta su Old Reddit e la caccia ai crawler

Parallelamente alla rimozione degli RSS, la piattaforma ha annunciato una nuova ondata di restrizioni rivolta a Old.Reddit.com, la versione legacy dell'interfaccia ancora apprezzata da milioni di utenti per la sua reattività e il design minimale. Secondo quanto ricostruito da Ars Technica, nei prossimi mesi potranno accedere all'interfaccia classica solo gli account autenticati che l'hanno utilizzata attivamente negli ultimi sei mesi, con un'eccezione concessa esclusivamente ai moderatori.

L'interfaccia storica, priva degli script pesanti della versione moderna, rappresentava un bersaglio privilegiato per script di crawling automatizzati. Sebbene la portavoce di Reddit abbia ribadito che l'intento è «preservare Old Reddit per le persone reali che lo usano», la progressiva esclusione degli account dormienti e dei visitatori privi di storico ridurrà fisiologicamente il bacino d'uso, preparando il terreno a una futura dismissione definitiva dell'infrastruttura legacy.

Il valore commerciale del testo umano nell'era dei modelli

Dietro la giustificazione tecnica della sicurezza informatica emerge una chiara traiettoria economica. I forum tematici e le discussioni non strutturate rappresentano oggi uno dei beni più preziosi per l'addestramento e il raffinamento dei modelli linguistici, poiché racchiudono ragionamento naturale, dialettica e contestualizzazione culturale difficili da replicare sinteticamente.

Durante il secondo trimestre del 2026, la voce contabile relativa ai ricavi accessori di Reddit — trainata principalmente dagli accordi di licenza dati stipulati con laboratori di frontiera come Google e OpenAI — è cresciuta del 24% su base annua, toccando i 43 milioni di dollari. In un panorama in cui ogni frammento di conversazione ha un valore di mercato negoziabile, lasciare varchi aperti per l'ingestione gratuita non è più compatibile con la strategia aziendale. Chi intende alimentare i propri sistemi con l'archivio della piattaforma deve necessariamente passare per partnership commerciali a pagamento.

Il punto di Mocchi's

La mossa di Reddit conferma una tendenza strutturale con cui le aziende e i team tecnici devono fare i conti: il web aperto e liberamente accessibile via protocolli standard sta progressivamente cedendo il passo a silos recintati e monetizzati. Per chi progetta software, pipeline di dati e soluzioni basate su LLM in Italia, fare affidamento sullo scraping non autorizzato o su canali non contrattualizzati è ormai un azzardo operativo ed esposto a blocchi improvvisi. Diventa imperativo costruire strategie di conoscenza incentrate su basi dati proprietarie, architetture documentali interne e integrazioni API certificate, archiviando definitivamente l'illusione che il web pubblico rimanga una risorsa gratuita e inesauribile.

Approfondisci

Tutti gli articoli del blog Mocchi's