Reddit ha aggiornato i suoi sistemi automatici per contrastare spam e attività manipolate generate anche con l’aiuto dell’intelligenza artificiale. Il risultato più evidente è un calo del 20% dell’esposizione degli utenti allo spam.
La società spiega di combinare strumenti di moderazione già esistenti con modelli linguistici avanzati, così da individuare schemi più nascosti di comportamento falso, promozione artificiale e automazione mascherata da attività umana.

Reddit usa AI e automazione per bloccare spam, voti falsi e account sospetti
Reddit monitora i profili a rischio fin dalla creazione dell’account e ora sfrutta anche i modelli LLM per riconoscere comportamenti molto più difficili da intercettare con i filtri tradizionali. L’obiettivo è individuare campagne coordinate, contenuti artificiosi e segnali di manipolazione che possono sembrare normali a una prima lettura.
Tra le misure adottate c’è anche la verifica degli account sospettati di essere automatizzati, che devono dimostrare di appartenere a una persona reale. In pratica, Reddit sta spostando la moderazione da un modello reattivo a uno sempre più preventivo, con controlli che avvengono prima che lo spam abbia un impatto visibile sulla community.
- Fino a 23 milioni di visualizzazioni spam bloccate ogni giorno con il sistema automatico aggiornato.
- Circa 25.000 nuovi post o commenti spam intercettati su base quotidiana.
- Quasi 2 milioni di voti non validi annullati.
- Riduzione del 20% nell’esposizione degli utenti ai contenuti spam.
- Calo aggiuntivo del 10-15% nella frequenza di contatto con account spam.
Anche i contenuti d’odio e violenza vengono gestiti più rapidamente
L’automazione non si limita allo spam. Reddit ha rafforzato anche il controllo sui contenuti d’odio e violenza, riducendo il tempo medio che passa dal rilevamento all’intervento a meno di 5 secondi. È un indicatore importante perché misura l’efficacia pratica della moderazione, non solo la capacità di identificare un problema.
La piattaforma indica inoltre un aumento di oltre il 200% nell’intensità degli interventi di enforcement, una riduzione superiore al 40% dell’esposizione potenziale a contenuti dannosi e un taglio di oltre il 40% dei falsi positivi. In altre parole, Reddit sostiene di essere riuscita a intervenire di più, più velocemente e con meno errori.
- Tempo medio tra rilevamento e intervento sceso sotto i 5 secondi.
- Forza delle azioni di moderazione aumentata di oltre il 200%.
- Esposizione potenziale a contenuti dannosi ridotta di più del 40%.
- Falsi positivi ridotti di oltre il 40%.


