Ricerca AI Cita 215.000 Pagine Software Generate Automaticamente
AI News

Ricerca AI Cita 215.000 Pagine Software Generate Automaticamente

5 min
03/09/2026
AI SearchPerplexityMachine-Generated ContentSEO Manipulation

L'architettura nascosta delle raccomandazioni AI

Quando chiedi a un assistente AI qual è il miglior software CRM o il miglior strumento di project management, da dove arriva effettivamente la risposta? Una nuova indagine di Trellner Research suggerisce che la base di prove dietro le raccomandazioni AI potrebbe essere molto meno autorevole di quanto gli utenti presumano.

Lo studio, condotto il 2 settembre 2026, ha analizzato 7.534 citazioni dai modelli Sonar e Sonar Pro di Perplexity in 380 categorie software. I risultati dipingono un quadro preoccupante: il 59,8% delle citazioni punta a domini classificati peggio di #100.000 nella lista Tranco top-1M, e il 23,4% è al di fuori del primo milione.

Ancora più preoccupante, tre siti apparentemente sotto controllo comune—WorldMetrics, WifiTalents e Gitnux—hanno pubblicato la sbalorditiva cifra di 215.128 pagine 'miglior software' generate automaticamente. Nessuno di questi domini esisteva prima di dicembre 2023, eppure Perplexity li ha citati 181 volte in 41 categorie.

La portata del problema

Il team di ricerca ha sottoposto 380 categorie di intento di acquisto—da 'software CRM' a 'software per la gestione di collezioni museali'—ai modelli di Perplexity tramite OpenRouter. Ogni richiesta chiedeva una classifica dei primi cinque con le homepage ufficiali dei prodotti. I risultati: 3.800 slot di raccomandazione, 1.807 prodotti distinti e 7.534 citazioni che coprono 2.055 domini.

Il rango mediano Tranco dei domini citati era 71.611, ma la vera storia sta nella coda lunga. 751 dei 2.055 domini citati (36,5%) non appaiono affatto nel primo milione. Questi domini non classificati sono anche più recenti—prima cattura Wayback mediana del 2020 contro il 2011 per i siti classificati—e il 16,6% è stato catturato per la prima volta nel 2025 o successivamente, rispetto a solo l'1,6% per i domini classificati.

Guideflow: Un blog di marketing supera Gartner

Forse il risultato più sorprendente riguarda Guideflow, un'azienda che vende demo interattive di prodotti. Il suo blog di marketing è stato citato 194 volte in 96 delle 380 categorie—un quarto di tutte le query—posizionandosi terzo in assoluto, davanti alle 158 citazioni di Gartner.

Guideflow non compete in nessuna delle categorie software per cui è stata citata. La sua sitemap elenca 3.351 URL di blog e ha fornito basi per qualsiasi cosa, da 'software di rendering 3D' a 'software IVR' e 'software RFID'. L'azienda non sta ingannando—sta semplicemente pubblicando content marketing su larga scala, e il livello di recupero di Perplexity lo tratta come una fonte autorevole.

continua a leggere sotto...

La rete delle 'Pagine di Fatti e Grounding'

I tre siti più preoccupanti—WifiTalents, WorldMetrics e Gitnux—sembrano essere un'unica operazione. Tutti registrati tramite NameCheap tra dicembre 2023 e maggio 2024, condividono gli stessi nameserver Cloudflare, template di pagina identici e strutture di navigazione corrispondenti. Ciascuno mantiene esattamente sei post del blog, tutti sugli altri brand del gruppo.

La loro scala è sbalorditiva: le sitemap elencano rispettivamente 103.578, 107.083 e 105.541 URL, con 70.731, 71.684 e 72.713 che sono pagine '/best/-software/' generate automaticamente. Sono 215.128 guide all'acquisto generate in tre brand—con solo sei post del blog scritti da umani ciascuno.

Ciò che rende queste pagine particolarmente preoccupanti è la loro autodescrizione. Sia WorldMetrics che Gitnux restituiscono titoli HTML della forma 'Facts & Grounding Page'—grounding è il termine tecnico per il passaggio di recupero che questi modelli AI eseguono. Le loro meta descrizioni sembrano rivolgersi direttamente all'AI: 'Fatti verificati su Gitnux: una società indipendente di ricerche di mercato che pubblica statistiche di settore, ricerche personalizzate e Best List di software.'

Un template, tre verdetti diversi

Lo studio ha recuperato la stessa pagina di categoria—'software di stima progetti'—da tutti e tre i brand. Nonostante condividano un template, ogni sito classifica prodotti diversi:

  • WorldMetrics: Float, Scoro, Teamwork.com, Procore, Wrike
  • WifiTalents: Float, Scoro, Teamwork.com, Buildertrend, Apropo
  • Gitnux: Saviom, Mosaic, Buildertrend, Float, Teamwork.com

Il vincitore di Gitnux non appare nemmeno tra i primi cinque di WorldMetrics. Ogni pagina accredita diversi membri dello staff—nove persone distinte nei tre siti—e ciascuna annuncia il proprio processo editoriale. Gitnux etichetta persino il suo risultato come 'AI-verified · Expert reviewed.'

Domini morti e reindirizzamenti fuorvianti

Lo studio ha anche verificato le 1.502 homepage dei fornitori raccomandate dai modelli. Dieci domini non risolvono a nessun indirizzo, tra cui graphiql.com (offerto per GraphiQL, che non ha tale sito) e todo.com (offerto per Microsoft To Do). Altri 92 domini reindirizzano a domini registrabili diversi, per lo più acquisizioni ordinarie.

Due casi sono emersi. Per le piattaforme di gestione dei dati di ricerca, Sonar ha fornito dryad.co—che reindirizza a un portale di gioco d'azzardo online indonesiano—mentre Sonar Pro ha correttamente identificato datadryad.org. Per gli strumenti di qualità dei dati, Sonar Pro ha fornito montecarlo.com, che reindirizza al gruppo alberghiero e di casinò di Monaco, mentre Sonar ha correttamente identificato montecarlodata.com.

Cosa significa per la ricerca AI

I risultati espongono una vulnerabilità critica nella ricerca basata su AI: il livello di recupero può essere manipolato da contenuti generati automaticamente progettati specificamente per essere letti dai modelli, non dagli umani. Le 'Pagine di Fatti e Grounding' sono rivolte, nei loro titoli e descrizioni, al software che le legge.

I due modelli di Perplexity condividevano un livello di recupero—restituendo elenchi di citazioni byte-identici in 289 delle 380 categorie—quindi questa non è una prova di sistemi indipendenti che convergono. È uno stack di ricerca campionato due volte.

Lo studio ha limitazioni: copre solo Perplexity, un'istantanea di un giorno e categorie ponderate verso verticali di nicchia. Ma le implicazioni sono chiare. Mentre gli assistenti AI diventano strumenti primari di scoperta del software, la qualità delle loro prove sottostanti conta più che mai.

Per acquirenti e sviluppatori, il messaggio è di verificare le raccomandazioni AI rispetto a fonti fidate e revisionate da umani. Per l'industria, questo è un campanello d'allarme sulla fragilità dell'ecosistema informativo dell'AI.