L'IA non rilevabile funziona? Test e risultati reali

Se stai leggendo questo articolo, probabilmente sei scettico sul fatto che l’IA non rilevabile funzioni davvero o meno. 

La maggior parte delle persone reagisce così quando arriva qui, ed è la reazione naturale di fronte a qualsiasi strumento che prometta di fare ciò che fa il nostro.

Quindi, invece di cercare di convincervi con una presentazione commerciale, ho eseguito io stesso i test e ho registrato tutto ciò che ho osservato.


Punti di forza

  • Il nostro “AI Humanizer” ha ottenuto un punteggio di 0%, ovvero quasi zero, su GPTZero per tutti e cinque i campioni testati; ogni risultato è stato classificato come scritto da un essere umano da uno dei rilevatori di IA più utilizzati in ambito accademico e professionale.

  • Sia Copyleaks che Grammarly hanno classificato il testo umanizzato come scritto da una persona in ogni singolo test, con tutti i punteggi che si sono attestati su 0% AI.

  • Il nostro rilevatore di IA ha centrato l'obiettivo: 94% o più su ogni campione generato dall'IA, 3% o meno su ogni campione scritto da un essere umano. Si tratta di un'accuratezza pari a 100% su tutta la linea.


Che cos’è l’IA non rilevabile?

Ho creato Undetectable AI perché ho notato che lo stesso problema si ripresentava ovunque. Gli studenti finivano nei guai per lavori che in realtà avevano scritto loro stessi.

I professionisti del marketing stavano perdendo clienti perché alcuni sistemi di rilevamento stabilivano che i loro testi fossero stati redatti da una macchina. E gli scrittori che utilizzavano l’intelligenza artificiale come punto di partenza non riuscivano a far sì che la bozza finale rispecchiasse il proprio stile personale.

I rilevatori commettevano un errore dopo l'altro, e sentivo di dover fare qualcosa per rimediare alla situazione.

Rilevamento AI Rilevamento AI

Non preoccupatevi più che l'intelligenza artificiale rilevi i vostri messaggi. Undetectable AI Può aiutarvi:

  • Fate apparire la vostra scrittura assistita dall'intelligenza artificiale simile all'uomo.
  • Bypass tutti i principali strumenti di rilevamento dell'intelligenza artificiale con un solo clic.
  • Utilizzo AI in modo sicuro e con fiducia a scuola e al lavoro.
Prova gratis

La piattaforma dispone di due strumenti, che svolgono funzioni molto diverse tra loro.

AI Humanizer prende il testo generato dall'intelligenza artificiale e lo riscrive in modo che sembri scritto da una persona in carne e ossa.

Non si tratta semplicemente di scambiare qualche parola. Il sistema ristruttura le frasi, varia il ritmo e attenua le transizioni che i sistemi di rilevamento cercano di individuare. L’obiettivo è ottenere un risultato che superi i principali sistemi di rilevamento e che risulti comunque comprensibile per un lettore umano.

Il rilevatore di IA che fa l'opposto di ciò che ci si aspetterebbe. Anziché generare testo, analizza un brano che gli si incolla e indica con quale probabilità sia stato scritto da una macchina. 

In realtà, ho iniziato a usarlo anch’io prima di pubblicare qualsiasi cosa sul nostro blog. Per me è diventato un controllo finale, e molti dei nostri utenti fanno lo stesso: incollano il testo e cliccano su “Invia”, e il rilevatore dà loro un’idea se il loro testo suona troppo “artificiale” o meno.

La maggior parte delle persone li usa insieme, uno dopo l’altro. Prima si individua qualcosa, poi si valuta come sta andando. Se non è proprio perfetto, lo si personalizza per migliorarlo, e poi si ricontrolla. 

A chi è destinata l'IA "Undetectable"?

Se sei uno studente, probabilmente conosci fin troppo bene questa frustrazione. Ci metti anima e corpo in una tesina, trascorrendo ore a fare ricerche e a scrivere, e poi la sottoponi a un rilevatore di IA come GPTZero o Copyleaks solo per assicurarti che non venga segnalata ingiustamente.

Ma a volte, nonostante tutti i tuoi sforzi, il sistema segnala ampie parti del tuo lavoro come scritte dall’IA, anche se sai bene di aver scritto ogni singola parola di tuo pugno. È un problema piuttosto fastidioso, ed è solo un aspetto della questione.

D'altro canto, ci sono professionisti del content marketing che si affidano all'intelligenza artificiale per rispettare le scadenze di pubblicazione. La qualità della scrittura è generalmente buona e le informazioni sono corrette, ma basta che un cliente sollevi anche un solo dubbio perché tutta la fiducia venga meno.

E poi ci sono persone per cui l’inglese non è la lingua madre che utilizzano l’intelligenza artificiale per migliorare le proprie competenze linguistiche, poiché questa riesce a garantire una grammatica e una fluidità perfette, anche se sono ancora in fase di apprendimento. 

Il fatto è che, sebbene il risultato possa essere tecnicamente corretto, spesso manca quel tocco personale, quel non so che che fa sembrare che sia stato scritto davvero da una persona in carne e ossa, ed è proprio questo che conta davvero.

Tutte queste persone finiscono per porsi la stessa domanda: se lo sottopongo a un metal detector, supererà il controllo?

Come funziona l’IA non rilevabile

Due percorsi, entrambi semplici.

Per umanizzare: vai alla Umanizzatore AI, incolla il testo e clicca per renderlo più naturale. Il risultato appare proprio accanto all’originale, così puoi confrontarli fianco a fianco prima di copiare qualsiasi cosa.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

Per effettuare il controllo: vai su AI Detector, incolla il tuo testo e clicca per avviare la scansione.

Cosa ho testato e come

Prima di mostrarvi i numeri, vorrei spiegarvi passo dopo passo cosa ho fatto esattamente. 

La metodologia

Cinque esempi di testo generati da ChatGPT, ciascuno redatto in un formato che rispecchia il modo in cui i nostri utenti lavorano realmente: una descrizione di prodotto per un blog, un saggio universitario sulle tesi di discussione, un’e-mail di candidatura per uno stage, una risposta dell’assistenza clienti e una recensione di un paio di cuffie.

Ogni campione è stato elaborato una volta dal nostro AI Humanizer. Successivamente, ogni risultato umanizzato è stato sottoposto a verifica utilizzando gli stessi tre rilevatori: GPTZero, Copyleaks e Grammarly.

Ho inoltre condotto un test di accuratezza separato sul nostro AI Detector utilizzando cinque esempi generati dall'intelligenza artificiale e cinque esempi scritti da esseri umani, tratti da fonti pubblicate, per verificare la sua capacità di distinguere i due tipi di testo.

Campione per campione: ciò che ho visto

Test 1: Descrizione del prodotto sul blog

Una descrizione del prodotto di 256 parole per uno shampoo, il tipo di testo che potrebbe produrre un piccolo sito di e-commerce o un blog di affiliazione. L'ho incollata nell'AI Humanizer e l'ho elaborata.

Il risultato è stato di 225 parole. Lo stile è diventato notevolmente più naturale. La lunghezza delle frasi variava, il ritmo era più vario e alcune transizioni rigide si sono ammorbidite, assumendo lo stile che potrebbe usare un vero copywriter.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?
Schermata

Risultati: 0% su GPTZero, 0% su Copyleaks e 0% su Grammarly. Il campione più pulito su tutta la linea.

Prova 2: Saggio universitario

Un saggio di 274 parole su come formulare una tesi. Questo è il caso d'uso che interessa di più alle persone quando chiedono se lo strumento funzioni, poiché la scrittura accademica è quella in cui la posta in gioco è più alta e i criteri di valutazione sono più rigorosi.

L'AI Humanizer ha ampliato il testo portandolo a 323 parole, ha aggiunto transizioni di collegamento e ha reso più coerente lo svolgimento dell'argomentazione. Il risultato sembra scritto da uno studente che abbia davvero riflettuto sull'argomento e lo abbia rivisto una volta.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?
Schermata

Risultati:

  • 0% su GPTZero
  • 0% su Copyleaks
  • e 0% su Grammarly

GPTZero, uno dei rilevatori di IA comunemente utilizzati dalle istituzioni accademiche, non ha rilevato alcuna incongruenza.

È possibile consultare la ripartizione completa nella tabella dei risultati riportata di seguito.

Test 3: Email di candidatura per un tirocinio

Un'e-mail di candidatura per uno stage di 241 parole scritta da uno studente che si candida presso un'azienda. Questo tipo di e-mail è uno dei casi d'uso più comuni nella vita reale che le persone inseriscono negli strumenti di intelligenza artificiale, in particolare gli studenti che cercano di rendere i propri testi più curati e professionali.

Il risultato generato dal nostro strumento AI Humanizer è stato di 328 parole. Tra i cinque esempi, questa versione ampliata è risultata la più utile perché ha aggiunto quel tipo di inquadramento, tono e contesto personale che uno studente reale, candidandosi per uno stage, includerebbe naturalmente in un’e-mail.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

Risultati: 0% su GPTZero, 0% su Grammarly e 0% su Copyleaks.

L'AI Humanizer ha ampliato in modo naturale l'e-mail originale, aggiungendo quel tipo di dettagli e di approccio personale che rendono una candidatura per uno stage più autentica e professionale. 

Test 4: Risposta dell’assistenza clienti

Una risposta del servizio clienti di 140 parole relativa a un problema di accesso all'account. 

Il risultato generato da AI Humanizer era di 188 parole. La struttura è rimasta chiara, ma il tono è passato da quello di un modello di assistenza generico a qualcosa che sembra scritto da una persona che sta effettivamente digitando una risposta.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

Risultati: 2% su GPTZero, 0% su Copyleaks, 0% su Grammarly.

I testi brevi e stereotipati sono solitamente più difficili da rendere più umani, poiché le risposte automatiche tendono a seguire strutture ripetitive e formulazioni prevedibili.

Ciononostante, l'AI Humanizer ha gestito bene questo esempio, mantenendo la risposta chiara e rendendola al contempo più naturale e colloquiale.

Test 5: Recensione del prodotto

Una recensione di 150 parole su un paio di cuffie, il tipo di commento informale che si legge su Amazon o Reddit. Tono colloquiale, frasi brevi, stile personale.

Il testo generato da AI Humanizer contava 152 parole, appena un po’ più lungo. La formulazione risultava naturale, con quei tocchi colloquiali che rendono una recensione più autentica.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

Risultati: 0% su GPTZero, 0% su Copyleaks, 0% su Grammarly.

I risultati: cosa rivelano i numeri

Ecco una panoramica completa dei risultati del nostro AI Humanizer, tutti raccolti in un unico posto. Il verde indica che il rilevatore ha classificato il testo umanizzato come scritto da un essere umano. Il rosso indica che lo ha ancora segnalato come scritto prevalentemente dall'IA.

CampioneGPTZeroCopyleaksGrammatica
Blog0%0%0%
Saggio universitario0%0%0%
Email0%0%0%
Assistenza clienti2%0%0%
Recensione del prodotto0%0%0%

Punteggi di rilevamento relativi a tutti e cinque i campioni dopo un unico passaggio attraverso l’AI Humanizer.

Tasso complessivo di bypass

Su un totale di 15 controlli effettuati dai rilevatori (cinque campioni distribuiti su tre rilevatori), tutti senza eccezioni sono risultati scritti da esseri umani. Ciò corrisponde a un tasso di bypass del 100% in un unico ciclo di umanizzazione senza modifiche manuali.

  • Grammarly non ha mai segnalato nulla. 
  • Copyleaks ha superato il test con cinque su cinque.

GPTZero ha fornito i risultati più coerenti su tutti e cinque i campioni. Ha classificato il blog, il saggio universitario e la recensione del prodotto come scritti interamente da esseri umani con un punteggio di 0%, mentre anche l’e-mail ha superato il test con 0% e la risposta dell’assistenza clienti ha ottenuto un punteggio di appena 2%. Maggiori dettagli in seguito.

Ripartizione per rivelatore

GPTZero: Ha mostrato la maggiore coerenza complessiva, con quattro campioni che hanno ottenuto un punteggio di 0% AI e uno di appena 2%. GPTZero ha classificato ogni singolo risultato come scritto da un essere umano con un elevato livello di sicurezza.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

GTPZero: Esempio 1, 100% umano.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

GTPZero: Esempio 2, 100% umano.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

GTPZero: Esempio 3, 100% umano.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

GTPZero: Esempio 4, 98% umano.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

GTPZero: Esempio 5, 100% umano.

Grammarly: 0%: l'intelligenza artificiale è stata rilevata in ogni campione. Grammarly non ha individuato alcun modello di intelligenza artificiale in nessuno dei testi umanizzati.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

Grammarly: Esempio 1, 0% AI.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

Grammarly: Esempio 2, 0% AI.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

Grammarly: Esempio 3, 0% AI.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

Grammarly: Esempio 4, 0% AI.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

Grammarly: Esempio 5, 0% AI.

Copyleaks: Copyleaks ha restituito risultati puliti su tutti e cinque i campioni, con ogni output umanizzato che ha ottenuto un punteggio 0% AI. 

I risultati positivi sono stati costanti in tutti i formati testati, dalla descrizione del blog e dal saggio universitario all’e-mail relativa al tirocinio, alla risposta dell’assistenza clienti e alla recensione del prodotto.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

CopyLeaks: Esempio 1, 0% AI.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

CopyLeaks: Esempio 2, 0% AI.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

CopyLeaks: Esempio 3, 0% AI.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

CopyLeaks: Esempio 4, 0% AI.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

CopyLeaks: Esempio 5, 0% AI.

Se dovessi scegliere un unico insegnamento da trarre dal malfunzionamento del rilevatore, sarebbe questo: l’AI Humanizer ha fornito risultati ineccepibili su tutta la linea, mentre Copyleaks e Grammarly hanno restituito “0% AI” su ogni singolo campione e GPTZero ha classificato ogni output come scritto da un essere umano con un elevato livello di affidabilità.

L’IA “non rilevabile” funziona davvero?

Sulla base dei dati che vi ho appena mostrato, la risposta breve è sì, ma con una precisazione.

Sui rilevatori più rilevanti nell'uso quotidiano (GPTZero e Grammarly), AI Humanizer ha superato tutti i test al primo tentativo. Questo copre la stragrande maggioranza delle situazioni in cui qualcuno controlla il tuo lavoro.

Anche sulle piattaforme più rigorose, come Copyleaks, è bastato un solo passaggio attraverso l’AI Humanizer per portare ogni campione a un punteggio AI 0% senza che fosse necessaria alcuna modifica manuale.

Dove offre le migliori prestazioni

I brani di testo più lunghi, con oltre 300 parole, hanno registrato tassi di bypass più elevati rispetto a quelli più brevi. Un testo più lungo offre all’AI Humanizer maggiore spazio per variare la formulazione e spezzare il ritmo.

I contenuti che presentavano già un tono colloquiale, come le recensioni dei prodotti, hanno ottenuto i punteggi più alti nella classificazione "umana" su tutti i fronti.

Anche i contenuti con una struttura più rigida, come il saggio universitario, hanno superato senza problemi tutti i sistemi di rilevamento, restituendo in tutti i casi il codice 0% AI.

La risposta dell'assistenza clienti è stato l'unico esempio a far scattare un qualsiasi allarme, ottenendo un punteggio di appena 2% su GPTZero, pur superando i controlli di Copyleaks e Grammarly con un punteggio di 0%.

I formati brevi e stereotipati, come le risposte dell'assistenza, tendono a seguire strutture prevedibili, ma anche in questi casi l'AI Humanizer ha mantenuto il punteggio ben all'interno della fascia tipica dei testi scritti da esseri umani.

Quanto è preciso il nostro rilevatore basato sull'intelligenza artificiale?

L'AI Humanizer rappresenta solo metà della storia. L'altra metà è il nostro AI Detector, e volevo mettere alla prova anche quella parte.

Ho sottoposto al nostro AI Detector cinque esempi di testo generati dall’intelligenza artificiale (tutti provenienti da ChatGPT) e cinque esempi scritti da esseri umani (tratti da fonti pubblicate, tra cui una recensione di un libro su Reddit, un post sul blog Substack ed estratti da romanzi e memorie già pubblicati) per verificare la sua efficacia nel distinguere i due tipi di testo.

Esempi di IA

L'AI Detector ha identificato in modo coerente ogni campione generato dall'intelligenza artificiale con un livello di affidabilità molto elevato, con punteggi compresi tra 94% e 99% AI.

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?
Schermata

Esempio 1 – Fonte: ChatGPT

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?
Schermata

Esempio 2 – Fonte: ChatGPT

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

Esempio 3 – Fonte: ChatGPT

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

Esempio 4 – Fonte: ChatGPT

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

Esempio 5 – Fonte: ChatGPT

Esempi scritti da persone

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?
Schermata

Fonte 1: Reddit – Recensione di ‘Il Trono di Spade’

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?
Schermata

 Fonte 2: Substack – Non servono mappe

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?

 Fonte 3: Tumblr

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?
Schermata

Fonte 4: Me Before You: Un romanzo 

L'IA non rilevabile funziona? Test reali e risultati: undetectable ai funziona?
Schermata

Fonte 5: Harry Potter e l'Ordine della Fenice

Tutti e cinque i campioni scritti da esseri umani hanno ottenuto un punteggio pari o inferiore a 3% nel nostro AI Detector. 

Il valore più alto è stato registrato in una recensione di un libro su Reddit, pari a 3%, mentre tre campioni hanno raggiunto appena 1%. Si tratta di una separazione tra testo generato dall’IA e testo umano praticamente perfetta.

Esempio generato dall'intelligenza artificialePunteggio del rilevatore
Esempio 1 (ChatGPT)99%
Esempio 2 (ChatGPT)94%
Esempio 3 (ChatGPT)99%
Esempio 4 (ChatGPT)99%
Esempio 5 (ChatGPT)99%
Esempio scritto da un essere umanoPunteggio del rilevatore
Recensione di un libro su Reddit3%
Post sul blog di Substack2%
Estratto pubblicato da un libro di memorie1%
Estratto dal romanzo pubblicato (1)1%
Estratto dal romanzo pubblicato (2)1%

L'accuratezza del nostro rilevatore di IA su campioni generati dall'intelligenza artificiale e scritti da esseri umani.

Sono dati significativi. Ogni campione generato dall'intelligenza artificiale è stato correttamente classificato come generato dall'intelligenza artificiale, mentre ogni campione scritto dall'uomo è stato correttamente classificato come scritto dall'uomo, garantendo così una precisione pari a 100% su tutti e dieci i campioni.

Detto questo, nessun sistema di rilevamento è perfetto per ogni possibile stile di testo, e continueremo a effettuare test man mano che verranno rilasciati nuovi modelli.

Prezzi: quanto costa l’IA “Undetectable”?

Undetectable AI offre piani a più livelli a seconda della quantità di testo che devi elaborare. 

I dettagli sui prezzi sono disponibili sul sito pagina dei prezzi, e sono disponibili opzioni per utenti singoli, team e casi d'uso con volumi elevati.

Ai fini di questo test, ciò che conta è che i risultati riportati in questo articolo rispecchino l'esperienza d'uso dello strumento così come la vivrebbe qualsiasi utente. 

Come ottenere i migliori risultati

Sulla base dei risultati ottenuti da questi test, ecco il flusso di lavoro che consiglierei se si desidera ottenere un risultato il più pulito possibile.

1. Incolla il testo nell’AI Humanizer ed esegui il processo. Basta un clic e il risultato viene visualizzato affiancato all'originale, così puoi vedere esattamente cosa è cambiato.

2. Prima della pubblicazione, sottoporre il testo umanizzato a un sistema di rilevamento. Utilizza il rilevatore su cui il tuo pubblico o la tua istituzione fa effettivamente affidamento.

Per i professionisti del marketing e gli autori di contenuti, effettuate un rapido controllo con GPTZero o con qualsiasi altro strumento di rilevamento preferito dal vostro cliente o dalla vostra piattaforma. Il nostro strumento di rilevamento basato sull’IA è adatto a questo scopo, ma potete anche effettuare il test direttamente su uno strumento di terze parti.

3. Effettua una revisione manuale per individuare eventuali parti che suonano ancora troppo "robotiche". Ci vogliono dai 30 ai 60 secondi. Se puoi, leggi ad alta voce ciò che viene visualizzato. Se una frase suona troppo artificiosa o troppo formale, riscrivila nel modo in cui la diresti realmente.

4. Ripeti la procedura con il tuo rilevatore di bersagli per confermare il punteggio. Se è stato approvato al primo tentativo, il gioco è fatto. Se invece è stato segnalato da un sistema di controllo rigoroso, le modifiche apportate al punto 3 sono solitamente sufficienti per farlo passare.

Pensieri finali

Nei 5 campioni che ho testato, AI Humanizer ha superato GPTZero ogni volta, ha ottenuto un punteggio di 0% su Copyleaks e Grammarly in ogni singolo test, e solo un campione ha dato luogo a un segnale di allarme (appena 2% su GPTZero) in un unico passaggio senza alcuna modifica manuale.

Per quanto riguarda il rilevamento, il nostro AI Detector ha raggiunto un valore pari o superiore a 94% su ogni campione generato dall’IA ed è rimasto al di sotto di 3% su ogni campione scritto dall’uomo. Ciò corrisponde esattamente allo scopo per cui abbiamo sviluppato entrambi gli strumenti.

Ciò significa che, considerando tutti e dieci i campioni, Il nostro rilevatore basato sull’intelligenza artificiale ha classificato correttamente ogni singolo caso, con un’accuratezza del 100%. Ogni campione generato dall'IA è stato contrassegnato come "IA", mentre ogni campione scritto da un essere umano è stato classificato come "scritto da un essere umano".

Stiamo inoltre continuando a migliorare entrambi i sistemi. AI Humanizer viene perfezionato per garantire prestazioni migliori di fronte a sistemi di rilevamento più rigorosi, mentre AI Detector viene costantemente aggiornato per stare al passo con i nuovi modelli linguistici man mano che vengono introdotti.

Se leggerete questo articolo tra un mese, è probabile che entrambi gli strumenti stiano già ottenendo risultati ancora migliori rispetto a quelli qui riportati.

Prova tu stesso: incolla il testo in AI non rilevabile ed esegui lo stesso test che ho fatto io. La scheda "Risultati" mostra il tuo punteggio relativo ai principali rilevatori, così potrai capire esattamente a che punto sei prima di pubblicare o inviare il tuo lavoro.