Aggiornato ad agosto 2026 · Tempo di lettura: 20 minuti
Se devi scegliere un solo servizio gratuito, ChatGPT offre l’equilibrio più prudente per un utilizzo generale, soprattutto quando contano ricerca aggiornata, qualità delle fonti e cautela nelle decisioni operative. Gemini è preferibile quando la priorità è rispettare numerosi vincoli formali o lavorare con maggiore continuità nell’ecosistema Google.
Il risultato cambia in base all’attività. Nei quattro test esplorativi svolti da Volvren il 31 luglio 2026, Gemini ha richiesto meno correzioni nella scrittura vincolata, ChatGPT ha ottenuto il vantaggio più netto nella ricerca normativa e i due servizi hanno commesso errori diversi nell’analisi di un documento. La scelta più utile dipende dal lavoro residuo che ciascun output lascia nel tuo caso concreto.
In breve: quale scegliere
- Scegli ChatGPT Free se cerchi un unico assistente per attività diverse e dai particolare importanza alla ricerca aggiornata e alla prudenza delle raccomandazioni.
- Scegli Gemini Free se lavori spesso con istruzioni formali complesse o vuoi una continuità più naturale con Gmail, Drive e Documenti.
- Non fidarti automaticamente di nessuno dei due per calcoli, documenti e decisioni aziendali: nel nostro test entrambi hanno prodotto una risposta plausibile con un errore importante.
- Valuta di usarli insieme quando il costo di un errore giustifica un secondo controllo, verificando comunque il risultato sui dati o sulle fonti originali.
- Non estendere questi risultati ai piani a pagamento: Google AI Pro e ChatGPT Plus sono stati confrontati attraverso la documentazione ufficiale, non con prove equivalenti.
Gemini vs ChatGPT a colpo d’occhio
| Attività o criterio | Risultato del confronto | Che cosa significa |
|---|---|---|
| Scrittura italiana con molti vincoli | Gemini | Ha rispettato tutti i requisiti formali al primo tentativo, anche se lo stile era più burocratico |
| Documento, costi e requisiti | Nessun vincitore | Gemini ha contraddetto la propria analisi; ChatGPT ha mostrato formule errate |
| Ricerca aggiornata con fonti | ChatGPT | Ha ricostruito meglio il quadro normativo e gestito le fonti ufficiali discordanti |
| Lettura di una dashboard | Quasi pari | Entrambi corretti sui dati; lieve vantaggio ChatGPT per la formulazione più prudente dell’azione sul budget |
| Integrazione con l’ecosistema Google | Gemini | Offre una continuità più diretta con Gmail, Drive e Documenti, non misurata nei test |
| Utilizzo generale con un solo piano gratuito | ChatGPT, con riserva | Ha lasciato meno lavoro nei compiti più delicati, ma richiede comunque verifica |
Il confronto diretto riguarda Gemini Free con il modello 3.6 Flash selezionato e ChatGPT Free senza nome del modello visibile nell’interfaccia. I quattro test sono prove esplorative eseguite una sola volta e non un benchmark statistico.
Che cosa stiamo davvero confrontando
Gemini e ChatGPT sono servizi che possono offrire modelli, strumenti e limiti diversi in base al piano, all’account e alla modalità. Il confronto pratico riguarda Gemini Free con 3.6 Flash selezionato e ChatGPT Free con il modello gestito automaticamente e non indicato nell’interfaccia. I piani a pagamento e le integrazioni sono descritti attraverso la documentazione ufficiale, non come esperienza diretta.
Se vuoi approfondire i due servizi prima del confronto, consulta le guide Cos’è ChatGPT e come usarlo e Gemini AI: cos’è, come funziona e come usarlo nel 2026.
Piani considerati nel confronto
I test riguardano esclusivamente Gemini Free e ChatGPT Free. I piani a pagamento non sono stati provati in condizioni equivalenti: il confronto seguente deriva dalle informazioni ufficiali disponibili al 31 luglio 2026, non dall’esperienza diretta di Volvren. La tabella non elenca tutti gli abbonamenti di Google e OpenAI, ma soltanto quelli richiamati nella scelta per profilo.
| Piano | Prezzo mensile mostrato | Differenza principale |
|---|---|---|
| Gemini Free | Gratis | Nel test era selezionato Gemini 3.6 Flash; modelli e strumenti disponibili possono variare per account |
| ChatGPT Free | Gratis | Accesso limitato all’esperienza predefinita, ricerca, file, analisi dati, immagini e Deep Research |
| Google AI Plus | 4,99 € | Limiti più alti in Gemini, accesso più ampio a Gemini 3.1 Pro e Deep Research, 400 GB di spazio Google |
| Google AI Pro | 21,99 € | Limiti ulteriormente estesi in Gemini e 5 TB di spazio Google |
| ChatGPT Plus | 23 € sulla pagina ufficiale italiana | Accesso più ampio a modelli, caricamenti, memoria, ricerca e altri strumenti di ChatGPT |
La documentazione indica per ChatGPT Free accesso limitato a caricamenti, analisi dati, comprensione visiva, immagini e Deep Research. ChatGPT Plus amplia l’accesso a modelli e strumenti. La pagina ufficiale italiana controllata da Volvren il 31 luglio 2026 mostrava 23 euro al mese; la schermata non esplicitava l’IVA o altre componenti fiscali. Il prezzo locale non è stato ricavato dal listino statunitense e va verificato nuovamente se cambia il canale d’acquisto. Fonti: piani ChatGPT e guida ufficiale a ChatGPT Plus.
La documentazione ufficiale indicava GPT-5.5 Instant come modello predefinito per tutti gli utenti ChatGPT; per il piano Free, il modello predefinito e i limiti possono cambiare nel tempo. Durante i test, però, l’interfaccia non mostrava il modello assegnato. Gli output vanno quindi attribuiti a ChatGPT Free, non a un modello dedotto dalla documentazione. La distinzione conta perché il servizio può cambiare modello, limiti o strumenti senza rendere ogni passaggio visibile all’utente. Fonti: annuncio ufficiale di GPT-5.5 Instant e FAQ di ChatGPT Free.
Google AI Plus e Google AI Pro aumentano progressivamente i limiti di Gemini e includono spazio su Gmail, Drive e Google Foto. Nella pagina ufficiale italiana controllata il 31 luglio 2026 costavano rispettivamente 4,99 e 21,99 euro al mese; anche in questo caso la schermata acquisita non esplicitava l’IVA. AI Plus è l’ingresso a pagamento più economico tra i piani Google considerati qui, mentre AI Pro è il confronto commerciale più vicino a ChatGPT Plus. Fonte: piani Google AI in Italia.
Prezzo e funzioni non rendono equivalenti i piani: conta se servono soprattutto spazio e app Google oppure modelli e strumenti di ChatGPT. In ogni caso, un abbonamento superiore non garantisce calcoli, fonti o raccomandazioni corretti.
Neppure il prezzo in euro può essere ricavato convertendo automaticamente quello in dollari: imposte, fatturazione e offerte locali possono produrre importi diversi. Per una decisione d’acquisto valgono quindi il flusso ufficiale mostrato all’account italiano e le condizioni disponibili al momento dell’abbonamento.
Come abbiamo svolto i quattro test
Le prove sono state eseguite il 31 luglio 2026 nelle interfacce web di ChatGPT Free e Gemini Free. Abbiamo cercato di ridurre le differenze estranee alla qualità delle risposte applicando lo stesso protocollo.
| Elemento | Condizione applicata |
|---|---|
| Account | Personali e gratuiti |
| Lingua | Interfacce e prompt in italiano |
| Contesto | Una nuova chat temporanea per ogni prova |
| Input | Stesso prompt e stessi file originali |
| Interazione | Prima risposta, senza correzioni, follow-up o rigenerazioni |
| Personalizzazione | Memoria e conversazioni precedenti escluse |
| Integrazioni | Nessuna app o fonte personale collegata richiamata dai prompt |
| Ricerca | Attivata soltanto nel Test 3 |
| Valutazione | Confronto con risultati noti, calcoli verificati e fonti primarie |
Nel Test 3 avevamo previsto di usare Deep Research, ma la funzione non risultava selezionabile in nessuno dei due account. La prova è stata quindi svolta con la normale ricerca web disponibile nei due servizi. Questa modifica mantiene il confronto omogeneo, ma impedisce di estendere il risultato alle modalità di ricerca approfondita.
Per ogni test abbiamo valutato la correttezza dell’output, il rispetto delle istruzioni e soprattutto il lavoro residuo necessario prima di poter utilizzare la risposta. Non abbiamo trasformato i risultati in un punteggio complessivo: la rilevanza di una buona scrittura, di un calcolo corretto o di fonti affidabili cambia in base all’attività del lettore.
Test 1: scrittura professionale in italiano
La prima prova chiedeva di trasformare un memo disordinato in un’email professionale, conservando nove informazioni e numerosi vincoli di struttura, lunghezza e tono. Il prompt integrale del Test 1 è disponibile nell’allegato unico.
Entrambi i servizi hanno mantenuto correttamente date, importi, responsabilità e altre informazioni del memo. Le differenze sono emerse soprattutto nel rispetto dei vincoli e nello stile.
Gemini ha soddisfatto tutte le richieste formali al primo tentativo. L’email era completa, ordinata e utilizzabile, ma alcune formulazioni risultavano più burocratiche del necessario. Espressioni come “non potrà in alcun caso superare la cifra” potevano essere abbreviate senza perdere precisione.
ChatGPT ha prodotto un testo più asciutto, ma il corpo contava 119 parole, una in meno rispetto al limite minimo. Ha inoltre conservato quasi alla lettera l’ambiguità del memo nella frase “Al momento hanno confermato 12 persone”, senza chiarire chi avesse confermato. Questo secondo limite riguardava la scorrevolezza, mentre la parola mancante costituiva la violazione misurabile del prompt.

Nel Test 1 Gemini ha rispettato tutti i vincoli formali; ChatGPT è rimasto una parola sotto il limite minimo.
Verdetto del Test 1: Gemini ha lasciato meno lavoro obbligatorio e ha vinto la prova per aderenza alle istruzioni. ChatGPT è risultato più sintetico, ma non ha rispettato un requisito misurabile e richiedeva una piccola revisione linguistica. Questo test non dimostra che Gemini scriva sempre meglio: indica che, in questa esecuzione, ha gestito con maggiore precisione un insieme di vincoli formali.
Test 2: analisi di un documento e di dati
La seconda prova utilizzava un PDF sintetico sulla scelta di un fornitore per un progetto di tre mesi. Ai due servizi abbiamo chiesto di calcolare i costi, distinguere requisiti e preferenze, valutare la nota del responsabile acquisti e formulare una raccomandazione. Il prompt integrale del Test 2 è disponibile nell’allegato unico.
I risultati corretti erano:
- Nexa: 11.500 euro;
- Orion: 12.154 euro;
- Lumen: 12.000 euro.
Nexa e Orion rispettavano entrambi i due requisiti obbligatori indicati nel documento. Lumen doveva invece essere esclusa perché conservava i dati negli Stati Uniti e superava il limite di tre minuti per la prima risposta. La preferenza per una disponibilità almeno del 99,8% non poteva essere trasformata in un requisito obbligatorio.
Gemini ha calcolato correttamente tutti e tre i totali e ha mostrato formule coerenti. Ha anche classificato Nexa e Orion come idonee nella tabella. Nella raccomandazione, però, ha definito Nexa “l’unica opzione” che rispettava pienamente i requisiti obbligatori, contraddicendo sia il documento sia la propria analisi precedente. Nexa restava la scelta più difendibile perché era idonea e meno costosa, ma non era l’unico fornitore idoneo.
ChatGPT ha formulato una raccomandazione più coerente: ha riconosciuto Nexa come l’opzione meno costosa tra quelle conformi e ha spiegato perché la nota del responsabile acquisti fosse fuorviante. Il canone mensile di Orion era il più basso, ma setup e ticket eccedenti la rendevano l’offerta più cara nel periodo considerato.
Nella tabella di ChatGPT, tuttavia, le formule di Nexa e Lumen sottraevano ticket “eccedenti” negativi, invece di considerarli pari a zero. I totali mostrati erano corretti, ma non derivavano dalle formule scritte. È un errore particolarmente insidioso: una conclusione plausibile può nascondere un procedimento non verificato.

Gemini ha contraddetto la propria tabella nella raccomandazione; ChatGPT ha mostrato formule incompatibili con due totali corretti.
Verdetto del Test 2: nessun vincitore. Gemini ha svolto correttamente i calcoli, ma ha introdotto una contraddizione decisiva nella raccomandazione. ChatGPT ha ragionato meglio sulla scelta finale, ma ha mostrato due formule errate. Nessuno dei due output era pronto per essere usato senza controllo.
Test 3: ricerca aggiornata con fonti
La terza prova chiedeva un briefing sull’AI Act per una PMI italiana che usava sistemi generativi di terzi per email interne, articoli sottoposti a revisione editoriale e video pubblicitari deepfake. Il recente AI Omnibus rendeva necessario distinguere il testo aggiornato dalle pagine ufficiali non ancora consolidate. Il prompt integrale del Test 3 è disponibile nell’allegato unico.
Deep Research non risultava selezionabile, quindi entrambi hanno usato la ricerca web normale. Le risposte sono state poi controllate sulle fonti ufficiali aggiornate dell’Unione europea.
ChatGPT ha distinto correttamente la PMI, che usava sistemi altrui come deployer, dai provider e ha riconosciuto che i tre utilizzi non rientravano nelle categorie ad alto rischio descritte. Ha individuato l’obbligo di AI literacy già applicabile, l’assenza di uno specifico obbligo di trasparenza per le email interne, l’eccezione per gli articoli sottoposti a revisione umana e l’obbligo di dichiarare i video deepfake dal 2 agosto 2026. Ha inoltre riportato le nuove scadenze del 2 dicembre 2027 e del 2 agosto 2028 per i sistemi ad alto rischio, non pertinenti al caso.
La gestione delle fonti è stata decisiva. ChatGPT ha rilevato che alcune pagine dell’AI Act Service Desk mostravano ancora il testo precedente all’Omnibus e ha dato prevalenza al regolamento aggiornato su EUR-Lex. L’output superava però il limite di 650 parole e richiedeva correzioni puntuali nei riferimenti e nella formulazione. Per esempio, nel passaggio sulle email richiamava l’articolo 50(5), mentre la regola sui contenuti destinati al pubblico e la relativa eccezione sono nel paragrafo 4. Le correzioni non cambiavano l’inquadramento della PMI o le azioni principali.
In una ricerca normativa, ridurre un testo troppo lungo è un intervento editoriale; correggere il ruolo di un soggetto, un obbligo o la fonte prevalente richiede invece di rifare parte della verifica. È questa differenza, non la sola quantità di errori, a spiegare il vantaggio di ChatGPT nella prova.
Gemini ha riconosciuto il ruolo di deployer, la trasparenza per i deepfake e le nuove scadenze, ma ha introdotto errori più sostanziali. Ha omesso regole di governance e obblighi per i provider di modelli di AI per finalità generali già applicabili dal 2 agosto 2025, pur essendo richiesta la distinzione tra PMI e fornitori. Ha inoltre attribuito genericamente ai provider una marcatura CE del “modello” e descritto l’AI literacy come un livello da garantire, invece di misure volte a sostenere lo sviluppo delle competenze.
Alcune sue affermazioni usavano inoltre fonti secondarie non necessarie e non risolvevano con la stessa precisione il conflitto tra pagine ufficiali. La trascrizione di una colonna della tabella Gemini è rimasta parziale, ma gli errori determinanti sono documentati nelle sezioni conservate integralmente.

ChatGPT ha gestito meglio obblighi, scadenze e conflitto tra fonti ufficiali; Gemini ha introdotto errori più sostanziali.
Verdetto del Test 3: ChatGPT ha ottenuto il vantaggio più netto del confronto. La risposta era troppo lunga e da correggere, ma conservava l’inquadramento normativo decisivo. Gli errori di Gemini su AI literacy, marcatura CE e fonti avrebbero potuto orientare male una decisione aziendale.
Le verifiche normative di riferimento sono disponibili nel Regolamento (UE) 2026/1744 su EUR-Lex, nella cronologia ufficiale dell’AI Act, nell’articolo 50 dell’AI Act Service Desk e nelle FAQ della Commissione sull’AI literacy.
Test 4: comprensione di una dashboard
L’ultima prova misurava la lettura di una dashboard con KPI complessivi, andamento settimanale, dati per canale e una nota sull’aggiornamento del tracciamento. Richiedeva calcoli esatti e prudenza: l’aumento delle visite e il calo delle conversioni erano osservabili, non la loro causa. Il prompt integrale del Test 4 è disponibile nell’allegato unico.

La dashboard sintetica fornita in modo identico a Gemini Free e ChatGPT Free.
Entrambi i servizi hanno letto correttamente i quattro KPI complessivi:
- spesa di 11.200 euro, 800 euro sotto il limite;
- 20.000 visite, 2.000 sopra l’obiettivo;
- 662 lead, 38 sotto l’obiettivo;
- conversione del 3,31%, inferiore di 0,59 punti percentuali rispetto all’obiettivo.
Anche il confronto settimanale era corretto. Tra l’8-14 e il 15-21 giugno, le visite aumentavano del 50%, i lead diminuivano del 25% e la conversione scendeva di 2 punti percentuali. Newsletter risultava il canale più efficiente, con un costo per lead di 10,17 euro, mentre Social era il peggiore, con 25 euro per lead. Social generava anche il maggior numero di visite, ma non era per questo il canale più efficiente.
Gemini ha separato chiaramente dati e ipotesi e ha indicato come prima azione la verifica del tracciamento aggiornato il 18 giugno. Subito dopo ha però proposto direttamente di ridurre la spesa su Social a favore di Newsletter e Search, senza subordinare in modo esplicito la riallocazione all’esito del controllo.
ChatGPT ha ottenuto gli stessi risultati numerici e ha assegnato la stessa priorità alla verifica del tracciamento. Ha formulato però l’eventuale riallocazione come una valutazione successiva, da approfondire sulla base del costo per lead e degli altri controlli. Il lieve vantaggio deriva quindi dalla cautela della raccomandazione, non dall’ordine delle azioni.

Entrambi hanno letto correttamente i dati; ChatGPT ha subordinato la riallocazione del budget alla verifica del tracciamento.
Verdetto del Test 4: sostanziale pareggio, con un lieve vantaggio ChatGPT. Entrambi hanno letto correttamente i dati; Gemini ha distinto meglio osservazioni e ipotesi, mentre ChatGPT ha subordinato la decisione sul budget alla verifica della qualità dei dati.
Dove ciascuno lascia meno lavoro residuo
Per lavoro residuo intendiamo le verifiche e le modifiche necessarie prima di usare una risposta. Una formula errata o una norma interpretata male pesano più di un testo semplicemente prolisso.
| Attività | Meno lavoro residuo | Controllo ancora necessario |
|---|---|---|
| Email con vincoli formali | Gemini | Alleggerire alcune formulazioni burocratiche |
| Documento con costi e requisiti | Nessuno | Ricontrollare formule, requisiti e coerenza della raccomandazione |
| Ricerca normativa aggiornata | ChatGPT | Ridurre il testo e correggere i riferimenti puntuali |
| Lettura di una dashboard | Quasi pari | Verificare qualità e attribuzione dei dati prima di agire |
Nel complesso, ChatGPT ha lasciato meno lavoro quando contavano ricerca e prudenza operativa; Gemini quando prevalevano i vincoli formali. Nel Test 2 bisognava invece tornare al documento originale in entrambi i casi.
Le correzioni del Test 1 erano circoscritte: per ChatGPT bastavano una parola aggiuntiva e una frase più naturale, mentre Gemini richiedeva soltanto un alleggerimento stilistico facoltativo. Nel Test 4 entrambi gli output erano già corretti nei calcoli; la differenza riguardava la forza della raccomandazione sul budget, non la priorità assegnata alla verifica del tracciamento.
I Test 2 e 3 lasciavano invece lavoro sostanziale. Nel documento sui fornitori era necessario ricontrollare formule, requisiti e raccomandazione sui dati originali. Nel briefing normativo la versione di ChatGPT poteva essere corretta senza cambiare l’impianto, mentre quella di Gemini richiedeva una nuova verifica di obblighi, formulazioni e gerarchia delle fonti.
Questo criterio è più utile di un punteggio unico: una piccola violazione formale può essere decisiva quando il prompt impone una soglia, ma un errore nascosto in una formula o in una norma può avere conseguenze molto maggiori anche se il resto dell’output appare convincente.
Ecosistema, integrazioni, privacy e costi
Integrazioni e continuità del lavoro
Gemini può interagire con Gmail, Documenti, Drive, Calendar, Keep e Tasks quando account e impostazioni lo consentono; alcune funzioni sono disponibili direttamente nelle app Google. ChatGPT può collegarsi a servizi e fonti esterne, compresi strumenti Google e Microsoft, con disponibilità variabile per piano e ambiente. Fonti: app Google Workspace in Gemini e app in ChatGPT.
Le connessioni personali erano escluse dai test. Possiamo quindi attribuire a Gemini una continuità più naturale nell’ecosistema Google, non una qualità superiore degli output.
Privacy e utilizzo delle conversazioni
Negli account personali di ChatGPT, l’uso dei contenuti per migliorare i modelli può essere disattivato. Le chat temporanee non compaiono nella cronologia, non creano memorie, non vengono utilizzate per addestrare i modelli e vengono eliminate dai sistemi entro 30 giorni, salvo le eccezioni dichiarate per sicurezza e abusi. Fonte: controlli dei dati di ChatGPT.
Negli account personali Gemini, con “Conserva attività” attivo, conversazioni e contenuti possono essere utilizzati per migliorare i servizi, anche attraverso revisione umana. Disattivando l’opzione o utilizzando una chat temporanea, le nuove conversazioni non vengono usate per addestrare i modelli salvo l’invio di feedback, ma Google le conserva con l’account fino a 72 ore per erogare il servizio e proteggerlo. Fonte: Privacy Hub di Gemini.
Non emerge un vincitore assoluto sulla privacy: contano tipo di account, impostazioni, app collegate, controlli amministrativi e dati trattati. Documenti riservati, credenziali e dati personali non necessari non dovrebbero essere caricati in un account consumer senza una valutazione specifica.
Le chat temporanee riducono alcuni usi e tempi di conservazione, ma non trasformano un account consumer in un ambiente adatto a qualsiasi informazione aziendale. Per professionisti e PMI la decisione deve considerare anche autorizzazioni interne, necessità del dato e possibilità di rimuovere o anonimizzare le informazioni prima del caricamento.
Quale abbonamento offre più valore?
Google AI Pro è più facile da giustificare se usi intensamente Gmail, Drive e Documenti e valorizzi lo spazio cloud incluso. ChatGPT Plus è più coerente se cerchi soprattutto modelli di ragionamento, Deep Research, memoria, progetti e strumenti interni a ChatGPT. Google AI Plus offre un passaggio intermedio più economico, ma non equivale funzionalmente a ChatGPT Plus.
I piani a pagamento non sono stati testati in modo equivalente. Queste restano quindi indicazioni per profilo, non un verdetto sulla qualità o sul rapporto qualità-prezzo.
Quale scegliere in base al proprio utilizzo
La raccomandazione generale per ChatGPT non deriva da un punteggio aggregato: pesa soprattutto il minor lavoro sostanziale lasciato nella ricerca normativa e la cautela della raccomandazione nel Test 4. La preferenza può invertirsi quando contano di più i vincoli formali oppure la continuità con l’ecosistema Google.
Per documenti, calcoli e decisioni aziendali, nessuno dei due va usato senza verifica. Anche il lieve vantaggio di ChatGPT sulla dashboard non dimostra una superiorità generale nell’analisi visiva. Le indicazioni sui piani a pagamento restano documentali e non permettono di considerarli automaticamente più affidabili.
| Profilo o attività prevalente | Scelta più coerente | Motivo |
|---|---|---|
| Utilizzo gratuito generale | ChatGPT Free | Risultato più prudente nelle prove con ricerca e decisioni operative |
| Molti vincoli di forma e lunghezza | Gemini Free | Migliore aderenza nel test di scrittura |
| Lavoro quotidiano nelle app Google | Gemini | Integrazione più diretta, non misurata nei test sugli output |
| PDF, calcoli o decisioni ad alto impatto | Nessuno senza verifica | Entrambi hanno prodotto un errore importante nel Test 2 |
Questa associazione vale per le condizioni osservate il 31 luglio 2026. Un’attività diversa, un nuovo modello o un piano superiore possono modificare il risultato; per questo è più corretto scegliere in base al compito ricorrente che al nome del prodotto.
Se vuoi valutare anche un assistente con un posizionamento diverso, puoi consultare il confronto ChatGPT vs Claude.
Quando conviene usare Gemini e ChatGPT insieme
Usare entrambi può essere utile quando il costo di un errore giustifica un controllo aggiuntivo. Il secondo servizio può cercare omissioni, formule non giustificate e contraddizioni nell’output del primo.
Il procedimento più affidabile prevede tre passaggi:
- ottenere una prima risposta da uno dei due servizi;
- chiedere all’altro di contestarla indicando errori verificabili;
- controllare direttamente sul documento originale, con un calcolo autonomo o sulle fonti primarie.
Il Test 2 mostra perché il terzo passaggio è indispensabile: Gemini aveva formule corrette e una raccomandazione contraddittoria; ChatGPT una scelta coerente e formule errate. Anche l’accordo tra i due non prova che una conclusione sia corretta. Il controllo incrociato riduce alcuni punti ciechi, ma non sostituisce la verifica.
Il secondo assistente deve ricevere anche il materiale originale e un compito di contestazione preciso. Chiedere soltanto “sei d’accordo?” favorisce una conferma superficiale; è più utile chiedere quali formule non giustificano i totali, quali requisiti sono stati confusi o quali affermazioni non sono sostenute dalle fonti. La decisione finale resta comunque sul documento, sul calcolo autonomo o sulla fonte primaria.
Limiti del confronto
Questi risultati descrivono quattro prove esplorative svolte il 31 luglio 2026, non un benchmark statistico. Ogni test è stato eseguito una sola volta e abbiamo conservato la prima risposta. Una nuova esecuzione avrebbe potuto produrre un output differente.
Il confronto presenta inoltre questi limiti:
- riguarda account personali e gratuiti, non i piani a pagamento o aziendali;
- valuta i servizi disponibili nelle interfacce utilizzate, non tutti i modelli sviluppati da Google e OpenAI;
- non comprende app collegate, dati personali o integrazioni con Google Workspace e altre piattaforme;
- non utilizza Deep Research, che non risultava selezionabile nei due account;
- non misura velocità, stabilità, generazione di immagini, programmazione o conversazioni prolungate;
- non permette di separare completamente la qualità del modello dagli strumenti di ricerca e dalle scelte automatiche della piattaforma;
Modelli, limiti, prezzi e funzioni possono cambiare anche in tempi brevi. Le informazioni commerciali e la disponibilità degli strumenti devono quindi essere ricontrollate alla data dell’ultima revisione dell’articolo.
Conclusione: Gemini o ChatGPT?
Conta il lavoro residuo lasciato da ciascun output, non il numero di test vinti. ChatGPT è il punto di partenza più prudente per un utilizzo gratuito generale: ha gestito meglio la prova più delicata, la ricerca normativa, e ha formulato con maggiore cautela la decisione sul budget. Gemini resta più adatto quando prevalgono istruzioni formali articolate o l’integrazione con l’ecosistema Google.
Il limite comune pesa più del vincitore: nel test su documenti e calcoli entrambi hanno prodotto risposte convincenti ma non utilizzabili senza controllo. Scegliere il servizio più adatto può ridurre il lavoro residuo; non elimina la verifica di formule, fonti e decisioni.
Prova entrambi gratis sullo stesso compito reale, usando gli stessi dati e una chat temporanea. Se ChatGPT risulta più adatto al tuo lavoro, confronta poi ChatGPT Free e Plus: differenze, test e quando conviene pagare prima di abbonarti.
