
Rappresentazione illustrativa dei token e dei limiti di utilizzo dell’AI. Il grafico non mostra il consumo reale di ChatGPT, Gemini o Claude.
Ho finito i token»: è una spiegazione frequente quando ChatGPT, Gemini o Claude smettono di rispondere o mostrano un avviso. Ma il termine token indica piccoli elementi di testo elaborati dal modello; non è il nome generico di qualsiasi blocco. Un limite di messaggi, una chat troppo lunga e un credito API esaurito sono situazioni diverse. Confonderle porta a tentativi inutili, come ricaricare di continuo una pagina quando il servizio indica già l'ora del ripristino.
In breve: leggi il messaggio esatto. Se dice che hai raggiunto un limite di utilizzo, attendi il ripristino o scegli un'opzione disponibile nel tuo piano. Se segnala un problema di lunghezza o contesto, riassumi il lavoro e riparti da una chat nuova. Se compare un errore di quota o saldo API, controlla l'account sviluppatore e la fatturazione di quell'API: l'abbonamento alla chat potrebbe essere separato.
Aggiornato al 29 settembre 2026. Piani, messaggi e quote cambiano nel tempo: verifica sempre l'avviso mostrato nel tuo account. Questa guida riguarda sia le chat per utenti sia, dove indicato, le API per sviluppatori; distingue i due ambiti.
Che cosa sono i token, in parole semplici
Un modello AI lavora su token, cioè parti di testo che non corrispondono sempre a parole intere. La domanda, parte del contesto della conversazione e la risposta occupano token. Anche allegati e strumenti possono incidere sulle risorse usate, secondo le regole del servizio. La finestra di contesto indica quanta informazione il modello può considerare in una richiesta; i limiti d'uso regolano quanto puoi usare il servizio in un periodo; i crediti API riguardano le chiamate fatte da software tramite un account sviluppatore. Sono concetti collegati, ma non equivalenti.
OpenAI spiega la differenza tra token e finestra di contesto nella sua guida ai token. Questo non significa che ogni chat mostri un contatore di token rimanenti: nell'interfaccia per utenti spesso vedi piuttosto avvisi relativi al modello o al piano.
Come riconoscere il limite che hai raggiunto
| Situazione | Indizio tipico | Cosa fare |
|---|---|---|
| Limite d'uso della chat | Avviso con modello, funzione o tempo di ripristino | Attendi o usa un'altra opzione offerta dal servizio |
| Conversazione o input troppo lunghi | Avviso sulla lunghezza, oppure risposte che perdono dettagli | Riassumi e apri una nuova chat; riduci gli allegati |
| Crediti o quota API esauriti | Errore nell'app che usa una chiave API, talvolta con codice | Controlla quota, saldo, fatturazione e codice esatto nella console API |
| Blocco senza messaggio chiaro | Indicatore di elaborazione che non termina | Verifica stato del servizio, chat nuova, rete e browser |
Se la risposta rimane semplicemente su “elaborazione”, non concludere che siano finiti i token. Per quel caso abbiamo preparato una guida ai blocchi di ChatGPT, Gemini e altre AI con i controlli da fare nell'ordine giusto.
ChatGPT: messaggi, modello, crediti e API non sono la stessa cosa
In ChatGPT alcuni modelli o funzioni possono avere limiti legati al piano e al periodo. Quando raggiungi un limite, il servizio può indicare quando torna disponibile il modello o mostrare un'alternativa. La soluzione dipende dall'avviso concreto: un limite non si cancella eliminando la cronologia. I limiti e le opzioni variano nel tempo; non riportiamo qui un numero di messaggi valido per tutti gli account.
Se invece usi un programma con una chiave API OpenAI, si applicano quote e fatturazione della piattaforma API. OpenAI distingue la fatturazione di ChatGPT da quella API e documenta separatamente errori di quota o spesa ed errori di velocità delle richieste. Due errori che possono essere descritti colloquialmente come «token finiti» richiedono quindi interventi diversi.
Gemini: limiti del modello e lunghezza del contesto
Le app Gemini prevedono limiti che dipendono da modello, funzioni e piano. Google spiega che, quando raggiungi un limite, l'app comunica il ripristino o propone, se disponibile, un'altra modalità o un piano con accesso maggiore. Richieste lunghe, file e conversazioni estese possono incidere sull'utilizzo.
Una finestra di contesto raggiunta è un'altra questione: se fornisci più materiale di quanto il modello riesce a considerare, alcuni dettagli potrebbero non entrare nella risposta. Riduci il materiale o suddividilo in parti, e chiedi un riepilogo dei fatti essenziali prima di cambiare conversazione. Controlla le indicazioni ufficiali sui limiti di Gemini per i dettagli aggiornati del tuo piano.
Claude: le chat lunghe possono pesare sull'utilizzo
Per Claude, Anthropic spiega che i messaggi disponibili dipendono dal piano, ma anche dalla lunghezza della conversazione, dal testo inviato e dagli allegati. Una chat che si prolunga per giorni può usare più risorse di una domanda breve. Se compare un avviso di limite, guarda le indicazioni nell'account; se il problema è una conversazione molto estesa, crea una sintesi fedele dei dati utili e riparti da lì. Le indicazioni Anthropic sui limiti spiegano come gestire meglio il proprio utilizzo.
Un abbonamento a Claude.ai e l'uso dell'API Anthropic hanno fatturazioni distinte: un piano chat non equivale automaticamente a un saldo API, come chiarisce il centro assistenza Anthropic.
E Copilot, DeepSeek e Perplexity?
Per Copilot è essenziale sapere quale prodotto stai usando: le funzioni AI integrate in alcune app Microsoft 365 possono avere crediti e limiti legati all'abbonamento. Non applicare automaticamente quelle quote alla chat personale.
Per DeepSeek, la documentazione API identifica anche un errore 402 “Insufficient Balance”: indica saldo insufficiente nell'API, non prova che qualunque utente della chat web abbia «esaurito i token». Per Perplexity, alcuni accessi ai modelli o alle ricerche avanzate dipendono dal piano e possono essere soggetti a limiti: leggi l'avviso specifico e la documentazione del tuo piano.
Come continuare un lavoro senza perdere il filo
Se devi passare a una chat nuova perché il contesto è troppo esteso, prepara un riassunto di passaggio con obiettivo, dati verificati, decisioni già prese e prossimo passo. Per esempio: «Sto scrivendo una guida ai mini PC per un blog italiano. Abbiamo verificato queste tre fonti [link]. Mantieni questo titolo e queste conclusioni; continua dalla sezione sui limiti». Controlla che la sintesi non includa password, dati riservati o informazioni che non vuoi inserire nel nuovo servizio.
Se hai raggiunto un limite temporaneo del piano, la chat nuova potrebbe non aggirarlo. In quel caso attendi il ripristino indicato o usa un modello alternativo se viene proposto. Se sei uno sviluppatore, non pubblicare la chiave API né screenshot contenenti credenziali mentre chiedi aiuto.
Domande frequenti
Se apro una nuova chat, riottengo i token?
Una chat nuova può ridurre il contesto della singola conversazione. Non ripristina automaticamente una quota d'uso temporanea, un credito API o un limite del tuo piano.
Un abbonamento ChatGPT o Claude include l'API?
Non presumere che sia così: chat e API hanno impostazioni e fatturazione distinte. Controlla i documenti ufficiali e il tuo account prima di aggiungere crediti.
Perché l'AI ha dimenticato ciò che avevo scritto all'inizio?
Una conversazione molto lunga può superare la quantità di informazioni gestibile in una singola richiesta o far sì che alcuni dettagli non siano considerati. Riporta i fatti essenziali e chiedi conferma prima di proseguire.
Se vedo un indicatore che gira, ho esaurito i token?
Non necessariamente. Senza un avviso esplicito, controlla stato del servizio, browser, rete e funzionamento di una nuova conversazione.
Fonti ufficiali
OpenAI: token e contesto; OpenAI: quota API; Google: limiti Gemini; Anthropic: limiti Claude; Microsoft: crediti Microsoft 365; DeepSeek: codici API. Consulta sempre il messaggio visualizzato nel tuo account: quote e nomi dei modelli possono cambiare.
Commenti
Posta un commento