Gemini API: come ottenere una chiave, chiamare il modello e quanto costano i gettoni
Lo Gemini API è il modo in cui chiami i modelli Gemini dal tuo codice invece che da una finestra di chat: un bot di supporto sul tuo sito, uno script che valuta i ticket, il completamento del codice in un editor, un'integrazione CRM. Il percorso classico richiede un account Google, una configurazione di fatturazione cloud e una carta straniera. Su NeuralSpace il percorso è più breve: una chiave viene creata nella tua dashboard in circa un minuto, il modello viene richiamato con una richiesta compatibile con OpenAI e paghi con un saldo token, senza abbonamento. Di seguito è riportata una guida passo passo: come ottenere una chiave, come si presenta la tua prima chiamata a Gemini 3.8 Flash e quanto costano i token.
Cos'è il Gemini API e chi ne ha bisogno
Gemini è la famiglia di modelli linguistici di Google. Attraverso API è aperto agli sviluppatori: invii una serie di messaggi, ottieni una risposta generata e la usi nel tuo prodotto: mostrala all'utente, memorizzala, elaborala ulteriormente. Casi d'uso tipici: supporto di chatbot, riepilogo di e-mail e documenti, estrazione di dati strutturati da testo, stesura di contenuti, automazione della routine negli script. Gemini 3.8 Flash nel catalogo NeuralSpace è il ramo veloce della famiglia: un equilibrio tra velocità e prezzo che si adatta ai dialoghi e all'elaborazione di testi in blocco.
Passaggio 1. Ottieni una chiave
- Iscriviti su NeuralSpace con la tua email: ci vuole meno di un minuto. Ai nuovi utenti vengono accreditati subito i gettoni iniziali, sufficienti per le prime API chiamate senza ricarica.
- Apri il API pagina tasti nella tua dashboard e crea una chiave. La chiave assomiglia a BLK0 e viene mostrata una volta: salvala immediatamente in un gestore di password o in una variabile di ambiente, non nel tuo repository.
- Controlla il tuo saldo: i modelli di testo richiedono un minimo di 50 token sul conto. Le ricariche avvengono nel dashboard: niente carte straniere, niente costi di abbonamento.

Passaggio 2. Chiama il modello
Gemini in pubblico API funziona tramite l'endpoint BLK1 compatibile con OpenAI: il corpo trasporta il modello, un array BLK2 con ruoli di sistema/utente/assistente e il limite BLK3. Una richiesta di arricciatura minima:
BLK4
La risposta ritorna nel formato OpenAI: il testo generato è in BLK5, l'utilizzo effettivo è in BLK6. Se disponi già del codice SDK OpenAI, cambiano esattamente due valori: base_url e la chiave:
BLK7
Le interfacce di chat traggono vantaggio dallo streaming: aggiungi BLK8 e la risposta arriva in blocchi tramite eventi inviati dal server, in modo che l'utente veda le prime parole prima del completamento della generazione.
Passaggio 3. Scopri quanto costa
La fatturazione è misurata: i token di input (la tua richiesta) e i token di output (la risposta del modello) vengono conteggiati separatamente, ciascuno con il proprio prezzo per milione. Per Gemini 3.8 Flash, al momento in cui scrivo, sono 33,5 token per milione di input e 168 token per milione di output. Una richiesta tipica di "2.000 token di contesto + 500 token di output" costa circa 0,15 token. Il prezzo è legato al tasso di cambio e fluttua, quindi controlla la tabella live prima di fare i conti: è pubblicata sul API pagina documentazione e restituito in formato leggibile dalla macchina da BLK9 . Per fare un confronto: DeepSeek V4 Flash nello stesso catalogo costa 21/42 token per milione, i modelli Claude sono notevolmente più costosi; Gemini 3.8 Flash si trova a metà in termini di prezzo e risponde velocemente.
Due limiti di servizio: 60 richieste al minuto per chiave e un saldo minimo di 50 token per i modelli di testo. Il saldo attuale è disponibile tramite BLK10, gli addebiti vengono visualizzati nella cronologia delle transazioni del tuo profilo.
Gemini sul sito: non è necessario alcun codice
Se non hai ancora bisogno del API, gli stessi modelli vivono nell'interfaccia: scegli Gemini 3.8 Flash nel chiacchierata - la ricerca web è abilitata lì - e per le immagini il generazione di immagini sezione offre Nano Banana, un modello basato su Gemini 2.5 Flash. Il saldo è condiviso: chat e API preleva dallo stesso conto.
Errori comuni della prima richiesta
- 401 Non autorizzato — la chiave è stata passata in modo errato: uno spazio in più, un valore troncato, un prefisso sbagliato. La chiave completa va dopo BLK11 o nell'intestazione BLK12.
- 429 Troppe richieste - hai raggiunto il limite di 60 richieste al minuto. Aggiungi una pausa o una coda dalla tua parte.
- Errore di equilibrio — meno di 50 token sul conto: ricarica nella dashboard e riprova.
- La chiave è trapelata in Git — mantienilo nelle variabili di ambiente (.env) e non eseguirne mai il commit; se perde, riemettere la chiave sulla stessa pagina delle chiavi API.
Domande frequenti
Ho bisogno di un conto da Google o di una carta straniera?
No. La chiave viene rilasciata nella tua dashboard NeuralSpace e paghi dal saldo dei token: fatturazione basata su token, nessun abbonamento, nessuna fatturazione cloud.
Quanto costa una chiamata da Gemini API?
Solo i token effettivi: al momento in cui scrivo, 33,5 token per milione di input e 168 per milione di output per Gemini 3,8 Flash; una richiesta di un paio di migliaia di token equivale a circa 0,15 token. I prezzi attuali sono in BLK13 e nella tabella della documentazione.
Esiste un livello gratuito?
Non ci sono generazioni libere sulla piattaforma. I nuovi utenti ricevono token iniziali, sufficienti per i primi esperimenti, dopodiché paghi per token senza costi di abbonamento.
Cos'altro può fare il API oltre al testo?
Con la stessa chiave ottieni generazione di immagini, video e musica, sintesi e riconoscimento vocale e un server MCP su https://neuralspace.pro/mcp per agenti AI. L'elenco completo degli endpoint è nella documentazione.