Gemini API: como obter uma chave, ligar para o modelo e quanto custam os tokens
O Gemini API é como você chama modelos Gemini a partir de seu próprio código em vez de uma janela de bate-papo: um bot de suporte em seu site, um script que faz a triagem de tickets, conclusão de código em um editor, uma integração de CRM. A rota clássica requer uma conta Google, configuração de faturamento na nuvem e um cartão estrangeiro. Em NeuralSpace o caminho é mais curto: uma chave é criada em seu painel em cerca de um minuto, o modelo é chamado com uma solicitação compatível com OpenAI e você paga com um saldo de token – sem assinatura. Abaixo está um guia passo a passo: como obter uma chave, como é sua primeira chamada para Gemini 3.8 Flash e quanto custam os tokens.
O que é o Gemini API e quem precisa dele
Gemini é a família de modelos de linguagem de Google. Através do API ele está aberto aos desenvolvedores: você envia uma série de mensagens, obtém uma resposta gerada e a utiliza em seu produto — mostra ao usuário, armazena e processa posteriormente. Casos de uso típicos: suporte a chatbots, resumo de e-mails e documentos, extração de dados estruturados de texto, elaboração de conteúdo, automatização de rotina em scripts. Gemini 3.8 Flash no catálogo NeuralSpace é o ramo rápido da família: um equilíbrio entre velocidade e preço que se adapta a diálogos e processamento de texto em massa.
Passo 1. Obtenha uma chave
- Inscreva-se no NeuralSpace com seu e-mail – leva menos de um minuto. Novos usuários recebem tokens iniciais imediatamente, o suficiente para as primeiras API chamadas sem recarga.
- Abra o API página de chaves em seu painel e crie uma chave. A chave se parece com BLK0 e é mostrada uma vez – salve-a imediatamente em um gerenciador de senhas ou em uma variável de ambiente, não em seu repositório.
- Verifique seu saldo: os modelos de texto exigem um mínimo de 50 tokens na conta. As recargas acontecem no painel – sem cartões estrangeiros, sem taxas de assinatura.

Passo 2. Chame o modelo
Gemini no público API funciona por meio do endpoint BLK1 compatível com OpenAI: o corpo carrega o modelo, uma matriz BLK2 com funções de sistema/usuário/assistente e o limite BLK3. Uma solicitação curl mínima:
BLK4
A resposta volta no formato OpenAI: o texto gerado está em BLK5 , o uso real está em BLK6 . Se você já possui o código OpenAI SDK, exatamente dois valores mudam – base_url e a chave:
BLK7
As interfaces de bate-papo se beneficiam do streaming: adicione BLK8 e a resposta chega em pedaços por meio de eventos enviados pelo servidor, para que o usuário veja as primeiras palavras antes da conclusão da geração.
Passo 3. Saiba quanto custa
O faturamento é medido: tokens de entrada (seu prompt) e tokens de saída (a resposta do modelo) são contados separadamente, cada um com seu próprio preço por milhão. Para Gemini 3.8 Flash, no momento em que este artigo foi escrito, eram 33,5 tokens por milhão de entrada e 168 tokens por milhão de saída. Uma solicitação típica de “2.000 tokens de contexto + 500 tokens de saída” custa cerca de 0,15 tokens. O preço está vinculado à taxa de câmbio e flutua, então verifique a tabela ao vivo antes de fazer as contas: ela é publicada no API página de documentação e retornado em formato legível por máquina por BLK9 . Para efeito de comparação: DeepSeek V4 Flash no mesmo catálogo custa 21/42 tokens por milhão, os modelos Claude são visivelmente mais caros; Gemini 3.8 O Flash fica no meio do preço enquanto responde rapidamente.
Dois limites de serviço: 60 solicitações por minuto por chave e um saldo mínimo de 50 tokens para modelos de texto. O saldo atual está disponível via BLK10, as cobranças aparecem no histórico de transações do seu perfil.
Gemini no site — nenhum código é necessário
Se você ainda não precisa do API, os mesmos modelos residem na interface: escolha Gemini 3.8 Flash no bater papo — a pesquisa na web está habilitada lá — e para imagens o geração de imagem seção oferece Nano Banana, um modelo baseado em Gemini 2.5 Flash. O saldo é compartilhado: chat e sorteio API da mesma conta.
Erros comuns de primeira solicitação
- 401 Não Autorizado — a chave foi passada incorretamente: um espaço extra, um valor truncado, um prefixo errado. A chave completa vem depois do BLK11 ou no cabeçalho do BLK12.
- 429 Muitas solicitações – você atingiu o limite de 60 solicitações por minuto. Adicione uma pausa ou fila ao seu lado.
- Erro de equilíbrio — menos de 50 tokens na conta: recarregue no painel e tente novamente.
- Chave vazou no git — mantenha-o em variáveis de ambiente (.env) e nunca faça commit; se vazar, emita novamente a chave na mesma página de chaves API.
Perguntas frequentes
Preciso de uma conta Google ou de um cartão estrangeiro?
A chave é emitida no seu painel NeuralSpace e você paga com um saldo de token: cobrança baseada em token, sem assinatura, sem cobrança na nuvem.
Quanto custa uma chamada Gemini API?
Somente os tokens reais: no momento em que este artigo foi escrito, 33,5 tokens por milhão de entrada e 168 por milhão de saída para Gemini 3,8 Flash; uma solicitação de alguns milhares de tokens equivale a aproximadamente 0,15 tokens. Os preços atuais estão em BLK13 e na tabela de documentação.
Existe um nível gratuito?
Não há gerações livres na plataforma. Novos usuários recebem tokens iniciais – o suficiente para os primeiros experimentos – depois disso você paga por token sem taxa de assinatura.
O que mais o API pode fazer além de texto?
Com a mesma chave você obtém geração de imagem, vídeo e música, síntese e reconhecimento de fala e um servidor MCP em https://neuralspace.pro/mcp para agentes de IA. A lista completa de endpoints está na documentação.