Gemini API: как получить ключ и вызвать модель, цены по токенам
Gemini API — это способ вызывать модели Gemini не в окне чата, а из своего кода: чат-бота на сайте, скрипта обработки заявок, автодополнения в редакторе, интеграции с CRM. Классический маршрут требует аккаунта Google, настройки биллинга в облачной консоли и зарубежной карты. На NeuralSpace путь короче: ключ создаётся в личном кабинете за минуту, модель вызывается OpenAI-совместимым запросом, а оплата идёт токенами баланса в рублях — без подписки. Ниже — пошагово: как получить ключ, как выглядит первый запрос к Gemini 3.8 Flash и сколько стоят токены.
Что такое Gemini API и кому он нужен
Gemini — семейство языковых моделей Google. Через API оно доступно разработчикам: вы отправляете массив сообщений, получаете сгенерированный ответ и используете его в своём продукте — показываете пользователю, кладёте в базу, обрабатываете дальше. Типовые сценарии: чат-боты поддержки, суммаризация писем и документов, извлечение структурированных данных из текста, генерация черновиков, автоматизация рутины в скриптах. Модель Gemini 3.8 Flash в каталоге NeuralSpace — «быстрая» ветка семейства: баланс скорости и цены, подходящий для диалогов и массовой обработки текстов.
Шаг 1. Получить ключ
- Зарегистрируйтесь на NeuralSpace по email — это меньше минуты. Новым пользователям сразу начисляются стартовые токены, на них можно выполнить первые запросы без пополнения.
- Откройте страницу «API-ключи» в личном кабинете и создайте ключ. Ключ имеет вид
nsk-…и показывается один раз — сохраните его сразу: в менеджер паролей или переменную окружения, а не в код репозитория. - Проверьте баланс: для доступа к текстовым моделям на счету должно быть минимум 50 токенов (1 токен = 1 ₽). Пополнение — в кабинете, без иностранных карт и абонентской платы.

Шаг 2. Вызвать модель
Gemini в публичном API работает через OpenAI-совместимый эндпоинт POST /v1/chat/completions: в теле передаются модель, массив messages с ролями system / user / assistant и лимит ответа max_tokens. Минимальный запрос через curl:
curl https://neuralspace.pro/v1/chat/completions \
-H "Authorization: Bearer nsk-ваш_ключ" \
-H "content-type: application/json" \
-d '{
"model": "gemini-3-8-flash",
"messages": [{"role": "user", "content": "Придумай три названия для канала про нейросети"}],
"max_tokens": 500
}'Ответ вернётся в формате OpenAI: сгенерированный текст — в choices[0].message.content, фактический расход — в поле usage. Если у вас уже есть код на OpenAI SDK, меняются ровно два значения — base_url и ключ:
from openai import OpenAI
client = OpenAI(
base_url="https://neuralspace.pro/v1",
api_key="nsk-ваш_ключ",
)
resp = client.chat.completions.create(
model="gemini-3-8-flash",
messages=[
{"role": "system", "content": "Ты кратко отвечаешь на технические вопросы."},
{"role": "user", "content": "Чем стриминг ответа отличается от обычного?"},
],
)
print(resp.choices[0].message.content)Для чат-интерфейсов полезен стриминг: добавьте в запрос "stream": true — ответ будет приходить порциями через Server-Sent Events, и пользователь увидит первые слова ещё до полной генерации.
Шаг 3. Понять, сколько это стоит
Тарификация — по факту: входные токены (ваш промпт) и выходные (ответ модели) считаются отдельно, у каждого типа своя цена за миллион. У Gemini 3.8 Flash на момент написания — 33,5 токена за миллион входных и 168 токенов за миллион выходных. Типовой запрос «2000 токенов контекста + 500 токенов ответа» обходится примерно в 0,15 токена. Цена привязана к курсу и плавает, поэтому перед расчётами смотрите живую таблицу: она опубликована на странице документации API и возвращается машиночитаемо эндпоинтом GET /v1/models. Для сравнения: DeepSeek V4 Flash в том же каталоге — 21/42 токена за миллион, модели Claude — заметно дороже; Gemini 3.8 Flash — средний по цене вариант при высокой скорости ответа.
Два служебных ограничения: лимит 60 запросов в минуту на ключ и порог баланса 50 токенов для текстовых моделей. Текущий баланс — запросом GET /v1/balance, списания видны в истории транзакций профиля.
Gemini на сайте — без кода
Если API пока не нужен, те же модели доступны в интерфейсе: в чате можно выбрать Gemini 3.8 Flash — там у неё включён веб-поиск, а для картинок в разделе генерации изображений есть Nano Banana, модель на базе Gemini 2.5 Flash. Баланс общий: что в чате, что через API.
Частые ошибки первых запросов
- 401 Unauthorized — ключ передан неверно: лишний пробел, обрезанное значение, чужой префикс. Ключ идёт целиком после
Bearerили в заголовкеx-api-key. - 429 Too Many Requests — упёрлись в лимит 60 запросов в минуту. Добавьте паузу или очередь на стороне приложения.
- Ошибка баланса — на счету меньше 50 токенов: пополните кабинет и повторите запрос.
- Ключ «утёк» в git — храните его в переменных окружения (.env) и не коммитьте; при утечке перевыпустите ключ на той же странице API-ключей.
Частые вопросы
Нужен ли аккаунт Google или карта иностранного банка?
Нет. Ключ выдаётся в личном кабинете NeuralSpace, оплата — токенами баланса в рублях: 1 токен = 1 ₽, без подписки и без облачного биллинга.
Сколько стоит вызов Gemini API?
Только за фактические токены: на момент написания 33,5 токена за миллион входных и 168 за миллион выходных у Gemini 3.8 Flash; запрос на пару тысяч токенов — порядка 0,15 ₽. Актуальные цены — в GET /v1/models и в таблице документации.
Есть ли бесплатный тариф?
Бесплатных генераций на платформе нет. Новым пользователям начисляются стартовые токены — их хватает на первые пробы, дальше оплата по токенам без абонентской платы.
Что ещё умеет API, кроме текста?
Тем же ключом доступны генерация изображений, видео и музыки, синтез и распознавание речи, а для ИИ-агентов — MCP-сервер по адресу https://neuralspace.pro/mcp. Полный список эндпоинтов — в документации.