← Все статьи

Gemini API: как получить ключ и вызвать модель, цены по токенам

Светящийся цифровой ключ доступа над тёмной клавиатурой в окружении линий кода

Gemini API — это способ вызывать модели Gemini не в окне чата, а из своего кода: чат-бота на сайте, скрипта обработки заявок, автодополнения в редакторе, интеграции с CRM. Классический маршрут требует аккаунта Google, настройки биллинга в облачной консоли и зарубежной карты. На NeuralSpace путь короче: ключ создаётся в личном кабинете за минуту, модель вызывается OpenAI-совместимым запросом, а оплата идёт токенами баланса в рублях — без подписки. Ниже — пошагово: как получить ключ, как выглядит первый запрос к Gemini 3.8 Flash и сколько стоят токены.

Что такое Gemini API и кому он нужен

Gemini — семейство языковых моделей Google. Через API оно доступно разработчикам: вы отправляете массив сообщений, получаете сгенерированный ответ и используете его в своём продукте — показываете пользователю, кладёте в базу, обрабатываете дальше. Типовые сценарии: чат-боты поддержки, суммаризация писем и документов, извлечение структурированных данных из текста, генерация черновиков, автоматизация рутины в скриптах. Модель Gemini 3.8 Flash в каталоге NeuralSpace — «быстрая» ветка семейства: баланс скорости и цены, подходящий для диалогов и массовой обработки текстов.

Шаг 1. Получить ключ

  1. Зарегистрируйтесь на NeuralSpace по email — это меньше минуты. Новым пользователям сразу начисляются стартовые токены, на них можно выполнить первые запросы без пополнения.
  2. Откройте страницу «API-ключи» в личном кабинете и создайте ключ. Ключ имеет вид nsk-… и показывается один раз — сохраните его сразу: в менеджер паролей или переменную окружения, а не в код репозитория.
  3. Проверьте баланс: для доступа к текстовым моделям на счету должно быть минимум 50 токенов (1 токен = 1 ₽). Пополнение — в кабинете, без иностранных карт и абонентской платы.
Страница «API-ключи» NeuralSpace: создание ключа для работы с Gemini API

Шаг 2. Вызвать модель

Gemini в публичном API работает через OpenAI-совместимый эндпоинт POST /v1/chat/completions: в теле передаются модель, массив messages с ролями system / user / assistant и лимит ответа max_tokens. Минимальный запрос через curl:

curl https://neuralspace.pro/v1/chat/completions \
  -H "Authorization: Bearer nsk-ваш_ключ" \
  -H "content-type: application/json" \
  -d '{
    "model": "gemini-3-8-flash",
    "messages": [{"role": "user", "content": "Придумай три названия для канала про нейросети"}],
    "max_tokens": 500
  }'

Ответ вернётся в формате OpenAI: сгенерированный текст — в choices[0].message.content, фактический расход — в поле usage. Если у вас уже есть код на OpenAI SDK, меняются ровно два значения — base_url и ключ:

from openai import OpenAI

client = OpenAI(
    base_url="https://neuralspace.pro/v1",
    api_key="nsk-ваш_ключ",
)

resp = client.chat.completions.create(
    model="gemini-3-8-flash",
    messages=[
        {"role": "system", "content": "Ты кратко отвечаешь на технические вопросы."},
        {"role": "user", "content": "Чем стриминг ответа отличается от обычного?"},
    ],
)
print(resp.choices[0].message.content)

Для чат-интерфейсов полезен стриминг: добавьте в запрос "stream": true — ответ будет приходить порциями через Server-Sent Events, и пользователь увидит первые слова ещё до полной генерации.

Шаг 3. Понять, сколько это стоит

Тарификация — по факту: входные токены (ваш промпт) и выходные (ответ модели) считаются отдельно, у каждого типа своя цена за миллион. У Gemini 3.8 Flash на момент написания — 33,5 токена за миллион входных и 168 токенов за миллион выходных. Типовой запрос «2000 токенов контекста + 500 токенов ответа» обходится примерно в 0,15 токена. Цена привязана к курсу и плавает, поэтому перед расчётами смотрите живую таблицу: она опубликована на странице документации API и возвращается машиночитаемо эндпоинтом GET /v1/models. Для сравнения: DeepSeek V4 Flash в том же каталоге — 21/42 токена за миллион, модели Claude — заметно дороже; Gemini 3.8 Flash — средний по цене вариант при высокой скорости ответа.

Два служебных ограничения: лимит 60 запросов в минуту на ключ и порог баланса 50 токенов для текстовых моделей. Текущий баланс — запросом GET /v1/balance, списания видны в истории транзакций профиля.

Gemini на сайте — без кода

Если API пока не нужен, те же модели доступны в интерфейсе: в чате можно выбрать Gemini 3.8 Flash — там у неё включён веб-поиск, а для картинок в разделе генерации изображений есть Nano Banana, модель на базе Gemini 2.5 Flash. Баланс общий: что в чате, что через API.

Частые ошибки первых запросов

  • 401 Unauthorized — ключ передан неверно: лишний пробел, обрезанное значение, чужой префикс. Ключ идёт целиком после Bearer или в заголовке x-api-key.
  • 429 Too Many Requests — упёрлись в лимит 60 запросов в минуту. Добавьте паузу или очередь на стороне приложения.
  • Ошибка баланса — на счету меньше 50 токенов: пополните кабинет и повторите запрос.
  • Ключ «утёк» в git — храните его в переменных окружения (.env) и не коммитьте; при утечке перевыпустите ключ на той же странице API-ключей.

Частые вопросы

Нужен ли аккаунт Google или карта иностранного банка?

Нет. Ключ выдаётся в личном кабинете NeuralSpace, оплата — токенами баланса в рублях: 1 токен = 1 ₽, без подписки и без облачного биллинга.

Сколько стоит вызов Gemini API?

Только за фактические токены: на момент написания 33,5 токена за миллион входных и 168 за миллион выходных у Gemini 3.8 Flash; запрос на пару тысяч токенов — порядка 0,15 ₽. Актуальные цены — в GET /v1/models и в таблице документации.

Есть ли бесплатный тариф?

Бесплатных генераций на платформе нет. Новым пользователям начисляются стартовые токены — их хватает на первые пробы, дальше оплата по токенам без абонентской платы.

Что ещё умеет API, кроме текста?

Тем же ключом доступны генерация изображений, видео и музыки, синтез и распознавание речи, а для ИИ-агентов — MCP-сервер по адресу https://neuralspace.pro/mcp. Полный список эндпоинтов — в документации.