← 所有文章

Gemini API:如何获取密钥、调用模型,以及 token 价格

黑暗键盘上方悬浮着发光的数字访问密钥,周围是代码行

Gemini API 让你从自己的代码里调用 Gemini 模型,而不是在聊天窗口里对话:网站上的客服机器人、自动分派工单的脚本、编辑器里的代码补全、CRM 集成,都是典型场景。传统路线需要 Google 账号、云控制台里的计费设置和一张外币卡。在 NeuralSpace 上路线更短:一分钟内在个人中心创建密钥,用兼容 OpenAI 的请求调用模型,用账户余额的 token 付款——无需订阅。下面按步骤说明:如何拿到密钥、第一次调用 Gemini 3.8 Flash 长什么样,以及 token 的价格。

Gemini API 是什么,谁需要它

Gemini 是 Google 的语言模型家族。通过 API 它向开发者开放:你发送一组消息,拿到生成的回复,再放进自己的产品里——展示给用户、存入数据库、做后续处理。典型用途:客服机器人、邮件和文档摘要、从文本抽取结构化数据、起草内容、在脚本里自动化重复劳动。NeuralSpace 目录中的 Gemini 3.8 Flash 是这个家族的「快速」分支:速度和价格平衡,适合对话和批量文本处理。

第 1 步:获取密钥

  1. 用邮箱在 NeuralSpace 注册——不到一分钟。新用户会立即获得初始 token,足够完成最初的几次调用,无需充值。
  2. 在个人中心打开 「API 密钥」页面并创建密钥。密钥形如 nsk-… 且只显示一次——请立即保存到密码管理器或环境变量,不要提交进代码仓库。
  3. 检查余额:文本模型要求账户至少有 50 个 token。充值在个人中心完成——不需要外币卡,也没有订阅费。
NeuralSpace 的「API 密钥」页面:为 Gemini API 创建密钥

第 2 步:调用模型

公开 API 里 Gemini 走兼容 OpenAI 的端点 POST /v1/chat/completions:请求体里带上模型名、带 system / user / assistant 角色的 messages 数组和 max_tokens 上限。最小的 curl 请求:

curl https://neuralspace.pro/v1/chat/completions \
  -H "Authorization: Bearer nsk-your_key" \
  -H "content-type: application/json" \
  -d '{
    "model": "gemini-3-8-flash",
    "messages": [{"role": "user", "content": "给一个神经网络频道起三个名字"}],
    "max_tokens": 500
  }'

响应是 OpenAI 格式:生成的文本在 choices[0].message.content,实际用量在 usage。如果你已经有 OpenAI SDK 的代码,只需要改两个值——base_url 和密钥:

from openai import OpenAI

client = OpenAI(
    base_url="https://neuralspace.pro/v1",
    api_key="nsk-your_key",
)

resp = client.chat.completions.create(
    model="gemini-3-8-flash",
    messages=[
        {"role": "system", "content": "你用简短的方式回答技术问题。"},
        {"role": "user", "content": "流式响应和普通响应有什么区别?"},
    ],
)
print(resp.choices[0].message.content)

聊天界面可以用流式输出:加上 "stream": true,回复会通过 Server-Sent Events 分段送达,用户在生成完成前就能看到开头几个字。

第 3 步:弄清价格

计费按实际用量:输入 token(你的提示)和输出 token(模型回复)分开计算,各自有每百万的单价。截至写作时,Gemini 3.8 Flash 是每百万输入 33.5 token、每百万输出 168 token。「2000 token 上下文 + 500 token 回复」的典型请求大约花 0.15 token。价格随汇率浮动,算账前请看实时表格:它发布在 API 文档页面,也可以通过 GET /v1/models 机器可读地获取。对比参考:同一目录里的 DeepSeek V4 Flash 是每百万 21/42 token,Claude 系列明显更贵;Gemini 3.8 Flash 价格居中、响应很快。

两个服务性限制:每个密钥每分钟 60 次请求;文本模型的最低余额为 50 token。当前余额用 GET /v1/balance 查询,扣费记录在个人资料的交易历史里。

不用写代码也能用 Gemini

暂时不需要 API 的话,同样的模型在界面里就有:在聊天里选择 Gemini 3.8 Flash——那里已启用联网搜索;图片生成板块里有 Nano Banana,它基于 Gemini 2.5 Flash。余额是共用的:聊天和 API 花的是同一个账户。

第一次调用常见的错误

  • 401 Unauthorized — 密钥传错了:多了空格、值被截断、前缀不对。完整密钥要放在 Bearer 后面或 x-api-key 头里。
  • 429 Too Many Requests — 触发了每分钟 60 次的限制。在你那侧加个间隔或队列。
  • 余额错误 — 账户不足 50 token:先充值再重试。
  • 密钥「泄漏」进 git — 放在环境变量(.env)里,不要提交;一旦泄漏,在同一张 API 密钥页面重新签发。

常见问题

需要 Google 账号或外币卡吗?

不需要。密钥在你的 NeuralSpace 个人中心签发,付款用 token 余额,按 token 计费,没有订阅,也没有云计费。

调用 Gemini API 要花多少钱?

只为实际 token 付费:截至写作时 Gemini 3.8 Flash 为每百万输入 33.5 token、每百万输出 168 token;几千 token 的请求约合 0.15 个 token。最新价格见 GET /v1/models 和文档表格。

有免费套餐吗?

平台上没有免费生成。新用户会获得初始 token,足够最初的试验,之后按 token 计费,没有订阅费。

除了文本,API 还能做什么?

同一把密钥还能生成图片、视频和音乐,做语音合成与识别,还有面向 AI 智能体的 MCP 服务器:https://neuralspace.pro/mcp。完整端点列表见文档。