Gemini API:如何获取密钥、调用模型,以及 token 价格
Gemini API 让你从自己的代码里调用 Gemini 模型,而不是在聊天窗口里对话:网站上的客服机器人、自动分派工单的脚本、编辑器里的代码补全、CRM 集成,都是典型场景。传统路线需要 Google 账号、云控制台里的计费设置和一张外币卡。在 NeuralSpace 上路线更短:一分钟内在个人中心创建密钥,用兼容 OpenAI 的请求调用模型,用账户余额的 token 付款——无需订阅。下面按步骤说明:如何拿到密钥、第一次调用 Gemini 3.8 Flash 长什么样,以及 token 的价格。
Gemini API 是什么,谁需要它
Gemini 是 Google 的语言模型家族。通过 API 它向开发者开放:你发送一组消息,拿到生成的回复,再放进自己的产品里——展示给用户、存入数据库、做后续处理。典型用途:客服机器人、邮件和文档摘要、从文本抽取结构化数据、起草内容、在脚本里自动化重复劳动。NeuralSpace 目录中的 Gemini 3.8 Flash 是这个家族的「快速」分支:速度和价格平衡,适合对话和批量文本处理。
第 1 步:获取密钥
- 用邮箱在 NeuralSpace 注册——不到一分钟。新用户会立即获得初始 token,足够完成最初的几次调用,无需充值。
- 在个人中心打开 「API 密钥」页面并创建密钥。密钥形如
nsk-…且只显示一次——请立即保存到密码管理器或环境变量,不要提交进代码仓库。 - 检查余额:文本模型要求账户至少有 50 个 token。充值在个人中心完成——不需要外币卡,也没有订阅费。

第 2 步:调用模型
公开 API 里 Gemini 走兼容 OpenAI 的端点 POST /v1/chat/completions:请求体里带上模型名、带 system / user / assistant 角色的 messages 数组和 max_tokens 上限。最小的 curl 请求:
curl https://neuralspace.pro/v1/chat/completions \
-H "Authorization: Bearer nsk-your_key" \
-H "content-type: application/json" \
-d '{
"model": "gemini-3-8-flash",
"messages": [{"role": "user", "content": "给一个神经网络频道起三个名字"}],
"max_tokens": 500
}'响应是 OpenAI 格式:生成的文本在 choices[0].message.content,实际用量在 usage。如果你已经有 OpenAI SDK 的代码,只需要改两个值——base_url 和密钥:
from openai import OpenAI
client = OpenAI(
base_url="https://neuralspace.pro/v1",
api_key="nsk-your_key",
)
resp = client.chat.completions.create(
model="gemini-3-8-flash",
messages=[
{"role": "system", "content": "你用简短的方式回答技术问题。"},
{"role": "user", "content": "流式响应和普通响应有什么区别?"},
],
)
print(resp.choices[0].message.content)聊天界面可以用流式输出:加上 "stream": true,回复会通过 Server-Sent Events 分段送达,用户在生成完成前就能看到开头几个字。
第 3 步:弄清价格
计费按实际用量:输入 token(你的提示)和输出 token(模型回复)分开计算,各自有每百万的单价。截至写作时,Gemini 3.8 Flash 是每百万输入 33.5 token、每百万输出 168 token。「2000 token 上下文 + 500 token 回复」的典型请求大约花 0.15 token。价格随汇率浮动,算账前请看实时表格:它发布在 API 文档页面,也可以通过 GET /v1/models 机器可读地获取。对比参考:同一目录里的 DeepSeek V4 Flash 是每百万 21/42 token,Claude 系列明显更贵;Gemini 3.8 Flash 价格居中、响应很快。
两个服务性限制:每个密钥每分钟 60 次请求;文本模型的最低余额为 50 token。当前余额用 GET /v1/balance 查询,扣费记录在个人资料的交易历史里。
不用写代码也能用 Gemini
暂时不需要 API 的话,同样的模型在界面里就有:在聊天里选择 Gemini 3.8 Flash——那里已启用联网搜索;图片生成板块里有 Nano Banana,它基于 Gemini 2.5 Flash。余额是共用的:聊天和 API 花的是同一个账户。
第一次调用常见的错误
- 401 Unauthorized — 密钥传错了:多了空格、值被截断、前缀不对。完整密钥要放在
Bearer后面或x-api-key头里。 - 429 Too Many Requests — 触发了每分钟 60 次的限制。在你那侧加个间隔或队列。
- 余额错误 — 账户不足 50 token:先充值再重试。
- 密钥「泄漏」进 git — 放在环境变量(.env)里,不要提交;一旦泄漏,在同一张 API 密钥页面重新签发。
常见问题
需要 Google 账号或外币卡吗?
不需要。密钥在你的 NeuralSpace 个人中心签发,付款用 token 余额,按 token 计费,没有订阅,也没有云计费。
调用 Gemini API 要花多少钱?
只为实际 token 付费:截至写作时 Gemini 3.8 Flash 为每百万输入 33.5 token、每百万输出 168 token;几千 token 的请求约合 0.15 个 token。最新价格见 GET /v1/models 和文档表格。
有免费套餐吗?
平台上没有免费生成。新用户会获得初始 token,足够最初的试验,之后按 token 计费,没有订阅费。
除了文本,API 还能做什么?
同一把密钥还能生成图片、视频和音乐,做语音合成与识别,还有面向 AI 智能体的 MCP 服务器:https://neuralspace.pro/mcp。完整端点列表见文档。