← 所有文章

GLM API 与 MCP:如何把代码模型接入你的项目
GLM 是一系列用于代码和文本的聊天模型。NeuralSpace 提供以下模型:GLM-5.3 Flash, GLM-5.3。它们都通过同一个公开 API 运行,并为 AI 智能体提供了现成的 MCP 服务器。密钥在 API 密钥页面 签发。
GLM 能做什么
GLM 模型专为 vibe coding 和文本任务打造。GLM-5.3 Flash 是适合大批量请求的快速版本,GLM-5.3 是用于复杂代码和推理的完整版本。两者都能编写和解释代码、回答问题并进行对话。
API 端点
请求发送到 POST /v1/chat/completions。示例:{"model": "glm-5.3", "messages": [{"role": "user", "content": "审查这段代码"}]}。授权使用请求头 x-api-key 中的 API key。可用的模型 id:glm-5.3-flash, glm-5.3。

MCP 工具
NeuralSpace 的 MCP 服务器位于 POST /mcp(Streamable HTTP)。要使用 GLM,智能体调用工具:chat, list_models, get_balance。这让 Claude Code、Cursor 等 MCP 客户端能直接使用网站模型。
如何接入
在 NeuralSpace 注册,打开 API 密钥页面 并创建 nsk-… 格式的密钥。然后在请求头或 MCP 客户端设置中传入它。完整文档见 /v1/docs 页面。
常见问题
Flash 和完整版有什么区别?
Flash 更快更便宜,完整版更适合困难任务。
适合 vibe coding 吗?
是的,两个版本都针对代码生成和解释进行了调优。
请求是什么格式?
兼容 OpenAI:POST /v1/chat/completions。