先看懂 AI 和中转站常见词
遇到 Key、Base URL、模型名、倍率和报错代码时,先来这里把词看懂,再去接入和排查。
AI 基础词
| 名词 | 白话解释 | 新手要注意什么 |
| 模型 | 真正负责回答问题、写代码、生成图片或视频的 AI 能力。 | 模型名要照抄服务商后台,不要自己改大小写、横线或版本号。 |
| 大模型 | 能处理自然语言、代码、图片等任务的模型总称。 | 不是越贵越适合你;写作、编程、图片、视频适合的模型可能不同。 |
| 多模态 | 同一个模型可以处理文字、图片、音频或视频等不同输入。 | 工具支持多模态,不代表你的服务商和当前模型也支持。 |
| Prompt / 提示词 | 你发给 AI 的要求,例如“帮我总结这段内容”。 | 提示词越具体,越容易得到可用结果。 |
| System Prompt / 系统提示词 | 比普通提问更高优先级的规则,常用于约束角色、风格和安全边界。 | 代码工具里的系统提示词会影响它怎么读文件、怎么改代码。 |
| 上下文窗口 | 模型一次能记住和处理的内容长度。 | 上下文越大不等于一定更聪明,但更适合处理长文档、大项目和连续多轮对话。 |
| 自动压缩 / 自动摘要 | 当对话或文件内容快超过上下文上限时,有些工具会把前面的内容总结成更短的摘要,再继续发给模型。 | 自动压缩可以让对话继续,但摘要可能漏掉细节;排查问题、改代码、核对配置时,不要默认模型还记得所有原文。 |
| Token | 模型计费和长度计算的基本单位,可以粗略理解为文字被拆成的小片段。 | 输入和输出都会消耗 Token,长文档、长对话会明显增加成本。 |
| 温度 / Temperature | 控制回答随机程度的参数。 | 想稳定、可复现就调低;想发散创意可以适当调高。 |
中转站相关
| 名词 | 白话解释 | 新手要注意什么 |
| 中转站 | 把你的工具请求转发到一个或多个模型服务的平台。 | 它不是模型本身,重点看它支持哪些模型、稳定性、价格和风险记录。 |
| 服务商 | 提供 AI 接口、模型、计费和后台管理的平台,可以是官方,也可以是中转站。 | 不同服务商的 API 地址、Key、模型名、计费方式都可能不同。 |
| 官方渠道 | 模型厂商自己提供的服务,例如 OpenAI、Anthropic、Google 等官方平台。 | 稳定性和规则更清晰,但支付、地区、价格和额度可能有门槛。 |
| 镜像 / 代理 | 把请求转发到目标服务的中间层。 | 看到这类词时要特别关注隐私、稳定性、是否保存请求内容。 |
| New API / 二开面板 | 很多中转站会基于开源面板搭建或二次开发后台。 | 菜单名可能叫令牌、渠道、分组、模型倍率,不一定和官方平台一样。 |
| 渠道 | 后台里连接到某个上游模型服务的线路。 | 渠道异常时,可能 Key 没错,但请求仍然失败。 |
| 模型分组 | 把不同模型或不同权限分到不同组。 | 你的 Key 没有进入对应分组时,会出现模型不可用或 model not found。 |
| 模型映射 | 服务商把一个显示名称映射到真实上游模型。 | 页面展示名和真实模型名可能不同,配置时以后台要求为准。 |
配置字段
| 字段 | 白话解释 | 怎么填 |
| API | 应用程序调用模型的接口。工具不是打开网页聊天,而是通过 API 把问题发给服务商。 | 只有工具明确支持 API 配置时才需要填。 |
| API Key / Key / 密钥 | 工具用来证明“我是这个账号”的一串字符。 | 从服务商后台复制完整内容,不要截图公开,不要多复制空格。 |
| 令牌 | 很多中转站后台对 Key 的叫法。 | 看到令牌、Token、API Key、密钥,通常都指同一类东西:访问凭证。 |
| Base URL / API 地址 | 服务商给工具请求模型用的接口地址。 | 它就是 API 链接;有时像网站首页,有时末尾要带 /v1,以后台示例为准。 |
| Endpoint | 接口地址的另一种叫法。 | 在中转站文档里看到 Endpoint,通常就去找 API 地址或 Base URL。 |
| Provider | 工具里的服务商配置项。 | 可以理解为“我要用哪家服务商、哪组 Key、哪个 API 地址”。 |
| Model / 模型 ID / 模型名 | 告诉服务商要调用哪个模型的 API 调用标识。 | 按后台模型列表照抄;获取模型列表失败时再手动添加。 |
| 兼容 OpenAI | 服务商的接口格式模仿 OpenAI API,很多工具可以直接按 OpenAI Provider 填。 | 兼容 OpenAI 不等于支持 Claude、Gemini、图片、视频所有接口。 |
计费与限制
| 名词 | 白话解释 | 新手要注意什么 |
| 余额 | 你在服务商账户里还能使用的金额或点数。 | 余额不足会导致请求失败,不一定是配置错。 |
| 倍率 | 中转站常用的计费系数,用来表示某个模型按几倍价格扣费。 | 模型越强、上下文越大、图片视频任务越复杂,倍率可能越高。 |
| 输入价格 | 你发给模型的内容产生的费用。 | 长文档、长代码、长历史对话会增加输入成本。 |
| 输出价格 | 模型回复内容产生的费用。 | 让模型写很长内容时,输出费用也会增加。 |
| 并发 | 同一时间能同时发起多少请求。 | 并发太低时,多开工具或多人共用会排队或失败。 |
| RPM / TPM | 每分钟请求数 / 每分钟 Token 数限制。 | 报 rate limit 时,通常是请求太快或内容太长。 |
| 上下文长度 | 一次请求最多能带多少内容。 | 超过限制时,工具可能截断内容、直接报错,也可能自动压缩或摘要历史对话后继续。 |
| 缓存 | 服务商或模型复用已处理内容来降低成本或加速。 | 缓存不一定自动生效,也不一定完全免费,要看服务商和模型规则。 |
| 缓存价格 | 缓存相关费用的总称,有些后台会把它拆成创建、命中、读取等不同价格。 | 看到缓存价格时,先确认它指的是写入缓存、读取缓存,还是后台把几项合并展示。 |
| 缓存创建价格 / 缓存写入价格 | 第一次把一段可复用内容写入缓存时产生的费用。 | 长系统提示词、长文档、固定上下文第一次使用时,可能会产生这类费用。 |
| 缓存命中价格 / 缓存读取价格 | 后续请求复用已经缓存的内容时产生的费用。 | 通常低于普通输入价格,但仍可能收费;不要理解成命中缓存就一定免费。 |
| 缓存命中 | 本次请求里有一段内容被服务商识别为和之前相同,并直接复用缓存。 | 只有满足服务商的缓存规则才会命中,例如相同前缀、足够长的内容、在有效期内重复使用。 |
| 缓存过期时间 | 缓存能被复用的时间范围。 | 过期后再次请求可能重新按普通输入计费,或者重新产生缓存创建费用。 |
常见报错词
| 报错词 | 通常含义 | 优先检查 |
| 401 / Unauthorized | 身份验证失败。 | Key 是否完整、是否过期、是否复制了多余空格。 |
| 403 / Forbidden | 账号或 Key 没有权限。 | 模型权限、分组权限、地区限制、余额状态。 |
| 404 / model not found | 模型不存在或当前 Key 不能用这个模型。 | 模型名是否照抄后台,Key 是否加入对应模型分组。 |
| 429 / rate limit | 请求太快或额度限制。 | 并发、RPM、TPM、服务商限制,稍后重试。 |
| timeout / 超时 | 请求没有及时返回。 | Base URL、网络、服务商状态、模型是否排队。 |
| invalid api key | Key 格式或权限不对。 | 重新复制 Key,确认没有把备注名当成 Key。 |
| invalid base url | 接口地址不正确。 | 确认是 API 地址,不是控制台地址;是否需要 /v1 以后台为准。 |
| insufficient quota | 额度或余额不足。 | 账户余额、模型倍率、充值是否到账。 |
看不懂报错时,先不要同时改很多项。按顺序查:Key、Base URL、模型名、余额、模型权限、服务商状态。