接入教程

中转接入教程

按工具查看接入步骤和排查方法。

首页/中转接入教程/先看懂 AI 和中转站常见词

先看懂 AI 和中转站常见词

遇到 Key、Base URL、模型名、倍率和报错代码时,先来这里把词看懂,再去接入和排查。

AI 基础词

名词白话解释新手要注意什么
模型真正负责回答问题、写代码、生成图片或视频的 AI 能力。模型名要照抄服务商后台,不要自己改大小写、横线或版本号。
大模型能处理自然语言、代码、图片等任务的模型总称。不是越贵越适合你;写作、编程、图片、视频适合的模型可能不同。
多模态同一个模型可以处理文字、图片、音频或视频等不同输入。工具支持多模态,不代表你的服务商和当前模型也支持。
Prompt / 提示词你发给 AI 的要求,例如“帮我总结这段内容”。提示词越具体,越容易得到可用结果。
System Prompt / 系统提示词比普通提问更高优先级的规则,常用于约束角色、风格和安全边界。代码工具里的系统提示词会影响它怎么读文件、怎么改代码。
上下文窗口模型一次能记住和处理的内容长度。上下文越大不等于一定更聪明,但更适合处理长文档、大项目和连续多轮对话。
自动压缩 / 自动摘要当对话或文件内容快超过上下文上限时,有些工具会把前面的内容总结成更短的摘要,再继续发给模型。自动压缩可以让对话继续,但摘要可能漏掉细节;排查问题、改代码、核对配置时,不要默认模型还记得所有原文。
Token模型计费和长度计算的基本单位,可以粗略理解为文字被拆成的小片段。输入和输出都会消耗 Token,长文档、长对话会明显增加成本。
温度 / Temperature控制回答随机程度的参数。想稳定、可复现就调低;想发散创意可以适当调高。

中转站相关

名词白话解释新手要注意什么
中转站把你的工具请求转发到一个或多个模型服务的平台。它不是模型本身,重点看它支持哪些模型、稳定性、价格和风险记录。
服务商提供 AI 接口、模型、计费和后台管理的平台,可以是官方,也可以是中转站。不同服务商的 API 地址、Key、模型名、计费方式都可能不同。
官方渠道模型厂商自己提供的服务,例如 OpenAI、Anthropic、Google 等官方平台。稳定性和规则更清晰,但支付、地区、价格和额度可能有门槛。
镜像 / 代理把请求转发到目标服务的中间层。看到这类词时要特别关注隐私、稳定性、是否保存请求内容。
New API / 二开面板很多中转站会基于开源面板搭建或二次开发后台。菜单名可能叫令牌、渠道、分组、模型倍率,不一定和官方平台一样。
渠道后台里连接到某个上游模型服务的线路。渠道异常时,可能 Key 没错,但请求仍然失败。
模型分组把不同模型或不同权限分到不同组。你的 Key 没有进入对应分组时,会出现模型不可用或 model not found。
模型映射服务商把一个显示名称映射到真实上游模型。页面展示名和真实模型名可能不同,配置时以后台要求为准。

配置字段

字段白话解释怎么填
API应用程序调用模型的接口。工具不是打开网页聊天,而是通过 API 把问题发给服务商。只有工具明确支持 API 配置时才需要填。
API Key / Key / 密钥工具用来证明“我是这个账号”的一串字符。从服务商后台复制完整内容,不要截图公开,不要多复制空格。
令牌很多中转站后台对 Key 的叫法。看到令牌、Token、API Key、密钥,通常都指同一类东西:访问凭证。
Base URL / API 地址服务商给工具请求模型用的接口地址。它就是 API 链接;有时像网站首页,有时末尾要带 /v1,以后台示例为准。
Endpoint接口地址的另一种叫法。在中转站文档里看到 Endpoint,通常就去找 API 地址或 Base URL。
Provider工具里的服务商配置项。可以理解为“我要用哪家服务商、哪组 Key、哪个 API 地址”。
Model / 模型 ID / 模型名告诉服务商要调用哪个模型的 API 调用标识。按后台模型列表照抄;获取模型列表失败时再手动添加。
兼容 OpenAI服务商的接口格式模仿 OpenAI API,很多工具可以直接按 OpenAI Provider 填。兼容 OpenAI 不等于支持 Claude、Gemini、图片、视频所有接口。

计费与限制

名词白话解释新手要注意什么
余额你在服务商账户里还能使用的金额或点数。余额不足会导致请求失败,不一定是配置错。
倍率中转站常用的计费系数,用来表示某个模型按几倍价格扣费。模型越强、上下文越大、图片视频任务越复杂,倍率可能越高。
输入价格你发给模型的内容产生的费用。长文档、长代码、长历史对话会增加输入成本。
输出价格模型回复内容产生的费用。让模型写很长内容时,输出费用也会增加。
并发同一时间能同时发起多少请求。并发太低时,多开工具或多人共用会排队或失败。
RPM / TPM每分钟请求数 / 每分钟 Token 数限制。报 rate limit 时,通常是请求太快或内容太长。
上下文长度一次请求最多能带多少内容。超过限制时,工具可能截断内容、直接报错,也可能自动压缩或摘要历史对话后继续。
缓存服务商或模型复用已处理内容来降低成本或加速。缓存不一定自动生效,也不一定完全免费,要看服务商和模型规则。
缓存价格缓存相关费用的总称,有些后台会把它拆成创建、命中、读取等不同价格。看到缓存价格时,先确认它指的是写入缓存、读取缓存,还是后台把几项合并展示。
缓存创建价格 / 缓存写入价格第一次把一段可复用内容写入缓存时产生的费用。长系统提示词、长文档、固定上下文第一次使用时,可能会产生这类费用。
缓存命中价格 / 缓存读取价格后续请求复用已经缓存的内容时产生的费用。通常低于普通输入价格,但仍可能收费;不要理解成命中缓存就一定免费。
缓存命中本次请求里有一段内容被服务商识别为和之前相同,并直接复用缓存。只有满足服务商的缓存规则才会命中,例如相同前缀、足够长的内容、在有效期内重复使用。
缓存过期时间缓存能被复用的时间范围。过期后再次请求可能重新按普通输入计费,或者重新产生缓存创建费用。

常见报错词

报错词通常含义优先检查
401 / Unauthorized身份验证失败。Key 是否完整、是否过期、是否复制了多余空格。
403 / Forbidden账号或 Key 没有权限。模型权限、分组权限、地区限制、余额状态。
404 / model not found模型不存在或当前 Key 不能用这个模型。模型名是否照抄后台,Key 是否加入对应模型分组。
429 / rate limit请求太快或额度限制。并发、RPM、TPM、服务商限制,稍后重试。
timeout / 超时请求没有及时返回。Base URL、网络、服务商状态、模型是否排队。
invalid api keyKey 格式或权限不对。重新复制 Key,确认没有把备注名当成 Key。
invalid base url接口地址不正确。确认是 API 地址,不是控制台地址;是否需要 /v1 以后台为准。
insufficient quota额度或余额不足。账户余额、模型倍率、充值是否到账。
看不懂报错时,先不要同时改很多项。按顺序查:Key、Base URL、模型名、余额、模型权限、服务商状态。