設定指南

中轉站設定指南

依工具瀏覽設定步驟與問題排查。

中轉站設定指南/先看懂 AI 和中轉站常見詞

先看懂 AI 和中轉站常見詞

遇到 Key、Base URL、模型名、倍率和報錯代碼時,先來這裡把詞看懂,再去接入和排查。

AI 基礎詞

名詞白話解釋新手要注意什麼
模型真正負責回答問題、寫代碼、生成圖片或視頻的 AI 能力。模型名要照抄服務商後臺,不要自己改大小寫、橫線或版本號。
大模型能處理自然語言、代碼、圖片等任務的模型總稱。不是越貴越適合你;寫作、編程、圖片、視頻適合的模型可能不同。
多模態同一個模型可以處理文字、圖片、音頻或視頻等不同輸入。工具支持多模態,不代表你的服務商和當前模型也支持。
Prompt / 提示詞你發給 AI 的要求,例如“幫我總結這段內容”。提示詞越具體,越容易得到可用結果。
System Prompt / 系統提示詞比普通提問更高優先級的規則,常用於約束角色、風格和安全邊界。代碼工具裡的系統提示詞會影響它怎麼讀文件、怎麼改代碼。
上下文窗口模型一次能記住和處理的內容長度。上下文越大不等於一定更聰明,但更適合處理長文檔、大項目和連續多輪對話。
自動壓縮 / 自動摘要當對話或文件內容快超過上下文上限時,有些工具會把前面的內容總結成更短的摘要,再繼續發給模型。自動壓縮可以讓對話繼續,但摘要可能漏掉細節;排查問題、改代碼、核對配置時,不要默認模型還記得所有原文。
Token模型計費和長度計算的基本單位,可以粗略理解為文字被拆成的小片段。輸入和輸出都會消耗 Token,長文檔、長對話會明顯增加成本。
溫度 / Temperature控制回答隨機程度的參數。想穩定、可復現就調低;想發散創意可以適當調高。

中轉站相關

名詞白話解釋新手要注意什麼
中轉站把你的工具請求轉發到一個或多個模型服務的平臺。它不是模型本身,重點看它支持哪些模型、穩定性、價格和風險記錄。
服務商提供 AI 接口、模型、計費和後臺管理的平臺,可以是官方,也可以是中轉站。不同服務商的 API 地址、Key、模型名、計費方式都可能不同。
官方渠道模型廠商自己提供的服務,例如 OpenAI、Anthropic、Google 等官方平臺。穩定性和規則更清晰,但支付、地區、價格和額度可能有門檻。
鏡像 / 代理把請求轉發到目標服務的中間層。看到這類詞時要特別關注隱私、穩定性、是否保存請求內容。
New API / 二開面板很多中轉站會基於開源面板搭建或二次開發後臺。菜單名可能叫令牌、渠道、分組、模型倍率,不一定和官方平臺一樣。
渠道後臺裡連接到某個上游模型服務的線路。渠道異常時,可能 Key 沒錯,但請求仍然失敗。
模型分組把不同模型或不同權限分到不同組。你的 Key 沒有進入對應分組時,會出現模型不可用或 model not found。
模型映射服務商把一個顯示名稱映射到真實上游模型。頁面展示名和真實模型名可能不同,配置時以後臺要求為準。

渠道分組常見說法

分組名通常是服務商自定義標籤,不是行業標準,也不能單獨證明上游來源。選擇前仍要核對服務商說明、可用客戶端、計費單位、額度限制和實際驗真結果。
常見說法通常表示什麼使用前重點確認
渠道分組把一種上游來源與一套價格、權限或限流規則組合成可選分組。同名分組在不同中轉站可能完全不同,以當前服務商說明為準。
官轉 / 官方直連通常聲稱請求經模型廠商官方 API 轉發。名稱本身不是證明;核對接口行為、模型版本、上下文、計費和驗真證據。
Max / Pro / Plus / 訂閱號池通常把官方個人訂閱或套餐額度集中後供多人使用。關注官方頻率限制、共享擁堵、額度重置週期,以及是否只允許指定客戶端。
Claude Code / Codex 專屬只接受特定官方 CLI 或客戶端請求的分組,可能校驗協議、請求頭或客戶端特徵。普通 SDK、第三方編輯器或聊天工具可能無法使用。
Vertex / Bedrock通過 Google Cloud Vertex AI 或 AWS Bedrock 提供的官方託管模型線路。模型來源可以是官方託管,但認證、地區、字段和功能仍可能與廠商直連 API 不同。
Kiro / 反重力(Antigravity)通常指從特定 AI 編程工具或推廣額度轉出的調用線路。價格和可用性依賴平臺政策,額度、客戶端限制和能力可能隨時變化。
逆向把網頁端或私有協議封裝成 API,而不是直接調用公開付費 API。重點關注穩定性、隱私、上下文、流式輸出、工具調用和服務條款風險。
按次計費按請求次數收費,是計費方式,不代表具體上游來源。先確認單次輸入、輸出和上下文上限;不能直接與按 Token 價格橫向比較。

配置字段

配置項白話解釋怎麼填
API應用程序調用模型的接口。工具不是打開網頁聊天,而是通過 API 把問題發給服務商。只有工具明確支持 API 配置時才需要填。
API Key / Key / 密鑰工具用來證明“我是這個賬號”的一串字符。從服務商後臺複製完整內容,不要截圖公開,不要多複製空格。
令牌很多中轉站後臺對 Key 的叫法。看到令牌、Token、API Key、密鑰,通常都指同一類東西:訪問憑證。
Base URL / API 地址服務商給工具請求模型用的接口地址。它就是 API 鏈接;有時像網站首頁,有時末尾要帶 /v1,以後臺示例為準。
Endpoint接口地址的另一種叫法。在中轉站文檔裡看到 Endpoint,通常就去找 API 地址或 Base URL。
Provider工具裡的服務商配置項。可以理解為“我要用哪家服務商、哪組 Key、哪個 API 地址”。
Model / 模型 ID / 模型名告訴服務商要調用哪個模型的 API 調用標識。按後臺模型列表照抄;獲取模型列表失敗時再手動添加。
兼容 OpenAI服務商的接口格式模仿 OpenAI API,很多工具可以直接按 OpenAI Provider 填。兼容 OpenAI 不等於支持 Claude、Gemini、圖片、視頻所有接口。

計費與限制

名詞白話解釋新手要注意什麼
餘額你在服務商賬戶裡還能使用的金額或點數。餘額不足會導致請求失敗,不一定是配置錯。
倍率中轉站常用的計費係數,用來表示某個模型按幾倍價格扣費。模型越強、上下文越大、圖片視頻任務越複雜,倍率可能越高。
輸入價格你發給模型的內容產生的費用。長文檔、長代碼、長曆史對話會增加輸入成本。
輸出價格模型回覆內容產生的費用。讓模型寫很長內容時,輸出費用也會增加。
併發同一時間能同時發起多少請求。併發太低時,多開工具或多人共用會排隊或失敗。
RPM / TPM每分鐘請求數 / 每分鐘 Token 數限制。報 rate limit 時,通常是請求太快或內容太長。
上下文長度一次請求最多能帶多少內容。超過限制時,工具可能截斷內容、直接報錯,也可能自動壓縮或摘要歷史對話後繼續。
緩存服務商或模型複用已處理內容來降低成本或加速。緩存不一定自動生效,也不一定完全免費,要看服務商和模型規則。
緩存價格緩存相關費用的總稱,有些後臺會把它拆成創建、命中、讀取等不同價格。看到緩存價格時,先確認它指的是寫入緩存、讀取緩存,還是後臺把幾項合併展示。
緩存創建價格 / 緩存寫入價格第一次把一段可複用內容寫入緩存時產生的費用。長系統提示詞、長文檔、固定上下文第一次使用時,可能會產生這類費用。
緩存命中價格 / 緩存讀取價格後續請求複用已經緩存的內容時產生的費用。通常低於普通輸入價格,但仍可能收費;不要理解成命中緩存就一定免費。
緩存命中本次請求裡有一段內容被服務商識別為和之前相同,並直接複用緩存。只有滿足服務商的緩存規則才會命中,例如相同前綴、足夠長的內容、在有效期內重複使用。
緩存過期時間緩存能被複用的時間範圍。過期後再次請求可能重新按普通輸入計費,或者重新產生緩存創建費用。

常見報錯詞

報錯詞通常含義優先檢查
401 / Unauthorized身份驗證失敗。Key 是否完整、是否過期、是否複製了多餘空格。
403 / Forbidden賬號或 Key 沒有權限。模型權限、分組權限、地區限制、餘額狀態。
404 / model not found模型不存在或當前 Key 不能用這個模型。模型名是否照抄後臺,Key 是否加入對應模型分組。
429 / rate limit請求太快或額度限制。併發、RPM、TPM、服務商限制,稍後重試。
timeout / 超時請求沒有及時返回。Base URL、網絡、服務商狀態、模型是否排隊。
invalid api keyKey 格式或權限不對。重新複製 Key,確認沒有把備註名當成 Key。
invalid base url接口地址不正確。確認是 API 地址,不是控制臺地址;是否需要 /v1 以後臺為準。
insufficient quota額度或餘額不足。賬戶餘額、模型倍率、充值是否到賬。
看不懂報錯時,先不要同時改很多項。按順序查:Key、Base URL、模型名、餘額、模型權限、服務商狀態。