Einrichtungsleitfaden

Provider-Einrichtungsleitfaden

Einrichtungsschritte und Fehlerbehebung nach Tool durchsuchen.

Provider-Einrichtungsleitfaden/Grundlegende Begriffe zu KI und KI-Providern verstehen

Grundlegende Begriffe zu KI und KI-Providern verstehen

Wenn Sie auf Begriffe wie Key, Base URL, Modellname, Multiplikator oder Fehlercodes stoßen, finden Sie hier die wichtigsten Erklärungen für Integration und Fehlerbehebung.

Grundlegende KI-Begriffe

BegriffEinfache ErklärungWorauf Einsteiger achten sollten
ModellDie KI-Fähigkeiten, die tatsächlich für das Beantworten von Fragen, das Schreiben von Code und das Generieren von Bildern oder Videos zuständig sind.Der Modellname muss exakt aus dem Backend des Providers kopiert werden; ändern Sie Groß-/Kleinschreibung, Bindestriche oder Versionsnummern nicht eigenmächtig.
Großes Sprachmodell (Large Model)Ein Überbegriff für Modelle, die Aufgaben wie natürliche Sprache, Code, Bilder usw. verarbeiten können.Teurer bedeutet nicht zwingend besser geeignet; verschiedene Modelle eignen sich für Texte, Programmierung, Bilder oder Videos.
MultimodalDasselbe Modell kann verschiedene Eingaben wie Text, Bilder, Audio oder Video verarbeiten.Wenn ein Tool Multimodalität unterstützt, bedeutet das nicht automatisch, dass auch Ihr Provider und das gewählte Modell dies unterstützen.
Prompt / AnweisungDie Anfrage, die Sie an die KI senden, zum Beispiel: „Fasse diesen Inhalt zusammen.“Je konkreter der Prompt formuliert ist, desto einfacher lassen sich brauchbare Ergebnisse erzielen.
System-PromptRegeln mit höherer Priorität als normale Anfragen, die oft verwendet werden, um Rolle, Stil und Sicherheitsgrenzen festzulegen.System-Prompts in Programmierwerkzeugen beeinflussen, wie Dateien gelesen und Code geändert wird.
Kontextfenster (Context Window)Die Menge an Inhalten, die das Modell auf einmal behalten und verarbeiten kann.Ein größerer Kontext bedeutet nicht zwingend mehr Intelligenz, eignet sich aber besser für lange Dokumente, große Projekte und fortlaufende mehrteilige Unterhaltungen.
Automatische Komprimierung / ZusammenfassungWenn die Konversation oder der Dateiinhalt das Kontextlimit zu überschreiten droht, fassen manche Tools den bisherigen Inhalt kurz zusammen und senden diese Zusammenfassung an das Modell.Die automatische Komprimierung ermöglicht das Fortführen der Unterhaltung, doch können Details verloren gehen; gehen Sie bei Fehlersuche, Code-Änderungen oder Konfigurationsprüfungen nicht davon aus, dass sich das Modell noch an den gesamten Originaltext erinnert.
TokenDie Basiseinheit für Abrechnung und Längenberechnung bei Modellen; vereinfacht als kleine Textfragmente zu verstehen.Sowohl Eingabe als auch Ausgabe verbrauchen Tokens; lange Dokumente und Unterhaltungen treiben die Kosten spürbar in die Höhe.
TemperatureParameter, der den Zufallsgrad der Antworten steuert.Für stabile, reproduzierbare Antworten senken; für kreative, abwechslungsreiche Ausgaben moderat anheben.

Rund um KI-Provider

BegriffEinfache ErklärungWorauf Einsteiger achten sollten
KI-ProviderLeitet Ihre Tool-Anfragen an eine oder mehrere Modellplattformen weiter.Es handelt sich nicht um das Modell selbst; entscheidend sind unterstützte Modelle, Stabilität, Preise und Risikohistorie.
ProviderEine Plattform, die KI-Schnittstellen, Modelle, Abrechnung und Backend-Verwaltung bereitstellt – offiziell oder als Relais-Anbieter.API-Adressen, Keys, Modellnamen und Abrechnungsmethoden können sich von Anbieter zu Anbieter unterscheiden.
Offizielle KanäleDienste, die direkt von Modellanbietern wie OpenAI, Anthropic, Google usw. bereitgestellt werden.Bieten klarere Stabilität und Regeln, können jedoch Hürden bei Zahlungsmethoden, Regionen, Preisen und Kontingenten haben.
Mirror / ProxyLeitet Anfragen über eine Zwischenschicht an den Zieldienst weiter.Achten Sie bei solchen Begriffen besonders auf Datenschutz, Stabilität und darauf, ob Anfrageinhalte gespeichert werden.
New API / Angepasste VerwaltungspanelsViele KI-Provider nutzen Open-Source-Panels oder entwickeln diese weiter.Menüpunkte heißen oft Token, Kanal (Channel), Gruppierung (Grouping) oder Modell-Multiplikator und stimmen nicht zwingend mit offiziellen Plattformen überein.
Kanal (Channel)Die Backend-Verbindung, die zu einem bestimmten Upstream-Modelldienst führt.Ist der Kanal gestört, schlägt die Anfrage möglicherweise fehl, obwohl der Key korrekt ist.
ModellgruppierungWeist verschiedenen Gruppen unterschiedliche Modelle oder Berechtigungen zu.Gehört Ihr Key nicht zur entsprechenden Gruppe, ist das Modell nicht verfügbar („model not found“).
Modell-MappingDer Provider ordnet einen Anzeigenamen dem tatsächlichen Upstream-Modell zu.Der auf der Oberfläche angezeigte Name kann vom echten Modellnamen abweichen; orientieren Sie sich bei der Konfiguration an den Vorgaben im Backend.

Konfigurationsfelder

EinstellungEinfache ErklärungEingabehinweis
APIDie Anwendung ruft die Schnittstelle des Modells auf. Das Tool öffnet keinen Web-Chat, sondern sendet Fragen per API an den Provider.Nur erforderlich, wenn das Tool explizit API-Konfigurationen unterstützt.
API Key / Key / SecretEine Zeichenfolge, mit der das Tool nachweist: „Ich gehöre zu diesem Konto.“Den vollständigen Schlüssel aus dem Backend des Providers kopieren; nicht öffentlich teilen und keine überflüssigen Leerzeichen mitkopieren.
TokenBezeichnung für den Key in den Backends vieler KI-Provider.Ob token, Token, API Key oder Secret – meist ist derselbe Zugangsdaten-Schlüssel gemeint.
Base URL / API-AdresseDie Schnittstellenadresse, die der Provider bereitstellt, damit das Tool Modellanfragen senden kann.Dies ist der API-Link; manchmal ähnelt er einer Website-Startseite, manchmal muss er auf /v1 enden – richten Sie sich nach den Beispielen im Backend.
EndpointEine andere Bezeichnung für die Schnittstellenadresse.Wenn in der Dokumentation von Endpoint die Rede ist, suchen Sie meist nach der API-Adresse oder Base URL.
ProviderProvider-Eintrag im Konfigurationsmenü des Tools.Bedeutet im Grunde: „Welchen Anbieter, welchen Key und welche API-Adresse möchte ich nutzen.“
Model / Model ID / Model NameTeilt dem Provider mit, welche Modell-API aufgerufen werden soll.Exakt aus der Modellliste im Backend kopieren; nur manuell eintragen, falls das automatische Abrufen der Modellliste fehlschlägt.
OpenAI-kompatibelDas API-Format des Providers orientiert sich an der OpenAI-API, sodass viele Tools einfach als OpenAI-Provider eingerichtet werden können.OpenAI-Kompatibilität bedeutet nicht automatisch die Unterstützung aller Claude-, Gemini-, Bild- oder Video-Schnittstellen.

Abrechnung und Limits

BegriffEinfache ErklärungWorauf Einsteiger achten sollten
Guthaben (Balance)Der verbleibende Betrag oder Punktestand im Provider-Konto.Unzureichendes Guthaben führt zu fehlschlagenden Anfragen; es handelt sich nicht zwingend um einen Konfigurationsfehler.
PreismultiplikatorEin bei KI-Providern üblicher Abrechnungskoeffizient, der angibt, mit welchem Faktor der Preis eines Modells berechnet wird.Je leistungsfähiger das Modell, je größer der Kontext und je komplexer Bild-/Videoaufgaben sind, desto höher kann der Multiplikator ausfallen.
Eingabepreis (Input Price)Kosten, die durch die an das Modell gesendeten Inhalte entstehen.Umfangreiche Dokumente, langer Code und lange Chat-Verläufe erhöhen die Eingabekosten.
Ausgabepreis (Output Price)Kosten, die durch die vom Modell generierten Antworten entstehen.Lässt man das Modell sehr lange Texte verfassen, steigen auch die Ausgabekosten entsprechend.
Parallelität (Concurrency)Wie viele Anfragen gleichzeitig ausgeführt werden können.Bei zu geringer Parallelität führen mehrere geöffnete Tools oder gemeinsame Nutzung zu Warteschlangen oder Fehlern.
RPM / TPMAnfragen pro Minute (Requests per Minute) / Tokens pro Minute (Tokens per Minute).Ein Rate-Limit-Fehler weist meist auf zu schnelle Anfragen oder zu umfangreiche Inhalte hin.
KontextlängeWie viele Inhalte eine einzelne Anfrage maximal umfassen darf.Bei Überschreitung wird der Inhalt abgeschnitten, ein Fehler ausgegeben oder die bisherige Unterhaltung automatisch komprimiert/zusammengefasst.
CacheProvider oder Modelle verwenden bereits verarbeitete Inhalte wieder, um Kosten zu senken oder Anfragen zu beschleunigen.Caching greift nicht zwingend automatisch und ist nicht immer völlig kostenlos; dies hängt von den Regeln des Providers und des Modells ab.
Cache-PreisEin Überbegriff für cachebezogene Kosten; manche Backends unterteilen dies in Erstellungs-, Treffer- oder Lesepreise.Prüfen Sie bei Preisangaben zunächst, ob es sich um Schreib-Cache, Lese-Cache oder einen kombinierten Backend-Wert handelt.
Cache-Erstellungspreis / Cache-SchreibpreisKosten, die beim erstmaligen Schreiben wiederverwendbarer Inhalte in den Cache anfallen.Fällt häufig bei der ersten Verwendung langer System-Prompts, umfangreicher Dokumente oder fixer Kontexte an.
Cache-Trefferpreis / Cache-LesepreisKosten, wenn nachfolgende Anfragen bereits zwischengespeicherte Inhalte wiederverwenden.In der Regel günstiger als der reguläre Eingabepreis, aber nicht zwingend kostenlos.
Cache-Treffer (Cache Hit)Ein Teil des Anfrageinhalts wurde vom Provider als identisch erkannt und direkt aus dem Cache wiederverwendet.Ein Treffer erfolgt nur, wenn die Caching-Bedingungen erfüllt sind (z. B. gleicher Präfix, ausreichende Länge und Wiederverwendung innerhalb der Gültigkeitsdauer).
Cache-AblaufzeitDas Zeitfenster, in dem der Cache wiederverwendet werden kann.Nach Ablauf wird der Inhalt wieder als reguläre Eingabe abgerechnet oder es fallen erneut Cache-Erstellungskosten an.

Häufige Fehlermeldungen

FehlerbegriffTypische BedeutungVorrangige Prüfung
401 / UnauthorizedAuthentifizierung fehlgeschlagen.Prüfen, ob der Key vollständig ist, abgelaufen ist oder versehentlich Leerzeichen mitkopiert wurden.
403 / ForbiddenKeine Berechtigung für Konto oder Key.Modellberechtigungen, Gruppenberechtigungen, regionale Einschränkungen, Guthabenstatus.
404 / model not foundModell existiert nicht oder Key darf es nicht nutzen.Prüfen, ob der Modellname exakt aus dem Backend kopiert wurde und der Key der passenden Modellgruppe zugeordnet ist.
429 / rate limitZu viele Anfragen oder Kontingentlimit erreicht.Parallelität, RPM, TPM, Provider-Limits prüfen; bitte später erneut versuchen.
timeout / timeoutAnfrage wurde nicht rechtzeitig beantwortet.Base URL, Netzwerkverbindung, Provider-Status und mögliche Modell-Warteschlangen prüfen.
invalid api keyKey-Format oder Berechtigungen fehlerhaft.Key erneut kopieren; darauf achten, nicht die Bezeichnung/Bemerkung anstelle des eigentlichen Keys einzufügen.
invalid base urlSchnittstellenadresse ist fehlerhaft.Sicherstellen, dass es sich um die API-Adresse und nicht um die Konsolen-URL handelt; prüfen, ob /v1 erforderlich ist (Backend-Vorgaben beachten).
insufficient quotaUnzureichendes Guthaben oder Kontingent.Kontostand, Modell-Multiplikator prüfen und sicherstellen, dass Aufladungen verbucht wurden.
Wenn Sie eine Fehlermeldung nicht verstehen, ändern Sie nicht mehrere Einstellungen gleichzeitig. Prüfen Sie der Reihe nach: Key, Base URL, Modellname, Guthaben, Modellberechtigungen und Provider-Status.