Comprendre d'abord les termes courants de l'IA et des relais d'IA
Lorsque vous rencontrez des termes comme Clé, Base URL, nom de modèle, multiplicateur et codes d'erreur, consultez d'abord cette page pour vous familiariser avec le vocabulaire avant de procéder à l'intégration et au dépannage.
Termes de base de l'IA
| Terme | Explication simple | À quoi les débutants doivent-ils faire attention ? |
|---|---|---|
| model (Modèle) | Les capacités d'IA réellement chargées de répondre aux questions, d'écrire du code et de générer des images ou des vidéos. | Le nom du modèle doit être copié exactement depuis l'interface du fournisseur ; ne modifiez pas vous-même les majuscules, les tirets ou les numéros de version. |
| Grand modèle (LLM) | Terme général désignant les modèles capables de traiter des tâches telles que le langage naturel, le code, les images, etc. | Plus cher ne signifie pas nécessairement plus adapté à vos besoins ; différents modèles peuvent être spécialisés dans la rédaction, la programmation, les images ou les vidéos. |
| Multimodal | Le même modèle peut traiter différentes entrées telles que du texte, des images, de l'audio ou de la vidéo. | Le fait que l'outil prenne en charge le multimodal ne signifie pas que votre fournisseur et le modèle actuel le prennent également en charge. |
| Prompt / Instruction | La demande que vous envoyez à l'IA, par exemple : « Aide-moi à résumer ce contenu. » | Plus le prompt est précis, plus il est facile d'obtenir des résultats exploitables. |
| Prompt système (System Prompt) | Règles ayant une priorité plus élevée que les questions ordinaires, souvent utilisées pour définir le rôle, le style et les limites de sécurité. | Les prompts système dans les outils de code influent sur la façon dont ils lisent les fichiers et modifient le code. |
| Fenêtre de contexte | La quantité de contenu que le modèle peut mémoriser et traiter en une seule fois. | Un contexte plus large ne rend pas forcément le modèle plus intelligent, mais il est mieux adapté au traitement de longs documents, de grands projets et de conversations continues à plusieurs tours. |
| Compression automatique / Résumé automatique | Lorsque la conversation ou le contenu d'un fichier est sur le point de dépasser la limite de contexte, certains outils résument le contenu précédent en un résumé plus court avant de continuer à l'envoyer au modèle. | La compression automatique permet de poursuivre la conversation, mais le résumé peut omettre des détails ; lors du dépannage, de la modification de code ou de la vérification de configurations, ne présumez pas que le modèle se souvient encore de tout le texte d'origine. |
| Token | L'unité de base pour la facturation et le calcul de la longueur du modèle ; il peut être compris grossièrement comme de petits fragments dans lesquels le texte est découpé. | L'entrée et la sortie consomment toutes deux des tokens ; les documents volumineux et les longues conversations augmentent considérablement les coûts. |
| Température | Paramètre contrôlant le caractère aléatoire de la réponse. | Si vous souhaitez de la stabilité et de la reproductibilité, baissez-la ; si vous cherchez une créativité plus divergente, vous pouvez l'augmenter de manière appropriée. |
Lié aux fournisseurs et relais d'IA
| Terme | Explication simple | À quoi les débutants doivent-ils faire attention ? |
|---|---|---|
| Relais d'IA (AI provider) | Transmet la requête de votre outil à une ou plusieurs plateformes de services de modèles. | Ce n'est pas le modèle lui-même ; l'important est de savoir quels modèles il prend en charge, sa stabilité, son prix et ses antécédents de risque. |
| Fournisseur (provider) | Une plateforme fournissant des interfaces d'IA, des modèles, une facturation et une gestion de backend, qui peut être officielle ou un service de relais. | Les adresses d'API, les clés, les noms de modèles et les modes de facturation peuvent tous varier d'un fournisseur à l'autre. |
| Canaux officiels | Services fournis directement par les créateurs des modèles, tels que les plateformes officielles d'OpenAI, Anthropic, Google, etc. | La stabilité et les règles sont plus claires, mais il peut y avoir des contraintes de paiement, de région, de prix et de quotas. |
| Miroir / Proxy | Transmet la requête vers la couche intermédiaire du service cible. | Faites particulièrement attention à la confidentialité, à la stabilité et à l'éventuelle conservation du contenu des requêtes en présence de ces termes. |
| New API / Panneau dérivé | De nombreux relais d'IA configurent ou développent leur backend sur la base de panneaux open-source. | Les menus peuvent s'appeler Token, Canal, Groupement, Multiplicateur de modèle, et peuvent différer de la plateforme officielle. |
| Canal (Channel) | La ligne dans le backend qui se connecte à un certain service de modèle en amont. | En cas d'anomalie sur le canal, la clé peut être correcte mais la requête échouera quand même. |
| Groupement de modèles | Attribue différents modèles ou différentes autorisations à différents groupes. | Si votre clé n'est pas associée au groupe correspondant, le modèle sera indisponible ou affichera « model not found ». |
| Mappage de modèles | Le fournisseur fait correspondre un nom d'affichage au modèle réel en amont. | Le nom affiché sur la page peut différer du nom réel du modèle ; lors de la configuration, conformez-vous aux exigences du backend. |
Champs de configuration
| Paramètre | Explication simple | Comment remplir |
|---|---|---|
| API | L'application appelle l'API du modèle. L'outil n'ouvre pas une interface de chat web mais envoie la question au fournisseur via l'API. | Requis uniquement si l'outil prend explicitement en charge la configuration de l'API. |
| API Key / Key / Secret | Une chaîne de caractères utilisée par l'outil pour prouver « Je suis ce compte ». | Copiez l'intégralité du contenu depuis l'interface du fournisseur, ne partagez pas de captures d'écran publiquement et ne copiez pas d'espaces superflus. |
| Token | La manière dont de nombreux relais d'IA nomment la clé (Key) dans leur backend. | Les termes token, Token, API Key ou secret désignent généralement la même chose : les identifiants d'accès. |
| Base URL / Adresse de l'API | L'adresse d'interface fournie par le fournisseur pour que l'outil puisse interroger le modèle. | C'est le lien de l'API ; il ressemble parfois à l'accueil d'un site web, parfois il doit se terminer par /v1, suivez l'exemple du backend. |
| Endpoint | Un autre nom pour désigner l'adresse de l'interface. | Si vous voyez Endpoint dans la documentation du fournisseur, cherchez généralement l'adresse de l'API ou la Base URL. |
| Provider | L'élément de configuration du fournisseur dans l'outil. | Peut être compris comme « quel fournisseur, quelle clé et quelle adresse d'API je souhaite utiliser ». |
| Model / Model ID / Model Name | Indique au fournisseur l'API de quel modèle appeler. | Copiez exactement selon la liste des modèles du backend ; ajoutez manuellement uniquement si la récupération automatique de la liste échoue. |
| Compatible avec OpenAI | Le format d'API du fournisseur imite celui d'OpenAI, et de nombreux outils peuvent simplement être configurés en tant que Provider OpenAI. | Être compatible avec OpenAI ne signifie pas prendre en charge toutes les interfaces de Claude, Gemini, des images ou des vidéos. |
Facturation et limites
| Terme | Explication simple | À quoi les débutants doivent-ils faire attention ? |
|---|---|---|
| Solde | Le montant ou les points que vous pouvez encore utiliser sur le compte du fournisseur. | Un solde insuffisant peut faire échouer la requête ; il ne s'agit pas nécessairement d'une erreur de configuration. |
| Multiplicateur de prix | Un coefficient de facturation couramment utilisé chez les relais d'IA pour indiquer combien de fois le prix de base d'un modèle est facturé. | Plus le modèle est performant, plus le contexte est large et plus les tâches d'image et de vidéo sont complexes, plus le multiplicateur peut être élevé. |
| Prix d'entrée (Input) | Le coût généré par le contenu que vous envoyez au modèle. | Les documents longs, le code volumineux et les historiques de chat étendus augmentent les coûts d'entrée. |
| Prix de sortie (Output) | Le coût généré par la réponse produite par le modèle. | Lorsque vous demandez au modèle de rédiger un contenu très long, le coût de sortie augmente également. |
| Concurrence | Le nombre de requêtes pouvant être lancées simultanément. | Si la concurrence est trop faible, utiliser plusieurs outils ou partager l'accès entre plusieurs personnes entraînera des mises en file d'attente ou des échecs. |
| RPM / TPM | Limite de requêtes par minute (RPM) / tokens par minute (TPM). | Un message de limite de débit (rate limit) signifie généralement que les requêtes sont trop rapides ou que le contenu est trop volumineux. |
| Longueur de contexte | La quantité maximale de contenu qu'une seule requête peut contenir. | Lorsque la limite est dépassée, l'outil peut tronquer le contenu, renvoyer directement une erreur ou compresser/résumer automatiquement l'historique de la conversation avant de continuer. |
| Cache | Les fournisseurs ou les modèles réutilisent du contenu déjà traité pour réduire les coûts ou accélérer la réponse. | La mise en cache ne s'active pas nécessairement de manière automatique ni n'est totalement gratuite ; cela dépend des règles du fournisseur et du modèle. |
| Prix du cache | Terme général désignant les coûts liés au cache ; certains systèmes backend le détaillent en plusieurs tarifs tels que création, accès (hits), lectures, etc. | En voyant le prix du cache, vérifiez d'abord s'il s'agit du cache en écriture, du cache en lecture, ou d'une moyenne regroupée par le backend. |
| Prix de création / d'écriture du cache | Le coût engagé lors de l'écriture initiale d'un bloc de contenu réutilisable dans le cache. | L'utilisation pour la première fois de longs prompts système, de documents volumineux ou d'un contexte fixe peut entraîner ce type de frais. |
| Prix d'accès / de lecture du cache (Hit) | Le coût engagé lorsque les requêtes suivantes réutilisent le contenu déjà mis en cache. | Généralement inférieur au prix d'entrée normal, mais des frais peuvent s'appliquer ; ne supposez pas qu'un accès au cache est forcément gratuit. |
| Succès de cache (Cache hit) | Une partie du contenu de cette requête a été reconnue par le fournisseur comme identique à une précédente et le cache a été réutilisé directement. | Un cache n'est atteint que s'il respecte les règles du fournisseur (même préfixe, contenu suffisamment long et réutilisation dans le délai de validité). |
| Durée d'expiration du cache | La période pendant laquelle le cache peut être réutilisé. | Faire une nouvelle requête après expiration peut être facturé comme une entrée standard ou générer à nouveau des frais de création de cache. |
Messages d'erreur courants
| Erreur | Signification courante | Vérification prioritaire |
|---|---|---|
| 401 / Unauthorized | Échec de l'authentification. | Vérifiez si la clé est complète, expirée ou si des espaces supplémentaires ont été copiés. |
| 403 / Forbidden | Le compte ou la clé ne dispose pas des autorisations nécessaires. | Autorisations du modèle, autorisations de groupe, restrictions géographiques, état du solde. |
| 404 / model not found | Le modèle n'existe pas ou la clé actuelle ne peut pas l'utiliser. | Vérifiez si le nom du modèle est bien copié depuis le backend et si la clé est ajoutée au groupe de modèles correspondant. |
| 429 / rate limit | Les requêtes sont trop fréquentes ou le quota limite a été atteint. | Concurrence, RPM, TPM, limites du fournisseur, veuillez réessayer plus tard. |
| timeout / timeout | La requête n'a pas répondu à temps. | Base URL, réseau, statut du fournisseur, mise en file d'attente du modèle. |
| invalid api key | Le format ou les autorisations de la clé sont incorrects. | Recopiez la clé en vous assurant de ne pas confondre le nom de remarque avec la clé elle-même. |
| invalid base url | L'adresse de l'interface est incorrecte. | Confirmez qu'il s'agit bien de l'adresse de l'API et non de l'adresse de la console ; la présence de /v1 dépend des exigences du backend. |
| insufficient quota | Crédit ou solde insuffisant. | Solde du compte, multiplicateur du modèle, vérification de la bonne prise en compte de la recharge. |
Lorsque vous ne comprenez pas un message d'erreur, ne modifiez pas plusieurs paramètres en même temps. Vérifiez dans l'ordre : Clé, Base URL, nom du modèle, solde, autorisations du modèle, état du fournisseur.
