Guide de configuration

Guide de configuration du fournisseur

Consultez les étapes de configuration et le dépannage par outil.

Guide de configuration du fournisseur/Modèles et fournisseurs : sachez d'abord quel modèle vous choisissez

Modèles et fournisseurs : sachez d'abord quel modèle vous choisissez

Distinguez d'abord les fournisseurs, séries de modèles et identifiants de modèles, comprenez à quoi chaque type de modèle est adapté, puis choisissez le fournisseur d'API IA et les tutoriels d'outils correspondants.

D'abord, distinguer les trois appellations

AppellationExplication simpleComment l'aborder lors de la configuration
Fournisseur (Vendor)Entreprises ou plateformes qui développent ou fournissent des services de modèles, telles qu'OpenAI, Anthropic, Google, DeepSeek, Alibaba Cloud, ByteDance et Volcano Engine, etc.Les fabricants déterminent les capacités des modèles, les protocoles d'interface, les prix et les limites ; le fournisseur d'API relaie simplement ces fonctionnalités sur son propre backend.
Série de modèlesUn ensemble de marques ou de familles de modèles, comme GPT, Claude, Gemini, DeepSeek, Qwen, GLM, Doubao.Le nom de la série vous aide uniquement à déterminer l'origine et les capacités générales ; il ne correspond pas directement à l'identifiant de modèle à saisir dans la configuration.
Identifiant de modèle / Nom du modèle (Model ID / Model Name)Le nom exact à renseigner dans la requête API, tel que la chaîne de caractères figurant dans la liste des modèles du backend du fournisseur.Copiez-le exactement depuis le backend, sans modifier la casse, les tirets, les points ou les numéros de version ; si la récupération de la liste échoue, ajoutez manuellement les identifiants fournis par le backend.
Nom d'affichage (Display Name)Le nom ou alias affiché dans l'outil ou le backend du service pour faciliter la lecture.Le nom d'affichage peut ne pas être directement appelable via l'API ; lors de la configuration, privilégiez les champs tels que 'Model ID', 'Model' ou 'Model Name'.

Fournisseurs de modèles internationaux courants

FournisseurModèles ou séries courantsUsages fréquents
OpenAIGPT, série o, GPT Image, Sora, etc.Conversations textuelles, code, raisonnement, génération d'images, génération de vidéos
AnthropicSérie ClaudeLecture de textes longs, code, rédaction, analyse
GoogleSérie GeminiCompréhension multimodale, contexte étendu, code, analyse d'images
xAISérie GrokConversations textuelles, raisonnement, scénarios d'information en temps réel
MetaSérie LlamaPoids open-source, auto-hébergement, hébergement tiers
Mistral AIMistral, Codestral, etc.Conversations textuelles, code, scénarios de modèles légers
CohereCommand, Embed, Rerank, etc.Bases de connaissances d'entreprise, recherche augmentée (RAG), vecteurs et reclassement
Stability AIStable Diffusion, Stable Image, etc.Génération et retouche d'images
RunwayModèles vidéo de la série GenGénération et édition de vidéos

Fournisseurs de modèles chinois courants

FournisseurModèles ou séries courantsUsages fréquents
DeepSeekDeepSeek Chat, DeepSeek Reasoner, etc.Conversations textuelles, code, raisonnement
Alibaba Cloud / QwenQwen, Qwen-VL, Qwen-Coder, etc.Conversation textuelle, analyse d'images, code, modèles open-source
Moonshot AIKimi, série MoonshotLecture de textes longs, rédaction et analyse de données
Zhipu AIGLM, GLM-4, etc.Dialogue textuel, raisonnement, multimodal, agents intelligents
ByteDance / Volcano Engine ArkSérie DoubaoDialogue textuel, multimodal, vecteurs, applications d'entreprise
Baidu AI Cloud / QianfanSérie ERNIE / WenxinConversation textuelle, multimodal, recherche et scénarios d'entreprise
Tencent CloudSérie HunyuanChat textuel, multimodal, accès d'entreprise
MiniMaxMiniMax, abab, modèles vocauxConversation textuelle, contexte long, voix et multimodal
iFlytekSérie SparkConversations textuelles, bureautique éducative, scénarios vocaux
01. AISérie YiModèles open-source, dialogue textuel, hébergement tiers

Types de modèles courants

TypeÀ quoi sert-ilPoints d'attention lors de la configuration
Modèle de chat / texteRépondre aux questions, rédiger des textes, traduire, résumer, écrire du code.La plupart des outils conversationnels configurent en priorité ce type de modèle, ce qui le rend idéal pour la première étape de test.
Modèles de raisonnementPlus adapté aux analyses complexes, aux mathématiques, au raisonnement de code et aux tâches en plusieurs étapes.Le prix et le temps de réponse peuvent être plus élevés ; ils ne sont donc pas indispensables pour de simples discussions.
Modèle de codeDavantage orienté vers la lecture et l'écriture de code, la correction de bugs et l'explication de projets.Dans les outils de programmation, vérifiez également la prise en charge des appels d'outils (tool calls), de la lecture/écriture de fichiers et de la gestion du contexte.
Modèles de vision / compréhension d'imagesAnalyser des images, reconnaître des captures d'écran, comprendre des tableaux ou des interfaces.L'outil lui-même doit prendre en charge le téléversement d'images, et le fournisseur doit également autoriser les entrées visuelles.
Modèle de génération d'imagesGénérer ou retoucher des images à partir de prompts textuels.Généralement distinct de l'interface de chat standard /chat/completions ; la page de configuration doit être basée sur l'API d'image.
Modèle de génération de vidéosGénérer de courtes vidéos, convertir une image en vidéo ou éditer des vidéos.Le fonctionnement habituel consiste à soumettre une tâche, attendre sa complétion, puis récupérer le résultat, plutôt qu'une réponse instantanée par chat.
Modèle d'embedding (vectorisation)Convertir du texte en vecteurs pour la recherche dans une base de connaissances et le calcul de similarité.Ne peut pas être utilisé pour discuter ; s'utilise généralement avec des bases de connaissances, des architectures RAG et des systèmes de recherche.
Modèle de reclassement (Rerank)Réorganiser les résultats de recherche afin de placer les éléments les plus pertinents en tête.Couramment employé pour optimiser les performances des bases de connaissances ; ne génère pas de réponses directement.
Modèles vocauxSynthèse vocale (TTS), reconnaissance vocale (STT), conversation vocale en temps réel.Les champs diffèrent des modèles de texte classiques ; vous devez vous référer à la documentation TTS / STT / Realtime correspondante.

Comment choisir pour un débutant ?

Que souhaitez-vous faire ?Que privilégier ?Raison
Chat général, traduction, résuméModèles de chat stables et économiquesS'assurer du bon fonctionnement de la clé, de l'adresse API et du nom du modèle est plus important au début que de chercher immédiatement le modèle le plus puissant.
Écrire du code, modifier des projetsModèles dotés de fortes capacités de programmation ou de raisonnementLes tâches de code dépendent fortement du contexte, des appels d'outils et de la précision ; les modèles bas de gamme risquent de multiplier les allers-retours correctifs.
Lire de longs documents, conversations étenduesModèles de texte avec une grande fenêtre de contexteUn contexte plus étendu permet de traiter davantage d'informations, mais le coût peut également être plus élevé.
Analyser des captures d'écran, traiter des imagesModèles multimodaux prenant en charge les entrées visuellesSi seul un modèle de texte ordinaire est configuré, le téléversement d'images sera indisponible ou non pris en compte.
Générer des imagesModèle de génération d'imagesLa génération d'images diffère d'un modèle de chat ; vous devez généralement configurer séparément les outils d'images et leurs API.
Générer des vidéosModèles de génération de vidéos ou plateformes vidéoLes modèles vidéo consomment beaucoup de ressources et demandent un temps d'attente élevé ; vérifiez attentivement la facturation et le traitement des tâches au préalable.
Créer une base de connaissancesModèle de chat + Embedding + optionnellement RerankUne base de connaissances ne repose pas uniquement sur un modèle de chat ; la récupération et le reclassement influent considérablement sur la qualité des réponses.
Si vous configurez vos outils chez un fournisseur d'API IA, la démarche la plus fiable consiste à : d'abord choisir un modèle de texte abordable pour valider la connexion, puis tester le modèle de code, de vision, d'image ou de vidéo dont vous avez réellement besoin. N'utilisez pas l'identifiant d'un fournisseur avec le protocole d'un autre simplement parce que les noms de séries de modèles se ressemblent.