Модели и разработчики: сначала разберитесь, чью модель вы выбираете
Сначала научитесь отличать разработчиков, линейки моделей и ID моделей, поймите, для чего подходит каждый тип, и только затем переходите к выбору провайдера и инструкциям по настройке инструментов.
Для начала разберитесь с тремя понятиями
| Понятие | Простыми словами | На что обращать внимание при настройке |
|---|---|---|
| Разработчик (Vendor) | Компании или платформы, которые создают модели или предоставляют к ним доступ: OpenAI, Anthropic, Google, DeepSeek, Alibaba Cloud, ByteDance / Volcano Engine и др. | Разработчики определяют возможности модели, протоколы интерфейса, цены и ограничения; провайдер лишь перенаправляет эти возможности через свой бэкенд. |
| Линейка моделей (Model series) | Семейство или бренд моделей, например GPT, Claude, Gemini, DeepSeek, Qwen, GLM, Doubao. | Название линейки помогает понять происхождение и общий уровень возможностей, но его нельзя указывать напрямую в поле ID модели при настройке. |
| ID модели / Название модели (Model ID / Model Name) | Точный строковый идентификатор, который передаётся в запросе к API (например, значение из списка моделей в панели провайдера). | Копируйте точь-в-точь из панели провайдера; не меняйте регистр, дефисы, точки или номера версий вручную. Если список моделей не загружается автоматически, добавьте ID вручную из панели. |
| Отображаемое имя (Display Name) | Понятное название модели на естественном языке, отображаемое в интерфейсе инструмента или панели для удобства чтения. | Отображаемое имя может не подходить для прямых API-вызовов; при настройке всегда отдавайте приоритет полям «Model ID», «Model» или «Model Name». |
Популярные зарубежные разработчики моделей
| Разработчик | Популярные модели и линейки | Типичные задачи |
|---|---|---|
| Линейка GPT, линейка o, GPT Image, Sora и др. | Текстовые диалоги, код, логические рассуждения, генерация изображений и видео | |
| Линейка Claude | Чтение длинных текстов, код, написание текстов, анализ | |
| Линейка Gemini | Мультимодальное понимание, длинный контекст, код, анализ изображений | |
| Линейка Grok | Текстовые диалоги, рассуждения, задачи с актуальной информацией в реальном времени | |
| Линейка Llama | Открытые веса, самостоятельный хостинг, сторонний облачный хостинг | |
| Mistral, Codestral и др. | Текстовые диалоги, код, работа с компактными эффективными моделями | |
| Command, Embed, Rerank и др. | Корпоративные базы знаний, RAG-поиск, векторные эмбеддинги и реранкинг | |
| Stable Diffusion, Stable Image и др. | Генерация и редактирование изображений | |
| Серия видеомоделей Gen | Генерация и редактирование видео |
Популярные китайские разработчики моделей
| Разработчик | Популярные модели и линейки | Типичные задачи |
|---|---|---|
| DeepSeek Chat, DeepSeek Reasoner и др. | Текстовые диалоги, код, логические рассуждения | |
| Qwen, Qwen-VL, Qwen-Coder и др. | Текстовые диалоги, понимание изображений, код, модели с открытым исходным кодом | |
| Kimi, линейка Moonshot | Чтение длинных текстов, копирайтинг и анализ данных | |
| GLM, GLM-4 и др. | Текстовые диалоги, рассуждения, мультимодальность, ИИ-агенты | |
| Линейка Doubao | Текстовые диалоги, мультимодальность, векторные эмбеддинги, корпоративные сценарии | |
| Линейка ERNIE / Wenxin | Текстовые диалоги, мультимодальность, поиск и корпоративные решения | |
| Линейка Hunyuan | Текстовые диалоги, мультимодальность, интеграция в корпоративные системы | |
| MiniMax, abab, голосовые модели | Текстовые диалоги, обработка длинных текстов, голос и мультимодальность | |
| Линейка Spark | Текстовые диалоги, образовательные и офисные задачи, голосовые сценарии | |
| Линейка Yi | Открытые модели, текстовые диалоги, сторонний хостинг |
Распространённые типы моделей
| Тип | Назначение | Что учесть при настройке |
|---|---|---|
| Диалоговые / текстовые модели (Chat) | Ответы на вопросы, написание текстов, перевод, суммаризация, генерация кода. | Большинство диалоговых инструментов настроены именно на этот тип; это лучший выбор для первого тестового запуска. |
| Модели рассуждения (Reasoning) | Сложный анализ, математика, логические цепочки в коде, многошаговые задачи. | Стоимость и задержка ответа обычно выше, поэтому для обычного общения их выбирать необязательно. |
| Модели для программирования (Code) | Чтение и написание кода, исправление багов, анализ структуры проектов. | В инструментах разработки проверяйте поддержку вызова функций (tool calls), чтения/записи файлов и работы с контекстом. |
| Модели зрительного восприятия (Vision) | Анализ изображений, распознавание скриншотов, чтение таблиц и интерфейсов. | Инструмент должен поддерживать загрузку файлов, а провайдер — обработку графического ввода. |
| Модели генерации изображений | Создание или редактирование картинок по текстовым описаниям. | Обычно работают не через стандартный чат-эндпоинт /chat/completions; страница настройки должна быть предназначена для Images API. |
| Модели генерации видео | Создание коротких видеороликов, преобразование картинки в видео, видеомонтаж. | Стандартный процесс: отправка задачи, ожидание обработки, затем получение результата (не мгновенный ответ в чате). |
| Векторные модели (Embeddings) | Преобразование текста в числовые векторы для поиска по базе знаний и оценки схожести. | Не подходят для диалогов; используются в связке с базами знаний, RAG и поисковыми системами. |
| Модели переранжирования (Rerank) | Сортировка результатов поиска для вывода наиболее релевантных совпадений наверх. | Применяются для оптимизации качества поиска в базах знаний; не генерируют ответы самостоятельно. |
| Голосовые модели | Преобразование текста в речь (TTS), распознавание речи (STT), диалоги голосом в реальном времени. | Параметры отличаются от текстовых моделей; сверяйтесь с документацией по TTS, STT или Realtime API. |
Что выбрать новичку?
| Какая перед вами задача? | Что выбрать в первую очередь? | Причина |
|---|---|---|
| Повседневные диалоги, перевод, суммаризация | Стабильные и недорогие диалоговые модели | Сначала важнее убедиться, что ключ, адрес API и имя модели работают корректно, а не гнаться за флагманами. |
| Написание кода, доработка проектов | Модели с сильными навыками программирования или рассуждения | Кодинг требователен к контексту, вызову инструментов и точности; слабые модели вынуждают делать слишком много правок. |
| Чтение объемных документов, длинные диалоги | Текстовые модели с большим контекстным окном | Большой контекст вмещает больше данных, но стоимость запросов может заметно возрасти. |
| Разбор скриншотов, анализ изображений | Мультимодальные модели с поддержкой Vision | Если настроена обычная текстовая модель, загрузка картинок не сработает или изображение будет проигнорировано. |
| Генерация изображений | Модели генерации изображений | Генерация картинок отличается от чата; обычно требуются специализированные инструменты и Images API. |
| Генерация видео | Модели генерации видео или видеоплатформы | Видеомодели дороги и требуют длительного ожидания; внимательно изучите тарификацию и формат выполнения задач. |
| Создание базы знаний | Диалоговая модель + Embedding + (опционально) Rerank | База знаний держится не только на чат-модели: качество поиска и переранжирования напрямую определяет точность ответов. |
При настройке инструментов через AI-провайдера надёжнее всего следовать порядку: сначала выберите недорогую текстовую модель и добейтесь стабильной работы, а затем переходите к специализированным моделям для кода, зрения, картинок или видео. Не подставляйте название модели одного разработчика в протокол другого только из-за похожего названия линейки.
