모델과 제공업체: 누구의 모델을 선택하는지 먼저 파악하기
제공업체(벤더), 모델 시리즈, 모델 ID의 차이를 먼저 이해하고, 각 모델 유형의 용도를 파악한 후 적합한 AI 제공자 및 도구 튜토리얼을 선택하세요.
먼저 세 가지 명칭을 구분하세요
| 명칭 | 쉽게 설명하면 | 설정 시 확인 방법 |
| 제공업체 (Vendor) | OpenAI, Anthropic, Google, DeepSeek, Alibaba Cloud, ByteDance(Volcano Engine) 등 모델 서비스를 개발하거나 제공하는 기업 및 플랫폼입니다. | 제조사(원천 제공업체)가 모델 성능, 인터페이스 규격, 가격 및 제한 사항을 결정하며, AI 제공자(중계 사이트)는 해당 기능을 자사 백엔드에 연결해 전달할 뿐입니다. |
| 모델 시리즈 (Model series) | GPT, Claude, Gemini, DeepSeek, Qwen, GLM, Doubao와 같은 모델 브랜드 또는 패밀리 명칭입니다. | 시리즈 이름은 모델의 계열과 전반적인 성능을 가늠하는 용도일 뿐이며, 설정에 입력해야 하는 모델 ID와 동일시해서는 안 됩니다. |
| 모델 ID / 모델 이름 (Model ID / Model Name) | API 요청 시 반드시 입력해야 하는 정확한 식별자로, 제공자의 백엔드 모델 목록에 표시되는 문자열입니다. | 백엔드에서 그대로 복사하여 사용하세요. 대소문자, 하이픈, 마침표, 버전 번호를 임의로 변경하지 마세요. 모델 목록을 자동으로 불러오지 못할 경우, 백엔드에서 제공하는 모델 ID를 수동으로 입력해야 합니다. |
| 표시 이름 (Display Name) | 도구 또는 서비스 백엔드에서 가독성을 높이기 위해 표시하는 별칭 또는 명칭입니다. | 표시 이름은 API로 직접 호출할 수 없는 경우가 많습니다. 설정할 때는 'Model ID', 'Model', 'Model Name' 등의 필드를 우선적으로 사용하세요. |
해외 주요 모델 제공업체
| 제공업체 | 주요 모델 및 시리즈 | 주요 활용 분야 |
OpenAI | GPT, o 시리즈, GPT Image, Sora 등 | 텍스트 대화, 코드 작성, 추론, 이미지 생성, 비디오 생성 |
Anthropic | Claude 시리즈 | 긴 글 분석/독해, 코드 작성, 작문, 데이터 분석 |
Google | Gemini 시리즈 | 멀티모달 이해, 긴 컨텍스트 처리, 코드, 이미지 이해 |
xAI | Grok 시리즈 | 텍스트 대화, 추론, 실시간 정보 탐색 |
Meta | Llama 시리즈 | 오픈소스 가중치, 자체 배포, 서드파티 호스팅 |
Mistral AI | Mistral, Codestral 등 | 텍스트 대화, 코드 작성, 경량화 모델 활용 |
Cohere | Command, Embed, Rerank 등 | 기업 지식 베이스 구축, 검색 증강(RAG), 임베딩 벡터 및 리랭킹 |
Stability AI | Stable Diffusion, Stable Image 등 | 이미지 생성, 이미지 편집 |
Runway | Gen 시리즈 비디오 모델 | 비디오 생성, 비디오 편집 |
주요 중국 모델 제공업체
| 제공업체 | 주요 모델 및 시리즈 | 주요 활용 분야 |
DeepSeek | DeepSeek Chat, DeepSeek Reasoner 등 | 텍스트 대화, 코드 작성, 추론 |
Alibaba Cloud / Qwen | Qwen, Qwen-VL, Qwen-Coder 등 | 텍스트 대화, 이미지 이해, 코드 작성, 오픈소스 모델 |
Moonshot AI | Kimi, Moonshot 시리즈 | 긴 글 분석/독해, 작문, 데이터 분석 |
Zhipu AI | GLM, GLM-4 등 | 텍스트 대화, 추론, 멀티모달, AI 에이전트 |
ByteDance / Volcano Engine Ark | Doubao 시리즈 | 텍스트 대화, 멀티모달, 벡터, 엔터프라이즈 애플리케이션 |
Baidu AI Cloud / Qianfan | ERNIE / Wenxin 시리즈 | 텍스트 대화, 멀티모달, 검색, 엔터프라이즈 환경 |
Tencent Cloud | Hunyuan 시리즈 | 텍스트 대화, 멀티모달, 엔터프라이즈 연동 |
MiniMax | MiniMax, abab, 음성 모델 등 | 텍스트 대화, 긴 문맥 처리, 음성, 멀티모달 |
iFlytek | Spark 시리즈 | 텍스트 대화, 교육 및 사무, 음성 관련 환경 |
01. AI | Yi 시리즈 | 오픈소스 모델, 텍스트 대화, 서드파티 호스팅 |
주요 모델 유형
| 유형 | 주요 기능 및 역할 | 설정 시 주의 사항 |
| 챗 / 텍스트 모델 | 질문 답변, 카피라이팅, 번역, 요약, 코드 작성 등 | 대부분의 대화형 도구에서 가장 우선적으로 설정하는 모델 유형으로, 초기 연동 테스트에 가장 적합합니다. |
| 추론 모델 (Reasoning) | 복잡한 분석, 수학, 코드 추론 및 다단계 작업에 적합합니다. | 비용과 응답 시간이 더 높을 수 있으므로, 단순한 일상 대화에는 굳이 우선 사용할 필요가 없습니다. |
| 코드 특화 모델 | 코드 분석, 코드 작성, 버그 수정, 프로젝트 설명에 특화되어 있습니다. | 코딩 도구에서 사용할 경우 Tool Call(함수 호출), 파일 읽기/쓰기, 컨텍스트 관리 기능이 지원되는지 확인해야 합니다. |
| 비전/시각 이해 모델 | 이미지 분석, 스크린샷 인식, 표 또는 UI 인터페이스 이해 등 | 도구 자체에서 이미지 업로드를 지원해야 하며, 제공자(중계 사이트) 역시 비전 입력을 지원해야 합니다. |
| 이미지 생성 모델 | 프롬프트를 기반으로 이미지를 생성하거나 편집합니다. | 일반적인 /chat/completions 대화형 인터페이스를 사용하지 않는 경우가 많으므로, 이미지 API 전용 설정 페이지를 확인해야 합니다. |
| 비디오 생성 모델 | 숏폼 영상 생성, 이미지 기반 비디오(Image-to-Video) 생성, 비디오 편집 등 | 실시간 대화 응답 방식이 아니라, 작업을 제출하고 완료될 때까지 기다린 후 결과를 조회하는 비동기 방식이 일반적입니다. |
| 임베딩 벡터 모델 | 텍스트를 벡터로 변환하여 지식 베이스 검색 및 유사도 매칭에 활용합니다. | 대화용으로는 사용할 수 없으며, 주로 지식 베이스, RAG(검색 증강 생성), 검색 시스템과 함께 사용됩니다. |
| 리랭킹(Rerank) 모델 | 검색 결과를 재정렬하여 관련성이 더 높은 내용을 상위에 배치합니다. | 지식 베이스의 검색 품질을 최적화하는 데 주로 사용되며, 직접 답변을 생성하는 모델이 아닙니다. |
| 음성 모델 | 텍스트 음성 변환(TTS), 음성 텍스트 변환(STT), 실시간 음성 대화 등 | 일반 텍스트 모델과 설정 필드가 다르므로 해당 TTS, STT, Realtime 관련 문서를 참조해야 합니다. |
초보자는 어떻게 선택해야 할까요?
| 목적 / 사용 용도 | 우선 선택해야 할 모델 | 이유 |
| 일반 대화, 번역, 요약 | 안정적이고 저렴한 텍스트 대화 모델 | 처음부터 최고 성능의 모델을 고집하기보다는 API Key, 주소(엔드포인트), 모델명이 정상 작동하는지 확인하는 것이 먼저입니다. |
| 코드 작성, 프로젝트 수정 | 코딩 능력이나 추론 능력이 뛰어난 모델 | 코딩 작업은 컨텍스트 길이, 도구 호출, 정확도에 크게 의존하므로, 지나치게 저렴한 모델은 잦은 오류로 수정 작업이 늘어날 수 있습니다. |
| 긴 문서 읽기, 장문 대화 | 컨텍스트 윈도우가 큰 텍스트 모델 | 컨텍스트가 길수록 많은 정보를 한 번에 수용할 수 있지만, 토큰 소모량과 비용이 증가할 수 있습니다. |
| 스크린샷 확인, 이미지 분석 | 비전 입력을 지원하는 멀티모달 모델 | 일반 텍스트 모델만 설정한 경우 이미지 업로드가 불가능하거나 이미지를 인식하지 못합니다. |
| 이미지 생성 | 이미지 생성 전용 모델 | 이미지 생성은 일반 대화 모델과 규격이 다르므로, 전용 이미지 생성 도구 및 이미지 API를 별도로 확인해야 합니다. |
| 비디오 생성 | 비디오 생성 모델 또는 전용 플랫폼 | 비디오 모델은 크레딧 소모가 크고 대기 시간이 길기 때문에 과금 체계와 작업 처리 방식을 미리 확인해야 합니다. |
| 지식 베이스(나만의 DB) 구축 | 대화 모델 + 임베딩(Embedding) + 선택적 리랭킹(Rerank) | 지식 베이스는 대화 모델만으로 작동하지 않으며, 검색(Retrieval)과 재정렬(Re-ranking)이 답변 품질에 결정적인 영향을 미칩니다. |
AI 제공자(중계 사이트)에서 도구를 설정할 때 가장 안전한 순서는 다음과 같습니다. 먼저 저렴한 텍스트 모델을 선택해 정상 연동되는지 확인한 후, 실제로 필요한 코딩, 비전, 이미지 또는 비디오 모델을 테스트하세요. 모델 시리즈 이름이 비슷하다고 해서 다른 제공자의 모델명을 임의로 입력해서는 안 됩니다.