Panduan pengaturan

Panduan pengaturan penyedia

Lihat langkah penyiapan dan pemecahan masalah berdasarkan alat.

Panduan pengaturan penyedia/Model dan vendor: Kenali dulu model milik siapa yang Anda pilih

Model dan vendor: Kenali dulu model milik siapa yang Anda pilih

Pahami perbedaan antara vendor, seri model, dan ID model terlebih dahulu, ketahui kegunaan setiap jenis model, lalu pilih provider AI dan panduan alat yang tepat.

Pertama, bedakan tiga istilah ini

NamaPenjelasan sederhanaHal yang perlu diperhatikan saat konfigurasi
VendorPerusahaan atau platform yang mengembangkan atau menyediakan layanan model, seperti OpenAI, Anthropic, Google, DeepSeek, Alibaba Cloud, ByteDance/Volcano Engine, dll.Produsen menentukan kemampuan model, protokol antarmuka, harga, dan batasan; provider AI hanya meneruskan kemampuan ini ke backend mereka sendiri.
Seri modelNama merek atau rumpun keluarga model, seperti GPT, Claude, Gemini, DeepSeek, Qwen, GLM, Doubao.Nama seri hanya membantu Anda mengetahui asal-usul dan kemampuan umumnya; nama ini tidak bisa langsung disamakan dengan ID model yang harus diisi pada konfigurasi.
ID Model / Nama ModelNama persis yang harus diisi dalam permintaan API, seperti rangkaian karakter pada daftar model di backend provider.Salin persis dari backend, jangan ubah huruf besar/kecil, tanda hubung, titik, atau nomor versi secara mandiri; jika pengambilan daftar model gagal, tambahkan ID model yang disediakan oleh backend secara manual.
Display Name (Nama Tampilan)Nama atau alias yang ditampilkan di antarmuka alat atau layanan agar lebih mudah dibaca.Nama tampilan mungkin tidak dapat dipanggil langsung melalui API; saat konfigurasi, prioritaskan bidang seperti 'Model ID', 'Model', atau 'Model Name'.

Vendor Model Luar Negeri Populer

VendorModel atau Seri PopulerPenggunaan Umum
OpenAIGPT, seri o, GPT Image, Sora, dll.Percakapan teks, kode, penalaran, pembuatan gambar, pembuatan video
AnthropicSeri ClaudeMembaca teks panjang, kode, penulisan, analisis
GoogleSeri GeminiPemahaman multimodal, konteks panjang, kode, pemahaman gambar
xAISeri GrokPercakapan teks, penalaran, skenario informasi real-time
MetaSeri LlamaBobot sumber terbuka (open-source), deployment mandiri, hosting pihak ketiga
Mistral AIMistral, Codestral, dll.Percakapan teks, kode, skenario model ringan
CohereCommand, Embed, Rerank, dll.Basis pengetahuan enterprise, retrieval augmentation (RAG), vektor, dan pemeringkatan ulang (reranking)
Stability AIStable Diffusion, Stable Image, dll.Pembuatan gambar, pengeditan gambar
RunwayModel video seri GenPembuatan video, pengeditan video

Vendor Model Domestik (Tiongkok) Populer

VendorModel atau Seri PopulerPenggunaan Umum
DeepSeekDeepSeek Chat, DeepSeek Reasoner, dll.Percakapan teks, kode, penalaran
Alibaba Cloud / QwenQwen, Qwen-VL, Qwen-Coder, dll.Percakapan teks, pemahaman gambar, kode, model open-source
Moonshot AIKimi, Seri MoonshotMembaca teks panjang, penulisan, dan analisis data
Zhipu AIGLM, GLM-4, dll.Dialog teks, penalaran, multimodal, agen cerdas (AI agent)
ByteDance / Volcano Engine ArkSeri DoubaoDialog teks, multimodal, vektor, aplikasi enterprise
Baidu AI Cloud / QianfanSeri ERNIE / WenxinPercakapan teks, multimodal, pencarian, dan skenario enterprise
Tencent CloudSeri HunyuanObrolan teks, multimodal, akses enterprise
MiniMaxMiniMax, abab, model berbasis suaraPercakapan teks, teks panjang, suara, dan multimodal
iFlytekSeri SparkPercakapan teks, perkantoran edukatif, skenario berbasis suara
01. AISeri YiModel open-source, dialog teks, hosting pihak ketiga

Jenis Model yang Umum

JenisFungsiHal yang perlu diperhatikan saat konfigurasi
Model Obrolan / TeksMenjawab pertanyaan, menulis teks, menerjemahkan, merangkum, menulis kode.Sebagian besar alat percakapan memprioritaskan konfigurasi model jenis ini, sehingga paling cocok untuk langkah pengujian pertama.
Model Penalaran (Reasoning)Lebih cocok untuk analisis kompleks, matematika, penalaran kode, dan tugas bertahap.Harga dan waktu respons mungkin lebih tinggi, jadi percakapan sederhana tidak selalu membutuhkan model jenis ini sebagai prioritas.
Model KodeLebih berfokus pada membaca kode, menulis kode, memperbaiki bug, dan menjelaskan proyek.Pada alat bantu pemrograman, periksa juga apakah pemanggilan alat (tool call), baca/tulis berkas, dan manajemen konteks didukung.
Model Pemahaman VisualMelihat gambar, mengenali tangkapan layar, memahami tabel atau antarmuka.Alat itu sendiri harus mendukung unggah gambar, dan provider juga harus mengizinkan input visual.
Model Pembuatan GambarMembuat atau mengedit gambar berdasarkan petunjuk teks (prompt).Biasanya bukan antarmuka obrolan standar /chat/completions, konfigurasi harus disesuaikan dengan API gambar.
Model Pembuatan VideoMembuat video pendek, gambar-ke-video (image-to-video), atau pengeditan video.Alur kerjanya umumnya berupa pengiriman tugas, menunggu selesai, lalu mengambil hasilnya, bukan balasan instan seperti obrolan.
Model Vektor EmbeddingMengonversi teks menjadi vektor untuk pencarian basis pengetahuan dan pencocokan kemiripan.Tidak dapat digunakan untuk mengobrol; biasanya digunakan bersama dengan basis pengetahuan, RAG, dan sistem pencarian.
Model Pemeringkat Ulang (Rerank)Menyusun ulang hasil pencarian agar konten yang paling relevan ditempatkan di posisi teratas.Umumnya digunakan untuk mengoptimalkan kinerja basis pengetahuan dan bukan model untuk menghasilkan jawaban.
Model SuaraTeks-ke-suara (TTS), suara-ke-teks (STT), percakapan suara real-time.Bidang konfigurasinya berbeda dari model teks biasa; Anda perlu merujuk ke dokumentasi TTS / STT / Realtime yang sesuai.

Bagaimana pemula harus memilih?

Apa kebutuhan Anda?Apa yang harus diprioritaskan?Alasan
Obrolan umum, penerjemahan, perangkumanModel obrolan yang stabil dan berbiaya rendahMemastikan API Key, alamat API, dan nama model berfungsi dengan baik jauh lebih penting daripada langsung mengejar model tercanggih di awal.
Menulis kode, memodifikasi proyekModel dengan kemampuan coding atau penalaran yang kuatTugas pemrograman sangat bergantung pada konteks, tool calling, dan akurasi; model yang terlalu murah rentan menghasilkan revisi berulang.
Membaca dokumen panjang, percakapan panjangModel teks dengan jendela konteks lebih panjangKonteks yang lebih panjang memungkinkan pemrosesan informasi lebih banyak, tetapi biayanya juga bisa lebih tinggi.
Melihat tangkapan layar, menganalisis gambarModel multimodal yang mendukung input visualJika hanya model teks standar yang dikonfigurasi, pengunggahan gambar mungkin tidak didukung atau tidak dapat dipahami.
Membuat gambarModel pembuatan gambarPembuatan gambar berbeda dengan model obrolan; biasanya Anda perlu menangani alat dan API gambar secara terpisah.
Membuat videoModel pembuatan video atau platform videoModel video membutuhkan kuota/biaya besar dan waktu tunggu lama; periksa skema tarif dan alur tugasnya dengan cermat terlebih dahulu.
Membangun basis pengetahuanModel obrolan + Embedding + Rerank opsionalBasis pengetahuan tidak hanya bergantung pada model obrolan; efektivitas retrieval dan reranking sangat memengaruhi kualitas jawaban.
Jika Anda mengonfigurasi alat di provider AI, urutan paling aman adalah: pilih model teks yang terjangkau terlebih dahulu dan pastikan berfungsi, lalu uji model kode, visi, gambar, atau video yang sebenarnya Anda butuhkan. Jangan mengisi nama model dari satu provider ke dalam protokol provider lain hanya karena nama seri modelnya mirip.