โมเดลและผู้ให้บริการ: รู้ก่อนว่ากำลังเลือกโมเดลของใคร
แยกแยะความแตกต่างระหว่างผู้ให้บริการ (Vendor), ซีรีส์โมเดล และ Model ID ให้ชัดเจน ทำความเข้าใจว่าโมเดลแต่ละประเภทเหมาะกับการใช้งานแบบไหน แล้วค่อยเลือกผู้ให้บริการ AI และอ่านคู่มือการตั้งค่าเครื่องมือ
ก่อนอื่น ต้องแยก 3 ชื่อนี้ให้ออก
| ชื่อเรียก | คำอธิบายแบบเข้าใจง่าย | วิธีดูตอนตั้งค่า |
| ผู้ให้บริการโมเดล (Vendor) | บริษัทหรือแพลตฟอร์มที่พัฒนาหรือให้บริการโมเดล เช่น OpenAI, Anthropic, Google, DeepSeek, Alibaba Cloud, ByteDance และ Volcano Engine เป็นต้น | ผู้ผลิตเป็นผู้กำหนดความสามารถของโมเดล โปรโตคอลของอินเทอร์เฟซ ราคา และข้อจำกัดต่างๆ ส่วนผู้ให้บริการ AI (Provider) มีหน้าที่เพียงเชื่อมต่อความสามารถเหล่านี้เข้ากับระบบหลังบ้านของตน |
| ซีรีส์โมเดล (Model series) | ชื่อแบรนด์หรือตระกูลโมเดล เช่น GPT, Claude, Gemini, DeepSeek, Qwen, GLM, Doubao | ชื่อซีรีส์ช่วยให้คุณรู้ที่มาและความสามารถโดยรวมเท่านั้น ไม่สามารถนำไปใส่แทน Model ID ที่ต้องกรอกในช่องตั้งค่าได้โดยตรง |
| Model ID / Model Name | ชื่อที่แน่นอนที่ต้องกรอกใน API request เช่น ข้อความตัวอักษรที่ระบุในรายการโมเดลหลังบ้านของผู้ให้บริการ | คัดลอกมาให้ตรงเป๊ะจากระบบหลังบ้าน อย่าเปลี่ยนตัวพิมพ์เล็ก-พิมพ์ใหญ่ เครื่องหมายขีดกลาง จุด หรือเลขเวอร์ชันเอง หากดึงรายการโมเดลไม่สำเร็จ ให้เพิ่ม Model ID ที่ผู้ให้บริการระบุไว้ด้วยตนเอง |
| Display Name | ชื่อหรือนามแฝงที่แสดงในระบบหลังบ้านหรือเครื่องมือเพื่อให้ผู้ใช้อ่านเข้าใจง่าย | ชื่อที่แสดงอาจไม่สามารถใช้เรียก API ได้โดยตรง เมื่อตั้งค่า ให้ยึดฟิลด์อย่าง 'Model ID', 'Model' หรือ 'Model Name' เป็นหลัก |
ผู้ให้บริการโมเดลต่างประเทศที่พบบ่อย
| ผู้ให้บริการ | โมเดลหรือซีรีส์ที่พบบ่อย | การใช้งานทั่วไป |
OpenAI | GPT, ซีรีส์ o, GPT Image, Sora ฯลฯ | สนทนาข้อความ, เขียนโค้ด, การให้เหตุผลเชิงตรรกะ, สร้างรูปภาพ, สร้างวิดีโอ |
Anthropic | ซีรีส์ Claude | อ่านข้อความขนาดยาว, เขียนโค้ด, งานเขียน, การวิเคราะห์ |
Google | ซีรีส์ Gemini | ความเข้าใจแบบหลายมิติ (Multimodal), บริบทขนาดยาว, เขียนโค้ด, ทำความเข้าใจภาพ |
xAI | ซีรีส์ Grok | สนทนาข้อความ, การให้เหตุผล, ข้อมูลแบบเรียลไทม์ |
Meta | ซีรีส์ Llama | น้ำหนักโมเดลแบบโอเพนซอร์ส, ติดตั้งใช้งานเอง, โฮสต์ผ่านผู้ให้บริการภายนอก |
Mistral AI | Mistral, Codestral ฯลฯ | สนทนาข้อความ, เขียนโค้ด, การใช้งานโมเดลขนาดเล็กน้ำหนักเบา |
Cohere | Command, Embed, Rerank ฯลฯ | ฐานความรู้องค์กร, การค้นคืนข้อมูลเสริม (RAG), เวกเตอร์และการจัดอันดับใหม่ (Rerank) |
Stability AI | Stable Diffusion, Stable Image ฯลฯ | สร้างรูปภาพ, แก้ไขรูปภาพ |
Runway | โมเดลวิดีโอซีรีส์ Gen | สร้างวิดีโอ, ตัดต่อและแก้ไขวิดีโอ |
ผู้ให้บริการโมเดลในประเทศจีนที่พบบ่อย
| ผู้ให้บริการ | โมเดลหรือซีรีส์ที่พบบ่อย | การใช้งานทั่วไป |
DeepSeek | DeepSeek Chat, DeepSeek Reasoner ฯลฯ | สนทนาข้อความ, เขียนโค้ด, การให้เหตุผล |
Alibaba Cloud / Qwen | Qwen, Qwen-VL, Qwen-Coder ฯลฯ | สนทนาข้อความ, ทำความเข้าใจภาพ, เขียนโค้ด, โมเดลโอเพนซอร์ส |
Moonshot AI | Kimi, ซีรีส์ Moonshot | อ่านข้อความขนาดยาว, งานเขียน, การวิเคราะห์ข้อมูล |
Zhipu AI | GLM, GLM-4 ฯลฯ | สนทนาข้อความ, การให้เหตุผล, มัลติโมดอล, AI Agent |
ByteDance / Volcano Engine Ark | ซีรีส์ Doubao | สนทนาข้อความ, มัลติโมดอล, เวกเตอร์, แอปพลิเคชันระดับองค์กร |
Baidu AI Cloud / Qianfan | ซีรีส์ ERNIE / Wenxin | สนทนาข้อความ, มัลติโมดอล, การค้นหา, การใช้งานระดับองค์กร |
Tencent Cloud | ซีรีส์ Hunyuan | สนทนาข้อความ, มัลติโมดอล, การเชื่อมต่อระดับองค์กร |
MiniMax | MiniMax, abab, โมเดลเกี่ยวกับเสียง | สนทนาข้อความ, ข้อความขนาดยาว, เสียง, มัลติโมดอล |
iFlytek | ซีรีส์ Spark | สนทนาข้อความ, งานเอกสารและการศึกษา, สถานการณ์ที่เกี่ยวกับเสียง |
01. AI | ซีรีส์ Yi | โมเดลโอเพนซอร์ส, สนทนาข้อความ, โฮสต์ผ่านผู้ให้บริการภายนอก |
ประเภทโมเดลที่พบบ่อย
| ประเภท | การทำงาน | ข้อควรระวังเมื่อตั้งค่า |
| Chat / Text Model | ตอบคำถาม, เขียนบทความ, แปลภาษา, สรุปเนื้อหา, เขียนโค้ด | เครื่องมือสนทนาส่วนใหญ่จะให้ความสำคัญกับการตั้งค่าโมเดลประเภทนี้ เหมาะที่สุดสำหรับใช้ทดสอบในขั้นตอนแรก |
| Reasoning models | เหมาะสำหรับงานวิเคราะห์ที่ซับซ้อน, คณิตศาสตร์, การให้เหตุผลเชิงตรรกะของโค้ด และงานหลายขั้นตอน | ราคาและเวลาตอบสนองอาจสูงกว่า จึงไม่จำเป็นต้องเลือกใช้เป็นอันดับแรกสำหรับการแชททั่วไป |
| Code model | เน้นไปที่การอ่านโค้ด, เขียนโค้ด, แก้ไขบั๊ก และอธิบายโปรเจกต์ | ในเครื่องมือเขียนโค้ด ควรตรวจสอบด้วยว่ารองรับ tool calls, การอ่าน/เขียนไฟล์ และการจัดการบริบทหรือไม่ |
| Visual understanding models | ดูรูปภาพ, อ่านภาพหน้าจอ, ทำความเข้าใจตารางหรืออินเทอร์เฟซ | เครื่องมือที่ใช้ต้องรองรับการอัปโหลดรูปภาพ และผู้ให้บริการต้องเปิดให้ส่งภาพเป็นอินพุตได้ด้วย |
| Image generation model | สร้างหรือแก้ไขรูปภาพตามข้อความสั่ง (Prompt) | โดยทั่วไปจะไม่ใช้ /chat/completions ของอินเทอร์เฟซแชททั่วไป หน้าตั้งค่าควรเป็นไปตาม Image API โดยเฉพาะ |
| Video generation model | สร้างวิดีโอสั้น, แปลงภาพเป็นวิดีโอ หรือแก้ไขวิดีโอ | ขั้นตอนทั่วไปคือส่งงานเข้าระบบ รอประมวลผล แล้วจึงดึงผลลัพธ์ออกมา ไม่ใช่การตอบกลับทันทีเหมือนการแชท |
| Embedding vector model | แปลงข้อความเป็นเวกเตอร์เพื่อใช้ในการค้นคืนฐานความรู้และจับคู่ความคล้ายคลึง | ไม่สามารถใช้เพื่อการสนทนาได้ มักใช้ร่วมกับฐานความรู้, RAG และระบบค้นหา |
| Rerank rearranged the model | จัดลำดับผลการค้นหาใหม่เพื่อให้เนื้อหาที่ตรงประเด็นที่สุดอยู่ด้านบน | นิยมใช้เพื่อเพิ่มประสิทธิภาพของฐานความรู้ ไม่ใช่โมเดลสำหรับสร้างคำตอบ |
| Voice models | แปลงข้อความเป็นเสียง (TTS), แปลงเสียงเป็นข้อความ (STT), สนทนาด้วยเสียงแบบเรียลไทม์ | ฟิลด์การตั้งค่าจะแตกต่างจากโมเดลข้อความทั่วไป จำเป็นต้องศึกษาคู่มือ TTS / STT / Realtime ที่เกี่ยวข้อง |
มือใหม่ควรเลือกอย่างไร?
| สิ่งที่ต้องการทำ | สิ่งที่ควรเลือกก่อน | เหตุผล |
| สนทนาทั่วไป, แปลภาษา, สรุปความ | โมเดลแชทที่มีความเสถียรและราคาประหยัด | การทำให้ Key, API address และชื่อโมเดลทำงานได้ถูกต้องสำคัญกว่าการมุ่งหาโมเดลที่ทรงพลังที่สุดตั้งแต่แรก |
| เขียนโค้ด, ปรับปรุงโปรเจกต์ | โมเดลที่มีความสามารถด้านโค้ดหรือการให้เหตุผลระดับสูง | งานเขียนโค้ดต้องอาศัยบริบท, tool calls และความแม่นยำสูง โมเดลราคาถูกมักทำให้ต้องแก้ไขงานซ้ำหลายรอบ |
| อ่านเอกสารขนาดยาว, สนทนาต่อเนื่องยาวๆ | โมเดลข้อความที่รองรับบริบท (Context) ขนาดยาว | บริบทที่ยาวขึ้นช่วยให้รับข้อมูลได้มากขึ้น แต่ค่าใช้จ่ายก็อาจสูงขึ้นตามไปด้วย |
| ดูภาพหน้าจอ, วิเคราะห์รูปภาพ | โมเดลมัลติโมดอลที่รองรับการป้อนข้อมูลด้วยภาพ | หากตั้งค่าเฉพาะโมเดลข้อความทั่วไป อาจไม่สามารถอัปโหลดรูปภาพได้หรือโมเดลอาจไม่เข้าใจภาพ |
| สร้างรูปภาพ | โมเดลสร้างรูปภาพ (Image generation) | การสร้างภาพไม่เหมือนกับโมเดลแชท โดยปกติคุณต้องแยกพิจารณาเครื่องมือสร้างภาพและ Image API ต่างหาก |
| สร้างวิดีโอ | โมเดลสร้างวิดีโอหรือแพลตฟอร์มวิดีโอ | โมเดลวิดีโอใช้ทรัพยากรสูงและมีระยะเวลารอนาน ควรตรวจสอบระบบคิดเงินและขั้นตอนการทำงานอย่างรอบคอบก่อน |
| สร้างฐานความรู้ | โมเดลแชท + Embedding + Rerank (ตามความเหมาะสม) | ฐานความรู้ไม่ได้พึ่งพาแค่โมเดลแชทเท่านั้น การค้นคืนข้อมูลและการจัดอันดับใหม่ส่งผลต่อคุณภาพของคำตอบอย่างมาก |
หากคุณกำลังตั้งค่าเครื่องมือผ่านผู้ให้บริการ AI ลำดับขั้นตอนที่เสถียรที่สุดคือ: เริ่มต้นด้วยการเลือกโมเดลข้อความราคาประหยัดมาทดสอบให้เชื่อมต่อได้สำเร็จก่อน จากนั้นค่อยทดสอบโมเดลโค้ด, วิชัน, รูปภาพ หรือวิดีโอที่คุณต้องการใช้งานจริง อย่ากรอกชื่อโมเดลจากผู้ให้บริการหนึ่งไปยังโปรโตคอลของอีกผู้ให้บริการหนึ่งเพียงเพราะชื่อซีรีส์คล้ายกัน