ถ้าคุณตามข่าววงการ AI คุณคงเคยเห็นชื่อ Qwen (จาก Alibaba) และ DeepSeek (จากบริษัท AI สตาร์ทอัพจีน) สองโมเดลนี้ไม่ได้แค่ "ออกมาให้ดู" แต่ถูกอ้างอิงในงานวิจัยวิชาการทั่วโลกมากขึ้นเรื่อย ๆ จนกลายเป็นปรากฏการณ์ที่ฝั่งตะวันตกต้องยอมรับว่า โมเดลเปิดจากจีนไม่ได้ตามหลังอีกต่อไป
ทำไมถึงเก่งขึ้นเร็วขนาดนี้
เหตุผลหลักมี 3 ข้อ:
- ทุนสนับสนุนมหาศาลจากรัฐบาลจีน - การแข่งขันด้าน AI เป็นนโยบายระดับชาติ บริษัทจีนได้งบวิจัยและข้อมูลที่บริษัทตะวันตกเข้าไม่ถึง
- ข้อมูลภาษาเอเชียมหาศาล - โมเดลเหล่านี้ถูกฝึกจากข้อมูลภาษาจีนและภาษาเอเชียอื่น ๆ ในปริมาณที่ทำให้เข้าใจโครงสร้างภาษาแบบเอเชียดีกว่าโมเดลฝั่งตะวันตก
- กลยุทธ์ Open Source - แทนที่จะปิดและเก็บค่า API แบบ OpenAI พวกเขาเลือกเปิดให้ใช้ฟรี ทำให้ชุมชนนักพัฒนาทั่วโลกช่วยปรับปรุง และถูกนำไปใช้ในงานวิจัยมากขึ้นเรื่อย ๆ
ข้อดีสำหรับองค์กรไทย
- ไม่มีค่า API รายเดือน - ดาวน์โหลดโมเดลมาติดตั้งบนเครื่องของคุณเอง ไม่มีค่าใช้จ่ายต่อเนื่อง
- ข้อมูลควบคุม 100% - ไม่มีข้อมูลออกจากองค์กร เพราะ AI ทำงานบนเครื่องคุณ สอดคล้อง PDPA
- ภาษาไทยดีขึ้น - โมเดล Qwen โดยเฉพาะ มีความสามารถด้านภาษาไทยที่ดีกว่าโมเดลเปิดอื่น ๆ ในระดับเดียวกัน
- ปรับแต่งได้เต็มที่ - Fine-tune ให้เข้าใจศัพท์เฉพาะทางของธุรกิจคุณ เช่น ศัพท์กฎหมาย การแพทย์ หรือภาษาองค์กร
ข้อควรพิจารณา
ไม่มีอะไรฟรีจริง ๆ ในโลก:
- ต้องมีคนดูแลระบบ - การติดตั้งและดูแล LLM บนเครื่องตัวเองต้องการความเชี่ยวชาญด้าน Infrastructure
- ต้องมี GPU - แม้โมเดลเล็กจะรันได้บนการ์ดเดียว แต่ต้องเลือกให้เหมาะกับงาน ไม่ใช่ซื้อมาแล้วหวังว่าจะใช้ได้ทุกอย่าง
- การอัปเดต - โมเดลใหม่ออกมาเรื่อย ๆ ต้องมีคนติดตามและอัปเดต ไม่งั้นจะตกยุค
เลือกอย่างไรให้เหมาะกับธุรกิจ
ไม่มีคำตอบเดียวที่ใช่สำหรับทุกองค์กร บางที่เหมาะกับ Cloud API บางที่เหมาะกับ On-Premise บางที่เหมาะกับ Hybrid ทีม Devsign ช่วยประเมินและออกแบบระบบ Private LLM ครบวงจร ตั้งแต่เลือกโมเดล ติดตั้ง GPU จนถึงอบรมทีมให้ใช้ได้จริง