๒02สถาปัตยกรรม 4 เครื่อง
Four-machine architecture
TL;DR — สรุปใน 30 วินาทีtldr
BOMLLM ประกอบด้วย 4 เครื่อง ที่แบ่งหน้าที่กันชัดเจน — นึกภาพเหมือนร้านอาหาร: Mac Mini = สมอง (เชฟคนเก่ง), VPS = หน้าบ้าน (หน้าร้าน+แคชเชียร์), NAS = ผู้จัดการหลังบ้าน (จัดตารางงาน+เฝ้าระวัง), i9 = ครัวภาพและเสียง (เตาแยกสำหรับจานพิเศษ)
| เครื่อง | บทบาท | ทำไมต้องมีเครื่องนี้ |
|---|---|---|
| Mac Mini M4 Pro 48GB | สมอง — ประมวลผล LLM | คุ้มค่าที่สุดเรื่องความเร็วต่อวัตต์ต่อบาท สำหรับโมเดลระดับ 27B: 30 tok/s บน MLX เทียบ 7.9 tok/s บน GGUF บนเครื่องเดียวกัน เงียบ กินไฟ 30–65 W |
| VPS (สิงคโปร์) | หน้าบ้าน — HTTPS สาธารณะ | รับ HTTPS, ยืนยันตัวตน, งบประมาณ, ฐานข้อมูล RAG, ค้นเว็บ — ถูกและออนไลน์ตลอด ใกล้ผู้ใช้ |
| i9 + 2× RTX 5060 Ti | ครัว — งานภาพและเสียง | งาน ComfyUI สร้างภาพ และ TTS ภาษาไทย ต้องใช้ CUDA — เครื่องเดิมที่มีอยู่แล้ว ต้นทุนเพิ่มคือค่าไฟอย่างเดียว |
| NAS Synology DS725+ | ผู้จัดการหลังบ้าน — ออโตเมชัน | รัน n8n รับ webhook, เฝ้าระวังด้วย Uptime Kuma, สำรองข้อมูล — กินไฟต่ำ เปิดมานานแล้ว 24/7 |
ทุกเครื่องเชื่อมกันด้วย Tailscale (VPN ส่วนตัวแบบ mesh) และเปิดสู่โลกภายนอกทางเดียวผ่าน Cloudflare Tunnel — ไม่มีการเปิดพอร์ตไร้เตอร์เลยแม้แต่พอร์ตเดียว ทุก API ต้องมีกุญแจ (ดูบทที่ ๔ และ ๑๕)
เมื่อไหร่ควรใช้ / When to usewhen to use
สถาปัตยกรรม 4 เครื่องนี้คือสิ่งที่ โตขึ้นจากการใช้งานจริง ไม่ใช่การออกแบบล่วงหน้าแบบเว็บหรู — ถ้าคุณเริ่มใหม่:
- ขั้นต่ำสุด: Mac + Cloudflare Tunnel เพียงเครื่องเดียวก็รันได้ (chat + bot) — kit นี้บูตโดยไม่มี i9 และ NAS ได้ ช่องทางไหนไม่มีเครื่องก็ปิดไปเฉย ๆ
- มีงานภาพ/เสียง: เพิ่ม i9 (หรือเครื่องการ์ดจอ NVIDIA เครื่องเดิม) ตามบทที่ ๑๑
- มี bot + ตารางงานอัตโนมัติ: เพิ่ม NAS (หรือเครื่อง Linux เปิดตลอดเครื่องเดิม) สำหรับ n8n
- เร่งความเร็ว/ลดความเสี่ยง: นี่คือของส่วนเกิน — ระบบหลักยังอยู่ที่ Mac เครื่องเดียว
วิธีทำ / How-tohow to
เส้นทางของข้อความ 1 ข้อความ (chat ปกติ):
เบราว์เซอร์ -> Cloudflare Tunnel -> Open WebUI -> LiteLLM (ตรวจกุญแจ+งบ+เลือกเส้นทาง)
-> Tailscale -> Ollama MLX (Mac) -> สตรีมคำตอบย้อนกลับทางเดิมเว็บแชทไม่เคยคุยกับ Mac ตรง ๆ เลย — ทุก call ผ่าน LiteLLM เพื่อให้ตรวจสอบและบันทึกได้ 100%
เส้นทางของ bot (LINE/Telegram):
แพลตฟอร์ม LINE/Telegram -> webhook -> n8n (NAS) -> workflow
-> LiteLLM /v1/chat/completions (โมเดล thai-chat-rt, think ปิด)
-> จัดรูปแบบคำตอบ -> ตอบกลับแพลตฟอร์มเส้นทางพิเศษ: ค้นเว็บใช้ SearXNG บน VPS, RAG ใช้เวกเตอร์บน Qdrant, ภาพวิ่งไป ComfyUI ผ่าน router บน NAS, เสียงวิ่งไป i9 — รายละเอียดตามบทที่ ๑๐–๑๑ ถ้าติดตรงไหน → บทที่ ๑๖
ตัวอย่างการตั้งค่า / Config exampleconfig example
บันได fallback 3 ชั้น — เหตุผลที่ระบบไม่เคยดับ แม้ Mac จะรีบูต:
| ชั้น | ที่ไหน | ต้นทุน | หน้าที่ |
|---|---|---|---|
| 🟢 Tier 1 | Mac (27B MLX) | ฟรี | รับ ~80–85% ของทราฟฟิกทั้งหมด |
| 🟡 Tier 2 | VPS (โมเดลเล็กบน CPU) | ฟรี | พยุงบอทให้ยังตอบได้ตอน Mac บูต/ร้อนเกิน |
| 🔴 Tier 3 | คลาวด์ API | เสียเงิน | ดึงเข้ามาเฉพาะเมื่อ 2 ชั้นแรกล้มเหลวจริง — ค่าใช้จ่ายจริงวันละ $0.31–2.76 |
กลไกนี้ config ไว้ใน LiteLLM ทั้งหมด (แถว fallbacks) — ตั้งค่าจริงอยู่ในบทที่ ๗
Pro tip — เคล็ดลับจากสนามจริงpro tip
คำถามที่พบบ่อย / FAQfaq
ถาม: ทำไมไม่รวมทุกอย่างไว้บนเครื่องเดียว? — ทำได้ แต่แยกเครื่องทำให้ (1) งานหนักภาพ/เสียงไม่กระทบความเร็ว LLM (2) หน้าบ้านสาธารณะแยกจากสมอง (3) เครื่องเดิมที่มีอยู่แล้วกลับมามีประโยชน์
ถาม: VPS ต้องแรงแค่ไหน? — สเปกอ้างอิงคือ Debian 12, 12 vCPU, 47GB แต่ compose รันได้สบายบน 4 vCPU / 8GB
คำถามอื่น ๆ ดูที่ FAQ
ดูเพิ่ม / See alsosee also
- บทที่ ๔ · เตรียมเครือข่าย — วิธีเชื่อม 4 เครื่องให้คุยกัน
- บทที่ ๖ · VPS = หน้าบ้าน — ติดตั้งชั้นหน้าบ้าน
- บทที่ ๑๕ · ความปลอดภัย — ทำไมโครงสร้างนี้ปลอดภัยกว่าเปิดพอร์ต
ภาพประกอบ / Figuresfigures
