สารบัญ — บทที่ ๒ / ๑๖
PART 1 · รู้จัก
๑ · BOMLLM คืออะไร
▸ ๒ · สถาปัตยกรรม 4 เครื่อง
๓ · ฮาร์ดแวร์ที่ต้องมี
PART 2 · ติดตั้ง
๔ · เตรียมเครือข่าย
๕ · Mac Mini = สมอง
๖ · VPS = หน้าบ้าน
๗ · .env และ litellm.yaml
๘ · Virtual keys และงบประมาณ
PART 3 · ใช้งาน
๙ · Open WebUI ครั้งแรก
๑๐ · ลงโมเดลเพิ่มและส่วนเสริม
๑๑ · ภาพและเสียง (optional)
๑๒ · สูตรภาษาไทย
PART 4 · ต่อช่องทาง
๑๓ · LINE และ Telegram bot
๑๔ · MT5 EA อ่านอย่างเดียว และ content pipeline
PART 5 · ดูแล
๑๕ · ความปลอดภัยและ monitoring
๑๖ · อัปเกรดและแก้ปัญหา
PART 1 · รู้จัก

02สถาปัตยกรรม 4 เครื่อง

Four-machine architecture

TL;DR — สรุปใน 30 วินาทีtldr

BOMLLM ประกอบด้วย 4 เครื่อง ที่แบ่งหน้าที่กันชัดเจน — นึกภาพเหมือนร้านอาหาร: Mac Mini = สมอง (เชฟคนเก่ง), VPS = หน้าบ้าน (หน้าร้าน+แคชเชียร์), NAS = ผู้จัดการหลังบ้าน (จัดตารางงาน+เฝ้าระวัง), i9 = ครัวภาพและเสียง (เตาแยกสำหรับจานพิเศษ)

เครื่องบทบาททำไมต้องมีเครื่องนี้
Mac Mini M4 Pro 48GBสมอง — ประมวลผล LLMคุ้มค่าที่สุดเรื่องความเร็วต่อวัตต์ต่อบาท สำหรับโมเดลระดับ 27B: 30 tok/s บน MLX เทียบ 7.9 tok/s บน GGUF บนเครื่องเดียวกัน เงียบ กินไฟ 30–65 W
VPS (สิงคโปร์)หน้าบ้าน — HTTPS สาธารณะรับ HTTPS, ยืนยันตัวตน, งบประมาณ, ฐานข้อมูล RAG, ค้นเว็บ — ถูกและออนไลน์ตลอด ใกล้ผู้ใช้
i9 + 2× RTX 5060 Tiครัว — งานภาพและเสียงงาน ComfyUI สร้างภาพ และ TTS ภาษาไทย ต้องใช้ CUDA — เครื่องเดิมที่มีอยู่แล้ว ต้นทุนเพิ่มคือค่าไฟอย่างเดียว
NAS Synology DS725+ผู้จัดการหลังบ้าน — ออโตเมชันรัน n8n รับ webhook, เฝ้าระวังด้วย Uptime Kuma, สำรองข้อมูล — กินไฟต่ำ เปิดมานานแล้ว 24/7

ทุกเครื่องเชื่อมกันด้วย Tailscale (VPN ส่วนตัวแบบ mesh) และเปิดสู่โลกภายนอกทางเดียวผ่าน Cloudflare Tunnelไม่มีการเปิดพอร์ตไร้เตอร์เลยแม้แต่พอร์ตเดียว ทุก API ต้องมีกุญแจ (ดูบทที่ ๔ และ ๑๕)

เมื่อไหร่ควรใช้ / When to usewhen to use

สถาปัตยกรรม 4 เครื่องนี้คือสิ่งที่ โตขึ้นจากการใช้งานจริง ไม่ใช่การออกแบบล่วงหน้าแบบเว็บหรู — ถ้าคุณเริ่มใหม่:

  • ขั้นต่ำสุด: Mac + Cloudflare Tunnel เพียงเครื่องเดียวก็รันได้ (chat + bot) — kit นี้บูตโดยไม่มี i9 และ NAS ได้ ช่องทางไหนไม่มีเครื่องก็ปิดไปเฉย ๆ
  • มีงานภาพ/เสียง: เพิ่ม i9 (หรือเครื่องการ์ดจอ NVIDIA เครื่องเดิม) ตามบทที่ ๑๑
  • มี bot + ตารางงานอัตโนมัติ: เพิ่ม NAS (หรือเครื่อง Linux เปิดตลอดเครื่องเดิม) สำหรับ n8n
  • เร่งความเร็ว/ลดความเสี่ยง: นี่คือของส่วนเกิน — ระบบหลักยังอยู่ที่ Mac เครื่องเดียว

วิธีทำ / How-tohow to

เส้นทางของข้อความ 1 ข้อความ (chat ปกติ):

เบราว์เซอร์ -> Cloudflare Tunnel -> Open WebUI -> LiteLLM (ตรวจกุญแจ+งบ+เลือกเส้นทาง)
          -> Tailscale -> Ollama MLX (Mac) -> สตรีมคำตอบย้อนกลับทางเดิม

เว็บแชทไม่เคยคุยกับ Mac ตรง ๆ เลย — ทุก call ผ่าน LiteLLM เพื่อให้ตรวจสอบและบันทึกได้ 100%

เส้นทางของ bot (LINE/Telegram):

แพลตฟอร์ม LINE/Telegram -> webhook -> n8n (NAS) -> workflow
  -> LiteLLM /v1/chat/completions (โมเดล thai-chat-rt, think ปิด)
  -> จัดรูปแบบคำตอบ -> ตอบกลับแพลตฟอร์ม

เส้นทางพิเศษ: ค้นเว็บใช้ SearXNG บน VPS, RAG ใช้เวกเตอร์บน Qdrant, ภาพวิ่งไป ComfyUI ผ่าน router บน NAS, เสียงวิ่งไป i9 — รายละเอียดตามบทที่ ๑๐–๑๑ ถ้าติดตรงไหน → บทที่ ๑๖

ตัวอย่างการตั้งค่า / Config exampleconfig example

บันได fallback 3 ชั้น — เหตุผลที่ระบบไม่เคยดับ แม้ Mac จะรีบูต:

ชั้นที่ไหนต้นทุนหน้าที่
🟢 Tier 1Mac (27B MLX)ฟรีรับ ~80–85% ของทราฟฟิกทั้งหมด
🟡 Tier 2VPS (โมเดลเล็กบน CPU)ฟรีพยุงบอทให้ยังตอบได้ตอน Mac บูต/ร้อนเกิน
🔴 Tier 3คลาวด์ APIเสียเงินดึงเข้ามาเฉพาะเมื่อ 2 ชั้นแรกล้มเหลวจริง — ค่าใช้จ่ายจริงวันละ $0.31–2.76

กลไกนี้ config ไว้ใน LiteLLM ทั้งหมด (แถว fallbacks) — ตั้งค่าจริงอยู่ในบทที่ ๗

Pro tip — เคล็ดลับจากสนามจริงpro tip

★ PROD LESSON
Single point of failure = ใช่ และเรายอมรับ — Mac ล่ม = Tier 2 รับต่อทันที (โมเดลเล็กกว่า ตอบช้ากว่า) และถ้าพังหนักกว่านั้น Tier 3 ถูกดึงเข้ามาแบบมีเพดาน $5/วัน — ธุรกิจ bot 5 ช่องทางของเรายอมรับความเสี่ยงนี้ได้ มันถูกกว่าการจ่ายคลาวด์เต็ม ๆ ทุกวัน
★ PRO TIP
เริ่มเล็กแล้วค่อยโต — อย่าซื้อครบ 4 เครื่องในวันเดียว — เริ่มจาก Mac อย่างเดียว ใช้จริง 1–2 สัปดาห์ แล้วค่อยเพิ่มเครื่องตามความจำเป็นที่ "เจอเอง" เส้นทางเติบโตของระบบเราก็มาจากงานจริง ไม่ใช่การวางแผนบนกระดาษ

คำถามที่พบบ่อย / FAQfaq

ถาม: ทำไมไม่รวมทุกอย่างไว้บนเครื่องเดียว? — ทำได้ แต่แยกเครื่องทำให้ (1) งานหนักภาพ/เสียงไม่กระทบความเร็ว LLM (2) หน้าบ้านสาธารณะแยกจากสมอง (3) เครื่องเดิมที่มีอยู่แล้วกลับมามีประโยชน์

ถาม: VPS ต้องแรงแค่ไหน? — สเปกอ้างอิงคือ Debian 12, 12 vCPU, 47GB แต่ compose รันได้สบายบน 4 vCPU / 8GB

คำถามอื่น ๆ ดูที่ FAQ

ดูเพิ่ม / See alsosee also

ภาพประกอบ / Figuresfigures

แผนภาพสถาปัตยกรรม BOMLLM 4 เครื่อง — Mac VPS i9 NAS เชื่อมด้วย Tailscale
แผนภาพภาพรวมทั้งระบบ (SVG วาดจากเอกสารสถาปัตยกรรมจริง)
แผนภาพบันได fallback 3 ชั้น — Mac แล้ว VPS แล้วคลาวด์
กลไกกันเซ็งเซอร์ตอน Mac ล่ม
ภาพสถาปัตยกรรมจาก repository ต้นทาง
ภาพเดียวกับใน README ของ repo — มีเวอร์ชันภาษาอังกฤษกำกับทุกกล่อง

วิดีโอ / Videovideo

🎬
วิดีโอกำลังผลิต — ติดตามที่ YouTube @icafefx
คลิปสาธิตทีละขั้นของบทนี้จะอัปโหลดที่ youtube.com/@icafefx เร็ว ๆ นี้