คู่มือการใช้งาน AI Server

AI Server คือโปรแกรมรวมศูนย์สำหรับเครื่อง NVIDIA DGX Spark ที่ส่งมอบโดย AIServer.in.th — จัดการโมเดล LLM, สตูดิโอเสียงภาษาไทย (Voice Studio), สตูดิโอภาพ/วิดีโอ (Video Studio), AI agent และสุขภาพเครื่อง ทั้งหมดในหน้าเว็บเดียว

สารบัญ: ติดตั้ง · หน้าจอหลัก · เริ่มใช้งาน · อัปเดต · ตำแหน่งไฟล์ · แก้ปัญหา

1. การติดตั้ง

สิ่งที่ต้องมี

  • เครื่อง NVIDIA DGX Spark (ตั้งค่าพื้นฐานมาให้แล้วสำหรับเครื่องที่ส่งมอบโดยเรา)
  • อินเทอร์เน็ต (ใช้ตอนติดตั้ง/อัปเดต และดาวน์โหลดโมเดล)
  • Access code รูปแบบ SPARK-XXXXXX — ได้รับพร้อมเครื่อง หรือติดต่อเรา

ติดตั้งด้วยคำสั่งเดียว

เปิด terminal บนเครื่อง Spark แล้วรัน (แทน SPARK-XXXXXX ด้วย code ของคุณ):

curl -fsSL "https://aiserver.in.th/dl.php?f=install.sh&code=SPARK-XXXXXX" | bash

ระบบจะตรวจ access code, ดาวน์โหลดเวอร์ชันล่าสุด (ตรวจ checksum เสมอ), ติดตั้งลง ~/aiserver พร้อมสภาพแวดล้อม python ของตัวเอง, จำ code ไว้ และตั้งให้เปิดเองทุกครั้งที่บูตเครื่อง — รีสตาร์ต Spark แล้วหน้าเว็บกลับมาเองใน ~1 นาที

⚠️ Access code หนึ่งชุดผูกกับเครื่องตามจำนวนที่ตกลงไว้ (ปกติ 1 เครื่อง) — ต้องการย้ายเครื่องหรือเพิ่มเครื่อง ติดต่อเราได้เลย

เสร็จแล้วเปิดเบราว์เซอร์จากเครื่องใดก็ได้ในวงแลนเดียวกัน:

http://<IP เครื่อง Spark>:9000

2. หน้าจอหลักมีอะไรบ้าง

ส่วน หน้าที่
แถบสถานะ LiteLLM gateway · โมเดล LLM ที่กำลังรัน · RAM — กด ℹ️ เพื่อดู API endpoint สำหรับต่อจากโค้ด
เกจสุขภาพ อุณหภูมิ/กำลังไฟ/โหลด GPU, RAM, CPU, ดิสก์
🧰 ซอฟต์แวร์ เช็คเครื่องมือที่ต้องมี (llama.cpp, docker, ffmpeg ฯลฯ) — กดติดตั้งที่ขาดได้จากหน้าเว็บ
🧠 GPU Manager โหลด/หยุดโมเดล LLM ได้หลายตัวพร้อมกัน (พอร์ต 8000-8009) ภายใต้งบแรม · ⚙️ ตั้งค่า thinking/sampling ต่อโมเดล · เห็นแรมของสตูดิโอและสั่งเคลียร์ได้จากที่เดียว
🎙️ Voice Studio (:8191) อัดเสียง → เทรนเสียงตัวเอง → พิมพ์ให้พูดไทยสำเนียงเป๊ะ · โคลนด่วนจากคลิป 10 วินาที · ปุ่มทำวิดีโอพูด (lipsync)
🎬 Video Studio (:8189) สร้างภาพ (Flux-2) · วิดีโอ+เสียงพูดไทย (LTX-2.5) · วิดีโอพร้อมเสียงในตัว (MiniMax H3 — Director Mode เขียนเป็น shot list) · lipsync จากรูป+ไฟล์เสียง (Wan S2V)
🦀 thClaws AI agent ภาษาไทยประจำเครื่อง ใช้ LLM ในเครื่องนี้ ทำงานอัตโนมัติทั้ง workspace

3. เริ่มใช้งานครั้งแรก

  1. โหลดโมเดล LLM — กล่อง GPU Manager → เลือกโมเดล → พอร์ต :8000 (หลัก) → โหลด (ระบบเช็คงบแรมให้ ถ้าไม่พอจะเสนอทางแก้เอง เช่นเคลียร์สตูดิโอ)
  2. ต่อ API จากโค้ด/แอปอื่น — ใช้ LiteLLM gateway ที่ http://<IP>:4000/v1 (OpenAI-compatible, ใน LAN ใส่ API key อะไรก็ได้) — ตัวอย่างการตั้งค่าอยู่ที่ปุ่ม ℹ️ บนหน้าหลัก
  3. ใช้สตูดิโอ — กด start ที่การ์ด ระบบเปิด ComfyUI backend ให้เองและแจ้งเมื่อพร้อม (~30 วินาที)
  4. โมเดลวิดีโอเสริม (ครั้งเดียว) — MiniMax H3 ต้องดาวน์โหลดโมเดล ~56GB ก่อนใช้แท็บ 🎥 H3:
    bash ~/aiserver/scripts/download-h3.sh

    หยุดกลางทางแล้วรันซ้ำได้ ระบบต่อจากเดิมอัตโนมัติ

3.1 Inference engines (llama-server / ds4-server / thClaws)

ปุ่ม “ติดตั้งที่ขาด” ในกล่อง 🧰 ซอฟต์แวร์ ติดตั้งให้อัตโนมัติเกือบทั้งหมด — ระบบดาวน์โหลด
binary ที่ build สำหรับ DGX Spark (GB10) มาให้เลย ไม่ต้อง compile เอง:

  • llama-server — engine หลักสำหรับโมเดล GGUF ทุกตัว (ติดตั้งอัตโนมัติ ~50MB)
  • vLLM — โหมดเสิร์ฟหลายผู้ใช้ (22GB, ติดตั้งเมื่อต้องใช้): วิธีติดตั้ง vLLM
  • Studio Stack — เครื่องยนต์ Voice/Video Studio: วิธีติดตั้ง Studio Stack
  • ds4-server — engine เฉพาะสำหรับ DeepSeek quant พิเศษของเรา (ติดตั้งอัตโนมัติ ~7MB)
    · ตัวไฟล์โมเดล DeepSeek (~87GB) เป็น quant พิเศษที่มากับเครื่องที่ส่งมอบ — ถ้าเครื่องคุณยังไม่มีไฟล์นี้
    ให้ใช้โมเดลตระกูล Qwen ไปก่อน (ดาวน์โหลดอัตโนมัติได้ทุกตัว)
  • thClaws — AI agent ภาษาไทย: ติดตั้งอัตโนมัติจาก release ทางการ (GitHub, รองรับ aarch64)

ติดตั้งด้วยมือ (กรณีไม่สะดวกใช้ปุ่ม): แทน SPARK-XXXXXX ด้วย code ของคุณ

# llama-server
curl -fsSL "https://aiserver.in.th/dl.php?f=llama-pack-gb10.tar.gz&code=SPARK-XXXXXX&mid=$(printf '%s' "$(cat /etc/machine-id)$(nvidia-smi --query-gpu=uuid --format=csv,noheader | head -1)" | sha256sum | cut -c1-16)" -o /tmp/p.tgz
mkdir -p ~/llama.cpp/build/bin && tar xzf /tmp/p.tgz -C ~/llama.cpp/build/bin

4. การอัปเดต

มี 2 ทาง ผลเหมือนกัน:

  • จากหน้าเว็บ (ง่ายสุด) — เมื่อมีเวอร์ชันใหม่ แบนเนอร์ “🔄 มีอัปเดตใหม่” จะขึ้นบนหน้าหลักพร้อมรายละเอียด กด อัปเดตเลย ปุ่มเดียวจบ (ระบบรีสตาร์ตตัวเองสั้น ๆ แล้วหน้ากลับมาเอง)
  • จาก terminal — รันคำสั่งติดตั้งเดิมซ้ำ (ไม่ต้องใส่ code แล้ว):
    curl -fsSL "https://aiserver.in.th/dl.php?f=install.sh&code=$(cat ~/.aiserver/license)" | bash

สิ่งที่การอัปเดตไม่มีทางแตะ: เสียงที่เทรนไว้, งานวิดีโอ, API keys, การตั้งค่า, โมเดลทุกตัว — ทั้งหมดอยู่นอกโฟลเดอร์โปรแกรม และถ้าเวอร์ชันใหม่มีปัญหาจนสตาร์ทไม่ขึ้น ระบบย้อนกลับเวอร์ชันเดิมให้อัตโนมัติ

5. ตำแหน่งไฟล์สำคัญ

ที่ เก็บอะไร
~/aiserver/ ตัวโปรแกรม (ถูกแทนที่ตอนอัปเดต)
~/aiserver.bak/ เวอร์ชันก่อนหน้า (ไว้ย้อนกลับ)
~/.aiserver/ license · การตั้งค่า · log ทุกบริการ (logs/hub.log ฯลฯ)

6. แก้ปัญหาเบื้องต้น

อาการ ทางแก้
access code ไม่ถูกต้อง เช็คตัวพิมพ์ใหญ่/ขีด หรือติดต่อเรา (code อาจถูกเพิกถอน/หมดอายุ)
code ถูกใช้กับเครื่องอื่นครบโควตา ติดต่อเราเพื่อย้ายเครื่องหรือเพิ่มโควตา — ปลดให้ได้ทันที
หน้าเว็บ :9000 ไม่ขึ้น bash ~/aiserver/run.sh restart แล้วดู ~/.aiserver/logs/hub.log
โหลดโมเดลแล้ว “งบแรมไม่พอ” ทำตามที่ระบบเสนอ: หยุดโมเดลอื่น / เคลียร์สตูดิโอ (ปุ่มในกล่อง GPU Manager)
สตูดิโอกด gen แล้วเงียบ ดูจุดสถานะ 🐳 ComfyUI backend — ถ้าแดง กด start แล้วรอข้อความ “พร้อม”
docker: permission denied ... docker.sock user ยังไม่อยู่ใน group docker — รัน sudo usermod -aG docker $USER แล้ว logout/login ใหม่
อัปเดตแล้วอยากย้อนเอง rm -rf ~/aiserver && mv ~/aiserver.bak ~/aiserver && bash ~/aiserver/run.sh restart

7. คู่มือเพิ่มเติม


AI Server โดย AIServer.in.th — สอบถาม / ขอ access code: jimmy@thaigpt.com หรือหน้า ติดต่อเรา