AI Server คือโปรแกรมรวมศูนย์สำหรับเครื่อง NVIDIA DGX Spark ที่ส่งมอบโดย AIServer.in.th — จัดการโมเดล LLM, สตูดิโอเสียงภาษาไทย (Voice Studio), สตูดิโอภาพ/วิดีโอ (Video Studio), AI agent และสุขภาพเครื่อง ทั้งหมดในหน้าเว็บเดียว
สารบัญ: ติดตั้ง · หน้าจอหลัก · เริ่มใช้งาน · อัปเดต · ตำแหน่งไฟล์ · แก้ปัญหา
1. การติดตั้ง
สิ่งที่ต้องมี
- เครื่อง NVIDIA DGX Spark (ตั้งค่าพื้นฐานมาให้แล้วสำหรับเครื่องที่ส่งมอบโดยเรา)
- อินเทอร์เน็ต (ใช้ตอนติดตั้ง/อัปเดต และดาวน์โหลดโมเดล)
- Access code รูปแบบ
SPARK-XXXXXX— ได้รับพร้อมเครื่อง หรือติดต่อเรา
ติดตั้งด้วยคำสั่งเดียว
เปิด terminal บนเครื่อง Spark แล้วรัน (แทน SPARK-XXXXXX ด้วย code ของคุณ):
curl -fsSL "https://aiserver.in.th/dl.php?f=install.sh&code=SPARK-XXXXXX" | bash
ระบบจะตรวจ access code, ดาวน์โหลดเวอร์ชันล่าสุด (ตรวจ checksum เสมอ), ติดตั้งลง ~/aiserver พร้อมสภาพแวดล้อม python ของตัวเอง, จำ code ไว้ และตั้งให้เปิดเองทุกครั้งที่บูตเครื่อง — รีสตาร์ต Spark แล้วหน้าเว็บกลับมาเองใน ~1 นาที
⚠️ Access code หนึ่งชุดผูกกับเครื่องตามจำนวนที่ตกลงไว้ (ปกติ 1 เครื่อง) — ต้องการย้ายเครื่องหรือเพิ่มเครื่อง ติดต่อเราได้เลย
เสร็จแล้วเปิดเบราว์เซอร์จากเครื่องใดก็ได้ในวงแลนเดียวกัน:
http://<IP เครื่อง Spark>:9000
2. หน้าจอหลักมีอะไรบ้าง
| ส่วน | หน้าที่ |
|---|---|
| แถบสถานะ | LiteLLM gateway · โมเดล LLM ที่กำลังรัน · RAM — กด ℹ️ เพื่อดู API endpoint สำหรับต่อจากโค้ด |
| เกจสุขภาพ | อุณหภูมิ/กำลังไฟ/โหลด GPU, RAM, CPU, ดิสก์ |
| 🧰 ซอฟต์แวร์ | เช็คเครื่องมือที่ต้องมี (llama.cpp, docker, ffmpeg ฯลฯ) — กดติดตั้งที่ขาดได้จากหน้าเว็บ |
| 🧠 GPU Manager | โหลด/หยุดโมเดล LLM ได้หลายตัวพร้อมกัน (พอร์ต 8000-8009) ภายใต้งบแรม · ⚙️ ตั้งค่า thinking/sampling ต่อโมเดล · เห็นแรมของสตูดิโอและสั่งเคลียร์ได้จากที่เดียว |
| 🎙️ Voice Studio (:8191) | อัดเสียง → เทรนเสียงตัวเอง → พิมพ์ให้พูดไทยสำเนียงเป๊ะ · โคลนด่วนจากคลิป 10 วินาที · ปุ่มทำวิดีโอพูด (lipsync) |
| 🎬 Video Studio (:8189) | สร้างภาพ (Flux-2) · วิดีโอ+เสียงพูดไทย (LTX-2.5) · วิดีโอพร้อมเสียงในตัว (MiniMax H3 — Director Mode เขียนเป็น shot list) · lipsync จากรูป+ไฟล์เสียง (Wan S2V) |
| 🦀 thClaws | AI agent ภาษาไทยประจำเครื่อง ใช้ LLM ในเครื่องนี้ ทำงานอัตโนมัติทั้ง workspace |
3. เริ่มใช้งานครั้งแรก
- โหลดโมเดล LLM — กล่อง GPU Manager → เลือกโมเดล → พอร์ต
:8000 (หลัก)→ โหลด (ระบบเช็คงบแรมให้ ถ้าไม่พอจะเสนอทางแก้เอง เช่นเคลียร์สตูดิโอ) - ต่อ API จากโค้ด/แอปอื่น — ใช้ LiteLLM gateway ที่
http://<IP>:4000/v1(OpenAI-compatible, ใน LAN ใส่ API key อะไรก็ได้) — ตัวอย่างการตั้งค่าอยู่ที่ปุ่ม ℹ️ บนหน้าหลัก - ใช้สตูดิโอ — กด start ที่การ์ด ระบบเปิด ComfyUI backend ให้เองและแจ้งเมื่อพร้อม (~30 วินาที)
- โมเดลวิดีโอเสริม (ครั้งเดียว) — MiniMax H3 ต้องดาวน์โหลดโมเดล ~56GB ก่อนใช้แท็บ 🎥 H3:
bash ~/aiserver/scripts/download-h3.shหยุดกลางทางแล้วรันซ้ำได้ ระบบต่อจากเดิมอัตโนมัติ
3.1 Inference engines (llama-server / ds4-server / thClaws)
ปุ่ม “ติดตั้งที่ขาด” ในกล่อง 🧰 ซอฟต์แวร์ ติดตั้งให้อัตโนมัติเกือบทั้งหมด — ระบบดาวน์โหลด
binary ที่ build สำหรับ DGX Spark (GB10) มาให้เลย ไม่ต้อง compile เอง:
- llama-server — engine หลักสำหรับโมเดล GGUF ทุกตัว (ติดตั้งอัตโนมัติ ~50MB)
- vLLM — โหมดเสิร์ฟหลายผู้ใช้ (22GB, ติดตั้งเมื่อต้องใช้): วิธีติดตั้ง vLLM
- Studio Stack — เครื่องยนต์ Voice/Video Studio: วิธีติดตั้ง Studio Stack
- ds4-server — engine เฉพาะสำหรับ DeepSeek quant พิเศษของเรา (ติดตั้งอัตโนมัติ ~7MB)
· ตัวไฟล์โมเดล DeepSeek (~87GB) เป็น quant พิเศษที่มากับเครื่องที่ส่งมอบ — ถ้าเครื่องคุณยังไม่มีไฟล์นี้
ให้ใช้โมเดลตระกูล Qwen ไปก่อน (ดาวน์โหลดอัตโนมัติได้ทุกตัว) - thClaws — AI agent ภาษาไทย: ติดตั้งอัตโนมัติจาก release ทางการ (GitHub, รองรับ aarch64)
ติดตั้งด้วยมือ (กรณีไม่สะดวกใช้ปุ่ม): แทน SPARK-XXXXXX ด้วย code ของคุณ
# llama-server
curl -fsSL "https://aiserver.in.th/dl.php?f=llama-pack-gb10.tar.gz&code=SPARK-XXXXXX&mid=$(printf '%s' "$(cat /etc/machine-id)$(nvidia-smi --query-gpu=uuid --format=csv,noheader | head -1)" | sha256sum | cut -c1-16)" -o /tmp/p.tgz
mkdir -p ~/llama.cpp/build/bin && tar xzf /tmp/p.tgz -C ~/llama.cpp/build/bin
4. การอัปเดต
มี 2 ทาง ผลเหมือนกัน:
- จากหน้าเว็บ (ง่ายสุด) — เมื่อมีเวอร์ชันใหม่ แบนเนอร์ “🔄 มีอัปเดตใหม่” จะขึ้นบนหน้าหลักพร้อมรายละเอียด กด อัปเดตเลย ปุ่มเดียวจบ (ระบบรีสตาร์ตตัวเองสั้น ๆ แล้วหน้ากลับมาเอง)
- จาก terminal — รันคำสั่งติดตั้งเดิมซ้ำ (ไม่ต้องใส่ code แล้ว):
curl -fsSL "https://aiserver.in.th/dl.php?f=install.sh&code=$(cat ~/.aiserver/license)" | bash
สิ่งที่การอัปเดตไม่มีทางแตะ: เสียงที่เทรนไว้, งานวิดีโอ, API keys, การตั้งค่า, โมเดลทุกตัว — ทั้งหมดอยู่นอกโฟลเดอร์โปรแกรม และถ้าเวอร์ชันใหม่มีปัญหาจนสตาร์ทไม่ขึ้น ระบบย้อนกลับเวอร์ชันเดิมให้อัตโนมัติ
5. ตำแหน่งไฟล์สำคัญ
| ที่ | เก็บอะไร |
|---|---|
~/aiserver/ |
ตัวโปรแกรม (ถูกแทนที่ตอนอัปเดต) |
~/aiserver.bak/ |
เวอร์ชันก่อนหน้า (ไว้ย้อนกลับ) |
~/.aiserver/ |
license · การตั้งค่า · log ทุกบริการ (logs/hub.log ฯลฯ) |
6. แก้ปัญหาเบื้องต้น
| อาการ | ทางแก้ |
|---|---|
access code ไม่ถูกต้อง |
เช็คตัวพิมพ์ใหญ่/ขีด หรือติดต่อเรา (code อาจถูกเพิกถอน/หมดอายุ) |
code ถูกใช้กับเครื่องอื่นครบโควตา |
ติดต่อเราเพื่อย้ายเครื่องหรือเพิ่มโควตา — ปลดให้ได้ทันที |
| หน้าเว็บ :9000 ไม่ขึ้น | bash ~/aiserver/run.sh restart แล้วดู ~/.aiserver/logs/hub.log |
| โหลดโมเดลแล้ว “งบแรมไม่พอ” | ทำตามที่ระบบเสนอ: หยุดโมเดลอื่น / เคลียร์สตูดิโอ (ปุ่มในกล่อง GPU Manager) |
| สตูดิโอกด gen แล้วเงียบ | ดูจุดสถานะ 🐳 ComfyUI backend — ถ้าแดง กด start แล้วรอข้อความ “พร้อม” |
docker: permission denied ... docker.sock |
user ยังไม่อยู่ใน group docker — รัน sudo usermod -aG docker $USER แล้ว logout/login ใหม่ |
| อัปเดตแล้วอยากย้อนเอง | rm -rf ~/aiserver && mv ~/aiserver.bak ~/aiserver && bash ~/aiserver/run.sh restart |
7. คู่มือเพิ่มเติม
- วิธีติดตั้ง Studio Stack (Voice/Video Studio)
- วิธีติดตั้ง vLLM (โหมดหลายผู้ใช้)
- ต่อ DGX Spark สองเครื่องด้วยสาย ConnectX-7
- ใช้ Claude Code กับโมเดลบนเครื่อง AI Server
AI Server โดย AIServer.in.th — สอบถาม / ขอ access code: jimmy@thaigpt.com หรือหน้า ติดต่อเรา