Claude Code คือ coding agent แบบ terminal ของ Anthropic — ปกติมันเรียกใช้โมเดล Claude
บนคลาวด์ แต่เครื่อง AI Server รองรับ Anthropic API format ในตัว
จึงชี้ Claude Code (และเครื่องมืออื่นที่ใช้ Anthropic SDK) มาใช้โมเดลบนเครื่องของคุณเองได้
— ข้อมูลไม่ออกจากองค์กร ไม่มีค่า API
สิ่งที่ต้องมีก่อน
- เครื่อง AI Server ที่โหลดโมเดลแล้ว (กล่อง GPU Manager → เลือกโมเดล → โหลด) และ LiteLLM ติดสถานะเขียว
- ทราบ IP ของเครื่อง — ดูได้จากหัวเว็บ AI Server หรือกดปุ่ม ℹ️ (API Endpoints)
- ติดตั้ง Claude Code บนเครื่องที่จะใช้งาน (คำสั่งเดียว):
curl -fsSL https://claude.ai/install.sh | bash(Windows ใช้ PowerShell:irm https://claude.ai/install.ps1 | iex)
วิธีตั้งค่า (ชั่วคราว — ลองก่อน)
เปิด terminal แล้วรัน (แทน <IP> ด้วย IP เครื่อง AI Server ของคุณ):
export ANTHROPIC_BASE_URL=http://<IP>:4000
export ANTHROPIC_AUTH_TOKEN=sk-local
export ANTHROPIC_MODEL=auto
export ANTHROPIC_SMALL_FAST_MODEL=auto
claude
เท่านี้ Claude Code จะคุยกับโมเดลบนเครื่อง Spark แทนคลาวด์ — ลองพิมพ์คำถามดูได้เลย
ตั้งถาวร (ไม่ต้อง export ทุกครั้ง)
สร้าง/แก้ไฟล์ ~/.claude/settings.json:
{
"env": {
"ANTHROPIC_BASE_URL": "http://<IP>:4000",
"ANTHROPIC_AUTH_TOKEN": "sk-local",
"ANTHROPIC_MODEL": "auto",
"ANTHROPIC_SMALL_FAST_MODEL": "auto"
}
}
จากนั้นสั่ง claude ได้เลยทุกครั้ง — ถ้าอยากสลับกลับไปใช้ Claude คลาวด์ ให้ลบ block นี้ออก
ความหมายของแต่ละค่า
| ตัวแปร | ความหมาย |
|---|---|
ANTHROPIC_BASE_URL |
ชี้ไปที่ LiteLLM gateway ของเครื่อง (พอร์ต 4000 — ไม่ต้องมี /v1 ต่อท้าย) |
ANTHROPIC_AUTH_TOKEN |
คีย์อะไรก็ได้ (ระบบในเครื่องไม่ตรวจ) — ใช้ sk-local ตามตัวอย่าง |
ANTHROPIC_MODEL |
auto = โมเดลหลักที่โหลดอยู่บนพอร์ต 8000 — สลับโมเดลใน GPU Manager ได้โดยไม่ต้องแก้ค่านี้ |
ANTHROPIC_SMALL_FAST_MODEL |
โมเดลสำหรับงานเบื้องหลังของ Claude Code (ตั้งชื่อหัวข้อ ฯลฯ) — ใช้ auto ตัวเดียวกัน |
ข้อควรรู้
- ข้อความเตือน “auto” is not a model this version of Claude Code recognizes ตอนเริ่ม — เป็นเรื่องการประเมินขนาด context ภายในเท่านั้น ใช้งานได้ปกติ
- โมเดลบนเครื่อง (ระดับ 27B) เหมาะกับถาม-ตอบ อธิบายโค้ด แก้งานเป็นจุด — งาน agent ซับซ้อนต่อเนื่องยาวๆ จะไม่เท่า Claude คลาวด์ เป็นเรื่องปกติของขนาดโมเดล
- เครื่องมืออื่นที่ใช้ Anthropic SDK ก็ตั้งค่าแบบเดียวกันได้ (base URL + token) — ส่วน client แบบ OpenAI format ใช้
http://<IP>:4000/v1ตามคู่มือหลัก - ถ้าเรียกแล้วไม่ตอบ: เช็คว่าโมเดลโหลดอยู่ (หน้า AI Server ต้องมี instance เขียวบนพอร์ต 8000) และเครื่องคุณกับเครื่อง Spark อยู่วงเน็ตเดียวกัน
กลับไปที่ คู่มือหลัก AI Server · สอบถาม: jimmy@thaigpt.com