ใช้ Claude Code กับโมเดลบนเครื่อง AI Server

Claude Code คือ coding agent แบบ terminal ของ Anthropic — ปกติมันเรียกใช้โมเดล Claude
บนคลาวด์ แต่เครื่อง AI Server รองรับ Anthropic API format ในตัว
จึงชี้ Claude Code (และเครื่องมืออื่นที่ใช้ Anthropic SDK) มาใช้โมเดลบนเครื่องของคุณเองได้
— ข้อมูลไม่ออกจากองค์กร ไม่มีค่า API

สิ่งที่ต้องมีก่อน

  • เครื่อง AI Server ที่โหลดโมเดลแล้ว (กล่อง GPU Manager → เลือกโมเดล → โหลด) และ LiteLLM ติดสถานะเขียว
  • ทราบ IP ของเครื่อง — ดูได้จากหัวเว็บ AI Server หรือกดปุ่ม ℹ️ (API Endpoints)
  • ติดตั้ง Claude Code บนเครื่องที่จะใช้งาน (คำสั่งเดียว): curl -fsSL https://claude.ai/install.sh | bash (Windows ใช้ PowerShell: irm https://claude.ai/install.ps1 | iex)

วิธีตั้งค่า (ชั่วคราว — ลองก่อน)

เปิด terminal แล้วรัน (แทน <IP> ด้วย IP เครื่อง AI Server ของคุณ):

export ANTHROPIC_BASE_URL=http://<IP>:4000
export ANTHROPIC_AUTH_TOKEN=sk-local
export ANTHROPIC_MODEL=auto
export ANTHROPIC_SMALL_FAST_MODEL=auto
claude

เท่านี้ Claude Code จะคุยกับโมเดลบนเครื่อง Spark แทนคลาวด์ — ลองพิมพ์คำถามดูได้เลย

ตั้งถาวร (ไม่ต้อง export ทุกครั้ง)

สร้าง/แก้ไฟล์ ~/.claude/settings.json:

{
  "env": {
    "ANTHROPIC_BASE_URL": "http://<IP>:4000",
    "ANTHROPIC_AUTH_TOKEN": "sk-local",
    "ANTHROPIC_MODEL": "auto",
    "ANTHROPIC_SMALL_FAST_MODEL": "auto"
  }
}

จากนั้นสั่ง claude ได้เลยทุกครั้ง — ถ้าอยากสลับกลับไปใช้ Claude คลาวด์ ให้ลบ block นี้ออก

ความหมายของแต่ละค่า

ตัวแปร ความหมาย
ANTHROPIC_BASE_URL ชี้ไปที่ LiteLLM gateway ของเครื่อง (พอร์ต 4000 — ไม่ต้องมี /v1 ต่อท้าย)
ANTHROPIC_AUTH_TOKEN คีย์อะไรก็ได้ (ระบบในเครื่องไม่ตรวจ) — ใช้ sk-local ตามตัวอย่าง
ANTHROPIC_MODEL auto = โมเดลหลักที่โหลดอยู่บนพอร์ต 8000 — สลับโมเดลใน GPU Manager ได้โดยไม่ต้องแก้ค่านี้
ANTHROPIC_SMALL_FAST_MODEL โมเดลสำหรับงานเบื้องหลังของ Claude Code (ตั้งชื่อหัวข้อ ฯลฯ) — ใช้ auto ตัวเดียวกัน

ข้อควรรู้

  • ข้อความเตือน “auto” is not a model this version of Claude Code recognizes ตอนเริ่ม — เป็นเรื่องการประเมินขนาด context ภายในเท่านั้น ใช้งานได้ปกติ
  • โมเดลบนเครื่อง (ระดับ 27B) เหมาะกับถาม-ตอบ อธิบายโค้ด แก้งานเป็นจุด — งาน agent ซับซ้อนต่อเนื่องยาวๆ จะไม่เท่า Claude คลาวด์ เป็นเรื่องปกติของขนาดโมเดล
  • เครื่องมืออื่นที่ใช้ Anthropic SDK ก็ตั้งค่าแบบเดียวกันได้ (base URL + token) — ส่วน client แบบ OpenAI format ใช้ http://<IP>:4000/v1 ตามคู่มือหลัก
  • ถ้าเรียกแล้วไม่ตอบ: เช็คว่าโมเดลโหลดอยู่ (หน้า AI Server ต้องมี instance เขียวบนพอร์ต 8000) และเครื่องคุณกับเครื่อง Spark อยู่วงเน็ตเดียวกัน

กลับไปที่ คู่มือหลัก AI Server · สอบถาม: jimmy@thaigpt.com