โมเดลภาษาขนาดใหญ่ AI

DwarfStar

เครื่องมืออนุมานในเครื่องเฉพาะทางสำหรับโมเดลภาษาขนาดใหญ่ ที่ปรับให้เหมาะสมกับ Apple Silicon และการสตรีมจาก SSD บนระบบที่มีหน่วยความจำจำกัด

DwarfStar คืออะไร

DwarfStar เป็นเครื่องมืออนุมานขนาดเล็กแบบครบวงจรสำหรับรันโมเดลภาษาขนาดใหญ่ในเครื่อง รองรับโมเดล DeepSeek, Qwen และ GLM โดยตรง มีการสตรีมจาก SSD แบบปรับตัวได้และเร่งความเร็วด้วย Metal

DwarfStar เทียบกับเครื่องมือที่คล้ายคลึง

โมเดลราคาฟรีฟรี, ฟรีเมียมชำระเงินชำระเงิน
เครดิตฟรี
ฟีเจอร์หลัก
  • โหลดโมเดลโดยตรงสำหรับ DeepSeek V4, Qwen3.6 และ GLM 5.2
  • การจัดการ Metal และการสตรีมจาก SSD แบบปรับตัวสำหรับระบบที่มีหน่วยความจำจำกัด
  • เซิร์ฟเวอร์ HTTP พร้อมการเรียกใช้เครื่องมือและเอเจนต์เขียนโค้ด
  • เข้าถึงโมเดล AI หลายตัว (GPT, Claude, Gemini, DeepSeek, Grok ฯลฯ)
  • การทำงานร่วมกันของทีมในพื้นที่ทำงานส่วนตัว
  • รองรับการอัปโหลดไฟล์ (PDF, โค้ด, เอกสาร) พร้อมการทำความเข้าใจบริบท
  • โมเดลเดียวสำหรับทุกงาน ไม่ต้องสลับโหมด
  • API ที่เข้ากันได้กับ OpenAI
  • คุณภาพระดับ Claude Fable ในงานที่ประเมิน
  • โทเคนไม่จำกัด
  • หน้าต่างบริบทไม่จำกัด
  • ราคารายเดือนคงที่
ข้อดี
  • ทำงานในเครื่องทั้งหมด ทำให้ข้อมูลเป็นส่วนตัว
  • ปรับให้เหมาะสมกับ Apple Silicon ด้วยการเร่ง Metal
  • เข้าถึงโมเดล AI ชั้นนำหลายตัวในแพลตฟอร์มเดียว
  • ฟีเจอร์การทำงานร่วมกันของทีมในตัว
  • คุณภาพสูงเทียบเท่า Claude Fable
  • ต้นทุนต่ำกว่าโมเดลระดับแนวหน้าอย่างมาก
  • โทเคนและบริบทไม่จำกัด
  • ราคาคงที่คาดการณ์ได้
ข้อจำกัด
  • ออกแบบมาสำหรับ Apple Silicon เป็นหลัก แบ็กเอนด์ CUDA/ROCm เป็นรอง
  • ไม่ใช่ตัวรัน GGUF ทั่วไป รองรับเฉพาะโมเดลที่กำหนด
  • ข้อความและเครดิตจำกัดในแผนฟรี
  • ฟีเจอร์ขั้นสูงต้องสมัครสมาชิกแบบชำระเงิน
  • โมเดลใหม่กว่าพร้อมการตรวจสอบอิสระที่จำกัด
  • ราคาที่แน่นอนไม่ได้เปิดเผยต่อสาธารณะ
  • ค่าใช้จ่ายรายเดือนสูง ($10K+)
  • ต้องใช้เวลาเตรียมการ 14 วัน
เหมาะสำหรับ
  • ผู้ใช้ Mac Apple Silicon ที่ต้องการอนุมาน LLM บนเครื่อง
  • นักพัฒนาที่ต้องการเครื่องมืออนุมานเฉพาะทางประสิทธิภาพสูง
  • ทีมที่ต้องการเข้าถึงโมเดล AI ที่หลากหลาย
  • ผู้สร้างเนื้อหาและนักวิจัย
  • นักพัฒนาที่ต้องการ LLM คุณภาพสูงในราคาต่ำ
  • ทีมที่ต้องการโมเดลอเนกประสงค์ตัวเดียว
  • ทีมองค์กรที่รันเอเจนต์ AI ในขนาดใหญ่
  • ทีมวิศวกรรมซอฟต์แวร์ที่ต้องการสร้างโค้ดระยะยาว

วิธีใช้ DwarfStar

  1. 1ติดตั้งข้อกำหนดเบื้องต้น: Xcode Command Line Tools บน macOS
  2. 2โคลน repository: git clone https://github.com/andreaborio/ds4.git && cd ds4
  3. 3ดาวน์โหลดโมเดล: ./download_model.sh q2-imatrix
  4. 4บิลด์: make
  5. 5รัน inference: ./ds4 -m ./ds4flash.gguf --nothink
  6. 6เริ่มเซิร์ฟเวอร์: ./ds4-server -m ./ds4flash.gguf --ctx 32768

ฟีเจอร์หลักของ DwarfStar

  • โหลดโมเดลโดยตรงสำหรับ DeepSeek V4, Qwen3.6 และ GLM 5.2
  • การจัดการ Metal และการสตรีมจาก SSD แบบปรับตัวสำหรับระบบที่มีหน่วยความจำจำกัด
  • เซิร์ฟเวอร์ HTTP พร้อมการเรียกใช้เครื่องมือและเอเจนต์เขียนโค้ด
  • การจัดการสถานะ KV ใน RAM และบนดิสก์
  • เครื่องมือ GGUF สำหรับการควอนไทซ์และการปรับเทียบ
  • รองรับ expert แบบกำหนดเส้นทางหลายความแม่นยำผสม
  • เกณฑ์วัดความถูกต้องและความเร็ว

เคสใช้งานของ DwarfStar

  • รันโมเดลภาษาขนาดใหญ่ในเครื่องบน Mac Apple Silicon
  • การอนุมานที่รักษาความเป็นส่วนตัวโดยไม่พึ่งพาคลาวด์
  • การพัฒนาและทดสอบแอปพลิเคชัน LLM
  • งานวิจัยเกี่ยวกับการควอนไทซ์และการสตรีมโมเดล

ราคาและเครดิตฟรีของ DwarfStar

DwarfStar ใช้โมเดลราคาแบบ ฟรี

โอเพนซอร์ส

ฟรี

สัญญาอนุญาต MIT ให้ใช้ฟรีบน GitHub

ข้อดีและข้อจำกัดของ DwarfStar

ข้อดี

  • ทำงานในเครื่องทั้งหมด ทำให้ข้อมูลเป็นส่วนตัว
  • ปรับให้เหมาะสมกับ Apple Silicon ด้วยการเร่ง Metal
  • รองรับโมเดลขนาดใหญ่หลายรุ่น (DeepSeek, Qwen, GLM)
  • การสตรีมจาก SSD แบบปรับตัวทำให้รันโมเดลที่ใหญ่กว่า RAM ได้
  • โอเพนซอร์ส มีการพัฒนาอย่างต่อเนื่องและมีเกณฑ์วัดประสิทธิภาพ

ข้อจำกัด

  • ออกแบบมาสำหรับ Apple Silicon เป็นหลัก แบ็กเอนด์ CUDA/ROCm เป็นรอง
  • ไม่ใช่ตัวรัน GGUF ทั่วไป รองรับเฉพาะโมเดลที่กำหนด
  • ซอฟต์แวร์เบต้าที่มีฟีเจอร์ทดลองบางอย่าง
  • ต้องมีความเชี่ยวชาญทางเทคนิคในการติดตั้งและกำหนดค่า

DwarfStar เหมาะกับงานแบบไหน?

  • ผู้ใช้ Mac Apple Silicon ที่ต้องการอนุมาน LLM บนเครื่อง
  • นักพัฒนาที่ต้องการเครื่องมืออนุมานเฉพาะทางประสิทธิภาพสูง
  • นักวิจัยที่ทดลองการควอนไทซ์และการสตรีมโมเดล

คำถามที่พบบ่อยเกี่ยวกับ DwarfStar

ตัวเลือกฟรีทดแทน DwarfStar

Opper AI logo

เกตเวย์ AI แบบรวมศูนย์ที่ให้การเข้าถึงโมเดลชั้นนำกว่า 300 รุ่นผ่าน API เดียวที่โฮสต์ในสหภาพยุโรปและเป็นไปตาม GDPR พร้อมอินเทอร์เฟซที่เข้ากันได้กับ OpenAI SDK

ฟรี
discode.ai logo

อินเทอร์เฟซแชทเดียวที่ให้คุณเข้าถึงโมเดล AI กว่า 100 รุ่น โดยเลือกโมเดลที่ดีที่สุดสำหรับงานของคุณโดยอัตโนมัติ พร้อมติดตามการใช้พลังงานและปกป้องความเป็นส่วนตัวของคุณ

ฟรี
Oxlo.ai logo

Oxlo.ai คือ API การอนุมาน AI ที่ให้ความสำคัญกับความเป็นส่วนตัว โดยเสนอราคาตามคำขอสำหรับโมเดลโอเพนซอร์สกว่า 45 รายการ

ฟรี
Graphsignal logo

Graphsignal เป็นแพลตฟอร์มการทำโปรไฟล์การอนุมานระดับการผลิตที่ช่วยให้วิศวกรปรับปรุงประสิทธิภาพ AI ในโมเดล เอ็นจิน GPU และตัวเร่งอื่นๆ

ฟรี
Groq logo

Groq มอบการทำ inference ของ AI ที่รวดเร็วและต้นทุนต่ำผ่าน GroqCloud และสแต็ก LPU แบบเฉพาะของบริษัท

ฟรี

ตัวเลือก AI ทดแทนที่ดีที่สุดสำหรับ DwarfStar

Aymo AI logo

แพลตฟอร์ม AI แบบครบวงจรสำหรับทีม ให้เข้าถึงโมเดล AI ชั้นนำ เช่น GPT, Claude, Gemini และอื่นๆ ในพื้นที่การทำงานร่วมกันที่ปลอดภัย

EB

Echo คือโมเดล AI แบบโอเพนเวทที่มอบประสิทธิภาพระดับ Claude ด้วยต้นทุนหนึ่งในสาม ปรับเปลี่ยนได้กับงานแชท โค้ด และเอเจนต์

L

LiquidBrain.ai นำเสนอการอนุมาน AI ด้วยโทเคนและบริบทไม่จำกัดในรูปแบบค่าธรรมเนียมรายเดือนคงที่ โดยใช้เอนจิ้นการอนุมานแบบกระจายที่จดสิทธิบัตรสำหรับการปรับใช้โมเดลแบบส่วนตัวและปรับขนาดได้

colibri logo

เอ็นจิ้น C ที่ไม่มี dependencies ซึ่งสตรีมน้ำหนักผู้เชี่ยวชาญจากดิสก์เพื่อรันโมเดล GLM-5.2 MoE ขนาด 744 พันล้านพารามิเตอร์บนฮาร์ดแวร์ผู้บริโภคโดยใช้ RAM เพียง 25 GB

Opper AI logo

เกตเวย์ AI แบบรวมศูนย์ที่ให้การเข้าถึงโมเดลชั้นนำกว่า 300 รุ่นผ่าน API เดียวที่โฮสต์ในสหภาพยุโรปและเป็นไปตาม GDPR พร้อมอินเทอร์เฟซที่เข้ากันได้กับ OpenAI SDK

ฟรี
Auriko logo

แพลตฟอร์ม API แบบรวมสำหรับการอนุมาน LLM พร้อมการปรับต้นทุน การจัดเส้นทาง การสังเกตการณ์ และการเฟลโอเวอร์อัตโนมัติ