Fireworks AI
Fireworks AI
บริการอินเฟอเรนซ์ ฝึกโมเดล และติดตั้งเฉพาะสำหรับโมเดลเปิด คิดเงินตามโทเค็นและชั่วโมง GPU

แพลตฟอร์ม
ภาพรวม
Fireworks AI คือแพลตฟอร์มอินเฟอเรนซ์สำหรับโมเดลเปิด หน้าแสดงราคาใช้หัวข้อว่าราคาที่ขยายจากไอเดียสู่ระดับองค์กรได้อย่างราบรื่น และแบ่งเป็นสามส่วน ได้แก่ อินเฟอเรนซ์แบบเซิร์ฟเวอร์เลสคิดตามโทเค็น การฝึกโมเดลคิดตามโทเค็นที่ใช้ฝึก และการติดตั้ง GPU เฉพาะแบบออนดีมานด์คิดตามชั่วโมง สำหรับการฝึกโมเดลขนาดไม่เกิน 16B แบบ LoRA SFT อยู่ที่ 0.50 ดอลลาร์ต่อหนึ่งล้านโทเค็น และแบบปรับทุกพารามิเตอร์อยู่ที่ 1.00 ดอลลาร์ ส่วนแบบออนดีมานด์ H100/H200 อยู่ที่ 8 ดอลลาร์ต่อชั่วโมง และ B200 อยู่ที่ 13 ดอลลาร์ เริ่มต้นใช้งานมีเครดิตฟรี 1 ดอลลาร์
ฟีเจอร์หลัก
- อินเฟอเรนซ์แบบเซิร์ฟเวอร์เลสคิดตามโทเค็น
- ปรับจูนโมเดล (LoRA และทุกพารามิเตอร์)
- GPU เฉพาะแบบออนดีมานด์
- เครดิตฟรี 1 ดอลลาร์เมื่อเริ่มต้น
- เงื่อนไขเฉพาะสำหรับองค์กร
ราคา
Training (up to 16B, LoRA SFT)
US$0.50 / 1M training tokens
ราคาที่ประกาศ (USD) · แหล่งข้อมูล
- Up to 16B: LoRA SFT $0.50 / Full Param SFT $1.00
- 16.1B-80B: LoRA SFT $3.00 / Full Param SFT $6.00
- 80B-300B: $6.00-$24.00
- >300B: $10.00-$40.00
- All per 1M training tokens
ตรวจสอบล่าสุด: กันยายน 2569
On-demand deployments
US$8 / GPU hour
ราคาที่ประกาศ (USD) · แหล่งข้อมูล
- H100/H200: $8.00/hour
- B200: $13.00/hour
- B300/GB300: $15.00-$20.00/hour
ตรวจสอบล่าสุด: กันยายน 2569
Serverless inference (embeddings example)
US$0.10 / 1M input tokens
ราคาที่ประกาศ (USD) · แหล่งข้อมูล
- Qwen3 8B embeddings: $0.1 per 1M input tokens
- Embeddings up to 150M params: $0.008
- Embeddings 150M-350M params: $0.016
- Get started with $1 in free credits
ตรวจสอบล่าสุด: กันยายน 2569
Enterprise
ติดต่อฝ่ายขาย
- Faster speeds and lower costs
- Higher rate limits
- Contact us for a quote
Fireworks AI ประกาศราคาเดียวทั่วโลกและเรียกเก็บเงินเป็น USD ไม่มีราคาแยกตามสกุลเงินท้องถิ่น
ภาพหน้าจอ

เครื่องมือ AI ที่เกี่ยวข้อง
Together AI
Together AI เป็นบริการ AI ด้านแพลตฟอร์มพัฒนา AI/API ที่นำไปใช้งานได้ เช่น การพัฒนา AI หรือ การอนุมาน (Inference)
Replicate
Replicate เป็นบริการ AI ด้านแพลตฟอร์มพัฒนา AI/API ที่นำไปใช้งานได้ เช่น การพัฒนา AI หรือ ต้นแบบ (Prototype)
Groq
คลาวด์อินเฟอเรนซ์ที่สร้างบนหน่วยประมวลผล LPU ของตัวเอง เปิดให้บริการกำลังประมวลผลเฉพาะในระดับใหญ่
OpenRouter
OpenRouter เป็นบริการ AI ด้านแพลตฟอร์มพัฒนา AI/API ที่นำไปใช้งานได้ เช่น การพัฒนา AI หรือ การเปรียบเทียบโมเดล