Groq
Groq
คลาวด์อินเฟอเรนซ์ที่สร้างบนหน่วยประมวลผล LPU ของตัวเอง เปิดให้บริการกำลังประมวลผลเฉพาะในระดับใหญ่

แพลตฟอร์ม
ภาพรวม
Groq นิยามตัวเองว่าเป็นนีโอคลาวด์อันดับต้นสำหรับงานอินเฟอเรนซ์ความเร็วสูง หัวใจหลักคือหน่วยประมวลผล LPU ที่พัฒนาเอง ส่วนรุ่นใหม่อย่าง LPX จะรวมตัวเร่ง LPU 256 ตัวต่อแร็คเข้ากับ GPU รุ่นใหม่ของ NVIDIA เพื่อให้อินเฟอเรนซ์ที่หน่วงต่ำและรองรับบริบทยาว รูปแบบการให้บริการแบ่งเป็นสามชั้นโดยชั้นบนรวมชั้นล่างไว้ด้วย ได้แก่ GroqMetal สำหรับโครงสร้างพื้นฐานแบบ bare metal, GroqCore สำหรับชุดซอฟต์แวร์อินเฟอเรนซ์ และ GroqAssured สำหรับการกำกับดูแลและการตรวจสอบระดับองค์กร เว็บไซต์ระบุว่าดำเนินการศูนย์ข้อมูล 13 แห่งใน 4 ทวีป ราคาไม่ได้เปิดเผย
ฟีเจอร์หลัก
- อินเฟอเรนซ์ความเร็วสูงด้วยหน่วยประมวลผล LPU
- LPX ที่ทำงานร่วมกับ GPU รุ่นใหม่ของ NVIDIA
- โครงสร้างพื้นฐาน bare metal GroqMetal
- ชุดซอฟต์แวร์อินเฟอเรนซ์ GroqCore
- การกำกับดูแลระดับองค์กรด้วย GroqAssured
- ศูนย์ข้อมูล 13 แห่งใน 4 ทวีป
ราคา
Contact sales
ติดต่อฝ่ายขาย
- GroqMetal / GroqCore / GroqAssured
- No published rate card
- Contact for a quote
ยังไม่มีราคาที่ตรวจสอบแล้วสำหรับประเทศของคุณ โปรดตรวจสอบการให้บริการและราคาในพื้นที่จากเว็บไซต์อย่างเป็นทางการ
ภาพหน้าจอ

เครื่องมือ AI ที่เกี่ยวข้อง
Together AI
Together AI เป็นบริการ AI ด้านแพลตฟอร์มพัฒนา AI/API ที่นำไปใช้งานได้ เช่น การพัฒนา AI หรือ การอนุมาน (Inference)
Fireworks AI
บริการอินเฟอเรนซ์ ฝึกโมเดล และติดตั้งเฉพาะสำหรับโมเดลเปิด คิดเงินตามโทเค็นและชั่วโมง GPU
Replicate
Replicate เป็นบริการ AI ด้านแพลตฟอร์มพัฒนา AI/API ที่นำไปใช้งานได้ เช่น การพัฒนา AI หรือ ต้นแบบ (Prototype)
OpenRouter
OpenRouter เป็นบริการ AI ด้านแพลตฟอร์มพัฒนา AI/API ที่นำไปใช้งานได้ เช่น การพัฒนา AI หรือ การเปรียบเทียบโมเดล