Groq
Groq
Cloud inferensi yang dibangun di atas prosesor LPU buatan sendiri, mengoperasikan kapasitas khusus berskala besar.

Platform
Ringkasan
Groq menyebut dirinya neocloud terdepan untuk inferensi cepat. Intinya adalah prosesor LPU yang dikembangkan sendiri; pada generasi baru, LPX memadukan 256 akselerator LPU per rak dengan GPU generasi baru NVIDIA untuk menghadirkan inferensi berlatensi rendah dan berkonteks panjang. Layanan dibagi menjadi tiga lapis yang masing-masing mencakup lapis di bawahnya: GroqMetal untuk infrastruktur bare metal, GroqCore untuk tumpukan inferensi, dan GroqAssured untuk tata kelola serta keterlacakan tingkat perusahaan. Situsnya menyebutkan pengoperasian 13 pusat data di empat benua. Harga tidak dipublikasikan.
Fitur utama
- Inferensi cepat dengan prosesor LPU sendiri
- LPX yang dipadukan dengan GPU generasi baru NVIDIA
- Infrastruktur bare metal GroqMetal
- Tumpukan inferensi GroqCore
- Tata kelola perusahaan dengan GroqAssured
- 13 pusat data di empat benua
Harga
Contact sales
Hubungi penjual
- GroqMetal / GroqCore / GroqAssured
- No published rate card
- Contact for a quote
Belum ada harga yang terverifikasi untuk negara Anda. Periksa ketersediaan dan harga setempat di situs resmi.
Tangkapan layar

Alat AI terkait
Together AI
Together AI adalah layanan AI untuk platform pengembangan AI/API yang dapat dimanfaatkan untuk pengembangan AI dan inferensi.
Fireworks AI
Inferensi, pelatihan, dan penempatan khusus untuk model terbuka, ditagih per token dan per jam GPU.
Replicate
Replicate adalah layanan AI untuk platform pengembangan AI/API yang dapat dimanfaatkan untuk pengembangan AI dan prototipe.
OpenRouter
OpenRouter adalah layanan AI untuk platform pengembangan AI/API yang dapat dimanfaatkan untuk pengembangan AI dan perbandingan model.