Groq
Groq
Nuvem de inferência construída sobre o próprio processador LPU, com capacidade dedicada em larga escala.

Plataformas
Visão geral
A Groq se define como a principal neocloud para inferência rápida. No centro está o processador próprio LPU; na nova geração, o LPX combina 256 aceleradores LPU por rack com as GPUs de nova geração da NVIDIA para oferecer inferência de baixa latência e contexto longo. A oferta é dividida em três camadas, cada uma incluindo as anteriores: GroqMetal para a infraestrutura bare metal, GroqCore para a pilha de inferência e GroqAssured para governança e auditoria corporativa. O site informa que opera 13 data centers em quatro continentes. Os preços não são divulgados.
Principais recursos
- Inferência rápida com o processador próprio LPU
- LPX combinado às GPUs NVIDIA de nova geração
- Infraestrutura bare metal GroqMetal
- Pilha de inferência GroqCore
- Controles corporativos com GroqAssured
- 13 data centers em quatro continentes
Preços
Contact sales
Falar com vendas
- GroqMetal / GroqCore / GroqAssured
- No published rate card
- Contact for a quote
Ainda não há preço verificado para o seu país. Confira a disponibilidade e os preços locais no site oficial.
Capturas de tela

Ferramentas de IA relacionadas
Together AI
Together AI é um serviço de IA de infraestrutura de desenvolvimento/API que pode ser usado para desenvolvimento de IA e inferência.
Fireworks AI
Inferência, treinamento e implantações dedicadas para modelos abertos, cobrados por tokens e horas de GPU.
Replicate
Replicate é um serviço de IA de infraestrutura de desenvolvimento/API que pode ser usado para desenvolvimento de IA e prototipagem.
OpenRouter
OpenRouter é um serviço de IA de infraestrutura de desenvolvimento/API que pode ser usado para desenvolvimento de IA e comparação de modelos.