Groq
Groq
Nube de inferencia construida sobre su propio procesador LPU, con capacidad dedicada a gran escala.

Plataformas
Descripción general
Groq se define como la principal neocloud para inferencia rápida. Se apoya en su procesador propio, la LPU; en la nueva generación, LPX combina 256 aceleradores LPU por rack con las GPU de nueva generación de NVIDIA para ofrecer inferencia de baja latencia y contexto largo. Se vende en tres capas, cada una con las anteriores: GroqMetal para la infraestructura bare metal, GroqCore para la pila de inferencia y GroqAssured para el gobierno y la auditoría empresarial. La web indica que opera 13 centros de datos en cuatro continentes. El precio no se publica.
Funciones principales
- Inferencia rápida con el procesador propio LPU
- LPX combinado con GPU NVIDIA de nueva generación
- Infraestructura bare metal GroqMetal
- Pila de inferencia GroqCore
- Controles empresariales con GroqAssured
- 13 centros de datos en cuatro continentes
Precios
Contact sales
Contactar con ventas
- GroqMetal / GroqCore / GroqAssured
- No published rate card
- Contact for a quote
Todavía no hay un precio verificado para tu país. Consulta la disponibilidad y el precio locales en el sitio oficial.
Capturas de pantalla

Herramientas de IA relacionadas
Together AI
Together AI es un servicio de plataforma de desarrollo de IA / API que se puede usar para el desarrollo de IA y la inferencia.
Fireworks AI
Inferencia, entrenamiento y despliegues dedicados para modelos abiertos, con cobro por tokens y horas de GPU.
Replicate
Replicate es un servicio de plataforma de desarrollo de IA / API que se puede usar para desarrollar IA y crear prototipos.
OpenRouter
OpenRouter es un servicio de plataforma de desarrollo de IA / API que se puede usar para desarrollar IA y comparar modelos.