Fireworks AI
Fireworks AI
Inferencia, entrenamiento y despliegues dedicados para modelos abiertos, con cobro por tokens y horas de GPU.

Plataformas
Descripción general
Fireworks AI es una plataforma de inferencia para modelos abiertos. Su página de precios, titulada precios para escalar sin fricción de la idea a la empresa, se divide en tres: inferencia sin servidor por tokens, entrenamiento por tokens de entrenamiento y despliegues dedicados bajo demanda por hora de GPU. En entrenamiento, para modelos de hasta 16B, LoRA SFT cuesta 0,50 dólares por millón de tokens y el SFT de parámetros completos, 1,00. Bajo demanda, H100/H200 cuesta 8 dólares la hora y B200, 13. Al empezar se ofrecen 1 dólar en créditos gratuitos.
Funciones principales
- Inferencia sin servidor con cobro por tokens
- Ajuste fino (LoRA y parámetros completos)
- GPU dedicadas bajo demanda
- 1 dólar en créditos gratuitos al empezar
- Condiciones a medida para empresas
Precios
Training (up to 16B, LoRA SFT)
0,50 US$ / 1M training tokens
Precio publicado (USD) · Fuente
- Up to 16B: LoRA SFT $0.50 / Full Param SFT $1.00
- 16.1B-80B: LoRA SFT $3.00 / Full Param SFT $6.00
- 80B-300B: $6.00-$24.00
- >300B: $10.00-$40.00
- All per 1M training tokens
Última verificación: septiembre de 2026
On-demand deployments
8 US$ / GPU hour
Precio publicado (USD) · Fuente
- H100/H200: $8.00/hour
- B200: $13.00/hour
- B300/GB300: $15.00-$20.00/hour
Última verificación: septiembre de 2026
Serverless inference (embeddings example)
0,10 US$ / 1M input tokens
Precio publicado (USD) · Fuente
- Qwen3 8B embeddings: $0.1 per 1M input tokens
- Embeddings up to 150M params: $0.008
- Embeddings 150M-350M params: $0.016
- Get started with $1 in free credits
Última verificación: septiembre de 2026
Enterprise
Contactar con ventas
- Faster speeds and lower costs
- Higher rate limits
- Contact us for a quote
Fireworks AI publica un único precio mundial y cobra en USD. No hay un precio aparte en tu moneda local.
Capturas de pantalla

Herramientas de IA relacionadas
Together AI
Together AI es un servicio de plataforma de desarrollo de IA / API que se puede usar para el desarrollo de IA y la inferencia.
Replicate
Replicate es un servicio de plataforma de desarrollo de IA / API que se puede usar para desarrollar IA y crear prototipos.
Groq
Nube de inferencia construida sobre su propio procesador LPU, con capacidad dedicada a gran escala.
OpenRouter
OpenRouter es un servicio de plataforma de desarrollo de IA / API que se puede usar para desarrollar IA y comparar modelos.