Fireworks AI
Fireworks AI
オープンモデルの推論・学習・専有デプロイをまとめて提供するAI基盤。トークンとGPU時間の従量課金。

対応プラットフォーム
概要
Fireworks AI はオープンモデルを扱う推論プラットフォームです。公式の料金ページは「Pricing to seamlessly scale from idea to enterprise」と掲げ、サーバーレス推論(トークン単位)、ファインチューニングなどの学習(学習トークン単位)、専有GPUのオンデマンド利用(GPU時間単位)の3本立てで料金が示されています。学習は16Bまでのモデルで LoRA SFT が100万学習トークンあたり0.50ドル、フルパラメータSFTが1.00ドル。オンデマンドは H100/H200 が1時間8ドル、B200 が13ドルです。開始時に1ドル分の無料クレジットが案内されています。
主な機能
- サーバーレスのトークン課金推論
- ファインチューニング(LoRA・フルパラメータ)
- 専有GPUのオンデマンド利用
- 初回1ドル分の無料クレジット
- Enterprise向けの個別条件
料金プラン
学習(16Bまで・LoRA SFT)
$0.50 / 1M training tokens
公式掲載通貨(USD) · 出典
- 16Bまで:LoRA SFT 0.50ドル/フルパラメータSFT 1.00ドル
- 16.1B〜80B:LoRA SFT 3.00ドル/フルパラメータSFT 6.00ドル
- 80B〜300B:6.00〜24.00ドル
- 300B超:10.00〜40.00ドル
- いずれも100万学習トークンあたり
最終確認:2026年9月
オンデマンドGPU
$8 / GPU hour
公式掲載通貨(USD) · 出典
- H100/H200:1時間8.00ドル
- B200:1時間13.00ドル
- B300/GB300:1時間15.00〜20.00ドル
最終確認:2026年9月
サーバーレス推論(埋め込み例)
$0.10 / 1M input tokens
公式掲載通貨(USD) · 出典
- Qwen3 8B 埋め込み:100万入力トークン0.1ドル
- 1.5億パラメータまでの埋め込み:0.008ドル
- 1.5億〜3.5億パラメータの埋め込み:0.016ドル
- 開始時に1ドル分の無料クレジット
最終確認:2026年9月
Enterprise
お問い合わせ
- 高速化と低コスト化の個別対応
- レート上限の引き上げ
- 問い合わせによる見積もり
Fireworks AIは世界共通の料金を掲載し、USDで課金します。各国通貨での個別価格はありません。
スクリーンショット

関連するAIツール
Together AI
Together AIは、AI開発基盤・APIとしてAI開発や推論に活用できるAIサービスです。
Replicate
Replicateは、AI開発基盤・APIとしてAI開発やプロトタイプに活用できるAIサービスです。
Groq
独自プロセッサLPUで高速な推論を提供するクラウド。推論に特化した専用インフラを大規模に運用する。
OpenRouter
OpenRouterは、AI開発基盤・APIとしてAI開発やモデル比較に活用できるAIサービスです。