CoAI

Fireworks AI

Fireworks AI

オープンモデルの推論・学習・専有デプロイをまとめて提供するAI基盤。トークンとGPU時間の従量課金。

API・モデル基盤有料
公式サイトへ

対応プラットフォーム

WebAPI

概要

Fireworks AI はオープンモデルを扱う推論プラットフォームです。公式の料金ページは「Pricing to seamlessly scale from idea to enterprise」と掲げ、サーバーレス推論(トークン単位)、ファインチューニングなどの学習(学習トークン単位)、専有GPUのオンデマンド利用(GPU時間単位)の3本立てで料金が示されています。学習は16Bまでのモデルで LoRA SFT が100万学習トークンあたり0.50ドル、フルパラメータSFTが1.00ドル。オンデマンドは H100/H200 が1時間8ドル、B200 が13ドルです。開始時に1ドル分の無料クレジットが案内されています。

主な機能

  • サーバーレスのトークン課金推論
  • ファインチューニング(LoRA・フルパラメータ)
  • 専有GPUのオンデマンド利用
  • 初回1ドル分の無料クレジット
  • Enterprise向けの個別条件

料金プラン

学習(16Bまで・LoRA SFT)

$0.50 / 1M training tokens

公式掲載通貨(USD) · 出典

  • 16Bまで:LoRA SFT 0.50ドル/フルパラメータSFT 1.00ドル
  • 16.1B〜80B:LoRA SFT 3.00ドル/フルパラメータSFT 6.00ドル
  • 80B〜300B:6.00〜24.00ドル
  • 300B超:10.00〜40.00ドル
  • いずれも100万学習トークンあたり

最終確認:2026年9月

オンデマンドGPU

$8 / GPU hour

公式掲載通貨(USD) · 出典

  • H100/H200:1時間8.00ドル
  • B200:1時間13.00ドル
  • B300/GB300:1時間15.00〜20.00ドル

最終確認:2026年9月

サーバーレス推論(埋め込み例)

$0.10 / 1M input tokens

公式掲載通貨(USD) · 出典

  • Qwen3 8B 埋め込み:100万入力トークン0.1ドル
  • 1.5億パラメータまでの埋め込み:0.008ドル
  • 1.5億〜3.5億パラメータの埋め込み:0.016ドル
  • 開始時に1ドル分の無料クレジット

最終確認:2026年9月

Enterprise

お問い合わせ

  • 高速化と低コスト化の個別対応
  • レート上限の引き上げ
  • 問い合わせによる見積もり

Fireworks AIは世界共通の料金を掲載し、USDで課金します。各国通貨での個別価格はありません。

スクリーンショット

Fireworks AIの公式サイト
Fireworks AI 公式サイト(2026-09-22撮影)

関連するAIツール