記事一覧に戻る

HF Hub の Inference Providers に関する最近のお知らせに続き、Fireworks.ai が HF Hub の Inference Provider として正式にサポートされることになりました!

Fireworks.ai は、モデルページはもちろん、HF のライブラリやツール群全体で blazing-fast なサーバーレス推論を提供し、お気に入りのモデルでの推論をこれまで以上に簡単にします。

Fireworks.ai supported as Inference Provider on Hugging Face

Fireworks.ai を通じてサーバーレス推論を実行できる主なモデルは以下の通りです:

その他にも多数のモデルをサポートしています。完全な一覧はこちらからご覧ください。

今すぐ Fireworks.ai でプロジェクトを盛り上げましょう!

使い方

Web サイト UI から

Fireworks.ai inference provider UI

Fireworks がサポートするすべてのモデルは、HF のこちらから検索できます。

クライアント SDK から

Python(huggingface_hub を使用)

以下の例では、Fireworks.ai を推論プロバイダーとして DeepSeek-R1 を使用する方法を示しています。Hugging Face トークンを使用して Hugging Face を経由して自動ルーティングするか、Fireworks.ai の API キーを使用することができます。

huggingface_hub をソースからインストールします:

pip install git+https://github.com/huggingface/huggingface_hub

huggingface_hub Python ライブラリを使って、provider パラメータを指定することで Fireworks.ai のエンドポイントを呼び出せます。

from huggingface_hub import InferenceClient

client = InferenceClient(
    provider="fireworks-ai",
    api_key="xxxxxxxxxxxxxxxxxxxxxxxx"
)

messages = [
    {
        "role": "user",
        "content": "What is the capital of France?"
    }
]

completion = client.chat.completions.create(
    model="deepseek-ai/DeepSeek-R1", 
    messages=messages, 
    max_tokens=500
)

print(completion.choices[0].message)

JS(@huggingface/inference を使用)

import { HfInference } from "@huggingface/inference";

const client = new HfInference("xxxxxxxxxxxxxxxxxxxxxxxx");

const chatCompletion = await client.chatCompletion({
    model: "deepseek-ai/DeepSeek-R1",
    messages: [
        {
            role: "user",
            content: "How to make extremely spicy Mayonnaise?"
        }
    ],
    provider: "fireworks-ai",
    max_tokens: 500
});

console.log(chatCompletion.choices[0].message);

HTTP 呼び出しから

以下は、cURL を使用して Fireworks.ai を推論プロバイダーとして Llama-3.3-70B-Instruct を呼び出す例です。

curl 'https://router.huggingface.co/fireworks-ai/v1/chat/completions' \
-H 'Authorization: Bearer xxxxxxxxxxxxxxxxxxxxxxxx' \
-H 'Content-Type: application/json' \
--data '{
    "model": "accounts/fireworks/models/llama-v3p3-70b-instruct",
    "messages": [
        {
            "role": "user",
            "content": "What is the meaning of life if you were a dog?"
        }
    ],
    "max_tokens": 500,
    "stream": false
}'

料金

直接リクエスト(Fireworks のキーを使用する場合)は、Fireworks アカウントに直接請求されます。

ルーティングリクエスト(Hub を介して認証する場合)は、標準の Fireworks API 料金のみをお支払いいただきます。Hugging Face による追加料金は一切発生せず、プロバイダーのコストをそのまま転嫁するだけです。(将来的には、プロバイダーパートナーとの収益分配契約を締結する可能性があります。)

重要なお知らせ ‼️ PRO ユーザーには毎月 $2 分の Inference クレジットが付与されます。このクレジットはすべてのプロバイダーでご利用いただけます。🔥

Hugging Face PRO プランに登録すると、Inference クレジット、ZeroGPU、Spaces Dev Mode、20 倍の制限緩和などの特典をご利用いただけます。