HF Hub の Inference Providers に関する最近のお知らせに続き、Fireworks.ai が HF Hub の Inference Provider として正式にサポートされることになりました!
Fireworks.ai は、モデルページはもちろん、HF のライブラリやツール群全体で blazing-fast なサーバーレス推論を提供し、お気に入りのモデルでの推論をこれまで以上に簡単にします。

Fireworks.ai を通じてサーバーレス推論を実行できる主なモデルは以下の通りです:
- deepseek-ai/DeepSeek-R1
- deepseek-ai/DeepSeek-V3
- mistralai/Mistral-Small-24B-Instruct-2501
- Qwen/Qwen2.5-Coder-32B-Instruct
- meta-llama/Llama-3.2-90B-Vision-Instruct
その他にも多数のモデルをサポートしています。完全な一覧はこちらからご覧ください。
今すぐ Fireworks.ai でプロジェクトを盛り上げましょう!
使い方
Web サイト UI から
Fireworks がサポートするすべてのモデルは、HF のこちらから検索できます。
クライアント SDK から
Python(huggingface_hub を使用)
以下の例では、Fireworks.ai を推論プロバイダーとして DeepSeek-R1 を使用する方法を示しています。Hugging Face トークンを使用して Hugging Face を経由して自動ルーティングするか、Fireworks.ai の API キーを使用することができます。
huggingface_hub をソースからインストールします:
pip install git+https://github.com/huggingface/huggingface_hub
huggingface_hub Python ライブラリを使って、provider パラメータを指定することで Fireworks.ai のエンドポイントを呼び出せます。
from huggingface_hub import InferenceClient
client = InferenceClient(
provider="fireworks-ai",
api_key="xxxxxxxxxxxxxxxxxxxxxxxx"
)
messages = [
{
"role": "user",
"content": "What is the capital of France?"
}
]
completion = client.chat.completions.create(
model="deepseek-ai/DeepSeek-R1",
messages=messages,
max_tokens=500
)
print(completion.choices[0].message)
JS(@huggingface/inference を使用)
import { HfInference } from "@huggingface/inference";
const client = new HfInference("xxxxxxxxxxxxxxxxxxxxxxxx");
const chatCompletion = await client.chatCompletion({
model: "deepseek-ai/DeepSeek-R1",
messages: [
{
role: "user",
content: "How to make extremely spicy Mayonnaise?"
}
],
provider: "fireworks-ai",
max_tokens: 500
});
console.log(chatCompletion.choices[0].message);
HTTP 呼び出しから
以下は、cURL を使用して Fireworks.ai を推論プロバイダーとして Llama-3.3-70B-Instruct を呼び出す例です。
curl 'https://router.huggingface.co/fireworks-ai/v1/chat/completions' \
-H 'Authorization: Bearer xxxxxxxxxxxxxxxxxxxxxxxx' \
-H 'Content-Type: application/json' \
--data '{
"model": "accounts/fireworks/models/llama-v3p3-70b-instruct",
"messages": [
{
"role": "user",
"content": "What is the meaning of life if you were a dog?"
}
],
"max_tokens": 500,
"stream": false
}'
料金
直接リクエスト(Fireworks のキーを使用する場合)は、Fireworks アカウントに直接請求されます。
ルーティングリクエスト(Hub を介して認証する場合)は、標準の Fireworks API 料金のみをお支払いいただきます。Hugging Face による追加料金は一切発生せず、プロバイダーのコストをそのまま転嫁するだけです。(将来的には、プロバイダーパートナーとの収益分配契約を締結する可能性があります。)
重要なお知らせ ‼️ PRO ユーザーには毎月 $2 分の Inference クレジットが付与されます。このクレジットはすべてのプロバイダーでご利用いただけます。🔥
Hugging Face PRO プランに登録すると、Inference クレジット、ZeroGPU、Spaces Dev Mode、20 倍の制限緩和などの特典をご利用いただけます。

0 Comments
Log in to join the conversation.No comments yet. Be the first to share your thoughts.