LLM API の無料枠の実測

更新日 · JSON · CC BY 4.0 · English

このページは、当社が日々の業務で LLM API の無料枠を使って受けた応答を集計した一次データです (期間と件数は各節)。要点: Gemini API の無料枠の上限はプロジェクトごと・モデルごとで、記載どおり太平洋時間の0時に戻りました (戻りの後の最初の呼び出しが成功 17 回中 12 回)。Cloudflare Workers AI は記載では UTC の0時に戻りますが、当社の観測では戻りの後もしばらく上限の応答が続き、最初の成功まで中央値 28.6 分・最長 82.9 分かかりました。

Google Gemini API (無料枠)

当社の観測の期間 2026-08-22 〜 2026-10-03・成功した呼び出し 1,597・失敗の応答 (上限の間の当社の再確認を含む) 2,994

公式の記載
記載出典
上限はプロジェクトごと (API キーごとではない)ai.google.dev/gemini-api/docs/rate-limits (確認 2026-10-02)
1日の回数 (RPD) は太平洋時間の0時に戻るai.google.dev/gemini-api/docs/rate-limits (確認 2026-10-02)
無料枠の数値はページに載っておらず、AI Studio で確かめるよう案内しているai.google.dev/gemini-api/docs/rate-limits (確認 2026-10-02)

当社の観測で分かったこと (記載との差)

  • 日の上限の 429 の本文が示した上限名は GenerateRequestsPerDayPerProjectPerModel-FreeTier、値は 20 (1プロジェクト・1モデルあたり1日20回)。文書のページには無料枠の数値が無い (観測 2026-10-02・件数 1)
当社が受けたエラーの型
種類件数 (日数)戻りの確認・次の成功まで本文の型 (冒頭)
1日の上限2,528 (18)記載の戻り時刻の後、最初の呼び出しが成功 12 回・まだ上限 0 回 (全 17 回)。戻り時刻から最初の成功まで 中央値 1.6 分・最長 8.4 分 (7 日)
{ "error": { "code": 429, "message": "You exceeded your current quota, please check your plan and bi
混雑 (503)365 (41)次の成功まで 中央値 1.5 時間・90% 点 9.1 時間 (365 件)
{ "error": { "code": 503, "message": "This model is currently experiencing high demand. Spikes in de
時間切れ94 (17)次の成功まで 中央値 3.5 時間・90% 点 12.0 時間 (94 件)
The read operation timed out
その他7 (2)次の成功まで 中央値 0.7 時間・90% 点 1.9 時間 (7 件)
<urlopen error EOF occurred in violation of protocol (_ssl.c:2406)>

成功したモデル: gemini-3.7-flash 950、gemini-3.5-flash 647

Cloudflare Workers AI (無料枠)

当社の観測の期間 2026-09-22 〜 2026-10-03・成功した呼び出し 497・失敗の応答 (上限の間の当社の再確認を含む) 4,025

公式の記載
記載出典
1日 10,000 ニューロンまで無料developers.cloudflare.com/workers-ai/platform/pricing/ (確認 2026-10-02)
上限は毎日 00:00 UTC に戻るdevelopers.cloudflare.com/workers-ai/platform/pricing/ (確認 2026-10-02)
当社が受けたエラーの型
種類件数 (日数)戻りの確認・次の成功まで本文の型 (冒頭)
1日の上限4,022 (11)記載の戻り時刻の後、最初の呼び出しが成功 4 回・まだ上限 6 回 (全 11 回)。戻り時刻から最初の成功まで 中央値 28.6 分・最長 82.9 分 (6 日)
{"errors":[{"message":"AiError: AiError: you have used up your daily free allocation of 10,000 neuro
時間切れ2 (1)次の成功まで 中央値 0.0 時間・90% 点 0.0 時間 (2 件)
The read operation timed out
その他1 (1)次の成功まで 中央値 9.8 時間・90% 点 9.8 時間 (1 件)
error code: 502

成功したモデル: @cf/meta/llama-3.3-70b-instruct-fp8-fast 259、@cf/openai/gpt-oss-120b 124、@cf/mistralai/mistral-small-3.1-24b-instruct 91、@cf/qwen/qwen3.8-27b 23

Alibaba Cloud Model Studio (Qwen、国際版・シンガポール)

当社の観測の期間 2026-08-13 〜 2026-10-03・成功した呼び出し 3,787・失敗の応答 (上限の間の当社の再確認を含む) 56

公式の記載
記載出典
無料枠はモデルごとに通常 100万 tokens、有効期間 90日 (モデル間で共有しない)www.alibabacloud.com/help/en/model-studio/new-free-quota (確認 2026-10-02)
「無料枠のみ」を有効にすると、使い切った時に AllocationQuota.FreeTierOnly を返して止まる (既定は無効で従量課金に移る)www.alibabacloud.com/help/en/model-studio/new-free-quota (確認 2026-10-02)
当社が受けたエラーの型
種類件数 (日数)戻りの確認・次の成功まで本文の型 (冒頭)
無料枠の総量の使い切り39 (7)—
{"error":{"message":"Free quota exhausted. To continue accessing the model on a paid basis, please a
時間切れ10 (2)次の成功まで 中央値 2.1 時間・90% 点 4.3 時間 (10 件)
<urlopen error timed out>
その他7 (3)次の成功まで 中央値 14.9 時間・90% 点 30.1 時間 (7 件)
{"error":{"message":"Model is not supported in current workspace service site","id":"<id>","type":"M

成功したモデル: qwen-plus 1,669、qwen-max 1,074、qwen-plus-2025-07-28 805、qwen3.5-plus-2026-02-15 146、qwen3-max 59、qwen3.7-plus 34

方法と注意

  • 当社の観測。当社の業務の呼び出し (無料枠・1事業者1鍵) の記録から集計し、追加の問い合わせはしていない。失敗の件数には、上限に当たっている間の当社の再確認も含む (件数は当社の呼び出し方に左右される)。2026-10-01 以前は、上限に当たると当社の側で数時間〜24時間止めていたので、その間の観測は無い。
  • 集計の元: 当社のアプリケーションのエラーの記録 (2026-10-02 より前は本文の冒頭180字まで)、2026-10-02 からは鍵・識別子を消した本文の全体、成功した呼び出しの記録 (時刻・事業者・モデル)。
  • 再現の方法: 1つのプロジェクト・アカウントから無料枠を呼び、2xx 以外の応答の本文と成功の時刻・モデル名をすべて記録し、同じ期間で同じ集計をする。
  • 載せていない事業者: cerebras・chatgpt・claude・codex・mistral・nvidia