GEMINI LABEN
SUNSET — 画像生成モデルの停止まで残り6日です。imagen-4.0 系と Gemini 3 Image 系が8月17日に止まりますMIGRATE — 移行先として gemini-3.1-flash-image が案内されています。generate_images から generate_content への書き換えが必要ですCHECK — 移行後に同じプロンプトで同じ絵が出る保証はありません。必要な生成物は停止前に確保しておく判断が要りますCLASSROOM — 8月17日は Gemini in Classroom のモバイル提供が始まる日でもあります。web は8月10日に全年齢の学生へ広がりましたDEPRECATION — Grok 4.1 ファミリーの停止は8月20日、gemini-robotics-er-1.6-preview は8月31日で、後継は er-2 系ですCHANGELOG — Gemini API の changelog は7月30日が最新のままです。直近の大きな変更は Gemini 3.6 Flash と 3.5 Flash-Lite の GA ですSUNSET — 画像生成モデルの停止まで残り6日です。imagen-4.0 系と Gemini 3 Image 系が8月17日に止まりますMIGRATE — 移行先として gemini-3.1-flash-image が案内されています。generate_images から generate_content への書き換えが必要ですCHECK — 移行後に同じプロンプトで同じ絵が出る保証はありません。必要な生成物は停止前に確保しておく判断が要りますCLASSROOM — 8月17日は Gemini in Classroom のモバイル提供が始まる日でもあります。web は8月10日に全年齢の学生へ広がりましたDEPRECATION — Grok 4.1 ファミリーの停止は8月20日、gemini-robotics-er-1.6-preview は8月31日で、後継は er-2 系ですCHANGELOG — Gemini API の changelog は7月30日が最新のままです。直近の大きな変更は Gemini 3.6 Flash と 3.5 Flash-Lite の GA です
記事一覧/API / SDK
API / SDK/2026-04-11上級

Gemini API レート制限と 429 対策の運用ノート ― 個人開発アプリで踏んだ落とし穴と対処

Gemini API のレート制限と 429 エラーに本番アプリで遭遇した経験から、指数バックオフ・アダプティブ制御・マルチキープール・Cloud Monitoring 連携を実装メモとしてまとめました。

gemini-api281rate-limiting4quota-managementpython103production105retry3monitoring5

プレミアム記事

夜間バッチが 30 分間、静かに止まった話

個人開発で運用している壁紙アプリのバックエンドに、Gemini API での画像説明生成・タグ補完・レビュー要約を少しずつ載せています。広告収益で回している小さなサービスなので、API の停止はそのまま日々の運用の停止を意味します。

本番ワークロードに Gemini API を組み込んでから、何度か 429 RESOURCE_EXHAUSTED の連鎖に遭ってきました。一番痛かったのは、ある夜間バッチで壁紙のメタタグを 80,000 件まとめて再生成しようとした時です。指数バックオフを「リクエスト単位」で持っていなかったために、最初に詰まったキーへリトライが殺到して 30 分以上 API が動かず、翌朝に予定していたストア反映と App Store Connect のレビュー対応がずれ込みました。その日からレート制限まわりのコードは、アプリの土台と同じくらい大事に扱うようになりました。

ここでは、その経験をベースに、Gemini API のクォータ体系・指数バックオフ・アダプティブレート制御・マルチキープール・Cloud Monitoring 連携を、運用メモとして整理しています。コードはどれも 2026 年春時点で壁紙アプリのバックエンド(Cloud Functions / Cloud Run)で動かしているものを、業務情報を抜いた形で掲載しています。

想定する読み手

  • Gemini API を実サービスに組み込み始めて、429 や TPM 超過に最初の数回は遭遇した方
  • 個人開発・スモールチームで Cloud Monitoring を最小構成から立ち上げたい方
  • AdMob などの広告収益ベースのアプリに AI コストを乗せるときの判断ラインを探している方

Gemini API のクォータ体系を読み解きます

Gemini APIには複数の次元でクォータが設定されており、まずこの体系を正確に把握する点が肝心です。

クォータの種類

Gemini APIのクォータは大きく3種類に分けられます。

1. RPM(Requests Per Minute)— 1分あたりのリクエスト数

最も頻繁に引っかかる制限です。モデルと課金プランによって異なり、例えばGemini 2.5 Proでは無料枠で5 RPM、有料プランでは1,000 RPM以上が設定されています。

2. TPM(Tokens Per Minute)— 1分あたりのトークン数

リクエスト数ではなく、処理するトークン量による制限です。大量のコンテキストを渡す場合はRPMより先にTPMに引っかかることがあります。

3. RPD(Requests Per Day)— 1日あたりのリクエスト数

日次の上限です。無料枠では特に厳しく、有料プランでは大幅に緩和されます。

Tier別の制限値の確認方法

現在の制限値はGoogle AI Studio の「Get API Key」ページ、またはGoogle Cloud コンソールの「Quotas & System Limits」から確認できます。また、APIレスポンスのヘッダーにも制限に関する情報が含まれることがあります。

import google.generativeai as genai
import time
 
genai.configure(api_key="YOUR_GEMINI_API_KEY")
 
# レスポンスメタデータでクォータ情報を確認
model = genai.GenerativeModel("gemini-2.5-pro")
response = model.generate_content("テスト")
 
# usage_metadata でトークン消費を把握
print(f"入力トークン: {response.usage_metadata.prompt_token_count}")
print(f"出力トークン: {response.usage_metadata.candidates_token_count}")
print(f"合計トークン: {response.usage_metadata.total_token_count}")

ここまでお読みいただきありがとうございます。

この記事の続きを読む

この先には、実装コードやベンチマーク結果など、実務でお役に立てる内容をご用意しています。このサイトは広告を掲載しておらず、サーバーや開発にかかる費用はメンバーの皆様のご支援で成り立っています。もしお役に立てていましたら、ご支援いただけますと大変ありがたいです。

この記事で得られること
壁紙アプリ 80,000 件の夜間バッチで遭遇した 429 連鎖の原因と、指数バックオフ・Jitter・タイムアウトを実測値ベースで再設計した記録
公式ドキュメントには書かれていない、本番運用で気づいた 7 つの実装インサイト(usage_metadata 反映遅延・Retry-After の信頼性・マルチキープール分離など)
AdMob 連携アプリで Flash/Pro を振り分ける時の判断基準と、Cloud Billing の日次アラートを『月予算 ÷ 30 × 1.3』で設定している運用ライン
Stripe による安全な決済 · いつでもキャンセル可能

この記事を購入する

この先の内容をすべてお読みいただけます。一度のご購入で、いつでも何度でもアクセスできます。このサイトは広告を掲載しておらず、皆さまのご支援がサーバー費用などの運営を支えています。

または
メンバーシップなら全記事が読み放題 →
シェア

お読みいただきありがとうございます

Gemini Lab は広告なしで運営しており、サーバー費用などの運営コストはメンバーシップのご支援で賄っています。実装コード・ベンチマーク・本番設計パターンなど、実務でお役立ていただける記事を毎日更新しています。もし読んでよかったと感じていただけましたら、ぜひご覧ください。

  • コピー&ペーストで使える実装コード付き
  • 毎日新しい上級ガイドを追加
  • ¥580/月 または ¥1,480 の永久アクセス
メンバーシップを見る →

関連記事

API / SDK2026-03-30
Gemini API 本番環境のオブザーバビリティ — ログ・監視・コスト追跡の実践パターン
Gemini APIを本番運用する際に不可欠なオブザーバビリティ基盤を構築する方法を解説。構造化ログ、トークン使用量の追跡、レイテンシ監視、コスト最適化ダッシュボードまで、実装コード付きで網羅します。
API / SDK2026-03-26
Gemini API AIゲートウェイ設計パターン — レート制限・フォールバック・コスト追跡を統合するプロキシサーバー構築ガイド
Gemini APIを本番運用するためのAIゲートウェイ(プロキシサーバー)を設計・実装する上級ガイド。レート制限、自動フォールバック、トークンコスト追跡、複数モデルルーティングを一元管理するアーキテクチャを解説します。
API / SDK2026-03-19
Gemini 2.5 Pro × FastAPI: プロダクション対応AIバックエンドの実装ガイド
Gemini 2.5 Pro APIとFastAPIを組み合わせ、ストリーミング・レート制限・Function Calling・Dockerデプロイまで網羅したプロダクション対応AIバックエンドの構築方法を徹底解説します。
📚RECOMMENDED BOOKS
大規模言語モデル入門
山田育矢
LLM開発
生成AIプロンプトエンジニアリング入門
我妻幸長
プロンプト
Claude CodeによるAI駆動開発入門
平川知秀
AI駆動開発
※ アフィリエイトリンクを含みます
もっと見る →