GEMINI LABEN
ROBOTICS — 8月31日に停止した ER 1.6 preview には後継があります。Gemini Robotics ER 2 が公開プレビュー中で、通常版とストリーミング版の2種類が提供されていますVIDEO — ER 2 の成功・失敗判定は静止画ではなく生の映像フィード上で動きます。こぼれ・滑り・位置ずれのような、実行の途中で起きる失敗を捉えられる設計ですDEADLINE — 次の期限は9月30日、gemini-omni-flash-preview の廃止です。移行先は8月27日に GA になった gemini-omni-1.1-flash で、残り4週間を切りましたAPIKEY — 残りの標準 API キーは、制限付きのものも含めて9月中に全面停止します。移行先は Google Cloud サービスアカウントに紐付く auth キー形式ですPRICE — Gemini 3.7 Flash の導入価格 $0.75/$3.75 per 1M は12月31日までです。2027年1月1日から $1.50/$7.50 になるため、年を跨ぐ見積もりは2本立てが要りますAUDIO — Gemini 3.5 Transcribe は85言語以上の言語検出、話者ダイアライゼーション、単語単位タイムスタンプ、最大1,000語のカスタム語彙バイアスに対応していますROBOTICS — 8月31日に停止した ER 1.6 preview には後継があります。Gemini Robotics ER 2 が公開プレビュー中で、通常版とストリーミング版の2種類が提供されていますVIDEO — ER 2 の成功・失敗判定は静止画ではなく生の映像フィード上で動きます。こぼれ・滑り・位置ずれのような、実行の途中で起きる失敗を捉えられる設計ですDEADLINE — 次の期限は9月30日、gemini-omni-flash-preview の廃止です。移行先は8月27日に GA になった gemini-omni-1.1-flash で、残り4週間を切りましたAPIKEY — 残りの標準 API キーは、制限付きのものも含めて9月中に全面停止します。移行先は Google Cloud サービスアカウントに紐付く auth キー形式ですPRICE — Gemini 3.7 Flash の導入価格 $0.75/$3.75 per 1M は12月31日までです。2027年1月1日から $1.50/$7.50 になるため、年を跨ぐ見積もりは2本立てが要りますAUDIO — Gemini 3.5 Transcribe は85言語以上の言語検出、話者ダイアライゼーション、単語単位タイムスタンプ、最大1,000語のカスタム語彙バイアスに対応しています
記事一覧/最新情報
最新情報/2026-05-06中級

Gemini API 開発者向け 2026年5月アップデート — 今月何が変わり、何をすべきか

2026年5月のGemini API最新変更点を開発者目線でまとめました。Gemini 3.2の実力評価、Gemini 2.0 Flash廃止対応、Google I/O直前の準備まで、今月知っておくべきことを整理します。

Gemini アップデート2Gemini 3.26Gemini API228Google I/O 202632026年5月個人開発者8

4月にGemini 3シリーズの本格展開をまとめた記事を書きましたが、あれから1ヶ月もたたないうちに状況がまた変わってきました。個人的に「ちょっと待ってほしい」と思うくらいのペースです。

5月に入って特に気になっているのが3点。Gemini 3.2の登場、6月のGemini 2.0 Flash廃止というタイムリミット、そしてGoogle I/O 2026が目前に迫っているという事実です。今月はただ新機能を試すだけでなく、来月以降の準備をしておく必要があります。開発中のアプリやサービスに影響が出る前に、今月やっておくべきことを整理してみます。

Gemini 3.2 が API で使えるようになった

4月末から段階的に展開が始まったGemini 3.2が、5月に入ってGoogle AI StudioおよびGemini APIで一般利用できるようになりました。モデルIDは gemini-3.2-progemini-3.2-flash です。

Gemini 3.1 Proと比較して実際に試した印象として、いくつか明確な違いを感じています。

コード生成の精度向上が顕著です。特にSwiftやKotlinのモバイル向けコードで、依存関係やAPIの使い方がより最新の状態を反映するようになりました。私が愛用しているSwiftUIのコード生成で、非推奨APIを使わなくなったのは地味に嬉しい変化です。

長文コンテキストの扱い方も改善されています。100万トークン近いコンテキストウィンドウを持つ3.1 Proでも、文書後半の情報が薄れる「中間圧縮」問題がありましたが、3.2ではその傾向が若干緩和されています。まだ完全ではありませんが、長大なコードベース全体をコンテキストに入れて質問するユースケースでは実感できる改善です。

import google.generativeai as genai
 
# Gemini 3.2 の使い方(既存コードの変更は最小限)
genai.configure(api_key="YOUR_API_KEY")
 
# モデルIDを更新するだけで3.2に移行できる
model = genai.GenerativeModel(
    model_name="gemini-3.2-pro",
    generation_config={
        "temperature": 0.7,
        "top_p": 0.95,
        "max_output_tokens": 8192,
    }
)
 
response = model.generate_content(
    "Swiftで非同期画像ダウンロードのキャッシュ機構を実装してください。"
    "URLSession、actor、async/awaitを使い、メモリと永続キャッシュの両方に対応してください。"
)
print(response.text)

移行コストはほぼゼロです。モデルIDを変えるだけで既存のコードがそのまま動きます。ただし、gemini-3.2-flashはまだプレビュー扱いのため、本番環境への採用は動作確認を十分行ってからをおすすめします。

6月のGemini 2.0 Flash廃止——今すぐ対応が必要な人

これが今月最も急ぎの話題です。Gemini 2.0 Flashが2026年6月末に廃止されることが確定しています。gemini-2.0-flashgemini-2.0-flash-exp を本番環境で使っている場合、6月末までに移行しなければサービスが停止します

移行先として推奨されているのは gemini-2.5-flash または gemini-3-flash です。コストパフォーマンスを重視するなら2.5 Flash、最新機能や精度を求めるなら3 Flashか3.1 Flashが候補になります。

まず自分のコードベースを確認する方法:

# リポジトリ内の古いモデルID参照を検索
grep -r "gemini-2.0-flash\|gemini-2.0-flash-exp" . --include="*.py" --include="*.ts" --include="*.js"

このコマンドで何も出なければひとまず安心です。出てきた場合は、テスト環境で新モデルに切り替えて動作確認してから本番に反映しましょう。私のアプリでは2.0 Flashを1箇所使っていたので、先週3-flashに切り替えました。体感的な応答速度に違いはほぼありませんでした。

Google I/O 2026 前に仕込んでおく3つの準備

Google I/O 2026は今月中旬から下旬の開催が予想されています。過去のI/Oでは、発表と同時に新APIや新モデルが使えるようになることが多いです。今回のI/Oでは何が来ても素早く試せるよう、今週中に準備しておきたいことが3つあります。

1. Google AI Studioのクォータを確認・拡張申請する

I/O後は新機能へのアクセス集中でAPIが混雑します。Google AI Studioのクォータ拡張は申請から反映まで数日かかるため、今のうちに上限を確認して必要なら申請を出しておくのが賢明です。Google AI Studioの画面左下「Usage」から現在の利用状況と上限が確認できます。

2. Vertex AI の認証設定を済ませておく

I/OでVertex AI経由の新機能が発表されることが多いです。Application Default Credentials(ADC)の設定と、必要なIAMロールの付与を今のうちに終わらせておくと、発表後すぐに試せます。

# ADC設定の確認(未設定の場合)
gcloud auth application-default login
gcloud config set project YOUR_PROJECT_ID
 
# 必要なAPIを有効化しておく(gemini関連)
gcloud services enable aiplatform.googleapis.com
gcloud services enable generativelanguage.googleapis.com

3. 新モデルのウェイトリストや限定アクセスに備える

毎年I/O後は新モデルの待機列が長くなります。AIプレミアムプラン(Google AI Pro/Ultra)の加入者には優先アクセスが与えられることが多いので、試したいモデルがある場合はサブスクリプションの確認をしておきましょう。また、Google for Developersのメールマガジンに登録しておくと、限定ベータの案内を早めに受け取れます。

今月注目したいマイナーアップデート

大きな機能追加と比べると地味ですが、実際の開発に影響するマイナーな変更も5月に入ってから出ています。

Implicit Cachingのヒット率改善:コンテキストキャッシングの自動判定ロジックが改善され、同じプレフィックスを持つリクエストのキャッシュヒット率が上がっています。大量のドキュメントを前置きとして使う用途では、APIコストが自然に下がっていくはずです。特別な設定変更は不要です。

thinking_budget の挙動変更:Gemini 3系のThinking Modeにおいて、thinking_budgetを明示しない場合の挙動が変わりました。より動的な自動調整になっており、以前より高精度なタスクではトークン消費が増えることがあります。Thinking Modeを使っている方は、今月の請求ダッシュボードを確認してみてください。

Lyria 3 ProとVeo 3.1 LiteのAPI安定化:4月に登場したLyria 3 Proによる音楽生成と低コスト動画生成APIのVeo 3.1 Liteが安定期に入り、本番環境での利用に適したSLAが適用されるようになりました。音楽や動画生成を組み込んだサービスを検討している方には、今が正式組み込みを進めるタイミングです。

5月の優先アクション

今月やることを一つだけ選ぶとすれば、Gemini 2.0 Flash の廃止対応が最優先です。6月末というタイムリミットがある唯一のタスクで、これを後回しにするとサービス停止というリスクがあります。

それが済んだら、Gemini 3.2を1〜2個のユースケースで試してみてください。モデルIDを変えるだけなので試すコストはほぼゼロです。I/O前に3.2の使い勝手を掴んでおくと、I/O後の新発表にも素早く反応できます。

Google I/Oでどんな発表があるかはまだわかりませんが、今回のI/Oへの期待をまとめた記事もあわせてご覧ください。今月のI/Oを境に、Geminiの開発者向けエコシステムがまた一段変わる可能性があります。楽しみにしつつ、準備は着実に進めておきたいと思っています。

シェア

お読みいただきありがとうございます

Gemini Lab は広告なしで運営しており、サーバー費用などの運営コストはメンバーシップのご支援で賄っています。実装コード・ベンチマーク・本番設計パターンなど、実務でお役立ていただける記事を毎日更新しています。もし読んでよかったと感じていただけましたら、ぜひご覧ください。

  • コピー&ペーストで使える実装コード付き
  • 毎日新しい上級ガイドを追加
  • ¥580/月 または ¥2,480 の永久アクセス
メンバーシップを見る →

もしこの記事がお役に立ちましたら、チップ(¥150)で応援いただけると大変励みになります。広告なしでの運営を続けるため、皆さまのご支援が大きな力になっています。

関連記事

最新情報2026-05-05
Google I/O 2026 まであと2週間 — Gemini API を本番で動かしている開発者が今から準備しておくべきこと
Google I/O 2026の開幕が迫る中、本番環境でGemini APIを使っている開発者が今週やっておくべき準備を整理しました。モデルバージョン固定・廃止通知の確認・APIレスポンスの品質モニタリングなど、具体的なアクションを解説します。
最新情報2026-08-31
gemini-robotics-er-1.6-preview は今日停止 — 次の期限は9月30日、gemini-omni-flash-preview の廃止です
本日の gemini-robotics-er-1.6-preview 停止から9月30日の gemini-omni-flash-preview 廃止、12月31日の導入価格終了まで、いま控えている Gemini の期限を1枚の表に整理し、対処の順番を示します。
最新情報2026-07-04
8月17日の Gemini 画像生成モデル停止に備える — 移行先を選ぶ前に『どこから呼んでいるか』を洗い出す
8月17日に提供終了となる Gemini 画像生成モデルへの備えとして、移行先を選ぶ前の棚卸し手順をまとめました。grep では漏れる3つの盲点、実行ログから実際に呼ばれているモデルを集計する方法、移行優先度の付け方、モデル ID の一元管理までを扱います。
📚RECOMMENDED BOOKS
大規模言語モデル入門
山田育矢
LLM開発
生成AIプロンプトエンジニアリング入門
我妻幸長
プロンプト
Claude CodeによるAI駆動開発入門
平川知秀
AI駆動開発
※ アフィリエイトリンクを含みます
もっと見る →