GEMINI LABEN
VIDEO — 9月1日、エージェント型の動画理解が 3.7 Flash・3.6 Flash・3.5 Flash-Lite に届きました。モデルが動画のタイムラインを自分で辿りますTOKENS — 必要なときだけ字幕・フレーム・音声を取りに行く方式で、長尺では従来処理に比べて最大88%のトークン削減とされていますSCOPE — 対応は Interactions API と GenerateContent API の両方です。長い動画を扱う見積もりは、この変更で前提が変わりますMUSIC — 9月3日、Lyria 3.5 がパブリックプレビューへ。フルレングスの楽曲生成に対応し、44.1kHz ステレオを出力しますCONTROL — Lyria 3.5 はテキストと画像を入力に取り、音楽的な一貫性、自然なボーカル、尺と構成の細かい制御が改善されましたROBOTICS — gemini-robotics-er-2-streaming-preview は Live API 上のリアルタイム配信向けで、物理動作に対するブロッキング挙動つきの function calling に対応しますVIDEO — 9月1日、エージェント型の動画理解が 3.7 Flash・3.6 Flash・3.5 Flash-Lite に届きました。モデルが動画のタイムラインを自分で辿りますTOKENS — 必要なときだけ字幕・フレーム・音声を取りに行く方式で、長尺では従来処理に比べて最大88%のトークン削減とされていますSCOPE — 対応は Interactions API と GenerateContent API の両方です。長い動画を扱う見積もりは、この変更で前提が変わりますMUSIC — 9月3日、Lyria 3.5 がパブリックプレビューへ。フルレングスの楽曲生成に対応し、44.1kHz ステレオを出力しますCONTROL — Lyria 3.5 はテキストと画像を入力に取り、音楽的な一貫性、自然なボーカル、尺と構成の細かい制御が改善されましたROBOTICS — gemini-robotics-er-2-streaming-preview は Live API 上のリアルタイム配信向けで、物理動作に対するブロッキング挙動つきの function calling に対応します
記事一覧/高度な活用
高度な活用/2026-04-16上級

Gemini 2.5 Pro の思考を制御する — Thinking Budget と推論プロセスを活用した高精度プロンプト設計

Gemini 2.5 Pro の Thinking 機能(内部推論プロセス)を深掘り解説。Thinking Budget の設定・調整から、思考プロセスを活用した高精度回答の引き出し方まで、API レベルの実装パターンを紹介します。

Gemini 2.5 Pro17Thinking Budgetreasoning4プロンプト設計9Gemini API233高精度AI

プレミアム記事

「賢さ」を設定できるモデルが登場した

Gemini 2.5 Pro が他のモデルと決定的に異なる点は、モデルが回答を返す前にどれだけ深く考えるかを設定できることです。

これが thinking_budget パラメータです。0に設定すれば即座に回答(Thinking OFF)、24576トークンまで上げれば問題をじっくり内部で検討してから回答します。同じプロンプトでも、この設定次第で回答品質が大きく変わることを、実際に検証してみました。

Thinking Budget とは何か

thinking_budget は Gemini 2.5 Pro の独自パラメータで、モデルの内部推論に使えるトークン数の上限を設定します。

注意すべきは「使えるトークン数の上限」であって「必ず使うトークン数」ではないことです。簡単な質問には少ない推論で答え、難しい問題には上限まで使います。つまり、高い値を設定することは「必要なら時間をかけていい」という許可を与えることになります。

コストについても正直に書くと:Thinking トークンは通常のトークンと同じ料金で課金されます。thinking_budget を24576に設定して難しい問題を解かせると、その分コストが増えます。コストを抑えたい簡単なタスクには低い値を使いましょう。

ここまでお読みいただきありがとうございます。

この記事の続きを読む

この先には、実装コードやベンチマーク結果など、実務でお役に立てる内容をご用意しています。このサイトは広告を掲載しておらず、サーバーや開発にかかる費用はメンバーの皆様のご支援で成り立っています。もしお役に立てていましたら、ご支援いただけますと大変ありがたいです。

この記事で得られること
Budget 値別のレイテンシ・コスト・品質スコアの実測値(5回平均)
本番運用で実際にハマった3つのトラブルと安全側に倒した対処コード
個人開発の本番アプリで私が使っている Budget 配分ルールと早見表
Stripe による安全な決済 · いつでもキャンセル可能

この記事を購入する

この先の内容をすべてお読みいただけます。一度のご購入で、いつでも何度でもアクセスできます。このサイトは広告を掲載しておらず、皆さまのご支援がサーバー費用などの運営を支えています。

または
メンバーシップなら全記事が読み放題 →
シェア

お読みいただきありがとうございます

Gemini Lab は広告なしで運営しており、サーバー費用などの運営コストはメンバーシップのご支援で賄っています。実装コード・ベンチマーク・本番設計パターンなど、実務でお役立ていただける記事を毎日更新しています。もし読んでよかったと感じていただけましたら、ぜひご覧ください。

  • コピー&ペーストで使える実装コード付き
  • 毎日新しい上級ガイドを追加
  • ¥580/月 または ¥2,480 の永久アクセス
メンバーシップを見る →

関連記事

高度な活用2026-08-06
知識カットオフが前進した日、見直すべきなのは2つの日付に挟まれた断定でした
モデルの知識カットオフが前進すると、古くなるのはモデルではなくシステム命令に書いた断定の側でした。旧カットオフと新カットオフに挟まれた行だけが補足から矛盾へ反転する理由と、その窓を機械判定する監査ツールの実行結果をまとめています。
高度な活用2026-04-06
Gemini 2.5 Proビジネス上級活用マスタークラス:思考力と統合力を極める
Gemini 2.5 Proの推論能力(Thinking)、100万トークンコンテキスト、マルチモーダル理解を最大限に活かすビジネス活用法を徹底解説。意思決定支援・文書分析・データ解析・戦略立案まで、上級者向けのプロンプト設計と実践ワークフローをまとめました。
高度な活用2026-09-05
長い動画を Gemini に辿らせるとき、見つける問いと「無い」を確かめる問いは別々に投げています
9月1日に来たエージェント的動画理解では、どこを観るかをモデル自身が決めます。見つける問いには効きますが、映り込みが無いことの確認には被覆の保証がありません。問いの形で処理モードを分ける判断と、被覆を自分で担保する実装を書き残します。
📚RECOMMENDED BOOKS
大規模言語モデル入門
山田育矢
LLM開発
生成AIプロンプトエンジニアリング入門
我妻幸長
プロンプト
Claude CodeによるAI駆動開発入門
平川知秀
AI駆動開発
※ アフィリエイトリンクを含みます