GEMINI LABEN
0918 — Gemini API の changelog は9月18日以降の新規なしです。新規プロジェクトの推奨は引き続き 3.5 Flash-Lite か 3.8 Flash です09/30 — gemini-omni-flash-preview は9月30日に止まります。残り6日で、後継は gemini-omni-1.1-flash ですENTCLI — Enterprise の Gemini CLI に 3.5 / 3.6 Flash が来ない、という問いが立っています。個人アカウントとの差がまだ説明されていませんNEW — つないだ MCP を初めて外した日、常時有効にするツールを選ぶ基準CONFIG — Antigravity 2.17.0 からリポジトリ設定は .gemini/config.json で読まれます。Gemini CLI と同じ .gemini/ を共有する形ですPICKER — 見慣れたモデルが使えないときは、まず自分の画面のピッカーに何が並んでいるかを確かめると、限定措置と故障を取り違えずに済みます0918 — Gemini API の changelog は9月18日以降の新規なしです。新規プロジェクトの推奨は引き続き 3.5 Flash-Lite か 3.8 Flash です09/30 — gemini-omni-flash-preview は9月30日に止まります。残り6日で、後継は gemini-omni-1.1-flash ですENTCLI — Enterprise の Gemini CLI に 3.5 / 3.6 Flash が来ない、という問いが立っています。個人アカウントとの差がまだ説明されていませんNEW — つないだ MCP を初めて外した日、常時有効にするツールを選ぶ基準CONFIG — Antigravity 2.17.0 からリポジトリ設定は .gemini/config.json で読まれます。Gemini CLI と同じ .gemini/ を共有する形ですPICKER — 見慣れたモデルが使えないときは、まず自分の画面のピッカーに何が並んでいるかを確かめると、限定措置と故障を取り違えずに済みます
記事一覧/高度な活用
高度な活用/2026-09-24中級

Gemini に「合っていますか」と聞くのをやめ、答えを伏せたまま分類し直してもらう設計に変えました

自分で付けたラベルの確認を Gemini に頼むと、頷く答えが返りがちです。確認型・反論指示型・伏せ型の三つを比べて伏せ型を選んだ理由と、答えが漏れる経路の塞ぎ方、食い違いだけを人が見る振り分けのコードまで書き残します。

Gemini API241構造化出力18プロンプト設計10画像分類6Python49

プレミアム記事

浮世絵壁紙の新しい素材に主題のタグを付け終えた夜、私は念のため Gemini に確認を頼んでおりました。「この作品は名所絵で合っていますか」と画像を添えて尋ねると、返ってくるのは、ほとんどが丁寧な同意と、もっともらしい理由です。

安心しかけたところで、手が止まりました。役者の大首絵に、うっかり名所絵のタグが付いたままの一枚があったのです。その一枚にも、背景の書き割りを根拠にした「名所絵として妥当です」という答えが付いておりました。

確認してもらったつもりが、私の答えをなぞってもらっていただけでした——この記事は、そこから聞き方を組み替えた記録です。

確認を頼む聞き方は、答えを先に渡していました

振り返ると、原因はモデルより先に、私の質問文にありました。「名所絵で合っていますか」という一文には、すでに「名所絵」という答えが入っています。モデルはその語を起点に画面を読み、合う根拠を探しにいきます。

これは Gemini だけの癖ではないのだと思います。gemini-cli のリポジトリには、応答が同意に寄りすぎることを扱った Issue(#4556)が長く開いたままになっており、コメントの中でも「指示で抑えられるのか、聞き方を変えるべきか」で意見が割れています。

私が引いた線は一つです。

判断を頼むときは、自分の答えを相手の目に入れない。

確認という作業を「私の答えを見せて是非を問う」から「何も見せずにもう一度解いてもらい、二つの答えを私が突き合わせる」へ移す、という発想です。

三つの聞き方を並べて、どれを残すか決めました

組み替える前に、思いつく聞き方を三つ並べて、同じ素材の束で試しました。個人開発の小さな運用ですので、評価は私自身の目視です。

聞き方プロンプトの形起きたこと向いている場面
確認型「◯◯で合っていますか」ほぼ同意。外れたタグにも理由を添えて頷く答えの候補が決まっていない文章の校正(後述)
反論指示型「このタグの誤りを探してください」正しいタグにも異論を作る。今度は反対側に寄る見落としの洗い出しだけが目的のとき
伏せ型候補だけ渡して分類させ、私のタグとは手元で比べる一致・不一致が素直に分かれる。一回あたりの出力はやや長い候補が有限で、正解が一つに決まる分類

意外だったのは反論指示型です。「誤りを探して」と頼むと、探すこと自体が課題になるため、正しいタグにも「背景を重く見れば名所絵とも言えます」といった異論が付きます。同意の偏りを、逆向きの偏りに付け替えただけでした。

伏せ型は、モデルに一から分類をやり直してもらうぶん出力が長くなります。それでも、人が見るべき作品が「食い違った分」に絞られるので、全体の手間はむしろ軽くなりました。私は分類には伏せ型を採り、確認型は別の用途に残すことにしました。

ここまでお読みいただきありがとうございます。

この記事の続きを読む

この先には、実装コードやベンチマーク結果など、実務でお役に立てる内容をご用意しています。このサイトは広告を掲載しておらず、サーバーや開発にかかる費用はメンバーの皆様のご支援で成り立っています。もしお役に立てていましたら、ご支援いただけますと大変ありがたいです。

この記事で得られること
自分のラベルを伏せたまま Gemini に分類し直してもらい、食い違った作品だけを人が見る仕組みを、手元のデータで今日から組めるようになります
ファイル名・候補の並び順・プロンプトの前置きから答えが漏れる経路を、運用に入れる前に塞げるようになります
確認を頼む・反論を頼む・答えを伏せる、の三つのうちどれを使うかを、作業の性質から自分で選べるようになります
Stripe による安全な決済 · いつでもキャンセル可能

この記事を購入する

この先の内容をすべてお読みいただけます。一度のご購入で、いつでも何度でもアクセスできます。このサイトは広告を掲載しておらず、皆さまのご支援がサーバー費用などの運営を支えています。

または
メンバーシップなら全記事が読み放題 →
シェア

お読みいただきありがとうございます

Gemini Lab は広告なしで運営しており、サーバー費用などの運営コストはメンバーシップのご支援で賄っています。実装コード・ベンチマーク・本番設計パターンなど、実務でお役立ていただける記事を毎日更新しています。もし読んでよかったと感じていただけましたら、ぜひご覧ください。

  • コピー&ペーストで使える実装コード付き
  • 毎日新しい上級ガイドを追加
  • ¥580/月 または ¥2,480 の永久アクセス
メンバーシップを見る →

関連記事

高度な活用2026-07-15
分類ラベルの近ミスはリトライで直らない — 閉じた語彙を正規化する層を挟んだ実測ノート
responseSchema の enum を外したラベルをリトライで直そうとすると同じ近ミスが返ります。壁紙アプリの30分類バッチで外れ方の分布を測り、別名表と埋め込み最近傍で正規化する受け入れ層を挟んだ実装と実測値をまとめました。
高度な活用2026-08-06
知識カットオフが前進した日、見直すべきなのは2つの日付に挟まれた断定でした
モデルの知識カットオフが前進すると、古くなるのはモデルではなくシステム命令に書いた断定の側でした。旧カットオフと新カットオフに挟まれた行だけが補足から矛盾へ反転する理由と、その窓を機械判定する監査ツールの実行結果をまとめています。
高度な活用2026-07-10
カテゴリを30から34に増やした日 — 8,000枚を全部かけ直さない差分再分類の設計
分類カテゴリを30から34に増やした際、既存8,000枚超を全件かけ直さない差分再分類の設計を記録しました。埋め込みで影響ラベルを絞り、確信度マージンで境界資産を拾う選定ルールの Before/After と、実際に回した結果や外した1件まで共有します。
📚RECOMMENDED BOOKS
大規模言語モデル入門
山田育矢
LLM開発
生成AIプロンプトエンジニアリング入門
我妻幸長
プロンプト
Claude CodeによるAI駆動開発入門
平川知秀
AI駆動開発
※ アフィリエイトリンクを含みます