すべての記事
画像の重複検査に埋め込み検索を足す前に、重複の定義を三つに分ける
同じ構図で色だけ違う二枚を、検査は重複と判定しました。知覚ハッシュと File Search の埋め込み検索の守備範囲を距離の実数で切り分け、何を重複と呼ぶかの定義から検査の構成を組み直した判断の記録です。
AI 検索が広げたクエリを分母から外して、実質 CTR を出し直します
運営サイトの検索データで、表示回数上位5件のクリックが全て0でした。うち4件は人間が打つ語ではありません。分母を作り直す手順と、Gemini に判定を任せる境界の引き方をまとめます。
日本の版画か中国の版画かを Gemini に当てさせない来歴ゲート
浮世絵の壁紙アプリに素材を入れる前の来歴チェックを、モデルに国を当てさせる形から、紙に写っている痕跡だけを列挙させる形へ組み替えた記録です。判断の表をこちら側に置き、証拠が足りない入力は保留へ回す配線を、動くコードと運用の判断基準まで含めてまとめました。
記憶が消えたのではなく、別のプロファイルに書かれていました — Memory profiles のスコープキーを実測で正す
Memory Bank のプロファイルはスキーマとスコープの組で一意になります。呼び出し側でスコープの形がわずかにぶれると、エラーを出さないまま別のプロファイルが増えていきます。分裂の量と、3種類の対処の効き目を同じ条件で測った記録です。
知識カットオフが前進した日、見直すべきなのは2つの日付に挟まれた断定でした
モデルの知識カットオフが前進すると、古くなるのはモデルではなくシステム命令に書いた断定の側でした。旧カットオフと新カットオフに挟まれた行だけが補足から矛盾へ反転する理由と、その窓を機械判定する監査ツールの実行結果をまとめています。
Vertex AI 改称後に検索基盤を測ったら、壊れていたのは順位ではなく集計層でした
Vertex AI から Gemini Enterprise Agent Platform への改称を受けて、自前の運用ドキュメント検索を実測しました。順位はほとんど動かず、完全一致に依存した集計層だけが静かに欠落していました。
番号が世代を表さなくなった — モデルIDを正規表現で分解する集計を作り直した記録
モデルIDから世代とティアを導く集計が、Flash が 3.6 で Pro の最上位が 3.5 という並びで、音もなく壊れました。正規表現派生とレジストリ結合の按分差を実行結果で並べ、IDを不透明な主キーとして扱い直すまでの記録です。
セキュリティ特化モデルを個人開発の監査に組み込む — 抽出層と、再提出されない指摘の指紋設計
外向きリクエストのシンクを AST で抽出し、モデルの指摘を再現可否だけで採用する三層のセキュリティ監査設計を解説します。指摘の重複を防ぐ指紋方式は4種類を実測し、粗い指紋が安全な実装まで巻き込んでしまう衝突の再現例も含めて丁寧に整理しました。
日本語で引いた検索に、対訳の英語記事が出てこない — 埋め込みが内容より先に言語を見ている件
gemini-embedding-2 で日英の対訳ペアを埋め込むと、同じ内容なのに最近傍になりません。言語そのものが類似度を押し上げているためです。対訳ペアを正解として再現率を測り、言語重心を引く方法と翻訳ブリッジを比べた記録をまとめます。
システム指示を何語で書くか — 現地語のプロンプトが多数になったアプリで3方式を測り直す
システム指示を英語で固定するか、ユーザーの言語に訳して渡すか。countTokens で言語別の入力トークンを実測し、出力言語の一致率とスキーマ遵守率を並べて、9トークンで足りる場所と訳すべき場所を切り分けます。
分類ラベルの近ミスはリトライで直らない — 閉じた語彙を正規化する層を挟んだ実測ノート
responseSchema の enum を外したラベルをリトライで直そうとすると同じ近ミスが返ります。壁紙アプリの30分類バッチで外れ方の分布を測り、別名表と埋め込み最近傍で正規化する受け入れ層を挟んだ実装と実測値をまとめました。
待ち時間を守りながら難問だけ深く考えさせる — Gemini の thinking_level をリクエストごとに振り分ける
アプリの AI 機能を全リクエスト high で回すと待ち時間と料金が膨らみ、全部 low にすると難問で精度が落ちます。Gemini 3.x の thinking_level をリクエストの難易度で振り分け、モバイルの待ち時間予算を守りながら深い推論を必要な場面だけに回すルーターを、実測値と動くコードで設計します。