AIエージェント開発

Gemini 2.5 API制限|新規は使えない・移行先と手順【2026年9月】

Gemini 2.5 API制限|新規は使えない・移行先と手順【2026年9月】

この記事の結論

Googleは2026年9月18日、Gemini 2.5系APIを過去に使った利用者に限定すると告知。deprecatedではなく停止日も未告知。移行先3.5 Flash-Lite・3.8 Flashの仕様・料金・手順を公式docsで整理。

2026年9月23日時点で、Gemini 2.5系のAPI(gemini-2.5-progemini-2.5-flashgemini-2.5-flash-lite)を呼べるのは「過去に実際に使った利用者」だけです。Googleは2026年9月18日付のGemini APIリリースノートでこの制限を告知し、新規プロジェクトにはGemini 3.5 Flash-LiteGemini 3.8 Flashを使うよう案内しました。2.5系はdeprecated(非推奨)ではなく、停止日も告知されていません。

  • すでに2.5系を使っているプロジェクト:今すぐ変える必要はありません。公式は「until further notice(追って通知するまで)」APIで提供を続けると書いています。ただしdeprecationsページの2.5系は「No shutdown date announced(停止日未告知)」であって「停止しない」ではありません。
  • これから作るプロジェクト:2.5系は選べません。コストと速度を優先するなら3.5 Flash-Lite、エージェントや長時間の開発タスクなら3.8 Flashが公式の案内先です。
  • 例外:画像生成のgemini-2.5-flash-imageだけは別枠でdeprecatedになっており、2026年10月2日に停止します。移行先はGemini 3.1 Flash Imageか3.1 Flash Lite Imageです。

この記事では、Googleの告知原文と意味、自分のプロジェクトが対象かどうかの見分け方、3.5 Flash-Liteと3.8 Flashの仕様・料金、公式の移行チェックリストに沿った手順を、Google AI for Developersの公式ドキュメント(参照日2026-09-23)だけを根拠に整理します。ベンチマークや体験談は書きません。コードはすべて公式ページに載っている例で、筆者が動かしたものではありません。

2026年9月23日時点の結論|影響を受けるのは「新規プロジェクトで2.5を呼ぶ人」だけ

まず時系列を押さえておきましょう。この制限は9月18日に突然始まったものではなく、7月末から開発者フォーラムで報告が出ていたものが、9月18日に公式リリースノートへ正式に書き込まれた、という流れです。

Gemini 2.5 系を呼ぶプロジェクトが影響を受けるかの分岐図。過去に使った実績があれば「そのまま使える(停止日は未告知)」、無ければ「新規は使えない」ので 3.5 Flash-Lite か 3.8 Flash へ

日付 出来事 根拠
2026年7月28日 Google AI Developers Forumに「新しく作ったGCPプロジェクトからgemini-2.5-proを呼ぶと404が返る」という報告。当時のdeprecationsページには2.5 Proの停止日として2026年10月16日が載っていた、と投稿者は書いている フォーラム投稿(投稿者c-endo)
2026年7月30日 Googleのスタッフ(Pooja Kapse)が同スレッドで回答。「過去に積極的に使った利用者にアクセスを限定する・deprecatedではない・新規プロジェクトは3.1 Flash-Liteか3.5 Flashへ」 同スレッドのスタッフ回答
2026年9月18日 Gemini APIリリースノートに「Gemini 2.5 models access update」として正式掲載。案内先が3.5 Flash-Lite か 3.8 Flashに更新される 公式changelog
2026年9月22日(UTC) modelsページ(2.5 Flash/2.5 Flash-Lite/2.5 Proの各節)とdeprecationsページ(2.5 Pro models/2.5 Flash models)に同じ注記が入った状態で最終更新 公式models・deprecationsページ

つまり、いま影響を受けるのは「2.5系を一度も使ったことのないプロジェクトで、2.5のモデルIDを新しく指定しようとしている人」です。既存の本番ワークロードを止める告知ではありません。一方で、停止日が将来告知される可能性は残っているので、既存利用者も「いつか移る」前提で移行先の仕様と料金を把握しておく価値があります。

Googleの告知原文と意味|deprecatedではない・停止日も未告知

リリースノートの2026年9月18日の項は次の一文だけです。原文をそのまま引用します。

deprecated(非推奨)と access limit(今回)の違い。deprecated は停止日が決まり停止後はエンドポイントが消え全員が対象。access limit は停止日未告知・既存の利用者は継続・新規プロジェクトは不可

Gemini 2.5 models access update: To ensure reliable performance for everyone, we are limiting access to the 2.5 models to users who have actively used them in the past. These models are not deprecated and will continue to be served until further notice through the API. For any new projects, use our latest models: 3.5 Flash-Lite or 3.8 Flash. This helps us maintain sufficient capacity for both ongoing legacy workflows and new applications.

(訳)Gemini 2.5モデルのアクセスに関する更新:全員に安定した性能を届けるため、2.5モデルへのアクセスを、過去に積極的に使ってきた利用者に限定します。これらのモデルはdeprecatedではなく、追って通知するまでAPIで提供を続けます。新規プロジェクトには最新モデルの3.5 Flash-Liteか3.8 Flashを使ってください。これにより、継続中の旧来のワークロードと新しいアプリケーションの双方に十分な容量を確保できます。

この一文から読み取れる意味は3つあります。

1. 制限の軸は「利用者」であって「モデルの寿命」ではない

通常のモデル終了は「このモデルはいつ止まる」というモデル側の話です。今回は「誰が呼べるか」という利用者側の話で、同じモデルIDでも呼べる人と呼べない人が分かれます。理由として書かれているのは容量(capacity)の確保で、性能上の欠陥や新モデルへの強制移行ではありません。

2. deprecatedではない=停止日が決まっていない

deprecationsページはdeprecationを「そのモデルのサポートを終了し、近い将来にシャットダウンするという告知」と定義し、シャットダウン後は「完全に停止し、エンドポイントは使えなくなる」と書いています。2026年9月23日時点の同ページでは、gemini-2.5-pro(公開2025年6月17日)、gemini-2.5-flash(同6月17日)、gemini-2.5-flash-lite(同7月22日)の3つとも「No shutdown date announced」です。フォーラム投稿者が7月に見たという「10月16日」の記載は、9月23日時点のページにはありません。

3. 「既存は継続・新規は不可」の二段構え

既存利用者は「until further notice」で継続、新規は最新モデルへ、という二段構えです。deprecatedと今回のaccess limitの違いを表にすると次のようになります。

観点 deprecated(非推奨) access limit(今回)
意味 サポート終了と近い将来の停止を告知する 呼べる利用者を「過去に使った人」に限定する
停止日 停止日が決まる(deprecationsページに最短の停止日が載る) 停止日は未告知
停止後 停止後はエンドポイントが消える 提供は続く(until further notice)
対象 利用者全員が対象 既存の利用者は継続新規プロジェクトは不可
告知の場所 Release notesで告知し、deprecationsページで日付を追跡 Release notes(9月18日)とmodels・deprecationsページの注記
2.5系での該当例 gemini-2.5-flash-image(2026年10月2日停止) gemini-2.5-progemini-2.5-flashgemini-2.5-flash-lite

なお、modelsページの「Model version name patterns」には、previewモデルは少なくとも2週間前の告知でdeprecatedになる、latestエイリアスは破壊的変更の2週間前にメール通知がある、と書かれています。stableモデルの停止日はdeprecationsページに「最短の停止日」として載り、正確な日付は事前に通知するとあります。2.5系に停止日が付くとすれば、この経路で告知されるはずです。

自分のプロジェクトが「過去に使った」に当たるかの確かめ方

ここは正直に書いておく必要があります。「actively used them in the past(過去に積極的に使った)」の定義、つまり判定の単位がプロジェクトなのかAPIキーなのかアカウントなのか、どのくらいの期間・回数を指すのかは、2026年9月23日時点の公式ドキュメントには書かれていません。フォーラムでもこの点が質問されましたが、スタッフ回答は方針の再掲で、定義には触れていません。

公式に示されている範囲で言えるのは、次の2点です。2.5系を呼ぶプロジェクトは、この2つのどちらかに分かれます。

  • 過去に使った実績があるプロジェクトは、そのまま使える停止日は未告知で、追って通知があるまで提供が続く。
  • 実績がない新規プロジェクトは、新規は使えないため、3.5 Flash-Liteか3.8 Flashへ

確かめ方として公式が用意した専用のAPIや管理画面の項目はありません。現実的には「対象プロジェクトのAPIキーで2.5のモデルIDを実際に呼ぶ」ことになります。フォーラムの報告では、実績のない新規プロジェクトから呼ぶとHTTP 404(NOT_FOUND)で「This model models/gemini-2.5-pro is no longer available to new users. Please update your code to use a newer model for the latest features and improvements.」というメッセージが返ったとされています。これは投稿者の報告であり、公式ドキュメントに載ったエラー仕様ではない点に注意してください。

呼び出しの最小例は、公式の「Migrating to the Interactions API」ページに載っているgenerateContentの例がそのまま使えます(公式の例・Pythonではpip install -U google-genaiと環境変数GEMINI_API_KEYが前提)。

# 公式の例(Migrating to the Interactions API ページ「Before (generateContent)」より)
# 本番環境で使用する前に、必ずテスト環境で動作確認してください。
from google import genai

client = genai.Client()

response = client.models.generate_content(
    model="gemini-2.5-flash-lite", contents="Tell me a joke."
)
print(response.text)

これが返ればそのプロジェクトは継続利用できる側、404が返れば新規側と考えるのが、いま公式情報から言える判定です。既存プロジェクトで新しいAPIキーを発行した場合にどう扱われるかは、公式に記載がありません。

移行先の選び方|3.5 Flash-Liteと3.8 Flashの仕様を並べる

公式が新規プロジェクト向けに挙げたのは2つだけです。それぞれのモデルページと「What’s new in Gemini 3.8 Flash」の記載から、仕様を並べます。

移行先 2 つの比較。Gemini 3.5 Flash-Lite(大量処理・文書解析・サブエージェント/コストと遅延が最優先/thinking 既定 minimal)と Gemini 3.8 Flash(長時間のソフトウェア開発・自律エージェント/複雑な推論)

項目 Gemini 3.5 Flash-Lite Gemini 3.8 Flash
モデルID gemini-3.5-flash-lite(Stable) gemini-3.8-flash(Stable・2026年9月2日GA)
公式の位置づけ 低遅延・低コストのマルチモーダルモデル。サブエージェントのタスクや文書解析、大量のエージェント処理、単純なデータ抽出、遅延とAPIコストが最優先の用途 最も賢いFlash。長時間のソフトウェアエンジニアリング、自律エージェント、複雑な業務ワークフロー向け
入力 テキスト・画像・動画・音声・PDF テキスト・画像・動画・音声・PDF
出力 テキスト テキスト
入力トークン上限 1,048,576 1,048,576
出力トークン上限 65,536 65,536
thinking 既定 minimal(minimal/low/medium/high) 既定 medium(low/medium/high。minimalはエラー)
ツール Function calling・Search grounding・Maps grounding・URL context・Code execution・File search・Computer use(Preview)・Structured outputs・Caching 同左
非対応 Live API・画像生成・音声生成 Live API・画像生成・音声生成
消費オプション Batch・Flex・Priority Batch・Flex・Priority
モデルページの最終更新 2026年7月30日(UTC) 2026年9月2日(UTC)

選び方は公式の説明どおりに用途で分けるのが安全です。

  • Gemini 3.5 Flash-Lite大量処理・文書解析・サブエージェントのように、コストと遅延が最優先の処理thinking既定 minimalなので、2.5 Flash-Liteでthinkingを切って使っていた処理の置き換え候補です。
  • Gemini 3.8 Flash長時間のソフトウェア開発・自律エージェント複雑な業務ワークフローthinking既定 mediumで、公式は「難しい多段タスクで高品質を出すために、意図的に小さな推論ステップを踏み、ツールを繰り返し呼び、途中で検証する」ため、トークン消費が増えると明記しています。日常的なタスクでは推論レベルを下げるか、Gemini 3.7 Flashを使う選択肢も「fully supported」と書かれています。

注意したいのは、公式の案内が「2.5 Proの後継は3.8 Flash」「2.5 Flash-Liteの後継は3.5 Flash-Lite」のような1対1の対応を示していない点です。deprecationsページの「Recommended replacement」列も2.5 Pro/Flash/Flash-Liteのstable版については空欄です。したがって「同じ名前のLiteだから同じ扱い」と決めつけず、用途と料金で判断してください。

料金の比較|2.5系と移行先の公式値(100万トークンあたり・USD)

料金ページ(参照日2026-09-23)のStandard・Paid Tierの値です。Batch・Flex・Priorityは別の単価があるので、料金ページで確認してください。

料金の比較(100 万トークンあたり・USD・入力/出力)。2.5 Flash-Lite $0.10/$0.40、2.5 Flash $0.30/$2.50、2.5 Pro $1.25/$10.00、3.5 Flash-Lite、3.8 Flash の公式値

モデル 入力/出力(thinkingトークン込み) 補足(別単価) Context caching Search grounding
2.5 Flash-Lite $0.10/$0.40 入力はテキスト・画像・動画の値。音声入力は$0.30 $0.01(音声$0.03)、保存$1.00/100万トークン・1時間 1,500 RPDまで無料、以後$35/1,000件
2.5 Flash $0.30/$2.50 入力はテキスト・画像・動画の値。音声入力は$1.00 $0.03(音声$0.1)、保存$1.00 1,500 RPDまで無料、以後$35/1,000件
2.5 Pro $1.25/$10.00 プロンプト20万トークン以下の値。超える場合は入力$2.50・出力$15.00 $0.125(20万トークン以下)/$0.25(超)、保存$4.50 1,500 RPDまで無料、以後$35/1,000件
3.5 Flash-Lite $0.30/$2.50 入力はテキスト・画像・動画・音声とも同額 $0.03、保存$1.00 月5,000件まで無料(Gemini 3.x全体で共有)、以後$14/1,000件。Free tierでは利用不可
3.8 Flash $0.75/$3.75 2026年12月31日までの導入価格。2027年1月1日から入力$1.50・出力$7.50 $0.075(2027年から$0.15)、保存$0.50(2027年から$1.00) 月5,000件まで無料(3.x共有)、以後$14/1,000件

料金表から言えることを3つ挙げます。いずれも公式値の単純計算で、thinkingトークン量の違いは含んでいません。

  • 2.5 Flash-Liteから3.5 Flash-Liteへは、入力が$0.10から$0.30(3倍)、出力が$0.40から$2.50(6.25倍)になります。名前は同じLiteでも単価は別物です。
  • 2.5 Flashから3.5 Flash-Liteへは入力・出力とも同額($0.30/$2.50)、3.8 Flashへは入力2.5倍・出力1.5倍です。ただし3.8 Flashの価格は2026年12月31日までの導入価格で、2027年1月1日に入力$1.50・出力$7.50の標準価格へ切り替わります(3.7 Flash・3.6 Flashも同じ扱い)。
  • Search groundingの課金モデルが変わる点にも注意が要ります。2.5系は「1日1,500リクエストまで無料、以後1,000件$35」、3.x系は「月5,000件まで無料(3.x全体で共有)、以後1,000件$14」で、3.5 Flash-LiteのFree tierではgroundingが使えません。

コスト最優先の置き換えでは、Gemini 3.1 Flash-Liteも検討対象になりますが、deprecationsページではgemini-3.1-flash-liteの停止日が2027年5月7日、推奨移行先がgemini-3.5-flash-liteと決まっています。新規プロジェクトで長く使うなら、公式の案内どおり3.5 Flash-Liteを選ぶ方が移行回数を減らせます。

移行手順4段|モデルIDの置換・パラメータ差・SDK・回帰テスト

手順は、公式の「What’s new in Gemini 3.8 Flash」の「Migration checklist」と、「What’s new in Gemini 3.5 Flash」の「Migrate from Gemini 2.5」節に書かれている項目を、実行順に4段へ並べ直したものです。項目はすべて公式チェックリストの記載で、ここに筆者の独自手順はありません。Gemini APIの基本から確認したい場合は先に読んでおくと流れがつかみやすくなります。

移行手順 4 段。1 モデル ID を置換(gemini-3.8-flash/gemini-3.5-flash-lite)、2 パラメータを直す(thinking_budget→thinking_level)、3 SDK を更新(google-genai v2.0.0 以上)、4 回帰テスト

1 モデルIDを置換

対象の文字列をgemini-3.8-flash/gemini-3.5-flash-liteへ変えます。generateContentは引き続きサポートされていますが、公式は新規開発にはInteractions APIを推奨しています。公式の移行ページに載っているBefore/Afterはこの2つです。

# 公式の例(Migrating to the Interactions API ページ「After (Interactions API)」より)
# 本番環境で使用する前に、必ずテスト環境で動作確認してください。
from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.8-flash", input="Tell me a joke."
)

print(interaction.output_text)

RESTで叩く場合の最小形も公式Quickstartに載っています。

# 公式の例(Gemini API Quickstart より)
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
  -H "x-goog-api-key: $GEMINI_API_KEY" \
  -H 'Content-Type: application/json' \
  -d '{
    "model": "gemini-3.8-flash",
    "input": "Explain how AI works in a few words"
  }'

2 パラメータを直す

公式チェックリストが「外す・置き換える」と明記しているのは次の項目です。

2.5系で使っていた指定 3.x系での扱い(公式チェックリスト)
temperaturetop_ptop_k generation configから外す(deprecated sampling parameters)
thinking_budget thinking_budget→thinking_level。文字列のlowmediumhigh(3.5 Flash-Liteはminimalも可、3.8 Flashでminimalはエラー)
candidate_count 外す(Gemini 3以降は非対応)
複数ターンの履歴を毎回送る サーバー側のprevious_interaction_idに統一し、モデル側の発話を先回りして詰める(prefilled model turns)のをやめる
Function callingの応答 マルチモーダルの資産はresponse payloadの中へ入れる。インライン指示は\n\nで区切って付ける。generateContentを使い続ける場合はFunctionResponsecall_idnameを必ず入れる
chain-of-thoughtを強いるプロンプト 簡素化し、代わりにthinking_levelmediumhighにして試す
PDF・動画の密な解析 media_resolution_highで精度を確認。Gemini 3の既定ではPDFのトークンが増え、動画は減る場合がある
画像セグメンテーション Gemini 3.xでは非対応。公式は「2.5 Flashをthinking offで使い続ける」と案内

thinkingの指定は、公式ページの例がそのまま参考になります。

# 公式の例(What's new in Gemini 3.8 Flash「Understanding reasoning levels」より)
# 本番環境で使用する前に、必ずテスト環境で動作確認してください。
from google import genai

client = genai.Client()

interaction = client.interactions.create(
    model="gemini-3.8-flash",
    input="Analyze this payment processing pipeline for race conditions during retry attempts and rewrite the transaction locks safely.",
    generation_config={
        "thinking_level": "medium"  # Balanced reasoning effort for complex tasks
    }
)
print(interaction.output_text)

thinkingページの表では、2.5系もthinking_levelで制御する形に統一されています(2.5 Pro・2.5 Flashは既定On、2.5 Flash-Liteは既定Off、いずれもlow/medium/high)。3.5 Flash-Liteは既定minimal、3.8 Flashは既定mediumです。

3 SDKを更新

公式はgoogle-genai v2.0.0以上への更新を「strongly recommend」としています(Interactions APIに破壊的変更が入ったため)。Quickstartの導入コマンドはPythonがpip install -U google-genai、JavaScriptがnpm install @google/genaiです。コーディングエージェントを使っている場合は、公式が用意したgemini-api-devスキル(npx skills add google-gemini/gemini-skills --skill gemini-api-devで導入)に「/gemini-api-dev migrate my app to Gemini 3.8 Flash」と指示する方法も公式ページに載っています。

4 回帰テスト

公式チェックリストが「テストしろ」と書いている観点は思考量・トークン・PDFの3系統に整理できます。

  • 思考量:既定の推論レベルが変わる(3.5 Flashの例ではhighからmediumへ)ので、品質・速度・コストを同じプロンプトで見直す。ツール呼び出しが多すぎるときは、まずthinking levelを下げ、それでも直らなければsystem instructionで制限する。
  • トークン:思考の保持(thought preservation)が既定でOnになり、ターンをまたいで推論文脈が引き継がれるため、トークン消費が増えることがある。max_output_tokensを小さくして抑えようとすると、thinkingトークンを含めた上限に当たった時点でincompleteで切れ、出力が空になっても課金される。公式は「代わりにthinking_levelを下げる」と書いている。
  • PDF:文書解析の精度をmedia_resolution_highで確認し、コンテキストを超えるならmedia_resolutionを明示的に下げる。

注意点|2.5 Flash Imageは10月2日停止・segmentation・年明けの料金改定

  • 画像生成の2.5だけは本当に止まるgemini-2.5-flash-image(Nano Banana)はdeprecatedで、2026年10月2日に停止します。料金ページの警告は「Gemini 3.1 Flash ImageかGemini 3.1 Flash Lite Imageへ移行」です。今回の「停止日未告知」はテキスト系の2.5 Pro/Flash/Flash-Liteの話で、画像生成モデルには当てはまりません。
  • 2.5のpreview版はすでに停止済み:たとえばgemini-2.5-flash-preview-09-25は2026年2月17日、gemini-2.5-flash-lite-preview-09-2025は2026年3月31日に停止しています。コードにpreview付きのIDが残っていれば、今回の件と関係なく動きません。
  • Live・TTSの2.5 previewgemini-2.5-flash-native-audio-preview-12-2025は停止日未告知で推奨移行先がgemini-3.8-livegemini-2.5-flash-preview-ttsgemini-2.5-pro-preview-ttsgemini-3.1-flash-tts-previewです。音声エージェントの移行先はGemini 3.8 Liveの解説で別途整理しています。
  • 2027年1月1日の料金切り替え:3.8 Flash・3.7 Flash・3.6 Flashは導入価格が2026年12月31日で終わり、3.8 Flashは入力$1.50・出力$7.50になります。年をまたぐ予算は標準価格で組んでください。
  • Free tierの扱い:料金ページではFree tierを「特定モデルへの限定的なアクセス」「入出力トークン無料」「コンテンツはGoogleの製品改善に使われる」と説明しています。3.5 Flash-LiteのSearch groundingはFree tierで「Not available」です。
  • 未確認事項:「過去に使った」の定義、2.5系に停止日が付く時期、Vertex AI側(Gemini Enterprise Agent Platform)で同じ制限がかかるかは、2026年9月23日時点で本記事の参照範囲(Gemini APIの公式ドキュメント)に記載がありません。

失敗パターン4つ|❌⭕で確認する

失敗1:新規プロジェクトのテンプレートにgemini-2.5-flashが残っている

❌ 社内の雛形やサンプルの既定モデルが2.5のまま。新しいプロジェクトを作るたびに404で止まる。
⭕ 雛形の既定をgemini-3.5-flash-litegemini-3.8-flashに変え、2.5のIDは「既存プロジェクト限定」とコメントで明記する。

失敗2:thinking_budgetをそのまま3.8 Flashに渡す

❌ 2.5で「思考を切る」ために使っていたthinking_budgetや、minimal相当の指定を3.8 Flashに持ち込む。3.8 Flashでminimalはエラーになる。
thinking_levelの文字列に置き換え、速さ優先なら3.8 Flashはlow、思考をほぼ切りたい処理は3.5 Flash-Liteのminimalを使う。

失敗3:「同じLiteだから単価も同じ」と思い込む

❌ 2.5 Flash-Liteの$0.10/$0.40の感覚で3.5 Flash-Liteの予算を組む。
⭕ 3.5 Flash-Liteは$0.30/$2.50。大量処理ならBatch API(料金ページで「50% cost reduction」と説明)やContext cachingの単価も含めて試算し直す。

失敗4:max_output_tokensを絞って節約する

❌ トークン消費を抑えるためにmax_output_tokensを小さく設定する。thinkingトークンを含めた上限なので、途中でincompleteになり、空の出力に課金される。
⭕ 公式の案内どおりthinking_levellowmediumへ下げる。

よくある質問

Gemini 2.5 Pro/Flash/Flash-Liteはいつ停止しますか?

2026年9月23日時点で停止日は告知されていません。deprecationsページの3モデルはいずれも「No shutdown date announced」で、リリースノートも「deprecatedではなく、追って通知するまで提供を続ける」としています。停止日が決まればRelease notesで告知され、deprecationsページに載ります。

「過去に使った」とは、いつ・何を基準に判定されますか?

公式ドキュメントに定義はありません(2026年9月23日時点)。判定の単位がプロジェクト・APIキー・アカウントのどれかも書かれていません。確かめるには、対象プロジェクトのキーで2.5のモデルIDを実際に呼ぶしかなく、フォーラムの報告では新規側には404の「no longer available to new users」が返るとされています。

2.5 Proの代わりは何を使えばよいですか?

公式が新規プロジェクト向けに案内しているのは3.5 Flash-Liteと3.8 Flashの2つです。Pro級のモデルとしてはGemini 3.1 Proがありますが、modelsページではPreview扱いで、今回の告知の案内先には含まれていません。まず3.8 Flashをthinking_level: "high"で試す、というのが公式の案内に沿った進め方です。

generateContentのコードは書き直さないといけませんか?

公式は「generateContentは引き続き完全にサポートされる」としつつ、新規開発にはInteractions APIを推奨しています。モデルIDの置き換えだけならgenerateContentのままでも動きますが、3.xではFunctionResponsecall_idnameが必要になるなど、チェックリストの項目はgenerateContentでも当てはまります。

無料枠で3.5 Flash-Liteや3.8 Flashは使えますか?

料金ページでは、3.5 Flash-Liteも3.8 FlashもFree tierの入力・出力が「Free of charge」です。ただしFree tierでは3.5 Flash-LiteのSearch groundingが使えず、送ったコンテンツがGoogleの製品改善に使われます。無料枠の上限や有料へ自動で上がる条件はrate limitsページと料金ページで確認してください。

まとめ|今日やること

  1. 既存プロジェクト:2.5系の呼び出しがある場所を洗い出し、「停止日が告知されたら移る」前提で、3.5 Flash-Liteか3.8 Flashのどちらへ寄せるかを用途で決めておく。
  2. 新規プロジェクト:雛形の既定モデルを3.x系へ変える。thinking_budgettemperaturetop_ptop_kcandidate_countを外し、thinking_levelへ置き換える。
  3. 予算:3.5 Flash-Liteは$0.30/$2.50、3.8 Flashは年内$0.75/$3.75・2027年から$1.50/$7.50で試算し直す。Search groundingは月5,000件の共有枠に変わる。

2026年9月23日時点で公式に書かれているのはここまでです。「過去に使った」の定義と2.5系の停止時期は、公式の続報が出た時点でこの記事に追記します。

この記事を読んで導入イメージが固まってきた方へ

UravationではAIエージェント導入の研修・コンサルを行っています。

運営元 Uravation よりAIエージェントを構想から本番運用まで進める順番と、体制・KPIの決め方をまとめた資料を無料で公開しています。 AIエージェント導入ロードマップを受け取る(無料)

参考・出典

Need help moving from reading to rollout?

この記事を読んで導入イメージが固まってきた方へ

Uravationでは、AIエージェントの要件整理、PoC設計、社内導入、研修まで一気通貫で支援しています。

この記事をシェア

X Facebook LINE

※ 本記事の情報は2026年9月時点のものです。サービスの料金・仕様は変更される可能性があります。最新情報は各サービスの公式サイトをご確認ください。

関連記事