2026年9月23日時点で、Gemini 2.5系のAPI(gemini-2.5-pro/gemini-2.5-flash/gemini-2.5-flash-lite)を呼べるのは「過去に実際に使った利用者」だけです。Googleは2026年9月18日付のGemini APIリリースノートでこの制限を告知し、新規プロジェクトにはGemini 3.5 Flash-LiteかGemini 3.8 Flashを使うよう案内しました。2.5系はdeprecated(非推奨)ではなく、停止日も告知されていません。
- すでに2.5系を使っているプロジェクト:今すぐ変える必要はありません。公式は「until further notice(追って通知するまで)」APIで提供を続けると書いています。ただしdeprecationsページの2.5系は「No shutdown date announced(停止日未告知)」であって「停止しない」ではありません。
- これから作るプロジェクト:2.5系は選べません。コストと速度を優先するなら3.5 Flash-Lite、エージェントや長時間の開発タスクなら3.8 Flashが公式の案内先です。
- 例外:画像生成の
gemini-2.5-flash-imageだけは別枠でdeprecatedになっており、2026年10月2日に停止します。移行先はGemini 3.1 Flash Imageか3.1 Flash Lite Imageです。
この記事では、Googleの告知原文と意味、自分のプロジェクトが対象かどうかの見分け方、3.5 Flash-Liteと3.8 Flashの仕様・料金、公式の移行チェックリストに沿った手順を、Google AI for Developersの公式ドキュメント(参照日2026-09-23)だけを根拠に整理します。ベンチマークや体験談は書きません。コードはすべて公式ページに載っている例で、筆者が動かしたものではありません。
2026年9月23日時点の結論|影響を受けるのは「新規プロジェクトで2.5を呼ぶ人」だけ
まず時系列を押さえておきましょう。この制限は9月18日に突然始まったものではなく、7月末から開発者フォーラムで報告が出ていたものが、9月18日に公式リリースノートへ正式に書き込まれた、という流れです。

| 日付 | 出来事 | 根拠 |
|---|---|---|
| 2026年7月28日 | Google AI Developers Forumに「新しく作ったGCPプロジェクトからgemini-2.5-proを呼ぶと404が返る」という報告。当時のdeprecationsページには2.5 Proの停止日として2026年10月16日が載っていた、と投稿者は書いている |
フォーラム投稿(投稿者c-endo) |
| 2026年7月30日 | Googleのスタッフ(Pooja Kapse)が同スレッドで回答。「過去に積極的に使った利用者にアクセスを限定する・deprecatedではない・新規プロジェクトは3.1 Flash-Liteか3.5 Flashへ」 | 同スレッドのスタッフ回答 |
| 2026年9月18日 | Gemini APIリリースノートに「Gemini 2.5 models access update」として正式掲載。案内先が3.5 Flash-Lite か 3.8 Flashに更新される | 公式changelog |
| 2026年9月22日(UTC) | modelsページ(2.5 Flash/2.5 Flash-Lite/2.5 Proの各節)とdeprecationsページ(2.5 Pro models/2.5 Flash models)に同じ注記が入った状態で最終更新 | 公式models・deprecationsページ |
つまり、いま影響を受けるのは「2.5系を一度も使ったことのないプロジェクトで、2.5のモデルIDを新しく指定しようとしている人」です。既存の本番ワークロードを止める告知ではありません。一方で、停止日が将来告知される可能性は残っているので、既存利用者も「いつか移る」前提で移行先の仕様と料金を把握しておく価値があります。
Googleの告知原文と意味|deprecatedではない・停止日も未告知
リリースノートの2026年9月18日の項は次の一文だけです。原文をそのまま引用します。

Gemini 2.5 models access update: To ensure reliable performance for everyone, we are limiting access to the 2.5 models to users who have actively used them in the past. These models are not deprecated and will continue to be served until further notice through the API. For any new projects, use our latest models: 3.5 Flash-Lite or 3.8 Flash. This helps us maintain sufficient capacity for both ongoing legacy workflows and new applications.
(訳)Gemini 2.5モデルのアクセスに関する更新:全員に安定した性能を届けるため、2.5モデルへのアクセスを、過去に積極的に使ってきた利用者に限定します。これらのモデルはdeprecatedではなく、追って通知するまでAPIで提供を続けます。新規プロジェクトには最新モデルの3.5 Flash-Liteか3.8 Flashを使ってください。これにより、継続中の旧来のワークロードと新しいアプリケーションの双方に十分な容量を確保できます。
この一文から読み取れる意味は3つあります。
1. 制限の軸は「利用者」であって「モデルの寿命」ではない
通常のモデル終了は「このモデルはいつ止まる」というモデル側の話です。今回は「誰が呼べるか」という利用者側の話で、同じモデルIDでも呼べる人と呼べない人が分かれます。理由として書かれているのは容量(capacity)の確保で、性能上の欠陥や新モデルへの強制移行ではありません。
2. deprecatedではない=停止日が決まっていない
deprecationsページはdeprecationを「そのモデルのサポートを終了し、近い将来にシャットダウンするという告知」と定義し、シャットダウン後は「完全に停止し、エンドポイントは使えなくなる」と書いています。2026年9月23日時点の同ページでは、gemini-2.5-pro(公開2025年6月17日)、gemini-2.5-flash(同6月17日)、gemini-2.5-flash-lite(同7月22日)の3つとも「No shutdown date announced」です。フォーラム投稿者が7月に見たという「10月16日」の記載は、9月23日時点のページにはありません。
3. 「既存は継続・新規は不可」の二段構え
既存利用者は「until further notice」で継続、新規は最新モデルへ、という二段構えです。deprecatedと今回のaccess limitの違いを表にすると次のようになります。
| 観点 | deprecated(非推奨) | access limit(今回) |
|---|---|---|
| 意味 | サポート終了と近い将来の停止を告知する | 呼べる利用者を「過去に使った人」に限定する |
| 停止日 | 停止日が決まる(deprecationsページに最短の停止日が載る) | 停止日は未告知 |
| 停止後 | 停止後はエンドポイントが消える | 提供は続く(until further notice) |
| 対象 | 利用者全員が対象 | 既存の利用者は継続・新規プロジェクトは不可 |
| 告知の場所 | Release notesで告知し、deprecationsページで日付を追跡 | Release notes(9月18日)とmodels・deprecationsページの注記 |
| 2.5系での該当例 | gemini-2.5-flash-image(2026年10月2日停止) |
gemini-2.5-pro/gemini-2.5-flash/gemini-2.5-flash-lite |
なお、modelsページの「Model version name patterns」には、previewモデルは少なくとも2週間前の告知でdeprecatedになる、latestエイリアスは破壊的変更の2週間前にメール通知がある、と書かれています。stableモデルの停止日はdeprecationsページに「最短の停止日」として載り、正確な日付は事前に通知するとあります。2.5系に停止日が付くとすれば、この経路で告知されるはずです。
自分のプロジェクトが「過去に使った」に当たるかの確かめ方
ここは正直に書いておく必要があります。「actively used them in the past(過去に積極的に使った)」の定義、つまり判定の単位がプロジェクトなのかAPIキーなのかアカウントなのか、どのくらいの期間・回数を指すのかは、2026年9月23日時点の公式ドキュメントには書かれていません。フォーラムでもこの点が質問されましたが、スタッフ回答は方針の再掲で、定義には触れていません。
公式に示されている範囲で言えるのは、次の2点です。2.5系を呼ぶプロジェクトは、この2つのどちらかに分かれます。
- 過去に使った実績があるプロジェクトは、そのまま使える。停止日は未告知で、追って通知があるまで提供が続く。
- 実績がない新規プロジェクトは、新規は使えないため、3.5 Flash-Liteか3.8 Flashへ。
確かめ方として公式が用意した専用のAPIや管理画面の項目はありません。現実的には「対象プロジェクトのAPIキーで2.5のモデルIDを実際に呼ぶ」ことになります。フォーラムの報告では、実績のない新規プロジェクトから呼ぶとHTTP 404(NOT_FOUND)で「This model models/gemini-2.5-pro is no longer available to new users. Please update your code to use a newer model for the latest features and improvements.」というメッセージが返ったとされています。これは投稿者の報告であり、公式ドキュメントに載ったエラー仕様ではない点に注意してください。
呼び出しの最小例は、公式の「Migrating to the Interactions API」ページに載っているgenerateContentの例がそのまま使えます(公式の例・Pythonではpip install -U google-genaiと環境変数GEMINI_API_KEYが前提)。
# 公式の例(Migrating to the Interactions API ページ「Before (generateContent)」より)
# 本番環境で使用する前に、必ずテスト環境で動作確認してください。
from google import genai
client = genai.Client()
response = client.models.generate_content(
model="gemini-2.5-flash-lite", contents="Tell me a joke."
)
print(response.text)
これが返ればそのプロジェクトは継続利用できる側、404が返れば新規側と考えるのが、いま公式情報から言える判定です。既存プロジェクトで新しいAPIキーを発行した場合にどう扱われるかは、公式に記載がありません。
移行先の選び方|3.5 Flash-Liteと3.8 Flashの仕様を並べる
公式が新規プロジェクト向けに挙げたのは2つだけです。それぞれのモデルページと「What’s new in Gemini 3.8 Flash」の記載から、仕様を並べます。

| 項目 | Gemini 3.5 Flash-Lite | Gemini 3.8 Flash |
|---|---|---|
| モデルID | gemini-3.5-flash-lite(Stable) |
gemini-3.8-flash(Stable・2026年9月2日GA) |
| 公式の位置づけ | 低遅延・低コストのマルチモーダルモデル。サブエージェントのタスクや文書解析、大量のエージェント処理、単純なデータ抽出、遅延とAPIコストが最優先の用途 | 最も賢いFlash。長時間のソフトウェアエンジニアリング、自律エージェント、複雑な業務ワークフロー向け |
| 入力 | テキスト・画像・動画・音声・PDF | テキスト・画像・動画・音声・PDF |
| 出力 | テキスト | テキスト |
| 入力トークン上限 | 1,048,576 | 1,048,576 |
| 出力トークン上限 | 65,536 | 65,536 |
| thinking | 既定 minimal(minimal/low/medium/high) | 既定 medium(low/medium/high。minimalはエラー) |
| ツール | Function calling・Search grounding・Maps grounding・URL context・Code execution・File search・Computer use(Preview)・Structured outputs・Caching | 同左 |
| 非対応 | Live API・画像生成・音声生成 | Live API・画像生成・音声生成 |
| 消費オプション | Batch・Flex・Priority | Batch・Flex・Priority |
| モデルページの最終更新 | 2026年7月30日(UTC) | 2026年9月2日(UTC) |
選び方は公式の説明どおりに用途で分けるのが安全です。
- Gemini 3.5 Flash-Lite:大量処理・文書解析・サブエージェントのように、コストと遅延が最優先の処理。thinking既定 minimalなので、2.5 Flash-Liteでthinkingを切って使っていた処理の置き換え候補です。
- Gemini 3.8 Flash:長時間のソフトウェア開発・自律エージェントや複雑な業務ワークフロー。thinking既定 mediumで、公式は「難しい多段タスクで高品質を出すために、意図的に小さな推論ステップを踏み、ツールを繰り返し呼び、途中で検証する」ため、トークン消費が増えると明記しています。日常的なタスクでは推論レベルを下げるか、Gemini 3.7 Flashを使う選択肢も「fully supported」と書かれています。
注意したいのは、公式の案内が「2.5 Proの後継は3.8 Flash」「2.5 Flash-Liteの後継は3.5 Flash-Lite」のような1対1の対応を示していない点です。deprecationsページの「Recommended replacement」列も2.5 Pro/Flash/Flash-Liteのstable版については空欄です。したがって「同じ名前のLiteだから同じ扱い」と決めつけず、用途と料金で判断してください。
料金の比較|2.5系と移行先の公式値(100万トークンあたり・USD)
料金ページ(参照日2026-09-23)のStandard・Paid Tierの値です。Batch・Flex・Priorityは別の単価があるので、料金ページで確認してください。

| モデル | 入力/出力(thinkingトークン込み) | 補足(別単価) | Context caching | Search grounding |
|---|---|---|---|---|
| 2.5 Flash-Lite | $0.10/$0.40 | 入力はテキスト・画像・動画の値。音声入力は$0.30 | $0.01(音声$0.03)、保存$1.00/100万トークン・1時間 | 1,500 RPDまで無料、以後$35/1,000件 |
| 2.5 Flash | $0.30/$2.50 | 入力はテキスト・画像・動画の値。音声入力は$1.00 | $0.03(音声$0.1)、保存$1.00 | 1,500 RPDまで無料、以後$35/1,000件 |
| 2.5 Pro | $1.25/$10.00 | プロンプト20万トークン以下の値。超える場合は入力$2.50・出力$15.00 | $0.125(20万トークン以下)/$0.25(超)、保存$4.50 | 1,500 RPDまで無料、以後$35/1,000件 |
| 3.5 Flash-Lite | $0.30/$2.50 | 入力はテキスト・画像・動画・音声とも同額 | $0.03、保存$1.00 | 月5,000件まで無料(Gemini 3.x全体で共有)、以後$14/1,000件。Free tierでは利用不可 |
| 3.8 Flash | $0.75/$3.75 | 2026年12月31日までの導入価格。2027年1月1日から入力$1.50・出力$7.50 | $0.075(2027年から$0.15)、保存$0.50(2027年から$1.00) | 月5,000件まで無料(3.x共有)、以後$14/1,000件 |
料金表から言えることを3つ挙げます。いずれも公式値の単純計算で、thinkingトークン量の違いは含んでいません。
- 2.5 Flash-Liteから3.5 Flash-Liteへは、入力が$0.10から$0.30(3倍)、出力が$0.40から$2.50(6.25倍)になります。名前は同じLiteでも単価は別物です。
- 2.5 Flashから3.5 Flash-Liteへは入力・出力とも同額($0.30/$2.50)、3.8 Flashへは入力2.5倍・出力1.5倍です。ただし3.8 Flashの価格は2026年12月31日までの導入価格で、2027年1月1日に入力$1.50・出力$7.50の標準価格へ切り替わります(3.7 Flash・3.6 Flashも同じ扱い)。
- Search groundingの課金モデルが変わる点にも注意が要ります。2.5系は「1日1,500リクエストまで無料、以後1,000件$35」、3.x系は「月5,000件まで無料(3.x全体で共有)、以後1,000件$14」で、3.5 Flash-LiteのFree tierではgroundingが使えません。
コスト最優先の置き換えでは、Gemini 3.1 Flash-Liteも検討対象になりますが、deprecationsページではgemini-3.1-flash-liteの停止日が2027年5月7日、推奨移行先がgemini-3.5-flash-liteと決まっています。新規プロジェクトで長く使うなら、公式の案内どおり3.5 Flash-Liteを選ぶ方が移行回数を減らせます。
移行手順4段|モデルIDの置換・パラメータ差・SDK・回帰テスト
手順は、公式の「What’s new in Gemini 3.8 Flash」の「Migration checklist」と、「What’s new in Gemini 3.5 Flash」の「Migrate from Gemini 2.5」節に書かれている項目を、実行順に4段へ並べ直したものです。項目はすべて公式チェックリストの記載で、ここに筆者の独自手順はありません。Gemini APIの基本から確認したい場合は先に読んでおくと流れがつかみやすくなります。

1 モデルIDを置換
対象の文字列をgemini-3.8-flash/gemini-3.5-flash-liteへ変えます。generateContentは引き続きサポートされていますが、公式は新規開発にはInteractions APIを推奨しています。公式の移行ページに載っているBefore/Afterはこの2つです。
# 公式の例(Migrating to the Interactions API ページ「After (Interactions API)」より)
# 本番環境で使用する前に、必ずテスト環境で動作確認してください。
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.8-flash", input="Tell me a joke."
)
print(interaction.output_text)
RESTで叩く場合の最小形も公式Quickstartに載っています。
# 公式の例(Gemini API Quickstart より)
curl -X POST "https://generativelanguage.googleapis.com/v1beta/interactions" \
-H "x-goog-api-key: $GEMINI_API_KEY" \
-H 'Content-Type: application/json' \
-d '{
"model": "gemini-3.8-flash",
"input": "Explain how AI works in a few words"
}'
2 パラメータを直す
公式チェックリストが「外す・置き換える」と明記しているのは次の項目です。
| 2.5系で使っていた指定 | 3.x系での扱い(公式チェックリスト) |
|---|---|
temperature/top_p/top_k |
generation configから外す(deprecated sampling parameters) |
thinking_budget |
thinking_budget→thinking_level。文字列のlow/medium/high(3.5 Flash-Liteはminimalも可、3.8 Flashでminimalはエラー) |
candidate_count |
外す(Gemini 3以降は非対応) |
| 複数ターンの履歴を毎回送る | サーバー側のprevious_interaction_idに統一し、モデル側の発話を先回りして詰める(prefilled model turns)のをやめる |
| Function callingの応答 | マルチモーダルの資産はresponse payloadの中へ入れる。インライン指示は\n\nで区切って付ける。generateContentを使い続ける場合はFunctionResponseにcall_idとnameを必ず入れる |
| chain-of-thoughtを強いるプロンプト | 簡素化し、代わりにthinking_levelをmediumかhighにして試す |
| PDF・動画の密な解析 | media_resolution_highで精度を確認。Gemini 3の既定ではPDFのトークンが増え、動画は減る場合がある |
| 画像セグメンテーション | Gemini 3.xでは非対応。公式は「2.5 Flashをthinking offで使い続ける」と案内 |
thinkingの指定は、公式ページの例がそのまま参考になります。
# 公式の例(What's new in Gemini 3.8 Flash「Understanding reasoning levels」より)
# 本番環境で使用する前に、必ずテスト環境で動作確認してください。
from google import genai
client = genai.Client()
interaction = client.interactions.create(
model="gemini-3.8-flash",
input="Analyze this payment processing pipeline for race conditions during retry attempts and rewrite the transaction locks safely.",
generation_config={
"thinking_level": "medium" # Balanced reasoning effort for complex tasks
}
)
print(interaction.output_text)
thinkingページの表では、2.5系もthinking_levelで制御する形に統一されています(2.5 Pro・2.5 Flashは既定On、2.5 Flash-Liteは既定Off、いずれもlow/medium/high)。3.5 Flash-Liteは既定minimal、3.8 Flashは既定mediumです。
3 SDKを更新
公式はgoogle-genai v2.0.0以上への更新を「strongly recommend」としています(Interactions APIに破壊的変更が入ったため)。Quickstartの導入コマンドはPythonがpip install -U google-genai、JavaScriptがnpm install @google/genaiです。コーディングエージェントを使っている場合は、公式が用意したgemini-api-devスキル(npx skills add google-gemini/gemini-skills --skill gemini-api-devで導入)に「/gemini-api-dev migrate my app to Gemini 3.8 Flash」と指示する方法も公式ページに載っています。
4 回帰テスト
公式チェックリストが「テストしろ」と書いている観点は思考量・トークン・PDFの3系統に整理できます。
- 思考量:既定の推論レベルが変わる(3.5 Flashの例ではhighからmediumへ)ので、品質・速度・コストを同じプロンプトで見直す。ツール呼び出しが多すぎるときは、まずthinking levelを下げ、それでも直らなければsystem instructionで制限する。
- トークン:思考の保持(thought preservation)が既定でOnになり、ターンをまたいで推論文脈が引き継がれるため、トークン消費が増えることがある。
max_output_tokensを小さくして抑えようとすると、thinkingトークンを含めた上限に当たった時点でincompleteで切れ、出力が空になっても課金される。公式は「代わりにthinking_levelを下げる」と書いている。 - PDF:文書解析の精度を
media_resolution_highで確認し、コンテキストを超えるならmedia_resolutionを明示的に下げる。
注意点|2.5 Flash Imageは10月2日停止・segmentation・年明けの料金改定
- 画像生成の2.5だけは本当に止まる:
gemini-2.5-flash-image(Nano Banana)はdeprecatedで、2026年10月2日に停止します。料金ページの警告は「Gemini 3.1 Flash ImageかGemini 3.1 Flash Lite Imageへ移行」です。今回の「停止日未告知」はテキスト系の2.5 Pro/Flash/Flash-Liteの話で、画像生成モデルには当てはまりません。 - 2.5のpreview版はすでに停止済み:たとえば
gemini-2.5-flash-preview-09-25は2026年2月17日、gemini-2.5-flash-lite-preview-09-2025は2026年3月31日に停止しています。コードにpreview付きのIDが残っていれば、今回の件と関係なく動きません。 - Live・TTSの2.5 preview:
gemini-2.5-flash-native-audio-preview-12-2025は停止日未告知で推奨移行先がgemini-3.8-live、gemini-2.5-flash-preview-ttsとgemini-2.5-pro-preview-ttsはgemini-3.1-flash-tts-previewです。音声エージェントの移行先はGemini 3.8 Liveの解説で別途整理しています。 - 2027年1月1日の料金切り替え:3.8 Flash・3.7 Flash・3.6 Flashは導入価格が2026年12月31日で終わり、3.8 Flashは入力$1.50・出力$7.50になります。年をまたぐ予算は標準価格で組んでください。
- Free tierの扱い:料金ページではFree tierを「特定モデルへの限定的なアクセス」「入出力トークン無料」「コンテンツはGoogleの製品改善に使われる」と説明しています。3.5 Flash-LiteのSearch groundingはFree tierで「Not available」です。
- 未確認事項:「過去に使った」の定義、2.5系に停止日が付く時期、Vertex AI側(Gemini Enterprise Agent Platform)で同じ制限がかかるかは、2026年9月23日時点で本記事の参照範囲(Gemini APIの公式ドキュメント)に記載がありません。
失敗パターン4つ|❌⭕で確認する
失敗1:新規プロジェクトのテンプレートにgemini-2.5-flashが残っている
❌ 社内の雛形やサンプルの既定モデルが2.5のまま。新しいプロジェクトを作るたびに404で止まる。
⭕ 雛形の既定をgemini-3.5-flash-liteかgemini-3.8-flashに変え、2.5のIDは「既存プロジェクト限定」とコメントで明記する。
失敗2:thinking_budgetをそのまま3.8 Flashに渡す
❌ 2.5で「思考を切る」ために使っていたthinking_budgetや、minimal相当の指定を3.8 Flashに持ち込む。3.8 Flashでminimalはエラーになる。
⭕ thinking_levelの文字列に置き換え、速さ優先なら3.8 Flashはlow、思考をほぼ切りたい処理は3.5 Flash-Liteのminimalを使う。
失敗3:「同じLiteだから単価も同じ」と思い込む
❌ 2.5 Flash-Liteの$0.10/$0.40の感覚で3.5 Flash-Liteの予算を組む。
⭕ 3.5 Flash-Liteは$0.30/$2.50。大量処理ならBatch API(料金ページで「50% cost reduction」と説明)やContext cachingの単価も含めて試算し直す。
失敗4:max_output_tokensを絞って節約する
❌ トークン消費を抑えるためにmax_output_tokensを小さく設定する。thinkingトークンを含めた上限なので、途中でincompleteになり、空の出力に課金される。
⭕ 公式の案内どおりthinking_levelをlowかmediumへ下げる。
よくある質問
Gemini 2.5 Pro/Flash/Flash-Liteはいつ停止しますか?
2026年9月23日時点で停止日は告知されていません。deprecationsページの3モデルはいずれも「No shutdown date announced」で、リリースノートも「deprecatedではなく、追って通知するまで提供を続ける」としています。停止日が決まればRelease notesで告知され、deprecationsページに載ります。
「過去に使った」とは、いつ・何を基準に判定されますか?
公式ドキュメントに定義はありません(2026年9月23日時点)。判定の単位がプロジェクト・APIキー・アカウントのどれかも書かれていません。確かめるには、対象プロジェクトのキーで2.5のモデルIDを実際に呼ぶしかなく、フォーラムの報告では新規側には404の「no longer available to new users」が返るとされています。
2.5 Proの代わりは何を使えばよいですか?
公式が新規プロジェクト向けに案内しているのは3.5 Flash-Liteと3.8 Flashの2つです。Pro級のモデルとしてはGemini 3.1 Proがありますが、modelsページではPreview扱いで、今回の告知の案内先には含まれていません。まず3.8 Flashをthinking_level: "high"で試す、というのが公式の案内に沿った進め方です。
generateContentのコードは書き直さないといけませんか?
公式は「generateContentは引き続き完全にサポートされる」としつつ、新規開発にはInteractions APIを推奨しています。モデルIDの置き換えだけならgenerateContentのままでも動きますが、3.xではFunctionResponseにcall_idとnameが必要になるなど、チェックリストの項目はgenerateContentでも当てはまります。
無料枠で3.5 Flash-Liteや3.8 Flashは使えますか?
料金ページでは、3.5 Flash-Liteも3.8 FlashもFree tierの入力・出力が「Free of charge」です。ただしFree tierでは3.5 Flash-LiteのSearch groundingが使えず、送ったコンテンツがGoogleの製品改善に使われます。無料枠の上限や有料へ自動で上がる条件はrate limitsページと料金ページで確認してください。
まとめ|今日やること
- 既存プロジェクト:2.5系の呼び出しがある場所を洗い出し、「停止日が告知されたら移る」前提で、3.5 Flash-Liteか3.8 Flashのどちらへ寄せるかを用途で決めておく。
- 新規プロジェクト:雛形の既定モデルを3.x系へ変える。
thinking_budget・temperature・top_p・top_k・candidate_countを外し、thinking_levelへ置き換える。 - 予算:3.5 Flash-Liteは$0.30/$2.50、3.8 Flashは年内$0.75/$3.75・2027年から$1.50/$7.50で試算し直す。Search groundingは月5,000件の共有枠に変わる。
2026年9月23日時点で公式に書かれているのはここまでです。「過去に使った」の定義と2.5系の停止時期は、公式の続報が出た時点でこの記事に追記します。
この記事を読んで導入イメージが固まってきた方へ
UravationではAIエージェント導入の研修・コンサルを行っています。
運営元 Uravation よりAIエージェントを構想から本番運用まで進める順番と、体制・KPIの決め方をまとめた資料を無料で公開しています。 AIエージェント導入ロードマップを受け取る(無料)
参考・出典
- Release notes | Gemini API — Google AI for Developers(2026年9月18日の項「Gemini 2.5 models access update」・参照日2026-09-23)
- Gemini deprecations | Gemini API — Google AI for Developers(2.5 Pro/Flash/Flash-Liteの停止日「No shutdown date announced」、2.5 Flash Imageの2026年10月2日停止・参照日2026-09-23)
- Models | Gemini API — Google AI for Developers(2.5各節の注記、Model version name patterns・最終更新2026-09-22 UTC・参照日2026-09-23)
- Gemini Developer API pricing — Google AI for Developers(3.8 Flash・3.5 Flash-Lite・2.5 Pro/Flash/Flash-Liteの料金・参照日2026-09-23)
- Gemini 3.8 Flash | Gemini API — Google AI for Developers(仕様・最終更新2026-09-02 UTC・参照日2026-09-23)
- Gemini 3.5 Flash-Lite | Gemini API — Google AI for Developers(仕様・最終更新2026-07-30 UTC・参照日2026-09-23)
- What’s new in Gemini 3.8 Flash | Gemini API — Google AI for Developers(Migration checklist・導入価格・reasoning levels・最終更新2026-09-17 UTC・参照日2026-09-23)
- What’s new in Gemini 3.5 Flash | Gemini API — Google AI for Developers(「Migrate from Gemini 2.5」の項・参照日2026-09-23)
- Gemini thinking | Gemini API — Google AI for Developers(thinking_levelのモデル別既定値・max_output_tokensの挙動・参照日2026-09-23)
- Gemini API quickstart — Google AI for Developers(導入コマンドとInteractions APIの最小例・参照日2026-09-23)
- Migrating to the Interactions API | Gemini API — Google AI for Developers(generateContentのBefore/Afterの例・参照日2026-09-23)
- Gemini-2.5-pro returns “no longer available to new users” — Google AI Developers Forum(2026年7月28日の報告と7月30日のGoogleスタッフ回答・参照日2026-09-23)
