AIエージェント入門

Gemini 3.7 Flash登場|料金半額とベンチマークを検証

Gemini 3.7 Flash登場|料金半額とベンチマークを検証

この記事の結論

Gemini 3.7 Flashが3.6 Flashからわずか3週間で登場。DeepSWEは49%→65.3%、価格は半額の$0.75/$3.75に。一次情報でベンチマークと料金を検証する。

結論:Googleが2026年8月13日に公開した「Gemini 3.7 Flash」は、コーディング系ベンチマークを大幅に押し上げながら、価格は2026年末まで前モデルの半額(入力$0.75/出力$3.75、100万トークンあたり)に据え置かれている。同価格帯のClaude Sonnet 5($2/$10)より安く、GPT-5.6 Sol($5/$30)と比べると同じ開発タスクで7倍以上のコスト差が出る。

関連: Gemini 3.1 Pro|1Mトークンの全貌と使い方

関連: Gemini vs Devin|違いと選び方を徹底比較【2026年】

要点

  • DeepSWE v1.1が49.0%→65.3%、WebDev Arena Eloが1538→1588に向上(Google公式発表値)
  • Gemini 3.6 Flashからわずか3週間での投入。背景には本命モデル「Gemini 3.5 Pro」の遅延がある
  • モデルIDはgemini-3.7-flash。コンテキスト上限は入力104万8,576トークン/出力6万5,536トークン

対象読者:コーディングエージェントやAPI課金コストを検討している開発者・PM。今日やること:手元のエージェントタスクのトークン数を当てはめて、Gemini 3.7 Flashへの切り替えでどれだけコストが下がるか試算する。

「Gemini 3.5 Proがまだ来ない」——そう感じていた開発者は少なくないはずだ。Bloombergが2026年7月16日に報じたところによれば、Gemini 3.5 Proは社内目標に届かないコーディング性能を理由に開発が難航しており、モデルの作り直しや複数の承認プロセスが重なって発売が延び続けている。そんな中でGoogleが2026年8月13日に投入したのは、上位モデルではなく「Gemini 3.7 Flash」——ワークホース級のFlashモデルだった。前バージョンの3.6 Flashからはわずか3週間しか経っていない。本記事では、公式発表とAPIドキュメントの一次情報をもとに、ベンチマークの伸び幅・料金体系・実際に使う際の注意点を数字で検証する。

Gemini 3.7 Flashとは何か(30秒で)

Gemini 3.7 Flashは、Google DeepMindが公開したGemini 3系列の最新Flashモデルで、公式ブログでは「コーディングとエージェント向けに最も賢いワークホースモデル」と位置づけられている。モデルIDはgemini-3.7-flashで、Google AI for DevelopersのモデルカードによればGA(一般提供)は2026年8月。入力トークン上限は104万8,576、出力トークン上限は6万5,536で、テキスト・画像・動画・音声・PDFの入力に対応する(出力はテキストのみ)。thinking(推論の深さ)はlow/medium(既定)/highの3段階を切り替えられる。

ベンチマークで何が変わったか

Google公式ブログが公開した3.6 Flashとの比較値は以下の通り。ソフトウェアエンジニアリング系のベンチマークで特に伸びが大きい。

ベンチマーク Gemini 3.6 Flash Gemini 3.7 Flash 伸び幅
DeepSWE v1.1 49.0% 65.3% +16.3pt
FrontierCode 1.1 Main 34.4% 43.6% +9.2pt
WebDev Arena(Elo) 1538 1588 +50
GDP.pdf(知識集約タスク) 22.0% 34.0% +12.0pt
AutomationBench 17.0% 30.4% +13.4pt

いずれもGoogle自社公表値であり、第三者機関による独立検証結果ではない点は留保が必要だ。それでも、デバッグやIssue解決といったコーディングタスクでの初回成功率(first-pass accuracy)が上がったとGoogleは説明しており、Webアプリの生成でも「より少ないプロンプト回数で機能が揃ったレイアウトを作れる」としている。

料金はどう変わったか — 実タスクでコスト計算する

価格は2026年末までの導入価格として、入力$0.75/出力$3.75(100万トークンあたり)。2027年1月1日以降は標準価格の入力$1.50/出力$7.50に切り替わる予定だ。これは3.6 Flash発売時点の価格のちょうど半額にあたる。

他モデルとの料金比較(すべて100万トークンあたりの公式API価格):

モデル 入力 出力 備考
Gemini 3.7 Flash(〜2026年末) $0.75 $3.75 導入価格
Gemini 3.7 Flash(2027年〜) $1.50 $7.50 標準価格
Claude Sonnet 5 $2.00 $10.00 2026年8月時点の恒久価格
GPT-5.6 Sol $5.00 $30.00 27.2万トークン超は入力2倍・出力1.5倍

実際の開発タスクに当てはめてみる。「入力20万トークン・出力5万トークンのコーディングエージェントタスク」を1回実行した場合のコストは次のようになる。

モデル 入力コスト 出力コスト 合計
Gemini 3.7 Flash(導入価格) $0.15 $0.1875 約$0.34
Claude Sonnet 5 $0.40 $0.50 約$0.90
GPT-5.6 Sol $1.00 $1.50 約$2.50

この試算では、Gemini 3.7 FlashはClaude Sonnet 5の約2.7倍、GPT-5.6 Solの約7.4倍安い。2027年以降の標準価格($1.50/$7.50)に切り替わっても合計は約$0.68で、依然としてSonnet 5より安い水準を維持する。ただしGPT-5.6 SolやClaude Sonnet 5は複雑な長期推論タスクでの精度がFlash系モデルより高いとされる場面もあり、単純な価格差だけで乗り換えを判断しない方がよい。

なぜ今Flashなのか — Gemini 3.5 Pro遅延の裏側

9to5Googleが2026年7月16日に報じた内容では、Gemini 3.5 Proの遅延要因として(1)コーディング性能が社内目標に届かなかったこと、(2)モデルを設計し直す必要が生じたこと、(3)複数関係者の承認プロセスに時間がかかっていること、の3点が挙げられている。Axiosの記事タイトルが端的に示す通り、Gemini 3.7 Flashは「Gemini 3.5 Proより先に」市場投入された形だ。Googleはブログ発表の中でGemini 3.5 Proの具体的な発売時期には触れておらず、2026年8月時点で公式なリリース日は確認できていない。

Googleにとってこの3週間隔でのFlashモデル連投は、上位モデルの遅延で生じた「新モデル待ち」の空気を、軽量モデルの継続的な性能向上で埋める狙いがあると読める。開発者としては、上位モデルの登場を待つより、Flash系の頻繁なアップデートに追従する方が現実的な選択肢になりつつある。

どこで使えるか

Gemini 3.7 Flashは以下のプラットフォームで利用できる。

  • Gemini API/Google AI Studio
  • Android Studio
  • Google Antigravity(エージェント型IDE)
  • Gemini Enterprise Agent Platform/Gemini Enterpriseアプリ
  • Gemini Spark(Google AI Pro/Ultra会員向け、160以上の国と地域で提供)

Gemini SparkのアーキテクチャについてはAgent Labでも別記事で解説している(後述)。API経由での最小構成は以下の通り(Google AI for Developers公式ドキュメントのモデルID表記に基づく)。

from google import genai

client = genai.Client(api_key="YOUR_API_KEY")

response = client.models.generate_content(
    model="gemini-3.7-flash",
    contents="このPythonスクリプトのバグを直して、修正理由も説明して",
    config={"thinking_level": "medium"},  # low / medium(既定) / high
)

print(response.text)

thinking_levelをlowにすると応答速度優先、highにすると推論の深さ優先になる。なお公式ドキュメントには「minimalは未対応でエラーになる」と明記されているため、3.6 Flash以前のパラメータをそのまま流用するとエラーになる点に注意したい。

【要注意】乗り換え前に確認すべき3つの注意点

  • 価格は期間限定:$0.75/$3.75は2026年末までの導入価格。2027年以降は自動的に倍額($1.50/$7.50)になる。長期契約のコスト試算をする場合は両方の価格で計算しておく。
  • ベンチマークは自社公表値:DeepSWEやFrontierCodeの数値はGoogleの公式発表であり、第三者による再現実験の結果ではない。本番導入前には自社のタスクで実測することを推奨する。
  • 「Ultra」「Ultrafast」など類似名との混同に注意:同時期にOpenAIも「GPT-5.6 Sol」の高速推論モード(Cerebras提供、限定プレビュー)を発表しているが、これはGemini 3.7 Flashとは無関係の別サービスである。Agent LabではGPT-5.6のサブエージェント機能「Ultra mode」も別記事で解説しているので、名称が似ているモデル・機能を混同しないよう合わせて確認してほしい。

導入コストを見誤らないために

価格が安くなったとはいえ、エージェント運用ではトークン消費量そのものが読みにくいという課題は変わらない。Agent Labではエージェントのコスト監視・暴走対策についても別記事でまとめており、Gemini 3.7 Flashへの切り替えを検討する際はあわせて確認しておきたい。Gemini 3.7 Flashの強みは、価格の安さに加えてGoogleの開発者エコシステム(Antigravity、Android Studio、AI Studio)に統合済みである点と、コーディングタスクに特化したベンチマークの伸びが大きい点にある。

よくある質問

Gemini 3.7 Flashはいつから使えますか?

2026年8月13日にGoogle公式ブログで発表され、同日〜8月14日にかけてGemini API、AI Studio、Android Studio、Antigravity、Gemini Spark等で順次利用可能になった。

Gemini 3.7 FlashとGemini 3.5 Proはどちらを使うべきですか?

2026年8月時点でGemini 3.5 Proは公式なリリース日が確認できていない状態にある。コーディング・エージェント用途で今すぐ使えるモデルを探しているなら、価格・性能ともに大幅に改善されたGemini 3.7 Flashが実質的な選択肢になる。

Gemini 3.7 Flashの料金はどのくらい安くなりましたか?

2026年末までの導入価格は入力$0.75/出力$3.75(100万トークンあたり)で、3.6 Flash発売時点の価格の半額とGoogleは説明している。2027年からは標準価格の$1.50/$7.50に切り替わる。

Gemini 3.7 Flashの使い方(API呼び出し)を教えてください

Google公式のPython SDK(google-genai)で、モデルIDにgemini-3.7-flashを指定してgenerate_contentを呼び出す。thinking_levelでlow/medium/highの推論の深さを切り替えられる(詳細は本記事のコード例を参照)。

参考・出典

関連記事

佐藤傑(さとう・すぐる)
株式会社Uravation代表取締役。早稲田大学法学部在学中に生成AIの可能性に魅了され、X(旧Twitter)で活用法を発信(@SuguruKun_ai、フォロワー10万人超)。100社以上の企業向けAI研修・導入支援を展開。著書累計3万部突破。

この記事を読んで自社のAIエージェント導入コストを見直したくなった方へ

UravationではAIエージェント導入の研修・コンサルを行っています。

Need help moving from reading to rollout?

この記事を読んで導入イメージが固まってきた方へ

Uravationでは、AIエージェントの要件整理、PoC設計、社内導入、研修まで一気通貫で支援しています。

この記事をシェア

X Facebook LINE

※ 本記事の情報は2026年8月時点のものです。サービスの料金・仕様は変更される可能性があります。最新情報は各サービスの公式サイトをご確認ください。

関連記事