· CTO Marcus テクノロジー  · 7 min read

Gemini 3.7 Flash登場——「実務用の主力機」に価格半額でベンチマークが跳ねた意味

Googleは2026年8月13日、Gemini 3.7 Flashを発表しました。DeepSWE v1.1は49.0%から65.3%へ、AutomationBenchは17.0%から30.4%へ。導入価格は入力$0.75/出力$3.75で2026年末まで。技術選定の考え方を整理します。

Googleは2026年8月13日、Gemini 3.7 Flashを発表しました。DeepSWE v1.1は49.0%から65.3%へ、AutomationBenchは17.0%から30.4%へ。導入価格は入力$0.75/出力$3.75で2026年末まで。技術選定の考え方を整理します。

※ 本記事は2026年8月17日時点の公開情報に基づきます。仕様・価格は変化するため、最新情報は各社公式発表等をご参照ください。

Googleは2026年8月13日Gemini 3.7 Flash を発表しました。位置づけは「コーディングとエージェント向けの、これまでで最も知的な主力モデル」です。前世代の3.6 Flashとの比較で、ソフトウェア課題解決のDeepSWE v1.1が49.0%→65.3%、業務自動化を測るAutomationBenchが17.0%→30.4%、FrontierCode 1.1 Mainが**34.4%→43.6%と、いずれも大きく伸びています(出典: Google 公式ブログ)。注目すべきは、これがフラッグシップではなく主力機(workhorse)**の話だという点です。

数字の伸び方が偏っている——伸びたのは「作業」の領域

ベンチマークの並びを見ると、伸び幅が大きいのは実務寄りの指標です。AutomationBenchは17.0%から30.4%へと約1.8倍、DeepSWE v1.1も49.0%から65.3%へ。Web開発の対戦評価であるWebDev ArenaのEloは1538から1588、文書処理を測るGDP.pdfは22.0%から34.0%です(出典: 同上)。

会話の自然さや知識の広さではなく、多段の計画とツール実行、指示の追従、失敗からの復帰といった、業務に組み込んだときに効く能力が中心に伸びています。エージェントを実運用に載せる際、成否を分けるのはまさにここです。1回の応答が賢いかではなく、10工程を最後まで通せるか。

価格は「導入価格」——期限を設計に織り込む

価格設定は明快です。導入価格は100万トークンあたり入力$0.75・出力$3.75で、2026年12月31日まで。2027年1月1日からは入力$1.50・出力$7.50の標準価格になります(出典: 同上)。

技術選定の観点で重要なのは、この期限です。導入価格で試算した投資対効果は、年明けに2倍のコストで再計算されます。半額の期間に採用を決め、標準価格で赤字になる設計にしてしまう——この失敗は避けられます。2027年1月の価格で成立する使い方を、いま設計しておく。それだけのことです。

提供面の広がり——「どこから呼べるか」を確認する

提供先も押さえておきます。エージェント型の開発環境であるGoogle Antigravity、Google AI StudioとAndroid Studio経由のGemini API、Gemini Enterprise Agent Platform、Gemini Enterpriseアプリ、そして160か国以上のProおよびUltra契約者向けのGemini Sparkで利用できます(出典: 同上)。

自社がどの入口を使うかで、認証・ログ・データの扱いが変わります。同じモデルでも、APIから呼ぶのと業務アプリの中で使うのとでは、監査の設計がまったく別物になる点は押さえておくべきです。

中小企業への翻訳——「主力機」を基準に組む

最上位モデルの性能競争は話題になりますが、業務の大半は主力機で足ります。実務としての判断はこうなります。

  1. 多数回まわす処理から主力機に寄せる。 問い合わせの一次整理、書類の読み取り、定型文の作成。1件あたりの単価が効く処理ほど、主力機の性能向上が効きます。

  2. 標準価格で試算する。 導入価格ではなく、2027年1月以降の価格で月次コストを出す。それで合わないなら、処理量そのものを見直す段階です。

  3. モデルを差し替えられる形にしておく。 3週間で世代が変わる領域です。呼び出し部分を1か所にまとめておけば、次の値下げも次の性能向上もすぐ取り込めます。

まとめ

  • Googleは2026年8月13日、Gemini 3.7 Flashを「コーディングとエージェント向けの最も知的な主力モデル」として発表した
  • 前世代3.6 Flash比で、DeepSWE v1.1が49.0%→65.3%、AutomationBenchが17.0%→30.4%、FrontierCode 1.1 Mainが34.4%→43.6%、GDP.pdfが22.0%→34.0%、WebDev ArenaのEloは1538→1588
  • 導入価格は100万トークンあたり入力$0.75・出力$3.75で2026年12月31日まで。2027年1月1日からは入力$1.50・出力$7.50となる
  • 提供はGoogle Antigravity、Gemini API(AI Studio・Android Studio)、Gemini Enterprise Agent Platform、Gemini Enterpriseアプリ、160か国以上のGemini Spark。入口ごとに監査・データの扱いが変わる

主力機の性能が上がるということは、特別な用途ではなく日常の業務がAIの射程に入るということです。フラッグシップの話題は派手ですが、事業の数字を動かすのはこちらの層です。導入価格ではなく標準価格で採算が合う設計を、値下げ期間のうちに作っておく。急いで決めるのではなく、急いで試して落ち着いて決めることが、この速度の市場では最も安全な進め方だと私たちは考えます。

※ 本記事は一般的な情報提供を目的としており、個別の法的・財務的・経営的助言ではありません。具体的な課題については専門家にご相談ください。

この記事のテーマについてご相談されたい方へ

代表 服田伸人が率いるHatta AI Groupでは、中小企業の経営課題に関するご相談を承っています。

お問い合わせはこちら

Related Posts

View All Posts »
出力トークン17%削減の新Flashと、半額でFable 5に迫るOpus 5——AIの費用は「単価」ではなく「1タスクの総量」で決まる
テクノロジー

出力トークン17%削減の新Flashと、半額でFable 5に迫るOpus 5——AIの費用は「単価」ではなく「1タスクの総量」で決まる

Googleは7月21日にGemini 3.6 Flashを発表し、出力トークン使用量を前世代比17%削減。Anthropicは7月24日にClaude Opus 5を入力5ドル・出力25ドルで公開しました。単価表の比較では見えない「1タスクあたりの総コスト」という技術選定の物差しを整理します。

MicrosoftがCopilotを内製「MAI」モデルへ切り替え開始——LLMは「選ぶ」から「切り替えられる設計」へ
テクノロジー

MicrosoftがCopilotを内製「MAI」モデルへ切り替え開始——LLMは「選ぶ」から「切り替えられる設計」へ

MicrosoftがExcelやOutlookのCopilot機能で、OpenAI・Anthropicのモデルを自社開発「MAI」モデルに置き換え始めたと報じられました。世界最大のAI配布チャネルによる内製切替と、同じ週のFable 5提供再開が示す教訓——LLM選定は一度きりの決定ではなく、切り替えられる設計だという話です。