MENU
みなづち
@minaduchi
ゲイ×強迫性障害のぼく。そんなぼくのネットだから言える本音をゆるっと発信。現実世界では隠して生息してるけどネットではさらけ出している。ゲイを自覚して20年。強迫性障害を発症して15年。
当サイトへのリンクについて

「みなづちAI」はリンクフリーです。リンクを行う場合の許可や連絡は不要です。引用する際は、引用元の明記と該当ページへのリンクをお願いします。

みなづちの活動を応援してみよう!

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて
  • URLをコピーしました!

みなづちです。

Googleが新しいモデルを出しました。Gemini 3.8 Flashです。

日本時間9月3日の午前0時ちょうど。発表ページの書き出しがこれです。

marking our third Flash release in only six weeks

6週間で3回目のFlash。しかも価格は据え置きで、100万トークンあたり入力0.75ドル、出力3.75ドルのままです。

比較表を見ると、数字が並んでいます。DeepSWE v1.1、Vals Finance Agent v2、Harvey’s Legal Agent Benchmark、HLE-Verified。相手として Claude Opus 5、Claude Sonnet 5、GPT-5.6 Sol、GPT-5.6 Terra の名前が並びます。

ところが、発表ページのHTMLを取得して competitors の名前を検索したところ、1件も出てきませんでした。

Claude が0件。Opus が0件。Sonnet が0件。GPT- が0件。OpenAI も Anthropic も0件。本文だけではありません。画像のalt属性も、埋め込みのJSONも、構造化データも、脚注まで含めて、ページ全体で0件です。

競合の名前は、すべてグラフ画像の中にだけ描かれていました。

本記事では、以下のポイントから解説します。

  • 競合名がHTMLから1件残らず消えていて、画像の中にだけあること
  • 本文の匿名表現が7箇所で、前世代の3.7 Flashの発表には0箇所だったこと
  • ただしGoogleは自社が負けている6行を太字で明示していて、隠しているわけではないこと
  • 「2027年に2倍の値上げ」ではなく、前世代の定価に戻るだけであること
  • 日本のGeminiアプリを開いても「3.8 Flash」という名前は出てこないこと

目次

結論:競合名はHTMLに0件。実名は画像の中にだけある

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

発表ページの比較表には競合が実名で載っています。ただしそれは画像であって、テキストではありません。

ページ全体を検索して0件だった

発表ページの生HTMLを406,628バイト取得し、機械的に検索しました。結果はこうです。

  • Claude:0件
  • Opus:0件
  • Sonnet:0件
  • Fable:0件
  • GPT-:0件
  • OpenAI:0件
  • Anthropic:0件
  • Grok / Qwen / Kimi / DeepSeek / Muse:いずれも0件

本文の散文だけではありません。画像のalt属性、figcaption、埋め込みJSON、構造化データ、記事本体の外側にある脚注ブロックまで含めて、ページのどこにも競合名がありませんでした。

alt属性は14枚すべてが総称表現だった

グラフは全部で14枚あります。alt属性を全部書き出すと、次のような形でした。

comparison chart showing Gemini 3.8 Flash and other models

a chart showing Gemini 3.8 Flash Cyber CyberGym Pass@1

どれも「Gemini 3.8 Flash と他のモデル」という言い方で、相手の名前がありません。

画像の中には14〜15モデルが実名で描かれている

一方、比較表の原寸画像(2600×3186ピクセル)をダウンロードして見ると、列見出しに6モデルが実名で並んでいます。

Gemini 3.8 Flash / Gemini 3.7 Flash / Claude Opus 5 / Claude Sonnet 5 / GPT-5.6 Sol / GPT-5.6 Terra。

DeepSWEの散布図にはさらに多く、Claude Fable 5、Claude Opus 4.8、Kimi K3、Grok 4.6、GLM 5.3、Qwen 3.8、Muse Spark 1.2、DeepSeek v4 Pro など14モデルが描かれています。

読めるのは目で見た人だけです。検索エンジンにも、スクリーンリーダーにも、この情報は届きません。


筆者の視点:「隠している」で書こうとして、4回訂正が入った

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

最初に立てた見立ては、検証のたびに形を変えました。結果的にそのほうが正確な記事になりました。

「都合の悪い数字を隠している」は成立しなかった

競合名がHTMLにないと分かった時点で、「Googleは不利な情報を隠している」という軸で書こうとしました。

比較表の原寸画像を開いて、崩れました。Googleは自社が負けている6行を、競合側に太字と灰色の網掛けで明示しています。DeepSWE v1.1、GDPVal-AA v2、Terminal-bench 4.0、OSWorld-2.0、GDP.PDF、BioMysteryBench。どれも Claude Opus 5 や GPT-5.6 Sol が勝者として強調されています。

隠していません。むしろ負けを目立たせています。

「73.7%」という数字は存在しなかった

DeepSWE v1.1 で Gemini 3.8 Flash が73.7%、Claude Opus 5 が74.0%。0.3ポイントの惜敗、という原稿を書きかけました。

比較表の実際の値は71.0%でした。差は0.3ポイントではなく3.0ポイントです。73.7%という数字は、表にも本文にも存在しませんでした。10分の1に見誤っていました。

「2027年に2倍の値上げ」も違った

脚注に「2027年1月1日から入力1.50ドル、出力7.50ドル」とあります。ちょうど2倍なので、値上げの記事にしようとしました。

前世代の発表ページを開いて、崩れました。1.50ドルと7.50ドルは、3.6 Flash が2026年7月21日に発売されたときの定価そのものです。3.7 Flash の発表ページには「an introductory price of half the original 3.6 Flash cost per million tokens」とあります。値上げではなく、半額キャンペーンの終了でした。

「トークンを食うので高くつく」も成立しなかった

Google自身が3か所で「トークンを多く使う」と書いています。だから実費が上がる、と書こうとしました。

グラフを実測して崩れました。詳しくは後述しますが、Google自身のグラフでは、3.8 Flash が3.7 Flash より安くて強い点が存在します。「高くつくだけ」と書くと、Googleのグラフと矛盾します。


発表は日本時間9月3日0時。本文の日付はタイムゾーンなし

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

日付の扱いから確認します。日本の読者にとっては1日ずれる位置にありました。

構造化データとRSSが秒まで一致している

発表ページの本文に印字されているのは「Sep 02, 2026」だけで、時刻もタイムゾーンもありません。

生HTMLの構造化データにはこうあります。

“datePublished”: “2026-09-02T15:00:00+00:00”

blog.google のRSSに載っている公開日時も「Wed, 02 Sep 2026 15:00:00 +0000」で、秒まで一致します。協定世界時9月2日15時ちょうど、日本時間では9月3日午前0時ちょうどです。米太平洋夏時間では9月2日の午前8時にあたります。

公開後に2回更新されているが、本文は変わっていない

構造化データの更新日時を見ると、協定世界時9月2日の15時40分14秒と16時16分23秒の2回、更新されています。

ウェブアーカイブに1件だけ残っているスナップショット(協定世界時9月2日15時46分13秒)と現在のページを比べました。本文は1文字も変わっていませんでした。差があったのは関連記事のサムネイル画像と、グラフ画像の読み込み指定だけです。

なお最初の更新は、同じ日に公開された Fairwind Program の記事(協定世界時9月2日15時40分)とほぼ同時刻でした。相互リンクを入れたものと見られます。


匿名表現は本文に7箇所。3.7 Flashの発表には0箇所だった

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

競合名がないかわりに、本文には「フロンティアモデル」という言い方が並びます。数えました。

本文にある7つの匿名表現の内訳

本文の散文から抜き出すと、次の7つでした。

  • often approaching the performance of higher-cost frontier models
  • outperforms most larger frontier models
  • outperforms 3.7 Flash and other frontier models
  • It surpasses both 3.5 Flash Cyber as well as significantly larger frontier models
  • compared to a leading frontier model at 47.8%
  • than the best commercial models that are much larger
  • compared to other leading frontier models

すべて「より大きい」「より高価な」「主要な」といった形容で、名前がありません。

なお証言の画像の中にもう1箇所、同種の表現があります。「ページ全体で7箇所」と書くと不正確なので、これは本文に限った数え方です。

前世代の発表ページには0箇所だった

3.7 Flash の発表ページ(2026年8月13日)を同じ方法で検索しました。「frontier models」という競合を指す匿名表現は0件でした。

3.7 Flash の発表は、そもそも他社との比較を本文で行っていません。匿名の競合言及は、3.8 Flash で新しく登場した書き方です。

ただし画像に実名を置く手口自体は3.7から続いている

一方、グラフ画像の中に競合を実名で描く形は、3.7 Flash の発表ページでも同じでした。変わったのは「本文で比較を語るようになったのに、そこには名前を書かなかった」という点です。


同じ相手を、散文では匿名に、図の中では実名にしている

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

いちばん分かりやすい例が、CWE-Bench というベンチマークの記述です。

発表ページ本文は「a leading frontier model」

On this benchmark, Gemini 3.8 Flash Cyber is on the Pareto frontier: with a pass@1 of 47.2% compared to a leading frontier model at 47.8%, yet offered at a significantly lower cost.

47.8%を出した相手が「a leading frontier model」と書かれています。そして Gemini は47.2%で、この相手に負けています。

同じGoogleの別ページでは実名

Google DeepMind のサイバー向け製品ページを開くと、同じ文がこうなっていました。

with a pass@1 of 47.2% compared to Fable 5 at 47.8%

「Fable 5」と実名で書かれています。Anthropic のモデルです。

ただし同じページの図にも実名がある

ここで注意が要ります。私は当初「blog.google は相手を隠した」と書こうとしましたが、これは成立しません。

同じ発表ページに貼られたCWE-Benchの散布図の画像には、「Fable 5」が47.8%・約10.2ドルの位置に実名でラベルされています。しかも本文はそのベンチマーク名から運営元のリーダーボードに直接リンクしており、開けば先頭行に「Claude Fable 5 / Claude Code / 47.8% / $10.27」と出ます。

正確に言えるのは「散文でだけ匿名にし、実名は画像とリンク先に置いた」です。


OpenAIとAnthropicはどうしているか。3社3様だった

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

「Googleだけが匿名化している」と書けるのかを確かめました。答えは、それも違いました。

OpenAIはHTMLの表に実名で書き、自社の負けも出す

OpenAI の GPT-5.6 発表ページを開くと、比較表がHTMLの表として組まれており、Claude と Gemini が実名で載っています。自社が負けている数値もそのまま出しています。

Anthropicは競合を1モデルに絞っていた

Anthropic の Claude Fable 5.1 発表ページ(2026年9月1日)はどうか。比較表に載っている競合はGPT-5.6 Sol の1モデルだけで、Gemini は0件でした。実名では書くが、相手を選んでいます。

成立する言い方は「画像の中にだけ置いた」

3社を並べると、「Googleだけが匿名化している」も「匿名化は業界の通例」も、どちらも事実に合いません。

成立する言い方はこうです。Googleだけが、競合の名前をラスタ画像の中にしか置いていません。HTMLの本文からも、alt属性からも、埋め込みデータからも消えています。結果として、検索エンジンにも、スクリーンリーダーを使う人にも、その情報は届きません。


単価は3世代とも同じ。ただし12月31日で導入価格が終わる

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

価格の話に移ります。ここは事実関係が明快でした。

3.6 / 3.7 / 3.8 が同額

料金ページを取得して、3世代のセクションを機械的に比較しました。3.8 Flash と 3.7 Flash はモデル名以外がバイト単位で完全に一致していました。3.6 Flash も金額はすべて同じです。

  • 入力:0.75ドル / 100万トークン
  • 出力:3.75ドル / 100万トークン
  • コンテキストキャッシュ:0.075ドル
  • バッチ・Flex:0.375ドル / 1.875ドル

導入価格の期限は2026年12月31日

発表ページの脚注にこうあります。

Introductory price expires on December 31, 2026. Starting January 1, 2027, $1.50/1M input tokens and $7.50/1M output tokens will apply.

2026年12月31日まで。そこから先は入力1.50ドル、出力7.50ドルです。

料金ページを見ると、標準ティアだけでなくバッチ・Flex・優先・キャッシュ・ストレージまで、すべて厳密に2倍になります。Google検索によるグラウンディングの課金だけは据え置きです。

3.6・3.7・3.8が同じ日に同じ値へ戻る

これは3.8 Flash だけの話ではありません。3.6 Flash も 3.7 Flash も、同じ2026年12月31日に導入価格が終わります。3世代がそろって同じ値に戻ります。


「2倍の値上げ」ではない。3.6 Flashの定価に戻るだけ

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

ここは私が書き損じかけた箇所です。金額は確かに2倍ですが、意味が違いました。

3.6 Flashの発売時価格を見ると分かる

3.6 Flash の発表ページ(2026年7月21日)にこうあります。

At $1.50/1M input tokens and $7.50/1M output tokens, 3.6 Flash reduces the overall cost per agentic task

1.50ドルと7.50ドルは、3.6 Flash が出たときの定価そのものでした。

3.7 Flashで半額にした

3.7 Flash の発表ページには、こう書かれています。

an introductory price of half the original 3.6 Flash cost per million tokens

3.6 Flash の半額を導入価格として設定した、という説明です。3.8 Flash はその価格を引き継いでいます。

つまり2027年1月1日に起きるのは、値上げではなく半額キャンペーンの終了です。書き方を間違えると、Googleが突然2倍にしたように読めてしまいます。


Googleは3か所で「トークンを多く使う」と書いている

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

単価が同じでも、消費するトークンが増えれば請求額は増えます。この点をGoogle自身が明記しています。

発表ページは「more tokens」と書く

At times, the model might use more tokens to maximize performance, especially at higher effort levels.

開発者ドキュメントは「by design」と書く

Gemini 3.8 Flash can use more tokens on longer running and complex tasks, by design.

Google Cloudの開発者ガイドがいちばん直截

In comparison to 3.7 Flash, 3.8 Flash delivers better accuracy and more reliable performance at the cost of higher token consumption.

精度と安定性の向上を、トークン消費の増加という代償で買っている。Googleがそう書いています。

そして発表ページには、こうも書かれています。

For applications where compute efficiency is the primary constraint, developers can utilize lower effort levels to minimize token overhead or continue to rely on Gemini 3.7 Flash, which remains fully supported for efficiency-first workloads.

効率が最優先なら3.7 Flashを使い続けろ、とGoogle自身が勧めています。


ただしグラフでは、3.8 Flashが3.7より安くて強い

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

「トークンを食うから高くつく」と結論しかけて、実測で止まりました。

横軸は対数ではなく、左が高額の反転線形軸

DeepSWEの散布図の画像をダウンロードし、グリッド線をピクセル単位で検出しました。縦のグリッドは10ドル・5ドル・0ドルの位置にあり、間隔が651ピクセルと649ピクセルでほぼ等間隔です。対数スケールではなく、左が高額・右が0ドルの反転した線形軸でした。図の右上に「most efficient」と書かれています。

グラフから実測した3.8と3.7の各点

マーカーを色で分離して座標を取ると、こうなりました。

Gemini 3.8 Flash(2点)

  • 約2.36ドル / 73.8%
  • 約1.96ドル / 71.1%

Gemini 3.7 Flash(3点)

  • 約2.17ドル / 65.4%
  • 約2.01ドル / 65.5%
  • 約1.83ドル / 53.7%

3.8の安い点が、3.7のどの点よりも上

3.8 Flash の1.96ドル・71.1%という点は、3.7 Flash の最良点(2.01ドル・65.5%)より安くて、しかも5.6ポイント高いです。

少なくともこのベンチマークでは、3.8 Flash が3.7 Flash を費用と性能の両面で上回っています。「トークンが増える」ことと「実費が増える」ことは、同じではありませんでした。


グラフには74%の点があるのに、表には71.0%が載っている

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

実測していて、もう1つ引っかかる点が出ました。

比較表のDeepSWEの値は71.0%

比較表のDeepSWE v1.1の行はこうなっています。

Gemini 3.8 Flash 71.0% / Gemini 3.7 Flash 65.3% / Claude Opus 5 74.0%(太字・網掛け) / Claude Sonnet 5 53.8% / GPT-5.6 Sol 72.7% / GPT-5.6 Terra 69.6%。

Claude Opus 5 が勝者として強調されています。

ところがグラフの上側の点は約74%

同じページの散布図を実測すると、3.8 Flash の上側の点は Claude Opus 5 のマーカーよりわずかに高い位置にあり、約74.0〜74.2%・約2.36ドルに相当します。

つまりGoogleは、自社のグラフに74%相当の点を描きながら、表には低いほうの71.0%を載せ、競合を勝者として太字にしています。

公開リーダーボードでは同着だった

運営元のリーダーボードを開くと、さらに事情が変わります。gemini-3.8-flash [high] が74%±1%で登録済みで、Claude Opus 5 は74%±4%。信頼区間が重なる同着です。ボード側には「All models run on mini-swe-agent for consistency.」とあり、全モデルが同じ実行環境で測られています。

グラフと表と公開ボードで、3つの違う数字が並んでいることになります。評価手法のPDFは、グラフに点が2つある理由も、上側の点が表に載らない理由も説明していません。


Terminal-bench 2.1だけ、自社の2ページで数字が違う

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

数字の食い違いは、もう1か所ありました。しかもそこだけです。

4つの系統で数字が全部違っている

Terminal-bench 2.1 における Gemini 3.8 Flash の値を並べます。

  • 発表ページ:89.4%
  • Google Cloud の開発者ガイド:90.8%
  • Artificial Analysis の独立実測:87.6%(11位)
  • Vals AI の独立実測:81.3%(4位)
  • 公式リーダーボード tbench.ai:登録なし

独立実測では、GPT-5.6 Sol にも Claude Opus 5 にも Claude Fable 5.1 にも負けています。Googleの表の順位が反転します。

食い違うのはTerminal-benchの1行だけ

発表ページと Google Cloud の開発者ガイドには、重複する行が他にもあります。CharXiv(86.2 / 84.5)と GDP.PDF(35.0 / 34.0)です。

これらを確認すると、小数まで一致していました。食い違っているのは Terminal-bench 2.1 の行だけです。単純な転記ミスの可能性が高そうですが、どちらが正しいのかはGoogleの説明がありません。


Harvey’s Legalは全56モデル中9位。首位はMetaのモデル

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

グラフに載っている相手の選び方も確認しました。ここは私の読み違えが1つありました。

6つの数値は公開値と完全に一致する

Harvey’s Legal Agent Benchmark のグラフには6本の棒があります。Gemini 3.8 Flash 10.0% / 3.7 Flash 8.8% / Claude Sonnet 5 5.0% / GPT-5.6 Terra 0.8% / Claude Opus 5 6.7% / GPT-5.6 Sol 2.5%。

運営元 Vals AI の公開リーダーボードと突き合わせると、6つとも丸めて完全一致でした。数値の捏造はありません。

ただし全56モデル中では9位だった

同じリーダーボードには56モデルが載っています。Gemini 3.8 Flash は9位でした。

首位は Meta の Muse Spark 1.2 で25.4%。Gemini の2.5倍です。ほかに Muse Spark 1.1、Grok 4.6、Grok 4.5、Claude Fable 5、Kimi K3、Qwen3.8-max、Qwen3.8-27B が上にいます。グラフに載っている5つの競合は、Gemini が勝てる相手でした。

「10%だからほぼ解けていない」は私の誤読だった

当初、絶対値が10.0%という低さに引っかかり、「ほとんど解けていない」と書こうとしました。

同じページに別の指標がありました。10.0%は「All pass rate」で、1つのタスクの採点基準を漏れなく全部満たした割合です。基準単位の通過率を見ると、Gemini 3.8 Flash は90.2%で7位でした。

「ほぼ解けていない」は誤りです。ただし、どちらの指標でも首位が Meta のモデルで、それがグラフに載っていないことは変わりません。


Vals Financeでは1位。ただし2位が載っていない

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

もう1つのベンチマークも同じ構造でした。

1位であること自体は公開値と一致

Vals Finance Agent v2 で Gemini 3.8 Flash は61.435%。公開リーダーボードで正真正銘の1位です。

2位との差は0.836ポイント

2位は Meta の Muse Spark 1.2 で60.599%。差は0.836ポイントです。

この2位が、Googleのグラフには載っていません。かわりに置かれているのは Claude Opus 5(58.6%、実質4位)です。実質3位相当の Claude Fable 5.1(58.877%)も省かれています。

コストで見るとさらに事情が変わる

1テストあたりのコストを見ると、Gemini 3.8 Flash が約2.00ドル、Muse Spark 1.2 が約0.77ドルです。2位のほうが2.6分の1の費用で0.836ポイント差まで来ています。

さらに GLM-5.3 Flash は57.85%を約0.048ドルで出しています。Geminiの約42分の1の費用で、3.6ポイント差です。


CyberGymは「発見」ではなく「再現」を測っている

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

サイバー特化モデルのほうも確認しました。ベンチマークの性質が説明と違いました。

発表ページは「業界標準」と書いている

On the standard industry benchmark for finding vulnerabilities, CyberGym, Gemini 3.8 Flash Cyber demonstrates frontier-level performance in autonomous vulnerability discovery.

「脆弱性を見つけるための業界標準ベンチマーク」「自律的な脆弱性発見」と書かれています。

運営元は「再現」と分類している

CyberGym の公式サイトはこう説明しています。

agents receive a vulnerability description and unpatched codebase, and are evaluated on their ability to reproduce target vulnerabilities by generating working PoCs

脆弱性の説明を与えられたうえで、それを再現する実証コードを作れるかを測るものです。ゼロから発見する能力ではありません。運営元の分類でも「Vulnerability Reproduction」に入っています。

公開リーダーボードには登録がない

公開リーダーボードのデータを取得して全64件を確認したところ、Gemini 3.8 Flash Cyber も 3.5 Flash Cyber も登録されていませんでした。

同ボードには86.2%を上回る登録が13件あり、最高は96.35%です。ただしこの13件はすべてエージェント枠の登録で、モデル単体の枠44件に限ると最高は GPT-5.5-Cyber の85.6%です。Googleの86.2%はモデル区分では首位相当になります。ここは公平に書いておく必要があります。

なお運営元自身が、上位帯についてこう注意しています。

modest score differences may not reflect meaningful capability gaps


Wizは第三者ではない。Googleの完全子会社だった

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

発表ページには外部企業の名前も出てきます。1社だけ、関係を確認する必要がありました。

発表ページに載っているWizの数値

Wiz found that Gemini 3.8 Flash Cyber achieves +7.5-9.7% higher recall on their internal penetration testing benchmark for a 2.3-5.2x lower cost compared to other leading frontier models.

Wizは2026年3月にGoogleの傘下に入っている

Wiz の公式ブログを開きました。2026年3月11日付、著者は CEO の Assaf Rappaport です。

Today, as we officially begin our journey as a Google company, that belief feels real in a much deeper way.

買収は完了しており、Wiz は Google の完全子会社です。

数値のほうは「社内事例」として提示されている

ここも正確に書く必要があります。Wiz の数値は「Real-world impact: securing Google’s code」という見出しの下、「We’re already using Gemini 3.8 Flash Cyber to secure code across Google.」という導入文に続く3項目の2番目にあります。社内での利用事例として提示されており、外部の第三者検証として掲げられているわけではありません。

問題は社外3社と並ぶ証言欄のほう

一方、同じページの「What our Fairwind Program partners are saying」という証言欄には、Wiz の担当者のコメントが顔写真つきで載っています。並んでいるのは Armadin、Palo Alto Networks、Snowflake という社外企業です。

資本関係の注記はどこにもありません。読者から見れば、社外のセキュリティ企業4社が評価しているように見えます。

なお、その Wiz 自身が公開リーダーボードに登録しているエージェントは、GPT-5.5 と Claude Opus 4.6 を組み合わせたものでした。


Gemini 3.8 Flashのモデルカードはリンクされていない

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

安全性の文書も確認しました。存在はしますが、たどり着く導線がありません。

発表ページの132件のリンクを全部数えた

発表ページの生HTMLからリンクを全部抽出しました。ユニークなURLは132件。そのうちモデルカードへのリンクは0件でした。「model card」という文字列自体、ページ全体で0件です。

モデルカードは8ページで実在する

Google DeepMind のモデルカード索引を開くと、「Gemini 3.8 Flash / Updated 2 September 2026」の行があります。実体は8ページのPDFです。

発表と同じ日に出ていますが、発表ページを読んだ人がそこへ行く手段がありません。開発者ドキュメントのモデルページを経由して初めてたどり着けます。

212ページと8ページという分量差

前日にAnthropicが公開した Claude Fable 5.1 と Mythos 5.1 のシステムカードは、実際にダウンロードして数えると212ページでした。Gemini 3.8 Flash のモデルカードは8ページです。

ただしこの比較は割り引いて読む必要があります。Googleのモデルカードは差分型で、アーキテクチャ・訓練データ・ハードウェアの各項目が「3.7 Flash のモデルカードを見よ」という形になっています。参照先が存在する構造です。


「非英語の安全性は悪化した」はモデルカードにしかない

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

そのモデルカードに、日本の読者に直接関係する記述がありました。

モデルカードの自動評価表にある5項目

3.8 Flash と 3.7 Flash を比べた表がこうなっています。

  • Text to Text Safety:−0.4pp(低いほど良い=改善)
  • Multilingual Safety:+5.4pp(悪化)
  • Image to Text Safety:0.0pp
  • Tone:+0.2pp(高いほど良い=改善)
  • Unjustified-refusals:+1.1pp(悪化)

本文の記述はこうです。

Safety performance across non-English languages regressed slightly relative to 3.7 Flash.

英語以外の言語での安全性能が、3.7 Flash と比べてわずかに後退した。日本語は英語以外です。

この後退は発表ページに書かれていない

発表ページの生HTMLを検索しましたが、この後退に触れた記述はありませんでした。

ただしGoogleは但し書きを付けている

ここも公平に書きます。同じ表には、次の注記が付いています。

The performance results reported below are computed with improved evaluations and thus are not directly comparable with performance results found in previous Gemini model cards.

Our manual review confirmed losses were overwhelmingly either a) false positives or b) not egregious.

評価方法が変わったので過去のモデルカードとは直接比較できないこと、人手で確認したところ悪化分の大半は誤検知だったことをGoogle自身が書いています。「5.4ポイント悪化した」だけを切り出すと、この但し書きを落とすことになります。


サイバー特化モデルを出しながら、本体の安全性評価は前世代からの外挿

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

安全性評価の手続きにも、書いておくべき点がありました。

3.8 Flash自体は評価されていない

モデルカードのフロンティア安全性評価の節にこうあります。

based on Gemini 3.7 Flash results, we are confident that Gemini 3.8 Flash is also unlikely to reach any T/CCLs

3.7 Flash の結果にもとづいて、3.8 Flash も危険な能力水準には達しないと確信している。3.8 Flash 自体を評価にかけたとは書かれていません。

枠組み自体は外挿を明文で認めている

これは違反ではありません。Google DeepMind のフロンティア安全性フレームワーク(バージョン3.1、2026年4月17日公開)は、実質的な変更がなければ再評価を省略できると明文で定めています。

ただし3.7 Flashは警戒閾値に到達していた

外挿の元になった 3.7 Flash のモデルカードには、こうあります。

Gemini 3.7 Flash reaches the alert threshold for this CCL, but not the CCL. We continue to deploy mitigations.

サイバー分野で警戒閾値には到達しているという記述です。しかも同じカードによれば、CBRN分野でも警戒閾値に達しています。

一方で3.8 Flash のモデルカードは、同じ3.7 Flash の評価について「did not reach any Tracked or Critical Capability Levels」と書いています。警戒閾値は危険水準そのものではないので厳密には両立しますが、読む文書によって印象が変わります。

前々世代のカードにあった一文が、今回はない

3.6 Flash のモデルカードには、サイバー分野が警戒閾値に達したため追加検証を行った旨が明記されています。

3.8 Flash のモデルカードには「cyber」という語が0件です。記載がないことは検証しなかった証明にはなりませんが、サイバー特化モデルを同時に出す発表としては気になる欠落です。

3.8 Flash Cyberにはモデルカードがない

そして、より緩い制限で出荷される 3.8 Flash Cyber のほうです。モデルカードのURLも、安全性レポートのURLも、いずれも404でした。

存在するのは4ページの評価手法PDFだけで、中身は性能ベンチマークの測り方だけです。安全性評価もレッドチーミングも悪用対策も書かれていません。


日本のGeminiアプリに「3.8 Flash」という名前は出てこない

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

日本の読者にとっての実務に移ります。ここで大きなずれがありました。

発表ページの対象はProとUltra

Consumers: 3.8 Flash is available to Google AI Pro and Ultra subscribers across the Gemini app, AI Mode in Google Search and Gemini in Google Sheets.

Google AI Pro と Ultra の加入者向け、と書かれています。

日本のプランページには版番号がない

Google One の日本語プランページを開きました。Gemini アプリの中身は「Gemini 3.1 Pro」「Gemini Omni Flash 4」「Flash 思考モード モデル」という呼び方で説明されています。

「3.8 Flash」「3.7 Flash」という文字列は0件でした。読者がアプリを開いても、この名前は見つかりません。

日本での月額は1,450円と2,900円

同じページで確認した2026年9月3日時点の価格です。

  • Google AI Plus(2TB):月額1,450円
  • Google AI Pro(5TB):月額2,900円

なお発表ページが挙げているのは Pro と Ultra だけで、Plus は列挙に入っていません。ただしプランページには Plus でも「Flash 思考モード モデルも利用可能」とあり、Plus が対象外だと断定できる記述はGoogleのどこにもありませんでした。

日本語ドキュメントは6週間遅れている

開発者向けの日本語ドキュメントも確認しました。料金ページの日本語版に載っている最新のFlashは3.6 Flashで、リリースノートの日本語版の最新項目は2026年7月21日です。英語版は9月2日まで更新されています。差は43日です。

しかもページのHTMLは「ja-x-mtfrom-en」、つまり英語からの機械翻訳で、ページ自身が「AI 翻訳には誤りが含まれる場合があります」と注記しています。

価格やモデル情報は、英語版で確認する必要があります。


読者が今日できること。無料枠で試して、3.7と比べる

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

ここまでを実際の行動に落とします。

Gemini APIの無料枠で試せる

Gemini API の無料枠で 3.8 Flash が使えます。料金ページの無料ティア欄は入力・出力・コンテキストキャッシュとも「Free of charge」です。日本からの利用も提供地域に入っています。

ただし条件があります。無料枠は「Used to improve our products」が「Yes」で、入力が製品改善に使われます。有料枠は「No」です。バッチ・Flex・Google検索によるグラウンディングも無料枠では使えません。

3.7 Flashは廃止されない

3.7 Flash を使い続ける選択肢は残っています。開発者ドキュメントの廃止スケジュールを見ると、3.8・3.7・3.6 のいずれも「No shutdown date announced」です。

Google自身が「効率優先なら3.7 Flashを使い続けろ」と書いているので、慌てて移行する理由はありません。

移行するならthinking_levelへ書き換える

APIで切り替える場合、パラメータの書き換えが必要です。思考量を指定するのは thinking_level で、値は low / medium / high の3段階、既定は medium です。

数値で細かく刻む thinking_budget は廃止され、3段階の選択だけになりました。なお minimal が使えないのは3.8固有ではなく、3.7 Flash の時点ですでに消えています。3.6 Flash までは minimal が選べました。

Google Cloudの東京リージョンは使えない

企業で使う場合の注意点です。Google Cloud での提供リージョンは global と、米国・EU のマルチリージョンだけです。東京リージョンは対象外でした。

ただしこれは 3.7 Flash も 3.6 Flash も同じで、3.8 固有の制約ではありません。データの所在を日本に限定する要件がある案件では、そもそもこの世代のFlashが使えないことになります。


まとめ:Gemini 3.8 Flashについて9月3日時点で確定していること

一次資料で確認できた事実だけを並べます。

Googleは日本時間2026年9月3日0時(協定世界時9月2日15時)に Gemini 3.8 Flash と 3.8 Flash Cyber を公開しました。3.6 Flash から数えて43日、6週間と1日で3世代目です。単価は3世代とも入力0.75ドル・出力3.75ドルで同額。2026年12月31日に導入価格が終わり、1.50ドル・7.50ドルに戻ります。これは値上げではなく、3.6 Flash 発売時の定価への復帰です。

発表ページのHTMLに競合モデルの名前は1件もありません。本文・alt属性・埋め込みデータ・脚注まで含めて0件で、Claude Opus 5 も GPT-5.6 Sol も、グラフ画像の中にだけ実名で描かれています。本文の匿名表現は7箇所で、前世代の3.7 Flash の発表ページには0箇所でした。同じ相手を、Google DeepMind の別ページでは「Fable 5」と実名で書いています。

ただしGoogleは隠していません。比較表では自社が負けている6行を競合側に太字で明示し、CWE-Bench では自社が47.2%で相手の47.8%に届かないことを本文に書いています。グラフには74%相当の点があるのに、表には低いほうの71.0%を載せて競合を勝者にしてもいます。

Google自身が3か所で「トークンを多く使う」と明記し、「効率優先なら3.7 Flash を使い続けろ」と書いています。ただし実測したグラフでは、3.8 Flash が1.96ドル・71.1%という点で、3.7 Flash の最良点(2.01ドル・65.5%)を費用と性能の両方で上回っています。「トークンが増える」ことと「実費が増える」ことは同じではありません。

モデルカードは発表ページからリンクされておらず、そこには「英語以外の言語での安全性能が3.7 Flash から後退した」という記述があります。ただしGoogle自身が「悪化分の大半は誤検知だった」と但し書きを付けています。また3.8 Flash 自体はフロンティア安全性評価にかけられておらず、3.7 Flash の結果からの外挿です。より緩い制限で出荷される 3.8 Flash Cyber には、モデルカードも安全性レポートもありません。

日本の読者にとっては、Google One の日本語ページに「3.8 Flash」という名前が一度も出てこないこと、開発者向け日本語ドキュメントが43日遅れの機械翻訳であること、Google Cloud の東京リージョンで使えないことが実務に効きます。

グラフを画像で出すこと自体は普通です。ただし名前を画像の中にしか置かないと、その情報は検索にも読み上げにも乗りません。

あなたが最後に読んだAIモデルの発表で、比較相手の名前は文字で書かれていましたか。

よくある質問(FAQ)

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

Q1. Gemini 3.7 Flashから乗り換えたほうがいいですか。
用途によります。Google自身が発表ページで「効率が最優先なら3.7 Flashを使い続けろ」と書いており、3.7 Flashに廃止予定はありません(開発者ドキュメントの廃止スケジュールは3.8・3.7・3.6とも「No shutdown date announced」)。ただしGoogleのDeepSWEグラフを実測すると、3.8 Flashの1.96ドル・71.1%という点は3.7 Flashの最良点(2.01ドル・65.5%)より安くて高スコアでした。少なくともこのベンチマークでは3.8が有利です。APIで移行する場合はthinking_levelへの書き換えが要ります。

Q2. 2027年に価格が2倍になるというのは本当ですか。
金額は2倍になりますが、「値上げ」という表現は正確ではありません。現在の0.75ドル・3.75ドルは2026年12月31日までの導入価格で、2027年1月1日から1.50ドル・7.50ドルになります。この1.50ドル・7.50ドルは、3.6 Flashが2026年7月21日に発売されたときの定価そのものです。3.7 Flashの発表時に半額を導入価格として設定し、3.8 Flashがそれを引き継いだ形で、期限が来れば元の水準に戻ります。3.6・3.7・3.8の3世代が同じ日にそろって戻ります。

Q3. 日本のGeminiアプリで3.8 Flashは使えますか。
発表ページは「Google AI ProとUltraの加入者」向けにGeminiアプリ・Google検索のAIモード・Googleスプレッドシートで提供すると書いています。ただしGoogle Oneの日本語プランページには「3.8 Flash」という文字列が0件で、Geminiアプリの中身は「Gemini 3.1 Pro」「Gemini Omni Flash 4」「Flash 思考モード モデル」という別の呼び方で説明されています。アプリを開いてもこの名前は見つからない可能性が高いです。なお月額はGoogle AI Plusが1,450円、Proが2,900円(2026年9月3日時点のGoogle One日本語ページ)。開発者向けにはGemini APIの無料枠でも試せます。

筆者より

この記事は、書こうとした軸が4回訂正されました。

最初は「Googleは都合の悪い数字を隠している」で書くつもりでした。競合名がHTMLに1件もないと分かった時点で、そう読めたからです。比較表の原寸画像を開いて崩れました。Googleは自社が負けている6行を、競合側に太字と網掛けで明示しています。隠すどころか目立たせていました。

「73.7%対74.0%で0.3ポイントの惜敗」も書きかけて崩れました。比較表の実際の値は71.0%で、差は3.0ポイントです。73.7%という数字は原典のどこにも存在しませんでした。10分の1に見誤っていました。

「2027年に2倍の値上げ」も違いました。1.50ドル・7.50ドルは3.6 Flashの発売時定価そのもので、起きるのは半額キャンペーンの終了です。前世代の発表ページを開かなければ、そのまま書いていました。

「トークンを食うので高くつく」も成立しませんでした。グラフのマーカーを座標で取ると、3.8 Flashの安いほうの点が3.7 Flashのどの点よりも安くて高スコアでした。Google自身のグラフと矛盾する原稿になるところでした。

最終的に残ったのは、「競合の名前がHTMLから1件残らず消えていて、画像の中にだけある」という事実です。他社を調べると、OpenAIはHTMLの表に実名で書いて自社の負けも出し、Anthropicは実名で書くが相手をGPT-5.6 Solの1モデルに絞っていました。3社3様で、「Googleだけが匿名化している」も「業界の通例」もどちらも言えません。

言えるのは、Googleだけが競合名をラスタ画像の中にしか置いていないということです。検索にも、スクリーンリーダーにも乗りません。しかも本文で比較を語る匿名表現7箇所は、前世代の発表ページには1つもありませんでした。

いちばん気になったのは、不利な事実がどれも「開かないと見えない場所」にあることです。負けている6行は画像の中、非英語の安全性の後退はリンクのないモデルカードの中、Terminal-benchの数字の食い違いは別ページとの突き合わせでしか見えません。どれも公開されていますが、発表ページを読んだだけの人には届きません。

参考資料

  • Google 公式発表ページ「Introducing Gemini 3.8 Flash and 3.8 Flash Cyber」(生HTML 406,628バイトを取得し、本文・脚注・alt属性・埋め込みJSON・構造化データまで検索。比較表と散布図の原寸画像をダウンロードして目視)
  • Google 公式ブログ「Proactive cyber defense for governments and enterprises」(Fairwind Program、著者 Four Flynn)
  • Google DeepMind Gemini 3.8 Flash モデルカード(PDF 8ページ。安全性評価表、Frontier Safety Assessment、Known Limitations、knowledge cutoff)
  • Google DeepMind Gemini 3.7 Flash / 3.6 Flash モデルカード(警戒閾値の記述、追加検証の有無の比較)
  • Google DeepMind Frontier Safety Framework Version 3.1(2026年4月17日公開。CCL/TCLの定義、再評価の要否)
  • Google DeepMind Gemini 3.8 Flash 評価手法PDF、および 3.8 Flash Cyber の Model evaluation PDF(4ページ)
  • Google DeepMind サイバー向け製品ページ(CWE-Bench の相手を実名で記載)
  • ai.google.dev Gemini API 料金ページ・リリースノート・モデルページ・廃止スケジュール・thinking ドキュメント・レート制限・提供地域(英語版と日本語版の両方を取得して比較)
  • Google Cloud Gemini 3.8 Flash 開発者ガイドおよびロケーション表
  • Google 公式ブログ「Gemini 3.7 Flash」(2026年8月13日)および「Gemini 3.6 Flash」(2026年7月21日)の各発表ページ
  • Google One 日本語プランページ(Google AI Plus / Pro の月額、Geminiアプリのモデル表記)
  • CWE-Bench 公開リーダーボード(Collinear AI 運営、Artificial Analysis が独立評価・公表)
  • Vals AI Harvey’s Legal Agent Benchmark および Finance Agent v2 の公開リーダーボード(全56モデル・55モデルを展開して順位を確認)
  • DeepSWE v1.1 公開リーダーボード(Datacurve 運営)
  • CyberGym 公開リーダーボード(データ実体を取得して全64件を確認)
  • tbench.ai Terminal-Bench 2.1 / 4.0 公開リーダーボード
  • Wiz 公式ブログ「It’s Official: Wiz Joins Google」(2026年3月11日、著者 Assaf Rappaport)
  • OpenAI GPT-5.6 発表ページおよび公式料金ページ(比較表の実名掲載、gpt-5.6-luna / gpt-5.6-cyber の価格)
  • Anthropic「Claude Fable 5.1 and Claude Mythos 5.1」発表ページおよびシステムカード(212ページ、実測)
  • Meta AI Research「Introducing Muse Code and Muse Spark 1.2」(2026年8月5日)
  • ウェブアーカイブに残る発表ページのスナップショット(協定世界時2026年9月2日15時46分13秒)
  • マイナビニュース TECH+(2026年9月3日7時5分)、ITmedia AI+(同7時42分)

※本記事の内容は2026年9月3日午前9時時点の公開情報に基づいています。発表ページの本文表示には日付のみでタイムゾーンの記載がないため、公開時刻は構造化データとRSSの値から換算しています。ベンチマークの数値は各運営元の公開リーダーボードを同日朝に取得した時点のもので、リーダーボードは随時更新されるため現在値と異なる場合があります。グラフから読み取った費用と得点は、画像のグリッド線をもとに座標を計測した推定値で、キャリブレーションの誤差を含みます。日本語ドキュメントの更新状況、Google One の価格表示、日本の各媒体の報道状況は、いずれも同日朝に確認した範囲での記述です。価格は米ドル建ての公式表示によるもので、円建て価格はGoogle One 日本語ページの表示をそのまま記載しています。安全性評価に関する記述は、Google自身が付した但し書きを含めて引用しています。
※本記事について、事実関係の誤りや最新情報の追加などお気づきの点がございましたら、ぜひコメント欄でお知らせください。

Gemini 3.8 Flashの発表に競合の名前は1つもない。画像の中を除いて

この記事が気に入ったら
フォローしてね!

よかったらシェアしてね!
  • URLをコピーしました!

お気軽にコメントどうぞ

コメントする

日本語を含まないコメントはスパム対策のため無視されます。承認後の公開となります。以下の入力欄は任意です。

目次