Google 独自の Android ベンチマーク: Gemini のコストは DeepSeek V4 Flash の 17.5 倍

Google Android Bench リストによると、Gemini 3.5 Flash の単一ランニングコストは 147 ドルであるのに対し、DeepSeek V4 Flash はわずか 8.4 ドルで、価格差は 17.5 倍です。 GPT-5.5が74点で1位となり、国産モデルのGLM、Kimi、DeepSeekがランクインした。

Google 独自のベンチマーク テストが覆される: Gemini のコストは DeepSeek の 17.5 倍

Google は、Android ベンチ リストを更新しました。これは、Android 開発タスクを完了する AI モデルの能力を特に測定するベンチマーク テストであり、開発者がモデルを選択する際の強力な参考値となります。この結果は非常に皮肉なもので、Google が I/O 2026 で「これまでで最も強力な Flash モデル」と主張した Gemini 3.5 Flash は、わずか 63.7 ポイントを獲得し、6 位にランクされました。 1 回の実行の平均コストは $147.1 (約 996 元) に達し、リスト全体の中で最も高価なモデルとなっています。 DeepSeek V4 Flash の 1 回あたりのランニング コストはわずか $8.4 (約 57 元) です。前者は後者の 17.5 倍です。

!【Androidベンチ一覧】(https://res.aistarmap.com/uploads/images/news/temp/md_6a57c2064bee6/images/android-bench.png)

結果とコストの詳細をリストします。

ランキング モデル スコア 旅行ごとの費用
1 GPT-5.5 74.0
2 GPT-5.4 72.4
3 Gemini 3.1 Pro プレビュー 72.4 ~$49
4 クロード作品4.7 68.7
5 クロード作品4.6 66.6
6 ジェミニ 3.5 フラッシュ 63.7 $147.1
7 GLM 5.1 59.7
8 キミ K2.6 58.6
10 ディープシーク V4 プロ 55.4
12 DeepSeek V4 フラッシュ 52.7 $8.4

国内モデルに関しては、GLM 5.1 (59.7 ポイント)、Kimi K2.6 (58.6 ポイント)、DeepSeek V4 Pro (55.4 ポイント) が同時にリストにランクインしており、開発者ツールの分野における中国 AI モデルの総合的な存在感を反映しています。

GoogleはI/O 2026で、Gemini 3.5 Flashエンコード機能はより堅牢で、出力速度は競合する最先端モデルの最大4倍で、一部の内部ベンチマークではGemini 3.1 Proを上回ったと主張していた。しかし、Android Bench の実際の Android 開発シナリオ データでは、まったく異なる結論が得られます。スコアがトップ 5 に入らないだけでなく、価格性能比は DeepSeek V4 Flash にさえ及ばないのです。 Google 独自のベンチマークでさえ、自社モデルの面目を保つことはできません。開発者が自分の足で投票する時代において、メーカーのマーケティングのレトリックは、実際のシナリオからの費用対効果の高いデータによって組織的に改ざんされています。

著作権:コンテンツソース IT ホーム 。このプラットフォームは、情報提供と学習交流の目的でコンテンツを編集・整理しています。著作権に関する問題がございましたら、お問い合わせください。

レビュー

  • レビューを読み込み中...