Googles eigener Android-Benchmark: Gemini kostet 17,5-mal so viel wie DeepSeek V4 Flash

Die Google Android Bench-Liste zeigt, dass die einzelnen laufenden Kosten für Gemini 3.5 Flash 147 US-Dollar betragen, während DeepSeek V4 Flash nur 8,4 US-Dollar kostet, was einem 17,5-fachen Preisunterschied entspricht. GPT-5.5 belegte mit einer Punktzahl von 74 den ersten Platz, und die einheimischen Models GLM, Kimi und DeepSeek schafften es gemeinsam auf die Liste.

Googles eigener Benchmark-Test wurde gekippt: Gemini kostete das 17,5-fache von DeepSeek

Google hat die Android Bench-Liste aktualisiert – ein Benchmark-Test, der speziell die Fähigkeit von KI-Modellen misst, Android-Entwicklungsaufgaben zu erledigen, und der einen starken Referenzwert für Entwickler bei der Auswahl von Modellen darstellt. Die Ergebnisse sind ziemlich ironisch: Gemini 3.5 Flash, das Google auf der I/O 2026 hochkarätig als „das bisher leistungsstärkste Flash-Modell“ bezeichnete, erreichte nur 63,7 Punkte und belegte den sechsten Platz. Die durchschnittlichen Kosten für eine einzelne Fahrt belaufen sich auf bis zu 147,1 USD (ca. 996 Yuan), was es zum teuersten Modell in der gesamten Liste macht. Die einmaligen Betriebskosten von DeepSeek V4 Flash betragen nur 8,4 $ (ca. 57 Yuan) – ersteres ist 17,5-mal letzteres.

Android-Bench-Liste

Ergebnisse und Kostendetails auflisten:

Rangliste Modell Ergebnis Kosten pro Fahrt
1 GPT-5.5 74,0
2 GPT-5.4 72,4
3 Gemini 3.1 Pro-Vorschau 72,4 ~49 $
4 Claude Opus 4.7 68,7
5 Claude Opus 4.6 66,6
6 Gemini 3.5 Flash 63,7 147,1 $
7 GLM 5.1 59,7
8 Kimi K2.6 58,6
10 DeepSeek V4 Pro 55,4
12 DeepSeek V4 Flash 52,7 8,4 $

Bei den inländischen Modellen standen GLM 5.1 (59,7 Punkte), Kimi K2.6 (58,6 Punkte) und DeepSeek V4 Pro (55,4 Punkte) gleichzeitig auf der Liste, was die kollektive Präsenz chinesischer KI-Modelle im Bereich der Entwicklertools widerspiegelt.

Google hatte auf der I/O 2026 behauptet, dass die Flash-Kodierungsfunktionen von Gemini 3.5 robuster seien, mit Ausgabegeschwindigkeiten, die bis zu viermal so hoch seien wie bei konkurrierenden Spitzenmodellen, und dass sie Gemini 3.1 Pro in einigen internen Benchmarks übertrafen. Die realen Android-Entwicklungsszenariodaten von Android Bench lassen jedoch ein völlig anderes Ergebnis zu: Nicht nur schafft es die Punktzahl nicht in die Top 5, auch das Preis-Leistungs-Verhältnis wird von DeepSeek V4 Flash sogar zunichte gemacht. Selbst Googles eigene Benchmarks können den eigenen Modellen nicht das Gesicht wahren. In einer Zeit, in der Entwickler mit den Füßen abstimmen, wird die Marketingrhetorik der Hersteller systematisch durch kostengünstige Daten aus realen Szenarien verfälscht.

Urheberrecht: Inhaltquelle IT-Heim . Diese Plattform hat den Inhalt für Informationszwecke und Lernaustausch zusammengestellt. Bei Urheberrechtsbedenken kontaktieren Sie uns bitte.

Bewertungen

  • Bewertungen werden geladen...