Google bringt Gemini 3.8 Flash auf den Markt: Performance nähert sich Spitzenmodell Claude Opus 5, Kosteneffizienz bleibt zentraler Wettbewerbsvorteil

Quelle Tradingkey

TradingKey - Google (GOOGL) hat am 2. September US-Ostküstenzeit zwei neue Modelle veröffentlicht: Gemini 3.8 Flash und Gemini 3.8 Flash Cyber. Dies ist bereits das dritte Modell der Flash-Serie, das Google innerhalb von sechs Wochen auf den Markt bringt. Es setzt die Merkmale hoher Geschwindigkeit und niedriger Kosten des vorherigen Gemini 3.7 Flash fort und baut zugleich die Fähigkeiten in den Bereichen Codegenerierung, komplexes Schlussfolgern, agentische Aufgaben und Cybersicherheit weiter aus.

Ersteres ist für Softwareentwicklung, KI-Agenten und mehrstufige Schlussfolgerungsaufgaben in Fachgebieten positioniert; Letzteres konzentriert sich auf das Erkennen von Schwachstellen sowie deren automatisierte Behebung und steht ausschließlich überprüften, vertrauenswürdigen IT-Sicherheitskräften zur Verfügung.

Obwohl die beiden Modelle auf unterschiedliche Anwendungsfälle abzielen, basieren beide auf demselben zugrunde liegenden KI-Kern und evaluieren sowie optimieren die Modellausgaben wiederholt über langlaufende Agenten-Schleifen.

Gemini 3.8 Flash: Verbessert Long-Horizon-Coding und Agenten-Aufgaben

Das Hauptupgrade von Gemini 3.8 Flash konzentriert sich auf die Bewältigung komplexer, fortlaufender Aufgaben, die mehrstufige Tool-Aufrufe erfordern. Google erklärte, dass die Leistung des Modells in ausgewählten Tests nahezu an die teurerer Flaggschiff-Modelle heranreicht.

Im DeepSWE v1.1 Long-Horizon-Software-Engineering-Benchmark erzielte Gemini 3.8 Flash 73,7 % und lag damit über den 65,3 % von Gemini 3.7 Flash sowie vor den 72,7 % von GPT-5.6 Sol und den 69,6 % von GPT-5.6 Terra; es lag lediglich knapp hinter den 74,0 % von Claude Opus 5.

8-a2b3c0c9f0044ec88039f9ca0ce895fc

Quelle: Google

Auch bei fachspezifischen Aufgaben zeigte Gemini 3.8 Flash eine starke Wettbewerbsfähigkeit. Der Benchmark HLE-Verified umfasst multidisziplinäre Fragen aus Wissenschaft, Technologie, Geisteswissenschaften und Fachwissen; hierbei übertraf Gemini 3.8 Flash ebenfalls Claude Sonnet 5 (31,0 %), GPT-5.6 Terra (51,1 %), Claude Opus 5 (54,4 %) und GPT-5.6 Sol (54,5 %).

Bei der Preisgestaltung behält Gemini 3.8 Flash die ursprünglichen Preise von Gemini 3.7 Flash bei: 0,75 US-Dollar pro Million Input-Tokens und 3,75 US-Dollar pro Million Output-Tokens.

Zum Vergleich: Die Preise für Input- und Output-Tokens liegen bei Claude Opus 5 bei 5 bzw. 25 US-Dollar, bei GPT-5.6 Sol bei 4 bzw. 20 US-Dollar und bei GPT-5.6 Terra bei 2 bzw. 12 US-Dollar.

Das bedeutet, dass Gemini 3.8 Flash in ausgewählten Coding- und Reasoning-Benchmarks an größere Modelle heranreicht oder diese sogar übertrifft – und das zu deutlich geringeren API-Aufruf-Kosten. Für Entwickler, die Code-Agenten, automatisierte Analysen und Unternehmens-Workflows einsetzen möchten, könnte diese Kosteneffizienz das entscheidende Verkaufsargument sein.

Gemini 3.8 Flash Cyber: Fokus auf Schwachstellenerkennung und automatisierte Behebung

Gemini 3.8 Flash Cyber ist ein weiteres wichtiges Modell, das diesmal vorgestellt wurde und primär auf Szenarien der Cybersicherheitsabwehr abzielt. Google gab bekannt, dass das Modell nicht allgemein verfügbar sein wird, sondern über das neue Fairwind-Programm geprüften, vertrauenswürdigen Verteidigungsteams bereitgestellt wird.

Im in der Cybersicherheitsbranche weit verbreiteten CyberGym-Benchmark zur Schwachstellenerkennung erzielte Gemini 3.8 Flash Cyber ein Ergebnis von 86,2 %, was über den 77,5 % von Gemini 3.5 Flash Cyber liegt und zudem GPT-5.6 Sol mit 83,6 %, Mythos 5 mit 83,8 % sowie GPT-5.5-Cyber mit 85,6 % übertrifft.

Bei internen Tests in praxisnahen Szenarien, die 20 Programmiersprachen umfassten, erreichte Gemini 3.8 Flash Cyber eine Erfolgsquote bei der Schwachstellenerkennung von 71,0 % und schnitt damit besser ab als Gemini 3.7 Flash mit 58,9 % und Gemini 3.5 Flash Cyber mit 46,6 %.

Bei der automatisierten Behebung erzielte Gemini 3.8 Flash Cyber im von Collinear durchgeführten CWE-Bench-Test einen Pass@1-Wert von 47,2 %, was nahe an die 47,8 % führender Spitzenmodelle heranreicht, wenngleich Google die niedrigeren Kosten hervorhob.

Haftungsausschluss: Nur zu Informationszwecken. Die bisherige Performance ist kein verlässlicher Indikator für zukünftige Ergebnisse.
placeholder
Goldpreis-Prognose: Fällt Gold nach dem Rutsch unter 4.300 USD weiter, während der US-Iran-Konflikt die Ölpreise nach oben treibt?TradingKey – Im asiatischen Handel am 2. September fielen die Goldpreise (XAUUSD) intraday unter 4.300 US-Dollar auf ein Tief von 4.282,45 US-Dollar, wobei der jüngste Kurs bei rund 4.320 US-Dollar ve
Autor  Mitrade Team
vor 10 Stunden
TradingKey – Im asiatischen Handel am 2. September fielen die Goldpreise (XAUUSD) intraday unter 4.300 US-Dollar auf ein Tief von 4.282,45 US-Dollar, wobei der jüngste Kurs bei rund 4.320 US-Dollar ve
placeholder
WTI-Preisprognose: Steigt über 86,00 USD, da der Ausbruch über den 100-Tage-SMA ins Spiel kommtWest Texas Intermediate (WTI) – der Benchmark-Preis für US-Rohöl – zieht am Dienstag zum zweiten Mal in Folge Käufer an, da eskalierende Spannungen zwischen den USA und dem Iran sowie die Pattsituation um die Straße von Hormus weiterhin Sorgen um die Angebotsseite schüren.
Autor  FXStreet
Gestern 07: 34
West Texas Intermediate (WTI) – der Benchmark-Preis für US-Rohöl – zieht am Dienstag zum zweiten Mal in Folge Käufer an, da eskalierende Spannungen zwischen den USA und dem Iran sowie die Pattsituation um die Straße von Hormus weiterhin Sorgen um die Angebotsseite schüren.
placeholder
Goldpreis-Prognose: Kann Gold weiter steigen, während die Fed-Zinserhöhungserwartungen anziehen und sich der US-Iran-Konflikt zuspitzt?TradingKey – Im asiatischen Handel am 31. August setzten die Goldpreise heute (XAUUSD) ihren Rückgang vom vergangenen Freitag fort und fielen im Tagesverlauf kurzzeitig unter 4.400 US-Dollar auf ein T
Autor  Mitrade Team
Mo. 31.Aug
TradingKey – Im asiatischen Handel am 31. August setzten die Goldpreise heute (XAUUSD) ihren Rückgang vom vergangenen Freitag fort und fielen im Tagesverlauf kurzzeitig unter 4.400 US-Dollar auf ein T
placeholder
Bitcoin-Preisprognose: Fed-Chef Warsh gibt Debüt in Jackson Hole, kann BTC die 83.000 USD durchbrechen?TradingKey – Fed-Chef Warsh gibt Jackson-Hole-Debüt: Kann Bitcoin das Momentum nutzen, um den starken Widerstand bei 83.000 US-Dollar zu durchbrechen?Am 28. August schwankte der Kurs von Bitcoin (BTC)
Autor  Mitrade Team
Fr. 28.Aug
TradingKey – Fed-Chef Warsh gibt Jackson-Hole-Debüt: Kann Bitcoin das Momentum nutzen, um den starken Widerstand bei 83.000 US-Dollar zu durchbrechen?Am 28. August schwankte der Kurs von Bitcoin (BTC)
placeholder
WTI fällt unter 81,00 USD, da Gespräche zwischen Iran und Oman Hoffnungen auf eine Wiedereröffnung der Straße von Hormus schürenWest Texas Intermediate (WTI), die US-Rohöl-Benchmark, notiert am Donnerstag in den frühen europäischen Handelsstunden bei rund 80,90 USD. WTI rutscht ab, da die Hoffnungen auf eine Wiedereröffnung der Straße von Hormus angesichts diplomatischer Bemühungen unter Beteiligung des Iran und Omans wachsen.
Autor  FXStreet
Do. 27.Aug
West Texas Intermediate (WTI), die US-Rohöl-Benchmark, notiert am Donnerstag in den frühen europäischen Handelsstunden bei rund 80,90 USD. WTI rutscht ab, da die Hoffnungen auf eine Wiedereröffnung der Straße von Hormus angesichts diplomatischer Bemühungen unter Beteiligung des Iran und Omans wachsen.
goTop
quote