Kategorien

HIER IST GEMINI 3.6 FLASH, BEI DEM DIE KOSTENEFFIZIENZ IM MITTELPUNKT STEHT

Die Kosten niedrig zu halten und eine möglichst optimale Token-Verwaltung zu erreichen, ist derzeit das vorrangige Ziel von Google.
DemonDani
DemonDani
Hier ist Gemini 3.6 Flash, bei dem die Kosteneffizienz im Mittelpunkt steht

Die zunehmende Beliebtheit der chinesischen Sprachmodelle „ scheint die Entwicklungstrends grundlegend zu verändern. In den letzten Wochen lässt sich bei den meisten Neuheiten bereits beobachten, dass man bestrebt ist, die Effizienz zu steigern, wobei natürlich auch die Leistungsverbesserung weiterhin eine wichtige Rolle spielt. Nun sind gleich mehrere effiziente Gemini-Varianten auf den Markt gekommen.

Gemini 3.6 Flash

Google hat Gemini aktualisiert: Nach Version 3.5 ist nun die Version 3.6 erschienen, und wie schon bei der Vorgängerversion wurde auch hier zunächst die Flash-Variante in Betrieb genommen. Im Laufe der Entwicklung standen die Stärkung der Programmierfähigkeiten, die Verbesserung der wissensbasierten Arbeit und der multimodale Betrieb im Mittelpunkt. Interessant ist darüber hinaus, dass der Ressourcenverbrauch deutlich gesunken ist und das Modell während seiner Arbeit weniger Token verbraucht. 

Galerie öffnen

Laut dem Artificial Analysis Index verbraucht es 17 Prozent weniger Token als zuvor das Modell „Gemini 3.5 Flash“. Je nach Aufgabe und Herausforderung kann der Unterschied jedoch sogar noch deutlich dramatischer ausfallen. So lief es beispielsweise unter DeepSWE bereits mit 65 % weniger Token.

Dank verschiedener Weiterentwicklungen benötigt das neue Gemini 3.6 Flash-Modell auch bei mehrstufigen Arbeitsabläufen weniger Inferenzschritte und Tool-Aufrufe. Durch die Effizienzsteigerung konnte Google sogar die Preise senken. Auf der Eingabeseite kostet die Verarbeitung von 1 Million Token bei Gemini 3.6 Flash weiterhin 1,5 Dollar, auf der Ausgabeseite gelang es dem Unternehmen jedoch, den Preis von zuvor 9 Dollar auf 7,5 Dollar zu senken. Bei ähnlicher Preisgestaltung lassen sich auch die ebenfalls neuen Modelle GPT-5.6 Luna und Grok 4.5 einsetzen, und die Leistung ist vergleichbar. 

Im Rahmen des MLE-Bench-Tests erreichte Gemini 3.6 Flash 63,9 Prozent, während GPT-5.6 Luna nur 47,6 % und Grok 4.5 lediglich 43,2 % erzielten. Im Gegensatz dazu weist es im SWE-Bench Pro lediglich eine Erfolgsquote von 58,7 % auf, während das GPT-5.6 Luna (62,7 %) und das Grok 4.5 (64,7 %) eine deutlich bessere Leistung vorweisen können. Den OSWorld-Test, der die Computerbedienung misst, schloss es mit 83 Prozent erneut an der Spitze ab, während GPT-5.6 Luna nur eine Erfolgsquote von 72,6 % erreichte.

Galerie öffnen

Bei Programmieraufgaben wird Gemini 3.6 Flash eine höhere Genauigkeit gewährleisten und dabei mit weniger unnötiger Code-Bearbeitung sowie einem zurückhaltenderen Ausführungszyklus auskommen. Google wies zudem darauf hin, dass großer Wert auf Sicherheit gelegt wurde. Es gibt Schutzmaßnahmen sowohl gegen Missbrauch im Zusammenhang mit chemischen, biologischen und nuklearen Waffen als auch gegen Cyberkriminalität.

Gemini 3.5 Flash-Lite und Flash Cyber

Google bringt zudem eine weiter vereinfachte Variante von Gemini 3.5 Flash auf den Markt, die den Zusatz „Lite“ trägt und trotz minimaler Verzögerung in der Lage ist, Antworten von sehr hoher Qualität zu liefern. Dies wird sich sowohl für Übersetzungsaufgaben als auch für die Dokumentenverarbeitung und für Agent-Aufgaben gut eignen. 

Galerie öffnen

Gemini 3.5 Flash-Lite erreicht im SWE-Bench-Pro-Test immer noch eine Leistung von 54,2 % und übertrifft damit das noch gar nicht so alte Modell Gemini 3 Flash (42,6 %), obwohl es deutlich teurer ist. Im OSWorld-Verified-Test schloss es mit einer Erfolgsquote von 74 % ab und liegt damit immer noch vor dem GPT-5.6 Luna (72,6 %). 

Galerie öffnen

Mit diesem Modell kostet die Verarbeitung von 1 Million Token an Informationen nur noch 0,3 Dollar, die Erstellung derselben Datenmenge hingegen bereits 2,5 Dollar. Dafür zeichnet es sich durch eine deutlich höhere Effizienz aus, sodass bei der Nutzung insgesamt mehr Geld eingespart werden kann. Zudem lässt sich damit sehr reibungslos arbeiten, da es laut dem Artificial Analysis Index in der Lage ist, 350 Token in nur einer Sekunde zu generieren.

Das Gemini 3.5 Flash Cyber-

Google hat außerdem das Modell „Gemini 3.5 Flash Cyber“ vorgestellt, das sich auf Cybersicherheit konzentriert und integriert mit dem Programmier-Sicherheitsagenten CodeMender genutzt werden kann. Dieses Tool wurde bereits so optimiert, dass es Software-Schwachstellen erkennt, überprüft und behebt. 

Innerhalb des CodeMender-Systems können mehrere Gemini 3.5 Flash Cyber-Agenten parallel laufen, um einen zusammengefassten Sicherheitsbericht zu erstellen; laut Google liefert das Modell beim CyberGym-Test eine erstklassige Leistung. Es weist eine Erfolgsquote von 83,2 % auf, während die deutlich größeren Modelle GPT-5.6 Sol und Mythos 5 nur geringfügig besser abschneiden – ihr Vorsprung beträgt weniger als 1 %. Lediglich das GPT-5.5-Cyber hat einen nennenswerten Vorsprung und erzielte ein Ergebnis von 85,6 %. 

Galerie öffnen

Aber wo bleibt denn nun das Gemini 3.5 Pro? Google hatte schon viel früher versprochen, das Pro-Modell aus der Gemini-3.5-Familie auszuliefern, doch es ist immer noch nicht erhältlich. Das Unternehmen gibt an, dass die Tests mit den Partnern derzeit laufen; es hat das Modell nicht vergessen, sondern die Entwicklung wurde lediglich von den neuesten Trends überholt. Schließlich haben wir sogar erfahren, dass das Unternehmen an der Gemini-4-Modellreihe arbeitet. Die Vorab-Trainingsphase läuft bereits, und das Modell wird voraussichtlich noch in diesem Jahr auf den Markt kommen.

Für den Newsletter anmelden
Mit meiner Registrierung akzeptiere ich die Nutzungsbedingungen und die Datenschutzerklärung.

Wir empfehlen Ihnen gerne

    Tests

      Diesbezügliche Artikel

      Zurück zum Seitenanfang