Heim
Google stellt Gemini 3.1 Flash-Lite vor: Deutliche Leistungssteigerung, Preis verdreifacht sich
Google DeepMind hat offiziell die Vorschau auf „Gemini 3.1 Flash-Lite“ veröffentlicht und damit das schnellste und kosteneffizienteste Modell der Gemini-3-Serie vorgestellt. Aufbauend auf der Grundlage von Gemini 2.5 Flash-Lite erreicht diese Version Geschwindigkeiten von über 360 Token pro Sekunde bei einer durchschnittlichen Antwortzeit von 5,1 Sekunden und bietet gleichzeitig eine erhebliche Verbesserung der Intelligenz. Laut dem Artificial Analysis Intelligence Index ist die Punktzahl des Modells um 12 Punkte auf 34 gestiegen, und es hat auf der Arena.ai-Rangliste mit einer Elo-Zahl von 1432 eine starke Beliebtheit bei den Nutzern gezeigt.

In Schlüsselbereichen wie multimodalen Fähigkeiten und wissenschaftlichem Schlussfolgern zeichnet sich Gemini 3.1 Flash-Lite aus: Es erzielte 86,9 % im GPQA-Diamond-Test und erreichte eine Genauigkeit von 76,8 % im MMMU-Pro-Benchmark. Seine Leistung übertrifft die von Schwergewichten wie Claude Opus 4.6 und Kimi K2.5. Bemerkenswert ist, dass das Modell Entwicklern die Möglichkeit bietet, die „Tiefe“ des logischen Denkens anzupassen, was eine flexible Anpassung an verschiedene Szenarien ermöglicht – von einfachen Übersetzungsaufgaben bis hin zur komplexen UI-Entwicklung.

Diese Leistungs- und Geschwindigkeitsgewinne gehen jedoch mit erheblichen Preisanpassungen einher. Der Preis für eine Million Eingabetoken von Gemini 3.1 Flash-Lite ist auf 0,25 US-Dollar gestiegen, während der Preis für die Ausgabe von 0,40 US-Dollar auf 1,50 US-Dollar gesprungen ist – fast eine Verdreifachung der bisherigen Kosten.
Diese Preisstrategie verdeutlicht den Kostendruck, dem Modellanbieter ausgesetzt sind, wenn sie schnelle Inferenz mit hochpräziser Logik in Einklang bringen müssen. Da das Modell nun auf Google AI Studio und Vertex AI zum Testen verfügbar ist, verlagert sich der Markt für leichtgewichtige Modelle von einem einfachen „Preiswettbewerb“ hin zu einer neuen Ära der „Zugänglichkeit hochleistungsfähiger Logik“.
Verwandter Artikel
U.S.-Aktien erreichen historischen Meilenstein, während KI- und Luft- und Raumfahrtriesen auf ihr Debüt als Billionen-Dollar-Unternehmen vorbereiten
Elon Musk, Sam Altman und Dario Amodei, drei Giganten des Technologiesektors, schreiten den Börsengängen ihrer jeweiligen Unternehmen voran. Mit SpaceX, OpenAI und Anthropic – drei Branchenriesen, die einer Bewertung von einer Billion US-Dollar nahek
Schwedisches KI-Startup Lovable Eyes: Bewertung von 13,2 Milliarden US-Dollar nach großer Finanzierungsrunde
Während KI-gestützte Coding-Tools an Popularität gewinnen, hat das schwedische Startup Lovable eine bedeutende Finanzierungsrunde abgeschlossen. Das Unternehmen strebt danach, 3 Milliarden US-Dollar einzusammeln, was seine Bewertung potenziell auf 13
Google testet den Remy AI Agent für Gemini, da der Fokus auf die Benutzerkontrolle verlagert wird
Laut Business Insider testet Google Remy, einen neuen KI-Personalagenten für Gemini. Dieses Tool soll Aufgaben im Auftrag von Nutzern ausführen und sowohl professionelle Arbeitsabläufe als auch tägliche Routinen optimieren.Derzeit wird Remy in einer
Empfehlungen zu verwandten Spezialthemen
Kommentare (0)
Google DeepMind hat offiziell die Vorschau auf „Gemini 3.1 Flash-Lite“ veröffentlicht und damit das schnellste und kosteneffizienteste Modell der Gemini-3-Serie vorgestellt. Aufbauend auf der Grundlage von Gemini 2.5 Flash-Lite erreicht diese Version Geschwindigkeiten von über 360 Token pro Sekunde bei einer durchschnittlichen Antwortzeit von 5,1 Sekunden und bietet gleichzeitig eine erhebliche Verbesserung der Intelligenz. Laut dem Artificial Analysis Intelligence Index ist die Punktzahl des Modells um 12 Punkte auf 34 gestiegen, und es hat auf der Arena.ai-Rangliste mit einer Elo-Zahl von 1432 eine starke Beliebtheit bei den Nutzern gezeigt.

In Schlüsselbereichen wie multimodalen Fähigkeiten und wissenschaftlichem Schlussfolgern zeichnet sich Gemini 3.1 Flash-Lite aus: Es erzielte 86,9 % im GPQA-Diamond-Test und erreichte eine Genauigkeit von 76,8 % im MMMU-Pro-Benchmark. Seine Leistung übertrifft die von Schwergewichten wie Claude Opus 4.6 und Kimi K2.5. Bemerkenswert ist, dass das Modell Entwicklern die Möglichkeit bietet, die „Tiefe“ des logischen Denkens anzupassen, was eine flexible Anpassung an verschiedene Szenarien ermöglicht – von einfachen Übersetzungsaufgaben bis hin zur komplexen UI-Entwicklung.

Diese Leistungs- und Geschwindigkeitsgewinne gehen jedoch mit erheblichen Preisanpassungen einher. Der Preis für eine Million Eingabetoken von Gemini 3.1 Flash-Lite ist auf 0,25 US-Dollar gestiegen, während der Preis für die Ausgabe von 0,40 US-Dollar auf 1,50 US-Dollar gesprungen ist – fast eine Verdreifachung der bisherigen Kosten.
Diese Preisstrategie verdeutlicht den Kostendruck, dem Modellanbieter ausgesetzt sind, wenn sie schnelle Inferenz mit hochpräziser Logik in Einklang bringen müssen. Da das Modell nun auf Google AI Studio und Vertex AI zum Testen verfügbar ist, verlagert sich der Markt für leichtgewichtige Modelle von einem einfachen „Preiswettbewerb“ hin zu einer neuen Ära der „Zugänglichkeit hochleistungsfähiger Logik“.
U.S.-Aktien erreichen historischen Meilenstein, während KI- und Luft- und Raumfahrtriesen auf ihr Debüt als Billionen-Dollar-Unternehmen vorbereiten
Elon Musk, Sam Altman und Dario Amodei, drei Giganten des Technologiesektors, schreiten den Börsengängen ihrer jeweiligen Unternehmen voran. Mit SpaceX, OpenAI und Anthropic – drei Branchenriesen, die einer Bewertung von einer Billion US-Dollar nahek
Schwedisches KI-Startup Lovable Eyes: Bewertung von 13,2 Milliarden US-Dollar nach großer Finanzierungsrunde
Während KI-gestützte Coding-Tools an Popularität gewinnen, hat das schwedische Startup Lovable eine bedeutende Finanzierungsrunde abgeschlossen. Das Unternehmen strebt danach, 3 Milliarden US-Dollar einzusammeln, was seine Bewertung potenziell auf 13











