Gemini 3.8 Live: Neues Google-Modell denkt und spricht simultan

Google erweitert seine Modellfamilie um zwei neue KI-Assistenten. Gemini 3.8 Live und Extended Thinking sollen durch sofortige Sprachverarbeitung und gleichzeitiges Denken natürliche Dialoge ermöglichen sowie komplexe Aufgaben lösen.
Künstliche Intelligenz, Ki, AI, Artificial Intelligence, Gemini, Google Gemini, Google KI

    Zwei neue KI-Modelle von Google

    Google hat den Ausbau seiner Modellfamilie für künstliche Intelligenz bekannt gegeben. Mit Gemini 3.8 Live sowie der Variante Live Extended Thinking führt der Konzern zwei neue Sprachassistenten ein, die ab sofort weltweit für Entwickler und Endanwender bereitstehen. Ziel des Unternehmens ist es, die verbale Interaktion mit Maschinen flüssiger und menschlicher zu gestalten.

    Beide Varianten sind darauf ausgelegt, Audio-Eingaben verzögerungsfrei zu verarbeiten. Während die Standardversion auf Skalierbarkeit und Kosteneffizienz setzt, fokussiert sich das erweiterte Modell auf komplexe Arbeitsabläufe. Google integriert die Technik ab sofort in bestehende Dienste wie die hauseigene Suchmaschine und verschiedene Workspace-Anwendungen.


    Echtzeit-Analyse und Sprachwechsel

    Wie das Unternehmen in einem Blogbeitrag erklärt, verarbeitet Gemini 3.8 Live visuelle Eingaben nahezu in Echtzeit. Das System erkennt laut den Entwicklern Wechsel zwischen 97 unterstützten Sprachen mitten im Gespräch. Ein Vorteil für Nutzer ist die Fähigkeit des Modells, Werkzeuge und API-Aufrufe im Hintergrund auszuführen. So bestätigt die Software Anfragen und führt den Dialog fort, während Aufgaben parallel bearbeitet werden.

    Für anspruchsvollere Aufgaben kommt Gemini 3.8 Live Extended Thinking zum Einsatz. Das Modell soll gleichzeitig denken und sprechen können. Es nutzt verbale Hinweise wie kurze Bestätigungen, um Pausen bei der Lösungsfindung natürlich zu überbrücken. In Leistungstests wie dem Speech to Speech Quality Index belegt das System laut Herstellerangaben vordere Plätze. Auch bei komplexen Aufgaben im Finanzsektor zeigt die Software gute Resultate.

    Verfügbarkeit und Einschränkungen

    Die Standardversion hält dabei in die Google-Suche Einzug. Die Extended-Variante steht hingegen in Gemini Live sowie für Abonnenten der teureren Pro-Tarife und Ultra-Tarife in Gmail, Docs und Keep bereit. Entwickler greifen über die Gemini API auf beide Modelle zu. Geschäftskunden erhalten vorerst nur über eine geschlossene Vorschau Zugriff auf die neuen Funktionen. Um Transparenz zu gewährleisten, versieht Google sämtliche generierten Audio-Inhalte mit SynthID, einem digitalen Wasserzeichen.

    Wie schätzt ihr die Entwicklung bei den Sprachassistenten ein? Nutzt ihr solche KI-Funktionen bereits im Alltag oder überwiegen für euch die Bedenken? Teilt eure Meinung in den Kommentaren!

    Zusammenfassung
    • Google stellt mit Gemini 3.8 Live zwei neue Sprachmodelle offiziell vor
    • Die KI-Systeme verarbeiten Audio- und Video-Eingaben beinahe in Echtzeit
    • Gemini beherrscht fließende Wechsel zwischen insgesamt 97 Sprachen mitten im Dialog
    • Das Extended-Modell überbrückt Denkpausen während komplexer Aufgaben natürlich
    • Verfügbar sind die Modelle ab sofort in der Suche und Workspace-Apps
    • Erzeugte Audio-Inhalte markiert der Konzern mit dem SynthID-Wasserzeichen

    Siehe auch:


    Tipp einsenden
    ❤ WinFuture unterstützen
    Sie wollen online einkaufen? Dann nutzen Sie bitte einen der folgenden Links, um WinFuture zu unterstützen: Vielen Dank!