Bessere Tracks mit Lyria 3.5 in Gemini: Googles Musik-KI wird alltagstauglich
Ausdrucksstärkere Vocals, längere Tracks, neue Templates: und jetzt für alle nutzbar
Text: WILD Redaktion ·

Google hat Lyria 3.5 in die Gemini-App gebracht. Das Musik-KI-Modell verspricht ausdrucksstärkere Vocals, reichhaltigere Arrangements und Tracks mit bis zu drei Minuten Länge. Nachdem es einen Monat lang nur in Google Flow Music verfügbar war, können nun alle Nutzer weltweit darüber Songs generieren.
Google hat am 4. September 2026 ein großes Versprechen gemacht: Lyria 3.5, das leistungsstärkste Musikgenerierungsmodell des Unternehmens, soll jetzt für alle nutzbar sein. Das Modell ist seit diesem Datum in der Gemini-App auf dem Web und in der mobilen Anwendung verfügbar. Wer ein Google-Konto besitzt, kann theoretisch sofort damit beginnen, Musik zu erzeugen.
Was sich nach einem einfachen Update anhört, hat durchaus Gewicht. Eine ganze Generation von KI-Musiksystemen hat sich in den vergangenen Jahren entweder als Spielerei entpuppt oder als professionelles Werkzeug etabliert. Google tritt mit Lyria 3.5 explizit in die Arena ein, in der bereits Suno, Udio und andere Anbieter um die Gunst von Musikschaffenden buhlen.
Der entscheidende Unterschied: Google stellt das Modell über die bestehende Gemini-App bereit, statt es einer separaten Spezialplattform vorzubehalten. Musikgenerierung wird damit vom Nischenprodukt zur Funktion, die keine zusätzliche Anwendung mehr erfordert. Das allein macht den Schritt bemerkenswert, unabhängig davon, wie gut das Ergebnis am Ende klingt.
🟨 WAS LYRIA 3.5 ÜBERHAUPT IST
Um zu verstehen, was Google hier anbietet, lohnt sich ein Blick auf die technische Grundlage. Lyria 3.5 ist ein Musikgenerierungsmodell, das aus einem Text-Prompt hochwertiges Audio synthetisiert. Man gibt also eine Beschreibung ein, etwa "melancholischer Akustik-Pop mit weiblichem Gesang", und das System erzeugt einen fertigen Track.
Die DeepMind-Modellkarte vom 29. Juli 2026 bezeichnet Lyria 3.5 als das "most capable music generation model to date", das leistungsfähigste Musikgenerierungsmodell, das Google je gebaut hat. Das ist eine klare Selbstbewertung, die man mit der nötigen Distanz lesen sollte.
Googles Formulierungen in Pressemitteilungen sind selten zurückhaltend. Aber die technische Architektur deutet tatsächlich auf einen erheblichen Sprung gegenüber früheren Versionen hin.
Das Modell wurde erstmals am 29. Juli 2026 in Google Flow Music vorgestellt, einer Plattform, die sich speziell an Künstler und KI-Kreative richtet. Der breitere Launch in der Gemini-App folgte gut einen Monat später, am 4.
September 2026. Damit ist Lyria 3.5 erstmals für ein Massenpublikum verfügbar, nicht nur für Nutzer einer spezialisierten Anwendung.
Wer die Gemini-App auf dem Smartphone hat oder den Webbrowser öffnet, findet dort nun einen Bereich, in dem sich Musik erzeugen lässt. Das ist ein erheblicher Unterschied zu den Wochen davor, als das Modell nur über einen separaten Dienst zugänglich war.
🟨 DIE WICHTIGSTEN NEUERUNGEN GEGENÜBER ZUVOR
Die Frage, was Lyria 3.5 besser macht als vorherige Versionen, lässt sich anhand der verfügbaren Informationen recht klar beantworten. Google selbst nennt drei zentrale Verbesserungen: ausdrucksstärkere Vocals, reichhaltigere musikalische Arrangements und eine höhere Klangtreue. In der Ankündigung für Google Flow Music, wo das Modell zuerst erschien, war zudem von Fortschritten bei Musikalität, Texten und kreativer Kontrolle die Rede. Nutzer können dort Tempo und Dauer beeinflussen.
Ob diese Kontrollmöglichkeiten in der Gemini-App ebenfalls zur Verfügung stehen, geht aus den verfügbaren Quellen nicht eindeutig hervor. Die App-Oberfläche richtet sich offenkundig stärker an Gelegenheitsnutzer als an Profis. Die Änderungen gegenüber dem, was Suno, Udio oder andere Dienste derzeit bieten, sind damit noch nicht abschließend bewertet.
Ein direkter Vergleich erfordert entweder eigene Tests oder zumindest eine systematische Gegenüberstellung, die anhand der vorliegenden Ankündigungen nicht möglich ist. Was sich sagen lässt: Google hat die Messlatte in der KI-Musikbranche mit dem Anspruch höher gelegt, ausdrucksstarke Vocals und vollständige Songstrukturen zu erzeugen. Die Frage ist, ob die Ergebnisse diesem Anspruch in der Praxis gerecht werden.
🟨 GENRE, STIL UND DIE NEUEN TEMPLATES
Die konkreten Funktionen in der Gemini-App verdienen einen genauen Blick. Laut dem Google-Blog lässt sich das Genre in der App einfach auswählen oder frei beschreiben. Man kann also entweder auf eine Dropdown-Liste zurückgreifen oder direkt eingeben, was man sich vorstellt. Ergänzend gibt es die Wahl zwischen Vocal- und Instrumental-Stil, was die Grundfrage "Mit Gesang oder ohne" sofort beantwortet.
Besonders interessant sind die neuen Templates, die Google als Einstiegshilfe positioniert. Sie richten sich an Nutzer, die nicht erst einen langen Prompt schreiben wollen, sondern schnell zu einem brauchbaren Ergebnis kommen möchten. Beispiele sind Hintergrundmusik für Videos, Geburtstags-Tracks und ähnliche Anlässe. Google nennt als konkrete Anwendungsfälle einen individuellen Backing-Track für ein Video, einen Marken-Jingle und einen personalisierten Klingelton.
Das klingt nach einem Werkzeugkasten für Alltagssituationen, nicht nach einem Instrument für Studioproduktionen. Das ist vermutlich beabsichtigt. Die breite Masse der Gemini-Nutzer sucht keine professionelle Komposition, sondern eine schnelle Lösung für ein konkretes Problem.
Die Templates senken die Einstiegshürde spürbar. Man muss nicht wissen, wie man einen guten Prompt formuliert, wenn einem das System bereits Kategorien und Vorlagen an die Hand gibt. Ob die Qualität der Ergebnisse bei den Templates besonders hoch ist oder ob sie eher als Grundgerüst dienen, lässt sich anhand der vorliegenden Informationen nicht beurteilen.
🟨 TRACKLÄNGE UND KLANGQUALITÄT
Die technischen Parameter sind ein zentraler Punkt für jeden, der KI-Musik ernsthaft nutzen will. Die DeepMind-Modellseite bestätigt, dass sich mit Lyria 3.5 Tracks von bis zu drei Minuten Länge erzeugen lassen. Drittquellen ergänzen, dass die Tracks in High-Fidelity-Stereo ausgegeben werden und vollständige Songs mit Strophen, Refrains und Bridges umfassen können.
Das ist ein deutlicher Fortschritt gegenüber vielen früheren KI-Musikmodellen, die oft bei 30 Sekunden oder einer Minute aufhörten. Drei Minuten sind zwar immer noch kein vollwertiger Song, aber deutlich brauchbarer als ein kurzer Clip. Ob sich die Dauer in der Praxis frei wählen lässt oder ob es feste Stufen gibt, ist nicht abschließend geklärt. Der Google-Blog spricht allgemein von der Möglichkeit, zwischen kurzen und längeren Tracks zu wählen, nennt aber keine konkreten Intervalle.
Die Frage der Klangqualität ist eng damit verknüpft. Google bezeichnet Lyria 3.5 als das "best-sounding music generation model", das klanglich beste Modell, das das Unternehmen je gebaut hat. Das ist eine Selbsteinschätzung, die kritisch einzuordnen ist. Ohne eigene Hörproben lässt sich nicht beurteilen, wie groß der Sprung gegenüber Suno, Udio oder den eigenen Vorgängerversionen tatsächlich ausfällt.
Die technischen Voraussetzungen für hochwertige Ausgabe sind offenbar gegeben. Was das im direkten Vergleich bedeutet, muss ein praktischer Test zeigen.
🟨 ÄNDERUNGEN IM WORKFLOW UND BEDIENUNG
Google hat Lyria 3.5 nicht nur technisch überarbeitet, sondern auch die Art und Weise, wie Nutzer mit dem Modell interagieren, neu gestaltet. In der Gemini-App gibt es keine komplexe Konfigurationsoberfläche, sondern einen geführten Prozess. Nutzer wählen zuerst ein Genre oder beschreiben es, entscheiden sich für Vocal oder Instrumental, wählen gegebenenfalls ein Template und erhalten dann den generierten Track. Das erinnert an einen Assistenten, der den Nutzer durch den Prozess führt.
Die API-Variante richtet sich hingegen an Entwickler, die Lyria 3.5 in eigene Anwendungen integrieren wollen. Dort stehen andere Parameter im Vordergrund als in der App. Entwickler können über das Google AI Studio auf das Modell zugreifen und es mit eigenen Eingaben steuern.
Die Frage, ob die generative Kontrolle über Tempo, Dauer und andere Parameter in der App wirklich zur Verfügung steht, lässt sich anhand der vorliegenden Quellen nicht sicher beantworten. Fest steht, dass Google Flow Music, wo das Modell einen Monat früher startete, explizit mehr Kontrolle für Künstler verspricht. Es ist denkbar, dass die Gemini-App bewusst vereinfacht wurde, um die Masse der Nutzer nicht zu überfordern.
Für professionelle Anwendungen dürfte ohnehin der Weg über Flow Music oder die API die bessere Wahl sein. Die App deckt offensichtlich einen anderen Anwendungsfall ab.
🟨 VERFÜGBARKEIT: GEMINI, API, AI STUDIO, FLOW MUSIC
Die Frage, wo man Lyria 3.5 heute nutzen kann, lässt sich anhand der verfügbaren Informationen recht präzise beantworten. Die Gemini-App auf dem Web und für mobile Geräte bietet den breitesten Zugang. Dort ist das Modell seit dem 4. September 2026 für alle Nutzer weltweit verfügbar, wie Google in seinem Blog bestätigt.
Für Künstler und KI-Kreative bietet Google Flow Music eine spezialisierte Umgebung mit mehr Kontrolle über den kreativen Prozess. Flow Music hat Lyria 3.5 bereits am 29. Juli 2026 erhalten, gut einen Monat vor der breiten Verfügbarkeit in Gemini.
Entwickler können das Modell über das Google AI Studio und die Gemini-API ansprechen und in eigene Projekte einbinden. Die API-Variante eröffnet technische Möglichkeiten, die in der App nicht zur Verfügung stehen.
Die Frage, ob die Nutzung in der Gemini-App kostenlos möglich ist, lässt sich anhand der offiziellen Quellen nicht zweifelsfrei klären. Der Google-Blog vom 4. September 2026 macht keine Angaben zu Kosten. Einzelne Drittquellen berichten von einem kostenfreien Zugang für alle Gemini-Nutzer, aber eine Bestätigung durch Google liegt nicht vor.
Bei der API verhält es sich anders: Dort werden laut Berichten Preise pro generiertem Song fällig, wobei die genauen Konditionen nicht offiziell bestätigt sind. Wer Lyria 3.5 professionell nutzen will, sollte die aktuellen Preisinformationen direkt bei Google prüfen, bevor er Pläne darauf aufbaut.
🟨 WAS NOCH OFFEN BLEIBT
Trotz der detaillierten Ankündigungen bleiben einige wichtige Fragen unbeantwortet. Die kommerziellen Nutzungsbedingungen für die API hat Google im Blogbeitrag nicht veröffentlicht. Drittquellen nennen unterschiedliche Beträge, etwa 0,08 US-Dollar pro Song, aber diese Angaben stammen nicht vom Hersteller selbst und können nicht als verlässlich eingestuft werden. Wer Lyria 3.5 geschäftlich nutzen möchte, sollte die offiziellen Preislisten abwarten oder direkt bei Google erfragen.
Ebenso offen ist die Frage der unterstützten Sprachen. Ob Lyria 3.5 auch deutsche, spanische oder andere nicht-englische Gesangsstimmen erzeugen kann, geht aus den verfügbaren Quellen nicht hervor. Die DeepMind-Modellkarte und der Google-Blog schweigen sich dazu aus. Für Nutzer außerhalb des englischsprachigen Raums ist das ein erheblicher Unsicherheitsfaktor.
Auch die Frage, ob die Gemini-App Bildvorlagen für die Musikgenerierung akzeptiert, lässt sich nicht abschließend klären. Für die API und das AI Studio berichten Drittquellen die Möglichkeit, bis zu zehn Bilder als Eingabe zu nutzen. Ob das auch für die App gilt, hat Google nicht kommuniziert. Solche Einschränkungen sind bei neuen KI-Modellen nicht ungewöhnlich, aber sie machen einen Unterschied, wenn man konkret plant, das Modell einzusetzen.
🟨 FÜR WEN LOHNT SICH LYRIA 3.5?
Die ehrliche Antwort auf diese Frage hängt stark davon ab, was man erwartet. YouTuber und Social-Media-Creator, die regelmäßig Hintergrundmusik für ihre Videos brauchen, könnten von Lyria 3.5 profitieren. Die Templates für Hintergrundmusik richten sich genau an diese Zielgruppe. Wie die Nutzungs- und Lizenzbedingungen für generierte Tracks konkret aussehen, hat Google bislang nicht im Detail erläutert.
Ob die Qualität für den professionellen Einsatz ausreicht, muss jeder für sich entscheiden. Songwriter und Hobby-Musiker, die schnell eine melodische Idee festhalten wollen, finden in dem Modell ein Werkzeug, das den Einstieg erleichtert. Man beschreibt, was man sich vorstellt, und erhält einen Ausgangspunkt, den man weiterentwickeln kann. Das ersetzt keine eigene Produktion, aber es kann den Weg dorthin verkürzen.
Professionelle Musiker, die bereits Google Flow Music nutzen, profitieren von den Verbesserungen bei Vocals und Arrangements. Für sie dürfte die Frage im Vordergrund stehen, ob sich die neue Klangqualität in ihrem Workflow bemerkbar macht. Ob das Modell einen Platz in einem ernsthaften Produktionsprozess verdient, hängt davon ab, wie nah es an professionelle Ergebnisse herankommt.
Drei Minuten Länge und vollständige Songstrukturen sind ein Fortschritt, aber noch kein Ersatz für eine vollständige DAW-Produktion. Lyria 3.5 ist ein Werkzeug für den Anfang, nicht für das Ende. Es hilft dabei, Ideen zu finden und erste Versionen zu erstellen. Was danach kommt, erfordert nach wie vor menschliche Arbeit.