TL;DR

Nowy model: Google wprowadziło Lyrię 3 Pro, model generowania muzyki oparty na sztucznej inteligencji, który tworzy pełne trzyminutowe utwory ze świadomością kompozycji strukturalnej. Wdrożenie platformy: model jest dostępny na sześciu platformach, w tym w aplikacji Gemini, Google Vids, ProducerAI, Vertex AI, Gemini API i AI Studio. Podejście dotyczące praw autorskich: Google przeszkolił Lyrię 3 Pro w zakresie danych licencjonowanych i dozwolonych, odróżniając ją od konkurentów Suno i Udio, którzy stanęli w obliczu procesów sądowych dotyczących praw autorskich. Funkcje bezpieczeństwa: każda wygenerowana ścieżka zawiera znaki wodne SynthID umożliwiające identyfikację treści generowanych przez sztuczną inteligencję w kanałach dystrybucji.

Zaledwie miesiąc po debiucie Lyrii 3 z 30-sekundowym limitem, Google wypuścił w środę Lyrię 3 Pro. Model generowania muzyki tworzy pełne trzyminutowe utwory ze strukturalną świadomością wstępów, zwrotek, refrenów i przejść, co stawia go w bezpośredniej konkurencji ze start-upami muzycznymi opartymi na sztucznej inteligencji, Suno i Udio.

Sześciokrotny wzrost czasu trwania utworu przenosi ofertę Google z nowatorskich klipów na obszary przydatne dla twórców treści i zastosowań komercyjnych. Google po raz pierwszy wprowadził generowanie muzyki do Gemini za pomocą Lyrii 3 w lutym 2026 r., oferując kontrolę stylu, wokalu i tempa oraz automatyczne generowanie tekstów. Wraz z ekspansją Lyria 3 Pro na platformy konsumenckie, korporacyjne i twórcze, firma dokonuje najbardziej agresywnego kroku w dotychczasowej historii muzyki generowanej przez sztuczną inteligencję.

Lyria 3 Pro dodaje kompozycję strukturalną i znak wodny

Świadomość składu strukturalnego stanowi podstawowy postęp techniczny Lyrii 3 Pro. Użytkownicy mogą teraz określać elementy struktury utworu, takie jak wstępy, zwrotki, refreny, przejścia i przejścia bezpośrednio w podpowiedziach, definiując muzyczny łuk kompozycji zamiast otrzymywać pojedynczą ciągłą pętlę.

Poprzednie wersje Lyrii generowały muzykę jako niezróżnicowany blok audio bez rozróżniania części utworu. Podpowiedzi strukturalne Lyrii 3 Pro pozwalają użytkownikom określić, gdzie zwrotka przechodzi w refren lub gdzie powinien pojawić się łącznik. Ta szczegółowość zapewnia producentom wideo i twórcom treści lepszą kontrolę, zmniejszając potrzebę ręcznej edycji dźwięku wygenerowanego przez sztuczną inteligencję po fakcie.

Połączenie dłuższego czasu trwania z kontrolą strukturalną sprawia, że ​​Lyria 3 Pro jest bliżej jakości wyjściowej, jakiej wymaga profesjonalna produkcja treści. Podczas gdy konkurenci tacy jak Suno i Udio skupili się na generowaniu chwytliwych haczyków i kompletnych utworów, Google kładzie nacisk na strukturę kompozycyjną ukierunkowaną na inny przypadek użycia: muzykę w tle, ścieżki dźwiękowe wideo i adaptacyjny dźwięk, w którym ścieżka muzyczna musi pasować do treści wizualnych lub interaktywnych.

Doskonała muzyka w tle dla stanu flow o 2 w nocy – stworzona za pomocą nowej Lyrii 3 Pro. Subskrybenci Google AI mogą wypróbować tę funkcję w @GeminiApp, a programiści mogą tworzyć za pomocą interfejsu API w @GoogleAIStudio – baw się dobrze! https://t.co/Se9dUR9ww1 pic.twitter.com/ss5le18Elk

— Demis Hassabis (@demishassabis) 25 marca 2026 r.

Google stwierdziło, że Lyria 3 Pro nie jest przeznaczona do odtwarzania charakterystycznego dźwięku żadnego konkretnego artysty. Gdy użytkownicy podają nazwisko artysty w monicie, modelka czerpie z niego szeroką inspirację, zamiast naśladować jego głos lub styl katalogowy. Od lutowej premiery Lyrii 3 firma niezmiennie podkreśla, że ​​jej technologia generowania muzyki skupia się na oryginalnej ekspresji, a nie na imitacji.

Każdy utwór wygenerowany przez Lyrię 3 lub Lyria 3 Pro jest opatrzony znakami wodnymi SynthID, niedostrzegalnym cyfrowym znacznikiem Google DeepMind służącym do identyfikacji treści generowanych przez sztuczną inteligencję. SynthID zaprojektowano tak, aby przetrwał typowe edycje dźwięku, takie jak kadrowanie, zapewniając trwały sygnał pochodzenia, gdy muzyka wygenerowana przez sztuczną inteligencję trafia do kanałów dystrybucji. Właścicielom praw zaniepokojonym nieautoryzowanym zalewaniem platform strumieniowego przesyłania muzyki przez sztuczną inteligencję znak wodny oferuje mechanizm wykrywania działający niezależnie od narzędzi specyficznych dla platformy.

Wdrażanie na sześciu platformach

Lyria 3 Pro to wprowadzamy aplikację Gemini dla płatnych subskrybentów, z dziennymi limitami generacji powiązanymi z poziomami subskrypcji. Abonenci AI Plus mogą tworzyć 10 utworów dziennie, abonenci Pro – 20, a abonenci Ultra – 50. Użytkownicy wersji bezpłatnej Gemini nie mają obecnie dostępu do Lyria 3 Pro, co ogranicza tę funkcję do klientów płacących.

Poza aplikacją konsumencką Google integruje Lyrię 3 Pro z Google Vids i ProducerAI, narzędzie do wspólnego tworzenia muzyki, które firma niedawno nabyła. Integracja z Google Vids dla klientów Workspace rozpoczyna się w tygodniu rozpoczynającym się 25 marca, umożliwiając użytkownikom biznesowym generowanie muzyki w tle i ścieżek dźwiękowych bezpośrednio w swoich projektach wideo.

Dostępna jest funkcja ProducerAI globalnie, zarówno dla abonentów bezpłatnych, jak i płatnych, oferując dedykowane środowisko do produkcji muzyki. Artyści, producenci i autorzy piosenek mogą iterować kompozycje z bardziej szczegółową kontrolą, niż zapewnia zorientowany na konsumenta interfejs Gemini.

W przypadku przedsiębiorstw Lyria 3 Pro jest dostępna za pośrednictwem Vertex AI, Gemini API i AI Studio dla programistów i firm wymagających generowania dźwięku na żądanie na dużą skalę. Dostęp Vertex AI jest obecnie w publicznej wersji zapoznawczej, dzięki czemu klienci korporacyjni mogą testować możliwości generowania muzyki przed przystąpieniem do wdrożeń produkcyjnych. Oferując dostęp na poziomie interfejsu API, Google umożliwia zewnętrznym programistom osadzanie generowania muzyki przez sztuczną inteligencję we własnych aplikacjach, co stanowi strategię dystrybucji, której nie oferuje obecnie żaden z konkurentów firmy skupiających się na konsumentach.

Google udostępnia także wariant działający w czasie rzeczywistym za pośrednictwem AI Studio. Lyria RealTime, dostępna za pośrednictwem interfejsu Live API Gemini API, umożliwia programistom generowanie i przesyłanie strumieniowe muzyki z niskim opóźnieniem. Potencjalne przypadki użycia obejmują aplikacje interaktywne, produkcję treści na żywo i adaptacyjne ścieżki dźwiękowe, które reagują na działania użytkownika w czasie rzeczywistym. Obejmujący sześć platform, od aplikacji do czatu konsumenckiego po interfejsy API dla przedsiębiorstw, zapewnia przewagę dystrybucyjną, której nie da się łatwo odtworzyć start-upom zajmującym się muzyką wykorzystującą sztuczną inteligencję do odtwarzania.

Partnerstwa twórców i kontekst branżowy

Google opracowało aplikację Lyria za pośrednictwem Music AI Sandbox, która zapewnia muzykom, producentom i autorom piosenek eksperymentalne narzędzia do komponowania sztucznej inteligencji od ery Lyria 2. Zdobywca nagrody Grammy, producent Yung Spielburg, wykorzystał Lyrię w procesie komponowania ścieżki dźwiękowej do krótkiego filmu Google DeepMind zatytułowanego „Dear Upstairs Neighbors”, natomiast DJ i producent François K współpracuje z Google nad nadchodzącym wydawnictwem.

[treści osadzone]

François K opisał Lyrię jako wszechstronne narzędzie twórcze, a nie skrót.

„Po zapoznaniu się z rozległym krajobrazem narzędzi muzycznych, postęp w pracy nad Lyrią 3 jest niesamowity, zwłaszcza jeśli chodzi o wierność i muzykalność. Sposób, w jaki używam generatywnych narzędzi AI, nigdy nie sprowadza się do podpowiedzi za jednym kliknięciem. Zamiast tego staje się to wszechstronną częścią mojego arsenału, pozwalając mi udoskonalać pomysły z realizmem i precyzją.”

François K, DJ i producent (za pośrednictwem Blog Google)

Jego charakterystyka podkreśla napięcie w centrum generowania muzyki przez sztuczną inteligencję: czy narzędzia te służą jako akceleratory kreatywności dla wyszkolonych muzyków, czy też jako zamienniki, które dewaluują ludzki kunszt. Nacisk Google na partnerstwo z twórcami sugeruje, że firma mocno umieszcza Lyrię 3 Pro po stronie akceleratora tej przepaści.

Lyria 3 Pro pojawia się, gdy branża muzyczna oparta na sztucznej inteligencji porusza się w coraz bardziej złożonym środowisku praw autorskich. Konkurenci Suno i Udio już generują minutowe utwory z chwytliwymi motywami, podczas gdy Meta’s MusicGen i Stable Audio celują w producentów i programistów. Podejście Google różni się naciskiem na licencjonowane dane szkoleniowe: firma przeszkoliła Lyrię 3 Pro, korzystając z danych partnerów i dozwolonych treści z YouTube i usług Google. Zarówno Suno, jak i Udio, zanim osiągnęły ugodę, w 2025 r. stanęły przed pozwami dotyczącymi praw autorskich złożonymi przez główne wytwórnie płytowe, natomiast wykorzystanie przez Google licencjonowanych i dozwolonych danych jak dotąd chroniło firmę przed podobnymi wyzwaniami prawnymi.

W całej branży platformy budują zabezpieczenia przed treściami generowanymi przez sztuczną inteligencję. Spotify właśnie udostępniło narzędzia do sprawdzania wykonawców umożliwiające muzykom oznaczanie utworów wydanych pod ich nazwami bez zezwolenia, co jest odpowiedzią na rosnące obawy związane z zalewaniem platformy utworami generowanymi przez sztuczną inteligencję pod nazwiskami uznanych artystów. Oddzielnie Deezer uruchomił narzędzia do wykrywania sztucznej inteligencji, których każda usługa przesyłania strumieniowego może używać do identyfikowania dźwięku generowanego przez sztuczną inteligencję. Główne wytwórnie płytowe przeszły od sporów sądowych do udzielania licencji, a Universal Music Group i Udio ogłosiły partnerstwo w następstwie ugody dotyczącej praw autorskich.

Łącznie te posunięcia sugerują, że branża przeorientuje się wokół muzyki opartej na sztucznej inteligencji, zamiast całkowicie się jej przeciwstawiać. Dzięki podejściu Google do danych licencjonowanych i zabezpieczeniom znaku wodnego Lyria 3 Pro może odnieść korzyści z tej zmiany, podczas gdy konkurenci, którzy opierali się na nielicencjonowanych danych szkoleniowych, stoją obecnie przed stałymi zobowiązaniami wynikającymi z rozliczeń, które mogą ograniczyć szybkość iteracji.

Wieloplatformowa strategia Google, obejmująca aplikacje konsumenckie, narzędzia do tworzenia i interfejsy API dla przedsiębiorstw, odróżnia Lyrię 3 Pro od konkurentów, którzy skupiają się głównie na generowaniu muzyki bezpośrednio do konsumentów. Suno i Udio oferują obecnie interfejsy internetowe dla indywidualnych użytkowników, ale żaden z nich nie zapewnia dostępu do korporacyjnego API ani integracji z pakietami biurowymi. Osadzając model w całym ekosystemie produktów, od Gemini, przez Vertex AI, po Google Vids, Google traktuje generowanie muzyki przez sztuczną inteligencję jako infrastrukturę, a nie samodzielną nowość.

Od Lyrii 2 w Music AI Sandbox w kwietniu 2025 r., przez Lyrię 3 w lutym 2026 r., aż po Lyrię 3 Pro miesiąc później, Google DeepMind skompresował w miesiącach typowe roczne cykle produktu. Dla niezależnych muzyków i twórców treści rozważających obecnie te narzędzia pytanie nie brzmi już, czy sztuczna inteligencja może generować użyteczną muzykę, ale czy ramy licencyjne i zabezpieczenia twórców mogą ewoluować wystarczająco szybko, aby dotrzymać kroku.

Categories: IT Info