Aigest.
Newsy

Gradium wprowadza Voice Design: Twórz syntetyczne głosy na podstawie promptów w kilka sekund

Firma Gradium zaprezentowała nową usługę Voice Design, która umożliwia generowanie unikalnych syntetycznych głosów w oparciu o proste promptowanie tekstowe, rozwiązując problem ograniczonej dostępności głosów w katalogac

RA

Udostępnij
Gradium wprowadza Voice Design: Twórz syntetyczne głosy na podstawie promptów w kilka sekund
Ilustracja poglądowa

Zespoły pracujące nad agentami głosowymi często napotykają na problem ograniczonej dostępności odpowiednich głosów. Standardowe katalogi, nawet te zawierające 400 różnych głosów, rzadko są w stanie sprostać specyficznym i często bardzo szczegółowym wymaganiom klientów. Przykładowo, zapotrzebowanie na głos recepcjonistki z Quebecu dla dealera w Montrealu, czy narratora po sześćdziesiątce z autorytatywnym tonem wykładowcy, często wykracza poza dostępne opcje.

Innowacyjne podejście do syntezy mowy

Firma Gradium wychodzi naprzeciw tym wyzwaniom, wprowadzając nową usługę o nazwie Voice Design. Jej głównym założeniem jest umożliwienie użytkownikom tworzenia całkowicie nowych, unikalnych syntetycznych głosów w zaledwie kilka sekund, bazując na prostych promptach tekstowych. To rozwiązanie ma na celu zniwelowanie luki między ograniczoną ofertą katalogową a rosnącymi, coraz bardziej precyzyjnymi potrzebami rynku.

Dotychczasowe metody, takie jak klonowanie głosu, pozwalały na replikowanie istniejących już mówców, jednak nie rozwiązywały problemu braku możliwości stworzenia zupełnie nowego, niestandardowego brzmienia. Voice Design od Gradium zmienia ten paradygmat, oferując elastyczność i szybkość w generowaniu głosów idealnie dopasowanych do konkretnych scenariuszy i wymagań.

Koniec z ograniczeniami katalogowymi

Nowa usługa Gradium ma potencjał zrewolucjonizować sposób, w jaki firmy i twórcy podchodzą do projektowania interakcji głosowych. Zamiast przeszukiwać obszerne, lecz wciąż skończone katalogi, użytkownicy będą mogli po prostu opisać pożądane cechy głosu, a system Gradium Voice Design wygeneruje go w mgnieniu oka. To otwiera drzwi do znacznie większej kreatywności i precyzji w dopasowywaniu głosów do tożsamości marki, postaci czy kontekstu narracyjnego.

Rozwiązanie to jest szczególnie istotne w kontekście rosnącej popularności asystentów głosowych, audiobooków, systemów IVR oraz innych aplikacji wykorzystujących syntezę mowy. Możliwość szybkiego tworzenia spersonalizowanych głosów, które idealnie oddają zamierzony ton i charakter, może znacząco poprawić jakość i naturalność interakcji z technologią, a także zwiększyć zaangażowanie użytkowników.

Źródło: marktechpost.com

Komentarze

Zaloguj się, aby dołączyć do dyskusji.

Nikt jeszcze nie skomentował. Bądź pierwszy!

Czytaj dalej

Pozew przeciwko OpenAI: ChatGPT miał pogłębić urojenia religijne użytkownika
Hugging Face wprowadza ML Intern: eksperymenty ML dostępne dla każdego przez czat
Microsoft łata rekordową liczbę luk bezpieczeństwa, w tle debata o AI w cyberbezpieczeństwie
Meta wyświetlała reklamy aplikacji AI tworzących materiały CSAM z wizerunkami prawdziwych nastolatek
Meta rezygnuje z oceny inżynierów na podstawie użycia AI po zjawisku "tokenmaxxing"
Słownik AI: Kluczowe terminy, które musisz znać, od AGI po halucynacje

Bądź na bieżąco ze światem AI

Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.