Aigest.
Newsy

Google DeepMind wprowadza Gemini 3.8 Live, oferując tańszą alternatywę dla GPT-Live-1

Google DeepMind udostępniło deweloperom nowe modele audio Gemini 3.8 Live i 3.8 Live Extended Thinking, które mają konkurować z ofertą OpenAI, oferując znacznie niższe koszty.

RA

Udostępnij
Google DeepMind wprowadza Gemini 3.8 Live, oferując tańszą alternatywę dla GPT-Live-1
Fot. The Decoder

Google DeepMind wprowadziło na rynek Gemini 3.8 Live oraz Gemini 3.8 Live Extended Thinking, dwa nowe modele audio przeznaczone dla deweloperów. Są one dostępne za pośrednictwem Gemini API oraz Google AI Studio, stanowiąc bezpośrednią konkurencję dla najnowszych modeli GPT-Live-1 firmy OpenAI, oferując przy tym znacznie niższe koszty.

Możliwości i wydajność nowych modeli

Model Gemini 3.8 Live został zaprojektowany do zasilania agentów głosowych, którzy mogą jednocześnie wykonywać wywołania API w tle, przetwarzać dane wizualne i prowadzić konwersację. Obsługuje on ponad 97 języków, co czyni go wszechstronnym narzędziem w globalnym zastosowaniu. Wariant Extended Thinking osiągnął pierwsze miejsce w rankingu Artificial Analysis Speech-to-Speech Leaderboard z wynikiem 82,6 procent, wyprzedzając tym samym modele GPT-Live-1 od OpenAI. Przykładowe aplikacje demonstrujące możliwości nowych modeli są dostępne na platformie GitHub.

Strategia cenowa i porównanie z OpenAI

Google przyjęło agresywną strategię cenową, oferując swoje usługi znacznie taniej niż konkurencja. Opłata za wejście audio wynosi 0,005 USD za minutę, natomiast za wyjście audio 0,018 USD. Dla porównania, OpenAI pobiera 0,05 USD za minutę za GPT-Live-1. Oznacza to, że godzina konwersacji głosowej z wykorzystaniem technologii Google kosztuje około 1,38 USD, podczas gdy w przypadku OpenAI jest to co najmniej 3,00 USD. Mimo niższej ceny, modele OpenAI wciąż mogą oferować bardziej naturalne konwersacje dzięki funkcji full duplex, która umożliwia jednoczesne słuchanie i mówienie. Dostępne dema sugerują również, że jakość dźwięku w rozwiązaniach OpenAI jest lepsza, co wskazuje, że Google ponownie postawiło na optymalizację kosztów kosztem najwyższej jakości.

Konsekwencje dla rynku AI

Wprowadzenie Gemini 3.8 Live i 3.8 Live Extended Thinking przez Google DeepMind wyraźnie zaostrza konkurencję na rynku modeli audio AI. Niższe ceny mogą przyciągnąć deweloperów i firmy poszukujące ekonomicznych rozwiązań do tworzenia agentów głosowych, co może przyspieszyć adopcję technologii AI w różnych sektorach. Strategia Google, polegająca na oferowaniu konkurencyjnych cen, może zmusić innych graczy rynkowych do rewizji swoich cenników, co w dłuższej perspektywie może przynieść korzyści użytkownikom końcowym poprzez obniżenie barier wejścia do zaawansowanych technologii głosowych.

Źródło: the-decoder.com

Komentarze

Zaloguj się, aby dołączyć do dyskusji.

Nikt jeszcze nie skomentował. Bądź pierwszy!

Czytaj dalej

OpenAI udostępnia GPT-Live-1 API: model, który słucha i mówi jednocześnie
Spowolnienie rozwoju AI: Czy bezpieczeństwo to tylko zasłona dymna dla dominacji rynkowej?
Elon Musk wycofuje pozew antymonopolowy przeciwko Apple, kontynuuje walkę z OpenAI
Plan Dario Amodeiego „Pace the Frontier” zyskuje poparcie gigantów AI
Debata o zagrożeniach AI: Czy ostrzeżenia o zagładzie to marketingowa strategia?
Sam Altman z OpenAI: Wejście na giełdę w 2026 roku byłoby „nierozsądne”

Bądź na bieżąco ze światem AI

Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.