Firmy inwestują w infrastrukturę AI szybciej, niż są w stanie mierzyć jej koszty
Nowe badanie VentureBeat Pulse Research ujawnia, że przedsiębiorstwa intensywnie inwestują w infrastrukturę AI, ale mają poważne problemy z monitorowaniem i optymalizacją związanych z nią kosztów, co prowadzi do znacznej

Przedsiębiorstwa intensywnie inwestują w infrastrukturę sztucznej inteligencji, jednak ich zdolność do monitorowania i zarządzania kosztami tych inwestycji pozostaje w tyle. Badanie VentureBeat Pulse Research, przeprowadzone na próbie 107 firm, ujawnia znaczną lukę obliczeniową – rozbieżność między agresywnymi wydatkami a brakiem przejrzystości ekonomicznej, co skutkuje niskim wykorzystaniem zasobów i nieefektywnym zarządzaniem.
Luka obliczeniowa i niskie wykorzystanie zasobów
Centralnym wnioskiem badania jest istnienie luki obliczeniowej, która polega na tym, że firmy inwestują w infrastrukturę AI znacznie szybciej, niż są w stanie zrozumieć i kontrolować jej ekonomię. Tylko około jedna piąta (21%) przedsiębiorstw wykorzystuje AI w produkcji na dużą skalę, jednak plany inwestycyjne wyprzedzają tę dojrzałość. Największym obszarem planowanych ocen w ciągu najbliższego roku są specjalistyczne chmury AI (45%), kategoria, z której obecnie prawie żadna z badanych firm nie korzysta. Jednocześnie istniejące zasoby obliczeniowe są słabo wykorzystywane – 83% firm zgłasza wykorzystanie procesorów graficznych (GPU) na poziomie 50% lub mniej, a prawie połowa (49%) działa na poziomie 25% lub poniżej. Co więcej, mniej niż połowa (44%) przedsiębiorstw jest w stanie rygorystycznie śledzić rzeczywiste koszty swoich obliczeń AI.
Niezdecydowanie co do dostawców i kryteria wyboru
Przedsiębiorstwa nie są zadowolone ze swoich obecnych dostawców infrastruktury. Zdecydowana większość (64%) planuje zmienić lub dodać dostawcę w ciągu dwunastu miesięcy, a 38% zamierza to zrobić w ciągu najbliższego kwartału. Jest to niezwykle wysoki wskaźnik rotacji jak na tak fundamentalną kategorię. Co ciekawe, decyzje o wyborze dostawcy nie są podyktowane ceną za token, lecz innymi czynnikami:
- Integracja z istniejącym stosem technologicznym (41%)
- Całkowity koszt posiadania (TCO) (35%)
Cena za milion tokenów jest decydującym czynnikiem dla zaledwie 8% badanych firm. To wskazuje, że kupujący optymalizują pod kątem dopasowania dostawcy i rzeczywistych kosztów operacyjnych, a nie reklamowanych stawek jednostkowych.
Przyszłe kierunki inwestycji i wyzwania
Obecnie większość firm korzysta z hiperskalerów (takich jak Google Cloud, Microsoft, AWS, Oracle) oraz API dostawców modeli (Gemini, OpenAI, Anthropic). Google Cloud jest liderem, używanym przez 48% przedsiębiorstw. Jednak plany na przyszłość wskazują na znaczącą zmianę. Specjalistyczne chmury GPU, takie jak CoreWeave, Lambda czy Crusoe, które obecnie są marginalne, stanowią największy obszar planowanych ewaluacji. Aż 45% firm planuje oceniać te rozwiązania, co sugeruje nadchodzącą replatformizację i przeniesienie znaczącej części obliczeń AI poza ogólnego przeznaczenia chmury. Badanie wskazuje również, że przejście od obliczeń GPU do przepustowości pamięci jako kluczowego ograniczenia w skalowaniu wnioskowania jest ledwo zauważane przez około jedną piątą przedsiębiorstw.
Wyniki badania VentureBeat Pulse Research rysują obraz dynamicznie rozwijającego się rynku infrastruktury AI, gdzie inwestycje wyprzedzają zdolność firm do efektywnego zarządzania i optymalizacji kosztów. Niskie wykorzystanie drogich zasobów, takich jak GPU, oraz brak przejrzystości w mierzeniu całkowitego kosztu posiadania, stanowią poważne wyzwania, które przedsiębiorstwa będą musiały rozwiązać, aby w pełni wykorzystać potencjał sztucznej inteligencji. Zmiana dostawców i zainteresowanie specjalistycznymi chmurami AI wskazują na poszukiwanie bardziej efektywnych i dopasowanych rozwiązań, co może prowadzić do znaczących przekształceń w krajobrazie dostawców infrastruktury w najbliższych latach.
Źródło: venturebeat.com
Komentarze
Zaloguj się, aby dołączyć do dyskusji.
Nikt jeszcze nie skomentował. Bądź pierwszy!
Czytaj dalej

Rynek 'neochmur' w 2026 roku: CoreWeave, Nebius, Lambda, Crusoe i Groq – analiza kluczowych graczy
Rynek 'neochmur' GPU dynamicznie się rozwija, a pięć kluczowych firm – CoreWeave, Nebius, Lambda, Crusoe i Groq – rywalizuje o dominację, oferując zróżnicowane modele biznesowe i strategie cenowe. Analiza porównuje ich o
Redakcja Aigest24 sie 2026

FreeToken: Przełomowy silnik MoE uruchamia 753B GLM-5.2 na pojedynczej karcie graficznej
Nowy silnik FreeToken, opracowany przez badaczy z UC Berkeley i UT Austin, umożliwia uruchamianie zaawansowanych modeli językowych, takich jak 753B GLM-5.2, na pojedynczych, konsumenckich kartach graficznych, znacząco ob
Redakcja Aigest23 sie 2026

CEO Pangram: Jesteśmy "niebezpiecznie blisko" teorii martwego internetu
Max Spero, CEO firmy Pangram, ostrzega przed rosnącym problemem zaufania w internecie, wynikającym z powszechnego użycia treści generowanych przez sztuczną inteligencję. Jego firma oferuje narzędzia do wykrywania AI, aby
Redakcja Aigest9 godz. temu

Amazon wykorzystuje AI do walki z oszustwami, Alexa pomoże rozpoznać scamy
Amazon wprowadza nowe funkcje oparte na sztucznej inteligencji, aby pomóc klientom w identyfikacji fałszywych wiadomości i oszustw. Usługa Alexa for Shopping będzie teraz w stanie potwierdzić autentyczność komunikacji od
Redakcja Aigest11 godz. temu

IBM i Confluent łączą siły: modele szeregów czasowych dla inteligencji w czasie rzeczywistym
IBM i Confluent wprowadzają modele fundamentowe szeregów czasowych (TSFM) do przetwarzania danych strumieniowych, umożliwiając podejmowanie decyzji w czasie rzeczywistym w różnych branżach. Rozwiązanie jest dostępne w Co
Redakcja Aigest12 godz. temu
Anthropic wprowadza Enterprise Frontier Safeguards (EFS) dla bezpieczeństwa danych firm
Anthropic zaprezentował nową architekturę Enterprise Frontier Safeguards (EFS), która pozwala firmom przechowywać dane monitorujące we własnej chmurze, zapewniając większą kontrolę i prywatność.
Redakcja Aigest18 godz. temu
Bądź na bieżąco ze światem AI
Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.