Google DeepMind prezentuje Gemini Robotics 2 dla robotów różnego typu
Google DeepMind wprowadziło Gemini Robotics 2, zaawansowany model wizualno-językowo-akcyjny (VLA), zdolny do sterowania robotami od ramion stołowych po humanoidalne. Firma udostępniła również Gemini Robotics ER 2, model

Google DeepMind ogłosiło wprowadzenie Gemini Robotics 2, określając go jako swój najbardziej zaawansowany model wizualno-językowo-akcyjny (VLA). Modele VLA łączą rozpoznawanie obrazu, przetwarzanie języka i kontrolę działań, umożliwiając robotom funkcjonowanie w środowiskach fizycznych. DeepMind podkreśla, że nowy model jest w stanie sterować systemami robotycznymi, począwszy od prostych ramion stołowych, aż po pełnowymiarowe roboty humanoidalne.
Gemini Robotics 2 jako warstwa inteligencji
Firma opisuje Gemini Robotics 2 jako „warstwę inteligencji” przeznaczoną dla nowej generacji robotów adaptacyjnych. Według DeepMind, model ten potrafi zarządzać ruchem całego ciała, wykonywać precyzyjne zadania motoryczne oraz koordynować pracę wielu robotów jednocześnie. Deweloperzy zainteresowani wczesnym dostępem do technologii mogą zgłaszać się poprzez listę oczekujących.
Gemini Robotics ER 2 dla rozumowania ucieleśnionego
Google DeepMind zaprezentowało również Gemini Robotics ER 2, model zaprojektowany specjalnie do „rozumowania ucieleśnionego”. Termin ten odnosi się do zdolności robota do rozumienia świata fizycznego i podejmowania decyzji o działaniach na podstawie zebranych informacji. ER 2 pełni funkcję systemu sterowania wyższego poziomu dla robotów i zastępuje poprzednią wersję, Gemini Robotics ER 1.6, która została wydana w kwietniu. Nowy model jest dostępny w Google AI Studio.
Wprowadzenie Gemini Robotics 2 i ER 2 stanowi znaczący krok w rozwoju autonomicznych systemów robotycznych. Integracja zaawansowanych zdolności wizualnych, językowych i motorycznych w jednym modelu może przyspieszyć adaptację robotów do złożonych i dynamicznych środowisk, otwierając nowe możliwości w automatyzacji i interakcji człowiek-robot.
Źródło: the-decoder.com
Komentarze
Zaloguj się, aby dołączyć do dyskusji.
Nikt jeszcze nie skomentował. Bądź pierwszy!
Czytaj dalej

GPT-6 Astra wykazuje znaczący postęp w rozumowaniu przestrzennym w testach robotycznych
Nowy model OpenAI, GPT-6 Astra, zademonstrował znaczący postęp w rozumowaniu przestrzennym, osiągając lepsze wyniki niż konkurencyjne rozwiązania w specjalistycznych testach robotycznych.
Redakcja Aigest2 dni temu

iOS 27: Siri odzyskuje blask dzięki integracji z Google Gemini i nowym funkcjom
Najnowsza aktualizacja systemu iOS 27 znacząco odmienia asystenta Siri, czyniąc go bardziej użytecznym i kontekstowym. Użytkownicy zauważają, że po latach marginalnego wykorzystania, Siri staje się kluczowym narzędziem d
Redakcja Aigest17 godz. temu
NVIDIA udostępnia OSMO: jeden plik YAML do orkiestracji AI w robotyce
NVIDIA udostępniła OSMO, narzędzie do orkiestracji przepływów pracy oparte na Kubernetesie, które umożliwia definiowanie zadań AI dla robotyki w jednym pliku YAML.
Redakcja Aigestwczoraj
Badacz z Princeton proponuje Recurrent Looped Transformer (RLT) z nieskończoną głębią czasową
Yifan Zhang z Princeton zaprezentował koncepcję Recurrent Looped Transformer (RLT), innowacyjnego modelu łączącego koder przyczynowy z rekurencyjnym dekoderem. Rozwiązanie to ma na celu usprawnienie przetwarzania sekwenc
Redakcja Aigestwczoraj

Sam Altman z OpenAI: Wejście na giełdę w 2026 roku byłoby „nierozsądne”
Sam Altman, CEO OpenAI, stwierdził, że spółka nie planuje debiutu giełdowego w 2026 roku, pomimo wcześniejszych doniesień i poufnych zgłoszeń IPO.
Redakcja Aigest2 dni temu

Robot-pies Unitree Go2 Pro za 4000 dolarów: recenzja i analiza fenomenu chińskiej firmy
Chińska firma Unitree rewolucjonizuje rynek robotyki, oferując zaawansowane roboty czworonożne i humanoidalne w przystępnych cenach. Test redakcyjny robota-psa Go2 Pro ujawnia jego możliwości i ograniczenia, jednocześnie
Redakcja Aigest2 dni temu
Bądź na bieżąco ze światem AI
Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.