Aigest.
Newsy

Google DeepMind prezentuje Gemini Robotics 2 dla robotów różnego typu

Google DeepMind wprowadziło Gemini Robotics 2, zaawansowany model wizualno-językowo-akcyjny (VLA), zdolny do sterowania robotami od ramion stołowych po humanoidalne. Firma udostępniła również Gemini Robotics ER 2, model

RA

Udostępnij
Google DeepMind prezentuje Gemini Robotics 2 dla robotów różnego typu
Fot. The Decoder

Google DeepMind ogłosiło wprowadzenie Gemini Robotics 2, określając go jako swój najbardziej zaawansowany model wizualno-językowo-akcyjny (VLA). Modele VLA łączą rozpoznawanie obrazu, przetwarzanie języka i kontrolę działań, umożliwiając robotom funkcjonowanie w środowiskach fizycznych. DeepMind podkreśla, że nowy model jest w stanie sterować systemami robotycznymi, począwszy od prostych ramion stołowych, aż po pełnowymiarowe roboty humanoidalne.

Gemini Robotics 2 jako warstwa inteligencji

Firma opisuje Gemini Robotics 2 jako „warstwę inteligencji” przeznaczoną dla nowej generacji robotów adaptacyjnych. Według DeepMind, model ten potrafi zarządzać ruchem całego ciała, wykonywać precyzyjne zadania motoryczne oraz koordynować pracę wielu robotów jednocześnie. Deweloperzy zainteresowani wczesnym dostępem do technologii mogą zgłaszać się poprzez listę oczekujących.

Gemini Robotics ER 2 dla rozumowania ucieleśnionego

Google DeepMind zaprezentowało również Gemini Robotics ER 2, model zaprojektowany specjalnie do „rozumowania ucieleśnionego”. Termin ten odnosi się do zdolności robota do rozumienia świata fizycznego i podejmowania decyzji o działaniach na podstawie zebranych informacji. ER 2 pełni funkcję systemu sterowania wyższego poziomu dla robotów i zastępuje poprzednią wersję, Gemini Robotics ER 1.6, która została wydana w kwietniu. Nowy model jest dostępny w Google AI Studio.

Wprowadzenie Gemini Robotics 2 i ER 2 stanowi znaczący krok w rozwoju autonomicznych systemów robotycznych. Integracja zaawansowanych zdolności wizualnych, językowych i motorycznych w jednym modelu może przyspieszyć adaptację robotów do złożonych i dynamicznych środowisk, otwierając nowe możliwości w automatyzacji i interakcji człowiek-robot.

Źródło: the-decoder.com

Komentarze

Zaloguj się, aby dołączyć do dyskusji.

Nikt jeszcze nie skomentował. Bądź pierwszy!

Czytaj dalej

GPT-6 Astra wykazuje znaczący postęp w rozumowaniu przestrzennym w testach robotycznych
iOS 27: Siri odzyskuje blask dzięki integracji z Google Gemini i nowym funkcjom
NVIDIA udostępnia OSMO: jeden plik YAML do orkiestracji AI w robotyce
Badacz z Princeton proponuje Recurrent Looped Transformer (RLT) z nieskończoną głębią czasową
Sam Altman z OpenAI: Wejście na giełdę w 2026 roku byłoby „nierozsądne”
Robot-pies Unitree Go2 Pro za 4000 dolarów: recenzja i analiza fenomenu chińskiej firmy

Bądź na bieżąco ze światem AI

Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.