Gemini 3.5 Flash z wbudowaną funkcją obsługi komputera
Google zintegrowało funkcję obsługi komputera bezpośrednio z modelem Gemini 3.5 Flash, umożliwiając tworzenie zaawansowanych agentów AI zdolnych do interakcji z różnymi platformami.

Model Gemini 3.5 Flash został wzbogacony o wbudowaną funkcję obsługi komputera, co stanowi znaczące usprawnienie w tworzeniu agentów zdolnych do interakcji z różnymi platformami. Wcześniej dostępna jedynie jako samodzielny model Gemini 2.5, ta zdolność jest teraz natywnie zintegrowana z głównym modelem Gemini Flash, oferując najlepszą dotychczas wydajność w zadaniach związanych z agentową obsługą komputera.
Nowe możliwości dla deweloperów
Gemini już wcześniej wyróżniało się w wywoływaniu funkcji oraz korzystaniu z wbudowanych narzędzi, takich jak wyszukiwarka i mapy. Dzięki nowej integracji, deweloperzy mogą teraz wykorzystać 3.5 Flash do niezawodnego tworzenia niestandardowych agentów, którzy potrafią "widzieć", "rozumieć" i "działać" w środowiskach przeglądarek, urządzeń mobilnych oraz komputerów stacjonarnych. Otwiera to drogę do zwiększonej wydajności w długoterminowych i korporacyjnych zadaniach automatyzacji, takich jak ciągłe testowanie oprogramowania czy praca koncepcyjna w profesjonalnych aplikacjach.
Deweloperzy i przedsiębiorstwa mogą rozpocząć korzystanie z funkcji obsługi komputera w 3.5 Flash za pośrednictwem Gemini API oraz platformy Gemini Enterprise Agent Platform.
Przykłady zastosowań i bezpieczeństwo
Funkcja obsługi komputera w 3.5 Flash znajduje zastosowanie w analizie aplikacji Gemini, zwracając skategoryzowaną listę funkcji, a także w audytowaniu własnej dokumentacji pod kątem dostępności. Aby złagodzić ryzyko ataków typu prompt injection w agentach działających w środowiskach produkcyjnych, Google stosuje ukierunkowane szkolenia adwersaryjne dla funkcji obsługi komputera w Gemini 3.5 Flash. Dodatkowo, udostępniono dwa opcjonalne systemy zabezpieczeń dla przedsiębiorstw, które mają na celu zwiększenie bezpieczeństwa.
Google zachęca deweloperów do przyjęcia podejścia "obrony w głąb" (defense-in-depth), łącząc te funkcje z bezpiecznym środowiskiem sandbox, weryfikacją "człowiek w pętli" (human-in-the-loop) oraz ścisłą kontrolą dostępu. Dodatkowe informacje dotyczące środków bezpieczeństwa są dostępne w dokumentacji najlepszych praktyk.
Integracja funkcji obsługi komputera w Gemini 3.5 Flash stanowi istotny krok w rozwoju agentów AI, umożliwiając im bardziej złożone i autonomiczne działanie w cyfrowym środowisku. To posunięcie podkreśla dążenie Google do dostarczania narzędzi, które nie tylko zwiększają wydajność, ale także zapewniają niezbędne mechanizmy bezpieczeństwa w obliczu rosnących wyzwań związanych z wdrażaniem sztucznej inteligencji w krytycznych zastosowaniach biznesowych.
Źródło: deepmind.google
Komentarze
Zaloguj się, aby dołączyć do dyskusji.
Nikt jeszcze nie skomentował. Bądź pierwszy!
Czytaj dalej

OpenAI Presence: Agenci AI gotowi do wdrożeń biznesowych
OpenAI wprowadza Presence, nową ofertę skierowaną do przedsiębiorstw, mającą na celu uczynienie agentów AI niezawodnymi w rzeczywistych zastosowaniach biznesowych. Rozwiązanie to ma usprawnić obsługę klienta i wewnętrzne
Redakcja Aigest6 dni temu

Czytelnicy wyżej oceniają opowiadania AI, dopóki nie wiedzą, kto jest autorem
Nowe badanie wykazało, że opowiadania generowane przez ChatGPT są oceniane wyżej niż te pisane przez ludzi, pod warunkiem, że czytelnicy nie są świadomi maszynowego autorstwa. Uczestnicy eksperymentu mieli trudności z od
Redakcja Aigest8 godz. temu

Amazon, Microsoft i OpenAI łączą siły, by stworzyć otwarty standard wtyczek dla agentów AI
Wiodące firmy technologiczne, w tym Amazon, Microsoft i OpenAI, ogłosiły współpracę nad Agent Plugins – otwartym standardem dla rozszerzeń agentów AI, mającym ujednolicić rozwój i ponowne wykorzystanie wtyczek.
Redakcja Aigestwczoraj

ChatGPT udostępnia nielimitowane czaty tekstowe dla darmowych użytkowników
OpenAI znosi limity na czaty tekstowe dla wszystkich użytkowników ChatGPT, co zbiega się z przekroczeniem miliarda użytkowników tygodniowo. Wprowadzono także nowe modele GPT-5.6 Luna i Sol.
Redakcja Aigest2 dni temu

Naïve pozyskuje 28,5 mln dolarów na automatyzację procesów biznesowych
Startup Naïve zebrał 28,5 miliona dolarów w rundzie finansowania Serii A, aby rozwijać infrastrukturę umożliwiającą agentom AI przejmowanie większości zadań związanych z zakładaniem i prowadzeniem firm.
Redakcja Aigest2 dni temu

Meta AI wykorzystuje drugiego agenta AI jako "trenera pamięci" do długotrwałych zadań
Meta AI opracowała innowacyjny system, w którym drugi agent AI pełni funkcję "trenera pamięci", pomagając głównemu agentowi utrzymać spójność i unikać powtarzania błędów podczas złożonych zadań.
Redakcja Aigest6 dni temu
Bądź na bieżąco ze światem AI
Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.