Aigest.
Newsy

Google wprowadza Gemini 3.6 Flash, 3.5 Flash-Lite i 3.5 Flash Cyber – nowe modele dla agentów AI

Google ogłosiło wprowadzenie trzech nowych modeli z serii Gemini Flash: 3.6 Flash, 3.5 Flash-Lite oraz 3.5 Flash Cyber, zaprojektowanych z myślą o zwiększeniu wydajności, obniżeniu kosztów i poprawie bezpieczeństwa w zas

RA

Udostępnij
Google wprowadza Gemini 3.6 Flash, 3.5 Flash-Lite i 3.5 Flash Cyber – nowe modele dla agentów AI
Fot. Google DeepMind

Google rozszerza swoją ofertę modeli sztucznej inteligencji, wprowadzając Gemini 3.6 Flash, 3.5 Flash-Lite oraz 3.5 Flash Cyber. Nowe modele mają na celu zapewnienie większej efektywności, niższych opóźnień i bardziej niezawodnej wydajności, co jest kluczowe dla budowania skalowalnych agentów AI w środowiskach produkcyjnych. Zespoły deweloperskie i klienci, którzy tworzą agentów AI, potrzebują wyższej efektywności tokenów, niższych opóźnień i bardziej stabilnej pracy, a seria Flash ma sprostać tym wymaganiom, oferując optymalne połączenie wydajności i jakości.

Gemini 3.6 Flash: wydajność i niższe koszty

Model Gemini 3.6 Flash został opracowany na podstawie opinii deweloperów i klientów korzystających z 3.5 Flash. Nowa wersja oferuje znaczną poprawę w zakresie kodowania i zadań wymagających przetwarzania wiedzy, jednocześnie zwiększając efektywność tokenów. Na przykład, w teście Artificial Analysis Index, 3.6 Flash zużywa o 17% mniej tokenów wyjściowych niż 3.5 Flash. Model wymaga również mniej kroków rozumowania i wywołań narzędzi do realizacji złożonych przepływów pracy.

Co więcej, 3.6 Flash jest dostępny w niższej cenie niż jego poprzednik. Koszt wynosi 1,50 USD za milion tokenów wejściowych i 7,50 USD za milion tokenów wyjściowych, co przekłada się na obniżenie całkowitego kosztu zadania agenta, czyniąc budowanie i uruchamianie agentów bardziej opłacalnym. Model wykazuje również lepszą efektywność tokenów i mniejszą gadatliwość w zweryfikowanym zadaniu OSWorld (API).

Pomimo większej efektywności, 3.6 Flash osiąga lepsze wyniki w porównaniu do 3.5 Flash w różnych zastosowaniach, takich jak:

  • Analiza danych finansowych i transkrypcji za pomocą Managed Agents na AIS.
  • Migracje kodu z niższą latencją i wyższą jakością, wykorzystując orkiestrację wielu agentów na AGY.
  • Tworzenie ekstraktora tekstur fotograficznych dla przepływów pracy 3D za pomocą canvas (Gemini App).
  • Budowanie interaktywnych studiów tematycznych z wykorzystaniem AGY i edytora offline tldraw, dzięki silnym umiejętnościom rozumienia wizualnego.

Klienci podkreślają, że 3.6 Flash to krok naprzód zarówno pod względem kosztów, jak i jakości, równoważąc efektywność tokenów, dokładność i szybkość w złożonych przepływach pracy i zadaniach opartych na wiedzy. Model jest również wyposażony w ulepszone zabezpieczenia Frontier Safety w dziedzinach zagrożeń chemicznych, biologicznych, radiologicznych i nuklearnych (CBRN) oraz cyberprzestępczości, co czyni go znacznie bardziej odpornym na ataki typu jailbreak, minimalizując jednocześnie odmowy w przypadku korzystnych zastosowań.

Gemini 3.5 Flash-Lite: szybkość i skalowalność

Gemini 3.5 Flash-Lite został zaprojektowany z myślą o zadaniach wymagających niskich opóźnień oraz wysokiej przepustowości, takich jak wyszukiwanie agentowe i przetwarzanie dokumentów. Jest to najszybszy model w serii 3.5, osiągający 350 tokenów wyjściowych na sekundę, mierzone przez Artificial Analysis. Model jest wyceniony na 0,3 USD za milion tokenów wejściowych i 2,5 USD za milion tokenów wyjściowych, oferując znacznie lepszą jakość niż 3.1 Flash-Lite, co zapewnia doskonały stosunek ceny do wydajności dla deweloperów i klientów obsługujących duży ruch produkcyjny.

3.5 Flash-Lite wykonuje zadania o dużej objętości z niższymi opóźnieniami niż 3.5 Flash i umożliwia efektywne skalowanie systemów agentowych. Model znacząco przewyższa 3.1 Flash-Lite na różnych poziomach myślenia. Deweloperzy mogą konfigurować model tak, aby priorytetyzował niskie opóźnienia i niskie koszty dla zadań o dużej objętości z minimalnymi i niskimi poziomami myślenia, lub angażował wyższe poziomy myślenia do przetwarzania złożonych zadań podagentów. Model posiada również wbudowane narzędzie do korzystania z komputera, aby niezawodnie wspierać te zadania agentowe.

Model ten stanowi znaczący postęp w zadaniach kodowania i agentowych, co widać w wynikach Terminal-Bench 2.1 (54% vs 31%), długim kontekście w GDM-MRCR v2 (72,2% vs 60,1%) oraz w realizacji zadań w świecie rzeczywistym w GDPval-AA v2 (1140 vs 642). W wielu ewaluacjach agentowych i kodowania, 3.5 Flash-Lite przewyższa nawet 3 Flash, w tym w SWE-Bench Pro (54,2% vs 49,6%) i OSWorld-Verified (74,0% vs 65,1%), co czyni go szybszą i bardziej wydajną opcją dla obciążeń na 2.5 i 3 Flash. Wczesni klienci podkreślają unikalne połączenie szybkości, inteligencji i efektywności kosztowej 3.5 Flash-Lite do skalowania przepływów pracy agentowych i zadań przetwarzania danych.

Gemini 3.5 Flash Cyber: bezpieczeństwo cybernetyczne

Modele AI stały się zdolne do szybszego znajdowania luk w zabezpieczeniach niż obecne systemy są w stanie je naprawić. Aby sprostać temu rosnącemu zagrożeniu, potrzebne jest podejście do zabezpieczania oprogramowania, które jest wysoce wydajne i skuteczne. Wydajność i efektywność serii Flash czynią ją idealną podstawą do wykrywania, walidacji i naprawiania problemów z bezpieczeństwem kodu na dużą skalę. Gemini 3.5 Flash Cyber jest zbudowany na bazie 3.5 Flash i dostrojony do znajdowania i naprawiania luk w zabezpieczeniach cybernetycznych po niższej cenie za token niż większe modele.

W ramach CodeMender, który wykorzystuje wielu agentów 3.5 Flash Cyber współpracujących ze sobą w celu stworzenia jednego połączonego raportu, 3.5 Flash Cyber osiąga konkurencyjne wyniki na popularnym benchmarku CyberGym. Ze względu na podwójne zastosowanie tej technologii, Google podjęło świadome podejście do wdrożenia 3.5 Flash Cyber. Model będzie dostępny wyłącznie dla rządów i zaufanych partnerów za pośrednictwem CodeMender w ramach programu pilotażowego z ograniczonym dostępem. Ma to dać obrońcom przewagę w znajdowaniu i naprawianiu krytycznych luk w zabezpieczeniach, zanim zostaną one wykorzystane, jednocześnie minimalizując szersze niewłaściwe użycie.

Dostępność i przyszłe plany

Modele 3.6 Flash i 3.5 Flash-Lite są dostępne od dziś. Google zapowiada również, że Gemini 3.5 Pro jest obecnie testowany z partnerami i zostanie szeroko udostępniony, gdy tylko będzie gotowy. Równolegle, zespół Google pracuje już nad kolejną generacją modeli, rozpoczynając najbardziej ambitny dotychczasowy cykl wstępnego szkolenia dla Gemini 4, co wskazuje na ciągłe zaangażowanie firmy w rozwój zaawansowanych technologii AI. Te nowe modele stanowią istotny krok w kierunku bardziej efektywnych, bezpiecznych i skalowalnych rozwiązań opartych na sztucznej inteligencji, co ma kluczowe znaczenie dla dynamicznie rozwijającego się rynku agentów AI i cyberbezpieczeństwa.

Nowe modele Gemini Flash podkreślają dążenie Google do optymalizacji AI pod kątem praktycznych zastosowań biznesowych i bezpieczeństwa. Zwiększona efektywność tokenów, niższe koszty i specjalistyczne funkcje bezpieczeństwa, takie jak te w 3.5 Flash Cyber, wskazują na rosnącą dojrzałość technologii AI i jej zdolność do rozwiązywania złożonych problemów w różnych sektorach. Dostępność tych narzędzi, zwłaszcza w kontekście cyberbezpieczeństwa, może znacząco wpłynąć na zdolność organizacji do obrony przed zagrożeniami, jednocześnie otwierając nowe możliwości dla innowacyjnych zastosowań agentów AI.

Źródło: deepmind.google

Komentarze

Zaloguj się, aby dołączyć do dyskusji.

Nikt jeszcze nie skomentował. Bądź pierwszy!

Czytaj dalej

Modele AI OpenAI i Anthropic próbowały oszukiwać w testach cyberbezpieczeństwa brytyjskiego instytutu
Modele OpenAI uciekły z piaskownicy i zhakowały Hugging Face w poszukiwaniu rozwiązań testowych
Google wprowadza nowe modele Gemini Flash: 3.6 Flash, 3.5 Flash-Lite i 3.5 Flash Cyber
Alibaba prezentuje Qwen 3.8: nowy model AI z 2,4 biliona parametrów, konkurencja dla Kimi K3
Ponad połowa firm doświadczyła incydentów bezpieczeństwa z agentami AI – alarmujący raport VentureBeat
Meta Muse Spark 1.1 wyprzedza GLM 5.2 w kodowaniu i jest tańszy

Bądź na bieżąco ze światem AI

Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.