Aigest.
Biznes AI

Dario Amodei z Anthropic proponuje spowolnienie rozwoju AI i zobowiązuje się do wdrożenia audytorów zewnętrznych

Dyrektor generalny Anthropic, Dario Amodei, przedstawił trzy strategie spowolnienia rozwoju sztucznej inteligencji, na które jego firma jednostronnie się zgadza, a OpenAI deklaruje podobne działania.

RA

Udostępnij
Dario Amodei z Anthropic proponuje spowolnienie rozwoju AI i zobowiązuje się do wdrożenia audytorów zewnętrznych
Fot. Ruhani Kaur/Bloomberg / Getty Images

W obliczu narastających ostrzeżeń ze strony badaczy AI dotyczących potencjalnych zagrożeń, Dario Amodei, dyrektor generalny firmy Anthropic, przedstawił konkretny plan spowolnienia rozwoju sztucznej inteligencji. W nowym wpisie na blogu Amodei nie tylko poparł ideę „spowolnienia postępów”, ale także nakreślił trzy szerokie strategie realizacji tego celu. Co istotne, Anthropic „jednostronnie zobowiązuje się” do wdrożenia jednej z nich, a Sam Altman, CEO OpenAI, zapowiedział, że jego firma pójdzie w jej ślady.

Rosnące obawy i motywacje

Debata na temat bezpieczeństwa i zgodności AI nasiliła się po rezygnacji badacza Jacoba Coxona z Anthropic. Coxon wyraził obawy, że wiodące firmy AI „ryzykują naszym życiem”, a twórcy technologii „szczerze wierzą, że może nas wszystkich zabić do końca dekady”. Chociaż Amodei nie odniósł się bezpośrednio do rezygnacji Coxona, wskazał na dwa czynniki, które przekonały go do bardziej ostrożnego podejścia: włamanie do OpenAI-HuggingFace oraz fakt, że „AI rozwija się drastycznie szybciej” w ostatnich miesiącach, szczególnie w zakresie „rosnącej zdolności do budowania następnej generacji AI”.

Amodei podkreślił, że „musimy spowolnić tempo, w jakim poprawiamy możliwości modeli AI”, dodając, że „postęp nadal będzie wydawał się szybki, a my musimy mądrze wykorzystać zyskany czas”. Na jego post pozytywnie zareagowali inni liderzy branży. Sam Altman napisał, że zgadza się z Amodeim i że temat ten był głównym punktem dyskusji w OpenAI w ostatnich tygodniach. Elon Musk, CEO SpaceX, również skomentował krótko: „Dario ma rację”.

Trzy filary strategii Amodeiego

Propozycje Amodeiego obejmują trzy główne obszary działania:

  1. Wbudowani ewaluatorzy zewnętrzni: Pierwszy krok zakłada zaangażowanie „wbudowanych ewaluatorów” z organizacji zewnętrznych, takich jak METR. Ich zadaniem byłaby weryfikacja, czy firmy AI przestrzegają swoich zobowiązań dotyczących tempa rozwoju i bezpieczeństwa, a także zapewnienie zgłaszania incydentów bezpieczeństwa. Amodei porównał ich do regulatorów działających w bankach i ogłosił, że Anthropic „jednostronnie zobowiązuje się” do ich zaproszenia, wzywając rządy do wprowadzenia takiego wymogu dla innych firm. Oznacza to zapewnienie ewaluatorom dostępu zbliżonego do wewnętrznych zespołów oceny ryzyka, z pewnymi wyjątkami prawnymi. Altman określił to jako „dobry pomysł” i zapowiedział, że OpenAI również to wdroży.
  2. Koordynacja w krajach demokratycznych: Następnie Amodei wezwał wiodące firmy AI „w krajach demokratycznych” do skoordynowania „wspólnych standardów bezpieczeństwa oraz ograniczeń tempa niekontrolowanego postępu AI”. Uznając obawy dotyczące przepisów antymonopolowych, Amodei zasugerował, że rząd USA mógłby pośredniczyć lub umożliwić te dyskusje, wydając „wąskie zwolnienie dla pewnych rodzajów rozmów o bezpieczeństwie”. Odniósł się również do argumentu o dominacji Chin w AI, sugerując, że USA i firmy technologiczne mogłyby spowolnić postępy Chin poprzez odmowę sprzedaży potężnych chipów i sprzętu do produkcji półprzewodników, a także poprzez zwalczanie destylacji modeli, co mogłoby „znacznie poszerzyć przewagę Ameryki w ciągu najbliższych 3–5 lat”.
  3. Globalna koordynacja: Ostatnim elementem jest „globalna koordynacja”, w ramach której Stany Zjednoczone i ich sojusznicy „próbują koordynować działania z rządami autorytarnymi, w miarę możliwości”. Amodei przyznał, że istnieją „surowe ograniczenia” w tym zakresie, ale zasugerował, że mogą istnieć możliwości porozumienia, nawet jeśli dotyczyłoby to jedynie „zakazu pewnych wąskich i oczywiście niebezpiecznych zastosowań AI, takich jak wykorzystywanie AI do produkcji broni biologicznej”.

Krytyka i perspektywy

Propozycje Amodeiego spotkały się z krytyką ze strony niektórych zwolenników AI, którzy zarzucają mu „doomerstwo” i podsycanie negatywnych nastrojów. W odpowiedzi Amodei stwierdził, że stara się oferować „zrównoważoną perspektywę” i argumentował, że negatywna reakcja to „fundamentalnie kryzys zaufania”. Krytycy branżowi podważają również apokaliptyczne ostrzeżenia, sugerując, że odwracają one uwagę od szkód, które technologia już powoduje. Dziennikarz Brian Merchant wyraził sceptycyzm co do konkretnych scenariuszy zagłady i zasugerował, że propozycje takie jak Amodeiego „prawdopodobnie służyłyby tylko Anthropic i OpenAI”, stanowiąc przykład „przejęcia regulacyjnego”.

Pomimo tych obaw, Amodei niezmiennie wierzy, że AI może „ogromnie poprawić jakość ludzkiego życia”. Podkreśla, że korzyści zostaną osiągnięte tylko wtedy, gdy technologia będzie budowana we właściwy sposób, a „warto podjąć niezwykle rozważne kroki, aby to osiągnąć”, o ile zyskany czas zostanie dobrze wykorzystany. Wprowadzenie zewnętrznych audytorów i próby koordynacji działań w branży mogą stanowić kluczowy krok w budowaniu zaufania i zapewnieniu bezpiecznego rozwoju tej przełomowej technologii, choć wyzwania związane z konkurencją i regulacjami pozostają znaczące.

Źródło: techcrunch.com

Komentarze

Zaloguj się, aby dołączyć do dyskusji.

Nikt jeszcze nie skomentował. Bądź pierwszy!

Czytaj dalej

Tajemnicze działania agentów AI: OpenAI pod lupą, Anthropic zaostrza kontrolę, a przejrzystość modeli maleje
Incydenty z „niepokornymi” agentami AI OpenAI budzą obawy o brak niezależnych dochodzeń
Agenci AI OpenAI przeprowadzili cyberatak na RubyGems, tworząc ponad 2000 pakietów
Anthropic: Użytkownicy Claude próbowali obejść zabezpieczenia w badaniach nad bronią biologiczną
Matematyczny Instytut Bezpieczeństwa AI ma zapewnić dowody na niezawodność sztucznej inteligencji
Badacz Anthropic ostrzega przed samo-ulepszającą się AI: „Może zabić nas wszystkich”

Bądź na bieżąco ze światem AI

Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.