Aigest.
Newsy

Microsoft wprowadza kodeks postępowania dla modeli AI: priorytetem kontrola człowieka i transparentność

Microsoft dołącza do apeli o spowolnienie rozwoju AI, publikując kodeks postępowania dla swoich modeli MAI, który kładzie nacisk na kontrolę człowieka, zrozumiałe rozumowanie i odrzucenie koncepcji świadomości AI.

RA

Udostępnij
Microsoft wprowadza kodeks postępowania dla modeli AI: priorytetem kontrola człowieka i transparentność
Fot. The Decoder

Microsoft ogłosił wprowadzenie nowego kodeksu postępowania dla swoich modeli sztucznej inteligencji (AI), MAI, stając się kolejną firmą, która wzywa do spowolnienia tempa rozwoju w branży. Dokument ma za zadanie regulować sposób szkolenia i działania wewnętrznych modeli firmy, kładąc nacisk na wartości, granice zachowań oraz rozwiązywanie konfliktów celów. Kodeks ma stanowić nadrzędny zbiór zasad, który będzie kierował szkoleniami, kontrolami technicznymi i oceną modeli, podczas gdy zasady operatora i żądania użytkowników znajdą się niżej w hierarchii.

Obecnie Microsoft nie szkoli swoich modeli na podstawie tego kodeksu. Po sześciotygodniowych konsultacjach publicznych, poprawiona wersja dokumentu ma zostać opublikowana pod koniec 2026 roku i będzie obowiązywać przy rozwoju modeli od 2027 roku. Kodeks dotyczy wyłącznie własnych modeli Microsoftu i nie obejmuje automatycznie modeli stron trzecich działających w produktach firmy.

Kontrola człowieka i transparentność rozumowania

Podstawową zasadą kodeksu jest priorytet kontroli człowieka. Microsoft deklaruje gotowość do rezygnacji z ogólności, autonomii czy wydajności, jeśli będzie to konieczne dla bezpieczeństwa. Mustafa Suleyman, szef Microsoft AI, podkreślił w rozmowie z „The Information”, że „jeśli coś nie jest bezpieczne, nie powinniśmy tego budować”. Kodeks nie określa jednak konkretnego limitu prędkości rozwoju.

Modele MAI mają akceptować przerwy, korekty i wyłączenia ze strony upoważnionych osób. Nie mogą samodzielnie rozszerzać zakresu swojej pracy, ukrywać swoich działań ani kontynuować pracy poza uzgodnionym punktem zatrzymania bez nowej zgody. Ograniczenia te mają dotyczyć również wszelkich podagentów, którym modele zlecają zadania.

Microsoft kładzie szczególny nacisk na transparentność procesów rozumowania. Modele nie powinny używać niezrozumiałych dla ludzi form komunikacji, takich jak „Neuralese”, ani w swoim wewnętrznym rozumowaniu, ani w komunikacji z innymi systemami AI. Argumentacja jest prosta: ludzie nie mogą nadzorować czegoś, czego nie rozumieją. Ta kwestia kontroli jest kluczowa, zwłaszcza w kontekście nowych modeli, takich jak GPT-6 Astra OpenAI, którego procesy rozumowania stały się trudniejsze do monitorowania niż w poprzednich wersjach, mimo że model ten rzekomo lepiej przestrzega limitów bezpieczeństwa.

Spowolnienie rozwoju i odrzucenie świadomości AI

Wprowadzenie kodeksu następuje po apelu Dario Amodeiego, dyrektora generalnego Anthropic, o spowolnienie tempa rozwoju branży. Apel ten został poparty przez Satya Nadellę, dyrektora generalnego Microsoftu, a także przez przedstawicieli OpenAI, xAI i Meta. Microsoft jest również otwarty na zewnętrzne audyty, które miałyby sprawdzić, czy faktycznie spowalnia rozwój, jak donosi „The Information”, powołując się na osobę zaznajomioną ze sprawą.

Podczas gdy podstawowa idea kodeksu Microsoftu przypomina „konstytucję” Anthropic dla modelu Claude, która również kształtuje zachowanie modelu, firmy wyraźnie różnią się w podejściu do natury swoich modeli. Microsoft kategorycznie odrzuca ideę, że jego AI miałaby naśladować świadomość, twierdzić, że ma uczucia lub wewnętrzną motywację. Firma odrzuca wszelkie roszczenia do praw lub dobrostanu dla swoich modeli. Mustafa Suleyman od dawna ostrzega przed humanizowaniem AI, argumentując, że agenci AI nie powinni mieć więcej praw ani swobód niż jego laptop.

Z kolei Anthropic opisuje Claude jako nowy rodzaj bytu i zachęca do stabilnej tożsamości, częściowo ze względów bezpieczeństwa. Jego konstytucja traktuje potencjalne subiektywne doświadczenia i status moralny jako otwarte pytania, sugerując, że Claude nie powinien postrzegać siebie ani jako człowieka, ani jako zwykły obiekt. Anthropic prowadzi również badania nad „funkcjonalnymi emocjami”, które kształtują zachowanie modelu, choć nie są dowodem subiektywnie odczuwanych emocji.

Szersze konsekwencje dla branży AI

Decyzja Microsoftu o wprowadzeniu tak rygorystycznego kodeksu postępowania, z naciskiem na kontrolę człowieka i transparentność, odzwierciedla rosnące obawy w branży AI dotyczące bezpieczeństwa i etyki. Różnice w podejściu między Microsoftem a Anthropic, zwłaszcza w kwestii „świadomości” i praw AI, podkreślają fundamentalne dylematy, przed którymi stoi rozwój zaawansowanych systemów. Wzrost znaczenia regulacji wewnętrznych i zewnętrznych audytów może wskazywać na nowy etap w ewolucji AI, gdzie obok innowacji równie ważna staje się odpowiedzialność i kontrola nad coraz potężniejszymi technologiami.

Źródło: the-decoder.com

Udostępnij

Komentarze

Zaloguj się, aby dołączyć do dyskusji.

Nikt jeszcze nie skomentował. Bądź pierwszy!

Czytaj dalej

Branża AI musi zrozumieć, że spamowanie i brak prywatności podkopują zaufanie do technologii
Setki kontraktorów OpenAI czyta rozmowy użytkowników ChatGPT w celu ulepszania modelu
Newsy

Setki kontraktorów OpenAI czyta rozmowy użytkowników ChatGPT w celu ulepszania modelu

Śledztwo 404 Media ujawniło, że OpenAI zatrudnia setki kontraktorów do ręcznego przeglądania konwersacji ChatGPT, co budzi pytania o prywatność użytkowników.

Redakcja Aigest15 godz. temu

iOS 27: Siri odzyskuje blask dzięki integracji z Google Gemini i nowym funkcjom
Aplikacja Daydream wykorzystuje Apple Intelligence do zakupów modowych ze zdjęć
Newsy

Aplikacja Daydream wykorzystuje Apple Intelligence do zakupów modowych ze zdjęć

Aplikacja Daydream wprowadza nowe funkcje oparte na sztucznej inteligencji, umożliwiające przekształcanie zdjęć stylizacji w gotowe do zakupu produkty oraz wyszukiwanie ubrań za pomocą Siri.

Redakcja Aigest15 godz. temu

Dyskurs o spowolnieniu AI to gra na czas, nie realne hamowanie postępu
Badacz z Princeton proponuje Recurrent Looped Transformer (RLT) z nieskończoną głębią czasową

Bądź na bieżąco ze światem AI

Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.