Setki kontraktorów OpenAI czyta rozmowy użytkowników ChatGPT w celu ulepszania modelu
Śledztwo 404 Media ujawniło, że OpenAI zatrudnia setki kontraktorów do ręcznego przeglądania konwersacji ChatGPT, co budzi pytania o prywatność użytkowników.

Śledztwo przeprowadzone przez 404 Media ujawniło, że OpenAI zatrudnia setki kontraktorów, którzy analizują rzeczywiste rozmowy użytkowników ChatGPT. Celem tego procesu jest ulepszanie odpowiedzi chatbota. Informacje te pochodzą z wewnętrznych dokumentów, do których dotarło 404 Media, oraz od dodatkowych źródeł.
Jak działa proces recenzowania
Recenzenci oceniają odpowiedzi ChatGPT w skali od jednego do siedmiu. Ich zadaniem jest redukcja nadmiernej uprzejmości oraz ludzkich zachowań w generowanych przez model tekstach. Jeden z recenzentów w rozmowie z 404 Media wyraził przekonanie, że użytkownicy nie są świadomi, iż ich czaty są czytane przez ludzi. Potwierdzają to również same przeglądane prompt'y, w których niektórzy użytkownicy wyraźnie prosili ChatGPT o zachowanie prywatności treści. Choć prompt'y są anonimizowane, mogą nadal zawierać wrażliwe dane osobowe. OpenAI stosuje filtr prywatności, jednak firma przyznaje, że może on popełniać błędy.
Kontraktorzy są rekrutowani za pośrednictwem firmy Crossing Hurdles i opłacani przez Mercor, firmę szkoleniową w dziedzinie AI. Jeden z recenzentów z Ameryki Północnej poinformował, że zarabia ponad 50 dolarów za godzinę.
Ustawienia prywatności i świadomość użytkowników
Użytkownicy mogą wyłączyć domyślnie włączone ustawienie „Ulepsz model dla wszystkich”, aby ich czaty nie były wykorzystywane do treningu modelu i potencjalnie przeglądane przez ludzi. Należy jednak pamiętać, że to ustawienie dotyczy wyłącznie nowych konwersacji. OpenAI oferuje również tymczasowy tryb czatu, który, według firmy, nie wykorzystuje danych wejściowych do treningu modelu.
Zapytane przez 404 Media o to, gdzie użytkownicy są wyraźnie informowani o ludzkiej recenzji, OpenAI początkowo nie odpowiedziało. Na stronie FAQ firmy znajduje się informacja, że upoważniony personel i dostawcy usług mogą przeglądać dane użytkowników w celu poprawy wydajności modelu, a także zalecenie, aby nie wprowadzać wrażliwych informacji. To powiadomienie jest dostępne online co najmniej od 2023 roku i na przestrzeni lat uległo jedynie niewielkim zmianom.
404 Media argumentuje, że ujawnienie tych informacji jest zbyt ukryte i zbyt niejasne, aby użytkownicy byli świadomi faktycznego zakresu ludzkiej recenzji. Stwierdzenie „Ulepsz model dla wszystkich” brzmi bardziej jak zachęta do wkładu w społeczność niż zgoda na to, by ludzie czytali rozmowy. Prawdopodobnie takie nieprecyzyjne sformułowanie jest celowe. Gdyby OpenAI prosiło o wyraźną zgodę, wskaźnik rezygnacji byłby prawdopodobnie wysoki.
Powszechność praktyki w branży AI
Humanitarna informacja zwrotna jest kluczowym elementem ulepszania modeli AI dla laboratoriów. Praktyka ta jest również szeroko rozpowszechniona w branży. Anthropic potwierdziło 404 Media, że wykorzystuje ludzkich recenzentów do sprawdzania odpowiedzi swojego chatbota Claude i ulepszania przyszłych modeli. Dotyczy to użytkowników, którzy mają włączone ustawienie „Pomóż ulepszyć nasze modele AI” w swoich ustawieniach prywatności. Anthropic również anonimizuje rozmowy przed recenzją, usuwając dane konta, takie jak adresy e-mail. Google również korzysta z ludzkich recenzentów i zaznacza w Gemini, że ludzie mogą przeglądać zapisane czaty.
Ujawnienie tej praktyki przez 404 Media podkreśla napięcie między potrzebą ulepszania modeli sztucznej inteligencji a prawem użytkowników do prywatności. Chociaż ludzka recenzja jest uznawana za niezbędną do rozwoju zaawansowanych systemów AI, transparentność i jasne informowanie o zakresie zbierania i analizy danych stają się kluczowe dla budowania zaufania w erze coraz bardziej inteligentnych technologii.
Źródło: the-decoder.com
Komentarze
Zaloguj się, aby dołączyć do dyskusji.
Nikt jeszcze nie skomentował. Bądź pierwszy!
Czytaj dalej

iOS 27: Siri odzyskuje blask dzięki integracji z Google Gemini i nowym funkcjom
Najnowsza aktualizacja systemu iOS 27 znacząco odmienia asystenta Siri, czyniąc go bardziej użytecznym i kontekstowym. Użytkownicy zauważają, że po latach marginalnego wykorzystania, Siri staje się kluczowym narzędziem d
Redakcja Aigest3 godz. temu

Aplikacja Daydream wykorzystuje Apple Intelligence do zakupów modowych ze zdjęć
Aplikacja Daydream wprowadza nowe funkcje oparte na sztucznej inteligencji, umożliwiające przekształcanie zdjęć stylizacji w gotowe do zakupu produkty oraz wyszukiwanie ubrań za pomocą Siri.
Redakcja Aigest4 godz. temu

Dyskurs o spowolnieniu AI to gra na czas, nie realne hamowanie postępu
Dario Amodei z Anthropic proponuje spowolnienie rozwoju AI, zyskując poparcie gigantów. Moim zdaniem to strategia, która ma na celu uspokojenie rynków i regulatorów, a nie faktyczne zahamowanie wyścigu.
Michał Chmielarz13 godz. temu
Badacz z Princeton proponuje Recurrent Looped Transformer (RLT) z nieskończoną głębią czasową
Yifan Zhang z Princeton zaprezentował koncepcję Recurrent Looped Transformer (RLT), innowacyjnego modelu łączącego koder przyczynowy z rekurencyjnym dekoderem. Rozwiązanie to ma na celu usprawnienie przetwarzania sekwenc
Redakcja Aigestwczoraj

ElevenLabs udostępnia Music v2.5: bardziej naturalna muzyka generowana przez AI
ElevenLabs wprowadziło Music v2.5, nową wersję swojego generatora muzyki AI, która oferuje pełniejsze i bardziej naturalne brzmienie. Narzędzie jest dostępne zarówno w aplikacji, jak i przez API, z opcjami darmowymi i pł
Redakcja Aigestwczoraj

AllSpark prezentuje Iris-mini i Iris-pro: najsilniejsze otwarte agenty wyszukiwania
Zespół AllSpark wprowadził na rynek Iris-mini i Iris-pro – dwa otwarte agenty wyszukiwania, które, według twórców, osiągają najlepsze wyniki w swoich klasach, przewyższając konkurencję na kluczowych benchmarkach.
Redakcja Aigestwczoraj
Bądź na bieżąco ze światem AI
Najważniejsze newsy, recenzje i poradniki — raz w tygodniu, prosto na maila. Bez spamu.