Načítavam…
Vaše rozhovory s ChatGPT môžu čítať aj ľudia

OpenAI využíva stovky externých hodnotiteľov, ktorí kontrolujú reálne konverzácie používateľov. Firma sa pred ich odovzdaním snaží odstrániť osobné údaje, sama však pripúšťa, že filtre nemusia zachytiť všetko.

Používatelia ChatGPT často komunikujú s AI aj o veľmi osobných témach, no za určitých okolností sa k ich konverzáciám môžu dostať aj skutoční ľudia. Podľa vyšetrovania 404 Media využíva OpenAI stovky externých pracovníkov, ktorí hodnotia reálne otázky používateľov a odpovede ChatGPT. Interný projekt má označenie Project Lily.

Hodnotitelia nevidia používateľské meno účtu, samotná konverzácia však môže obsahovať osobné alebo citlivé informácie. Podľa 404 Media sa medzi materiálmi objavujú aj celé rozhovory, pričom niektoré otázky používateľov dokonca naznačujú, že očakávali, že ich obsah zostane iba medzi nimi a chatbotom.

Ľudia hodnotia, ako dobre ChatGPT odpovedá

Úlohou externých pracovníkov nie je iba čítať konverzácie. Najskôr majú pochopiť a stručne opísať, čo sa používateľ snaží dosiahnuť, a následne hodnotia odpovede vytvorené ChatGPT.

Odpovede dostávajú hodnotenie na škále od 1 do 7, kde jednotka znamená prakticky nepoužiteľnú odpoveď a sedmička odpoveď, ktorú by už bolo ťažké výraznejšie zlepšiť. Hodnotitelia zároveň vysvetľujú, čo bolo na odpovedi dobré alebo problematické.

OpenAI sa týmto spôsobom snaží model naučiť nielen správnejšie odpovedať, ale aj prirodzenejšie komunikovať. Interné pokyny podľa 404 Media upozorňujú napríklad na prílišnú ústretovosť voči používateľovi, takzvanú sycophancy, zbytočné napodobňovanie jeho štýlu alebo emócií a správanie, pri ktorom sa AI prezentuje príliš ľudsky. Model má tón používateľa do určitej miery rešpektovať, ale zároveň zostať profesionálny a nepredstierať vlastné emócie či osobné skúsenosti.

Hodnotiteľ môže vidieť aj súhrn toho, čo o vás ChatGPT vie

Zaujímavým detailom vyšetrovania je aj takzvaný user memories summary. Ten sa podľa 404 Media pri niektorých úlohách zobrazuje nad samotnou konverzáciou a môže sumarizovať, na čo používateľ ChatGPT používal v minulosti, aké témy ho zaujímajú alebo ďalší osobný kontext.

V niektorých prípadoch môže takýto súhrn obsahovať aj približnú informáciu o tom, kde sa používateľ nachádza. Neznamená to však, že hodnotiteľ dostáva prístup k celému účtu alebo histórii používateľa.

Osobné údaje sa OpenAI snaží odstrániť

Predtým, ako sa konverzácie dostanú k hodnotiteľom, ich OpenAI spracuje pomocou svojho systému Privacy Filter, ktorý má rozpoznávať a maskovať osobné údaje.

Ani tento systém však nie je neomylný. OpenAI uvádza, že môže prehliadnuť nezvyčajné identifikátory alebo nejednoznačné súkromné údaje, prípadne niektoré informácie odstrániť nesprávne. Verejne dostupná verzia Privacy Filter dosahuje v benchmarku PII-Masking-300k približne 98 % recall, takže nejde o stopercentnú ochranu.

To vysvetľuje, prečo môžu hodnotitelia napriek anonymizácii naraziť na citlivé údaje priamo v texte konverzácie. OpenAI zároveň pracovníkov podľa 404 Media inštruuje, aby úlohy obsahujúce potenciálne osobné informácie alebo bezpečnostné problémy označili na ďalšie riešenie.

Používanie konverzácií sa dá vypnúť

OpenAI otvorene uvádza, že pri osobných službách, ako je ChatGPT, môže obsah konverzácií používať na ďalšie zlepšovanie a tréning svojich modelov. Používateľ to však môže vypnúť cez Settings → Data Controls → Improve the model for everyone. Po deaktivovaní sa nové konverzácie na tréning ChatGPT nepoužívajú.

Podľa OpenAI sa Privacy Filter používa pri tréningových procesoch aj na používateľské konverzácie v prípade, že má používateľ túto možnosť zapnutú. Temporary Chat predstavuje ďalšiu možnosť: tieto rozhovory sa nezobrazujú v histórii, nevytvárajú pamäť a nepoužívajú sa na zlepšovanie modelov. OpenAI ich uchováva 30 dní z bezpečnostných dôvodov a následne ich vymaže.

Pre osobné účty Free, Plus a Pro je podľa informácií poskytnutých 404 Media používanie konverzácií na zlepšovanie modelov štandardne povolené. Pri Business, Enterprise a Edu účtoch je táto možnosť štandardne vypnutá. Zmena nastavenia sa navyše týka nových konverzácií a nepôsobí spätne na obsah, ktorý už mohol byť spracovaný.

OpenAI ľudských hodnotiteľov výrazne nezdôrazňuje

Práve toto je jedna z najzaujímavejších častí celého prípadu. 404 Media sa OpenAI priamo opýtalo, kde používateľov informuje o tom, že ich konverzácie môžu pri zlepšovaní ChatGPT čítať ľudia. Firma podľa reportu na túto konkrétnu otázku priamo neodpovedala.

Po otázkach od 404 Media OpenAI aktualizovalo svoju stránku vysvetľujúcu nastavenie „Improve the model for everyone“ a pridalo podrobnejšie informácie o možnosti vypnúť tréning. Ani aktualizovaná stránka však podľa 404 Media výslovne neuvádzala, že vybrané konverzácie môžu čítať ľudskí hodnotitelia.

Podobné postupy pritom nie sú výsadou OpenAI. Anthropic pre 404 Media potvrdil, že ľudské hodnotenie používa aj pri zlepšovaní Claude, ak má používateľ zapnuté príslušné nastavenie. Google zase pri Gemini upozorňuje, že niektoré uložené konverzácie môžu kontrolovať ľudia.

Pre používateľov z toho vyplýva jednoduché pravidlo: AI chatboty je stále vhodné vnímať ako cloudové služby, nie ako úplne súkromný rozhovor medzi dvoma ľuďmi. Ak nechcete, aby sa vaše nové konverzácie používali na zlepšovanie ChatGPT, môžete túto možnosť vypnúť v nastaveniach, prípadne pri citlivejšej komunikácii použiť Temporary Chat.



Komentáre

Meno:
:)