Nagyobb mell, rövidebb szoknya: valójában emberek is nézik a Microsoft chatbotjának küldött képeket

Ha a Microsoft Copilot chatbotjára bízza valaki egy fotó átszerkesztését, arra számítana, hogy a kép közte és a gép között marad. Kiderült: a kérések egy részét emberek kapják meg, és alkalmanként nekik kell eldönteniük, melyik változatban lett elég nagy egy mell. Sőt.

Aki feltölt egy szelfit a Microsoft Copilotba, és megkéri, hogy mondjuk igazítsa meg rajta a frizuráját, aligha gondolna arra, hogy ezt a képet rajta és a gépen kívül más is láthatja. A Copilot adatvédelem szempontjából is kényes kérdést vetnek fel a 404 Media amerikai oknyomozó portál által megszerzett belső dokumentumok: eszerint

a chatbotnak küldött képszerkesztési kérések egy része emberek elé kerül.

Legalább több száz alvállalkozó látja a felhasználó eredeti kérését, a feltöltött fotót és a gép által elkészített változatokat is.

Copilot adatvédelem

A lap az alvállalkozóknak szóló útmutatókra, valós felhasználói kérésekre és képekre, valamint az értékelők belső üzenőfalán folytatott beszélgetésekre hivatkozik. (Az értékelők a mesterséges intelligencia munkáját ellenőrzik: megnézik, mit kért a felhasználó, mit adott vissza a gép, és eldöntik, melyik megoldás sikerült jobban.) Az egyik értékelő névtelenséget kért, mert nem nyilatkozhat a sajtónak. Így írta le, mit lát:

Nagyon gyakoriak a szexuális jellegű kérések, és kétséges, hogy a képeken szereplők beleegyeztek-e abba, amit a fotóikkal csinálnak.

Hol találkozhatunk ezzel?

A Copilot a Microsoft csevegőprogramja, amelyet a copilot.com oldalon, Windowsban, a mobilalkalmazásban és az Edge böngészőben is elérhetünk. Kérdésekre válaszol, képeket készít, és a beszélgetésbe feltöltött fotót a kérésünkre átalakítja.

Ehhez elég a pluszjelre kattintani, a menüben a képek vagy fájlok hozzáadását választani, kiválasztani a képet, majd leírni, mit változtasson rajta, például hogy tüntesse el a háttérben álló embereket, vagy tegye át a jelenetet egy erdőbe.

A 404 Media által látott útmutatók pontosan ezt a helyzetet írják le: amikor a felhasználó a csevegőablakban kéri meg a Copilotot, hogy szerkesszen át egy képet.

Copilot adatvédelem

A Microsoft adatvédelmi GYIK-je szerint, amely a Copilot-alkalmazás régebbi változatára vonatkozik, a munkahelyi vagy iskolai fiókkal bejelentkezők beszélgetései nem kerülnek a modellek tanítására szolgáló adatok közé. Ugyanez igaz a Microsoft 365 otthoni előfizetéseiben a Wordbe, Excelbe, PowerPointba és Outlookba épített Copilotra.

Ez a kitétel azonban csakis a tanításra vonatkozik.

Arról, hogy ezek a felhasználók az emberi értékelésből is kimaradnak-e, a Microsoft nem nyilatkozott: a 404 Media megkeresésére csak annyit közölt, hogy az ügyféladatokat a felhasználási feltételeknek megfelelően, többek között termékei fejlesztésére és magatartási kódexe betartatására használja.

Nagyobb mell, rövidebb szoknya, She-Hulk

Az alvállalkozók belső üzenőfalán az egyik értékelő olyan kérésekről írt, amelyekben a felhasználók arra kérték a Copilotot, hogy rövidítse meg egy valódi nő szoknyáját, növelje meg a melleit, vagy tűsarkúban mutasson többet a lábából. A képeken gyakran feltűnik She-Hulk, a Marvel-képregények zöld bőrű hősnője. Az értékelők gyerekeknek szóló rajzfilmfigurákról kért lábfétis képekkel is találkoztak, valamint olyan kérésekkel, amelyek

embereket helyeznek szexuális pózokba.

Egy alvállalkozó arról számolt be, hogy egyetlen feladatcsomagban nyolc, szoknya alá készített fotót kapott. Egy másik értékelő „valamiféle állatáldozat” képeit látta, egy harmadik pedig szexuális mozdulatokat és pozíciókat kérő utasításokat olvasott.

Többen anorexiát népszerűsítő tartalmakról írtak. Az egyik kérés arra szólította fel a Copilotot, hogy Ariana Grandét anorexiásként ábrázolja. Beszámolnak olyan kérésekről, amely fiatal lányok egy csoportjáról akar trágár vagy kihívó képet készíteni.

A feladat: eldönteni, melyik lett jobb

Az értékelőket nem azért fizetik, hogy kiszűrjék vagy jelentsék a sértő tartalmakat.

Az ő dolguk a Copilot munkájának minőségét megítélni, a szexuális képek esetében ugyanúgy, mint bármely más képnél. Az útmutató szerint az értékelő megkapja a felhasználó eredeti kérését, a feltöltött fotót és a Copilot két szerkesztett változatát, majd kiválasztja a jobbat.

Négy szempontot kell mérlegelnie. Követi-e a kép a szerkesztési utasítást? Változatlan maradt-e minden, aminek annak kellett maradnia? Vannak-e rajta torzulások vagy természetellenes felületek? És milyen a végeredmény összességében? Az útmutató példája szerint, ha a kérés az, hogy „tegyél egy csészét az asztalra”, akkor a csészén kívül semmi nem változhat a képen.

A Microsoftot kifejezetten az értékelők ösztönös benyomása érdekli.

Bízz a megérzéseidben: amikor egymás mellett ránézel a két szerkesztett képre, melyik tűnik azonnal jobbnak? Emberi nézőként számít a zsigeri reakciód

– áll az útmutatóban. A folytatás: „Ha kétségeid vannak, az első benyomásodra hagyatkozz. Az emberi intuíció jól kiszúrja azokat a finom minőségi különbségeket, amelyeket nehéz szavakba önteni.”

Hogy ez a gyakorlatban mit jelent, azt egy alvállalkozó így foglalta össze a belső fórumon:

Nehéz bármit komolyan venni, amikor arra kell figyelnem, melyik modell generálta a megfelelő mellméretet, vagy melyik középkorú nőt helyezte anatómiailag megfelelő, szexuálisan kihívó pózba.

Az amerikai The A.V. Club kulturális magazin a témáról írt cikkében egyenesen úgy fogalmazott, hogy az értékelők azt döntik el, melyik mesterséges intelligenciával készült, szoknya alá fényképezett She-Hulk teljesíti legjobban a felhasználó kérését.

Mi áll a szabályzatban?

A Copilot felhasználási feltételei tiltják a felnőtt és a felkavaró tartalmat, a gyermekek szexuális kizsákmányolását ábrázoló anyagokat, a beleegyezés nélküli képszerkesztést és a deepfake-eket. A képszerkesztésről szóló súgóoldal azt is kéri, hogy ne töltsünk fel olyan képet, amely mások magánszféráját sérti, vagy valakit a beleegyezése nélkül ábrázol.

A Microsoft adatvédelmi tájékoztatója szerint a modellek tanításához felhasznált képekről eltávolítják a metaadatokat, az arcokat pedig elhomályosítják:

a 404 Media forrása ezzel szemben azt állítja, hogy az általa látott képeken az arcok mindig kitakaratlanok.

Ugyanez a tájékoztató kimondja, hogy egyes Copilot-beszélgetéseket „termékfejlesztési és biztonsági célból” gépek és emberek is átnéznek. Azt is rögzíti, hogy „képzett AI-szakértők” értékelhetik a beszélgetéseket a modellek pontosságának és biztonságának javítása érdekében. Ha felmerül a gyanú, hogy a felhasználó megsértette a magatartási kódexet, a vizsgálat részeként korlátozott emberi ellenőrzés kötelező, és ez alól nem lehet kibújni. A feltöltött fájlokat a Microsoft legfeljebb 18 hónapig tárolja. (Augusztus 18. óta a Copilot-alkalmazás új változata érhető el, ehhez a cég külön oldalakat készített.)

A beállítások között letilthatjuk, hogy a beszélgetéseinket a Microsoft a modellek tanítására használja. A cég leírása szerint azonban ez csak a jövőbeli beszélgetésekre hat, és a tiltás ellenére a Microsoft a beszélgetéseket általános termékfejlesztésre, hirdetésekre, valamint biztonsági és a jogszabályok betartása érdekében továbbra is felhasználhatja.

Hasonló eset két héttel korábban a ChatGPT-vel

A 404 Media szeptember 14-én az OpenAI-ról közölt hasonló cikket. Beszámolójuk szerint a „Project Lily” fedőnevű programban több száz alvállalkozó olvas valós ChatGPT-beszélgetéseket, és értékeli a chatbot válaszait. A beszélgetésekben olykor érzékeny személyes adatok is szerepelnek.

Ugyanebben a cikkben az Anthropic (Claude) is megerősítette a lapnak, hogy emberi ellenőrzést használ a modelljei fejlesztésére.

Az emberi munkának ma is nagy szerepe van a mesterséges intelligencia betanításában, és ennek a munkának a nagy részét alacsony bérű országokban végzik.

A Time magazin még 2023 elején derítette ki, hogy az OpenAI egy kenyai alvállalkozón, a Samán keresztül olyan munkásokkal címkéztette a ChatGPT biztonsági szűrőjéhez szükséges szövegeket, akik óránként 1,32 és 2 dollár közötti összeget vittek haza.

A szövegek egy része gyermekek szexuális bántalmazását, állatokkal való szexet, gyilkosságot, kínzást és vérfertőzést írt le részletesen.

Az egyik munkás elmondta, hogy visszatérő képek gyötörték, miután egy különösen brutális leírást kellett feldolgoznia. A Sama végül 2022 februárjában, a tervezettnél nyolc hónappal korábban felmondta a megbízást.

Venezuelában a gazdasági összeomlás tette az országot az adatcímkézés egyik központjává. Az MIT Technology Review 2022-es riportja szerint a képeket címkéző, tartalmakat moderáló venezuelaiak sokszor centekért dolgoztak. A Scale AI Remotasks nevű platformjának operatív alelnöke szerint az ottani munkások átlagosan alig több mint 90 centet kerestek óránként.

Copilot adatvédelem

A helyzet azóta sem változott sokat.

A 404 Media idén márciusban ismét egy kenyai férfiról írt, aki napi nyolc órán át pornófilmek minden egyes képkockáját írta le egy adatcímkéző cégnek, műszakja után pedig AI-alapú szexchatbotok mögött ülve magányos felhasználókkal levelezett. Álmatlanság és poszttraumás stressz-zavar (PTSD) lett a vége, és a saját intim élete is megsínylette. A férfi ma egy kenyai adatcímkézői érdekvédelmi szervezet, a Data Labelers Association főtitkára.

A nagy technológiai cégek, különösen a közösségimédia-vállalatok, évek óta alvállalkozók tömegeivel moderáltatják a felhasználók tartalmait. A Time már 2022 februárjában beszámolt arról, hogy a Sama a Facebooknak is dolgozott: moderátorai mindössze 1,5 dolláros órabérért néztek kivégzéseket, nemi erőszakot és gyermekbántalmazást ábrázoló képeket és videókat.

A mostani ügyben az az újdonság, hogy

az értékelők olyan kéréseket és feltöltéseket látnak, amelyeket a felhasználók privátnak hisznek, és nem biztonsági szűrés céljából nézik őket, hanem azért, hogy a chatbot válaszai jobbak legyenek.

Legalább figyelmeztetést kértek

A Prolific az egyik cég, amely erre a munkára alvállalkozókat toboroz. Honlapján többek között azzal hirdeti magát, hogy reprezentatív csoportoktól gyűjt emberi visszajelzést modellek hangolásához, biztonsági értékelésekhez és referenciamérésekhez.

Copilot adatvédelem

Az értékelők egy része arra panaszkodott, hogy úgy vállaltak el feladatokat, hogy nem tudták: azok explicit, sőt akár illegális képeket is tartalmaznak. Aki a nyolc szoknya alatti fotót kapta, arra kérte a feletteseit, hogy a feladatot lássák el »nem biztonságos tartalom« jelzéssel. A mellméretről író alvállalkozó ezzel a kérdéssel kezdte a hozzászólását:

Ki írja ezeket a kéréseket, és ki döntötte el, hogy a Copilot mostantól lényegében pornógyártásra összpontosít?

2024 januárjában pornográf képek terjedtek el Taylor Swiftről az X-en (korábban Twitter). A Microsoft ingyenes képgenerátorával előállított képek a 4chan fórumról és egy mesterséges intelligenciával készült pornóra szakosodott Telegram-csoportból származtak. A Microsoft a 404 Media cikke után zárta be a Microsoft Designerben azt a kiskaput, amelyen keresztül ezek a képek készültek.

Hogy a beszélgetéseink és a feltöltött képeink bekerülhetnek-e a modellek tanítására szolgáló adatok közé, az a legtöbb szolgáltatásnál egyetlen, alapból bekapcsolt beállításon múlik. Korábbi cikkünkben lépésről lépésre bemutattuk, hol kapcsolhatjuk ki ezt a ChatGPT-ben, a Claude-ban és a Geminiben. Arról is írtunk, mit érdemes átnézni a Copilotban, a LinkedInben és az X-ben, és mi az, amit nem old meg önmagában ez a kapcsoló.