„Google“ teigia, kad naujoji AI modelių šeima turi įdomią savybę: galimybę „identifikuoti“ emocijas.
Ketvirtadienį paskelbta, kad „PaliGemma 2“ modelių šeima gali analizuoti vaizdus, leidžia AI generuoti antraštes ir atsakyti į klausimus apie žmones, kuriuos „mato“ nuotraukose.
„PaliGemma 2 sukuria išsamias, kontekstui svarbias vaizdų antraštes“, – rašė „Google“ dienoraščio įraše, pasidalytame su „TechCrunch“, – ne tik objekto identifikavimą, bet ir veiksmus, emocijas ir bendrą scenos pasakojimą.
Emocijų atpažinimas neveikia iš karto, o PaliGemma 2 turi būti tiksliai sureguliuotas šiam tikslui. Nepaisant to, ekspertai, su kuriais kalbėjosi „TechCrunch“, buvo sunerimę dėl atvirai prieinamo emocijų detektoriaus.
„Tai mane labai neramina“, – „TechCrunch“ sakė Oksfordo interneto instituto duomenų etikos ir dirbtinio intelekto profesorė Sandra Wachter. „Man sunku manyti, kad galime „skaityti“ žmonių emocijas. Tai tarsi patarimo klausti „Magic 8 Ball“.
Daugelį metų startuoliai ir technologijų gigantai bandė sukurti dirbtinį intelektą, galintį aptikti emocijas, pradedant pardavimų mokymais ir baigiant nelaimingų atsitikimų prevencija. Kai kurie teigia, kad tai pasiekė, tačiau mokslas stovi ant netvirtos empirinės bazės.
Dauguma emocijų detektorių remiasi ankstyvuoju psichologo Paulo Ekmano darbu, kuris iškėlė teoriją, kad žmones sieja šešios pagrindinės emocijos: pyktis, nuostaba, pasibjaurėjimas, malonumas, baimė ir liūdesys. Vėlesni tyrimai suabejojo Ekmano hipoteze, tačiau įrodo, kad yra didelių skirtumų tarp skirtingų šeimų žmonių išreiškimo, kaip jaučiasi.
„Emocijų aptikimas paprastai neįmanomas, nes žmonės emocijas patiria sudėtingais būdais“, – „TechCrunch“ sakė Mike'as Cookas, Karalienės Marijos universiteto mokslininkas, besispecializuojantis dirbtinio intelekto srityje. „Žinoma, mes manome, kad galime pasakyti, ką kiti žmonės jaučia, žiūrėdami į juos, ir per daugelį metų daugelis žmonių taip pat bandė, pavyzdžiui, šnipinėjimo agentūros ar rinkodaros įmonės. Esu tikras, kad kai kuriais atvejais visiškai įmanoma aptikti kai kuriuos bendrinius reikšmininkus, bet mes niekada negalime to visiškai „išspręsti“.
Nenuostabu, kad emocijų aptikimo sistemos dažniausiai yra nepatikimos ir šališkos dėl jų kūrėjų prielaidų. 2020 m. MIT tyrime mokslininkai parodė, kad veidą analizuojantys modeliai gali sukurti nenumatytą pirmenybę tam tikroms išraiškoms, pavyzdžiui, šypsenai. Naujausi darbai rodo, kad emocinės analizės modeliai juodaodžių veiduose priskiria daugiau neigiamų emocijų nei baltųjų.
„Google“ teigia, kad atliko „išsamų testavimą“, siekdama įvertinti demografinius PaliGemma 2 paklaidas, ir nustatė „mažą toksiškumo ir nešvankybių lygį“, palyginti su pramonės etalonais. Tačiau bendrovė nepateikė viso naudojamų etalonų sąrašo ir nenurodė, kokių tipų bandymai buvo atlikti.
Vienintelis etalonas, kurį „Google“ atskleidė, yra „FairFace“, dešimčių tūkstančių žmonių nuotraukų rinkinys. Bendrovė teigia, kad „PaliGemma 2“ gerai įvertino „FairFace“. Tačiau kai kurie mokslininkai kritikavo etaloną kaip šališkumo metriką, pažymėdami, kad „FairFace“ atstovauja tik kelioms rasių grupėms.
„Emocijų interpretavimas yra gana subjektyvus dalykas, apimantis ne tik vaizdines priemones, bet ir labai įtrauktas į asmeninį ir kultūrinį kontekstą“, – sakė Heidy Khlaaf, vyriausioji AI dabar instituto, ne pelno organizacijos, tiriančios dirbtinio poveikio visuomenei pasekmes. intelektas. „Neskaitant AI, tyrimai parodė, kad emocijų negalime numanyti vien iš veido bruožų.
Emocijų aptikimo sistemos sukėlė reguliuotojų užsienyje pyktį, kurie siekė apriboti technologijos naudojimą didelės rizikos kontekstuose. AI įstatymas, pagrindinis ES dirbtinio intelekto teisės aktas, draudžia mokykloms ir darbdaviams naudoti emocijų detektorius (bet ne teisėsaugos agentūras).
Didžiausias nuogąstavimas dėl atvirų modelių, tokių kaip PaliGemma 2, kurį galima įsigyti iš daugelio kompiuterių, įskaitant AI dev platformą Hugging Face, yra tai, kad jais bus piktnaudžiaujama arba jais bus piktnaudžiaujama, o tai gali sukelti realią žalą.
„Jei šis vadinamasis „emocinis identifikavimas“ grindžiamas pseudomokslinėmis prielaidomis, tai turės reikšmingų pasekmių, kaip šis gebėjimas gali būti panaudotas siekiant toliau – ir klaidingai – diskriminuoti marginalines grupes, pavyzdžiui, teisėsaugos, žmogiškųjų išteklių, sienų valdymo ir taip toliau“, – sakė Khlaafas.
Paklaustas apie pavojus, kylančius viešai išleidžiant „PaliGemma 2“, „Google“ atstovas sakė, kad bendrovė laikosi „reprezentacinės žalos“ testų, susijusių su vaizdiniu atsakymu į klausimus ir antraštėmis. „Mes atlikome patikimus PaliGemma 2 modelių vertinimus, susijusius su etika ir sauga, įskaitant vaikų saugą ir turinio saugą“, – pridūrė jie.
Stebėtojas nėra įsitikinęs, kad to pakanka.
„Atsakingos naujovės reiškia, kad jūs galvojate apie pasekmes nuo pirmos dienos, kai įžengiate į savo laboratoriją, ir tai darote per visą produkto gyvavimo ciklą“, – sakė ji. „Galiu galvoti apie daugybę galimų problemų (su tokiais modeliais), kurios gali sukelti distopinę ateitį, kai nuo emocijų priklauso, ar gausi darbą, paskolą ir ar būsi priimtas į universitetą.