404 Median mukaan OpenAI käyttää satoja ulkopuolisia kontraktoreita lukemaan käyttäjien aitoja ChatGPT-promptteja ja arvioimaan mallin vastauksia. Sisäisen hankkeen koodinimi on Project Lily, ja tapaus nostaa esiin kysymyksiä siitä, miten hyvin käyttäjät tietävät keskustelujensa mahdollisesta ihmisluennasta.
Satoja ihmisiä lukee oikeita käyttäjäkeskusteluja
Tutkiva media Joseph Coxin kirjoittamassa 404 Median jutussa 14.9.2026 kerrotaan, että OpenAI on palkannut satoja kontraktoreita käsittelemään valtavaa virtaa aitoja ChatGPT-käyttäjien promptteja. Arvioitava aineisto voi sisältää yksittäisiä kehotteita tai kokonaisia keskusteluja käyttäjän ja chatbotin välillä. ChatGPT:llä on raportin mukaan yli 900 miljoonaa käyttäjää, joista moni tuskin olettaa, että ihminen saattaa lukea heidän viestejään.
Sisäisissä dokumenteissa hanke esiintyy koodinimellä Project Lily. 404 Median näkemä materiaali ei kerro, mitä OpenAI-mallia tarkalleen koulutetaan – onko kyseessä nykyinen tuoteversio vai tuleva julkaisu. Toiminta on erillistä niistä turvallisuustarkastuksista, joissa yhtiö on kertonut käsittelevänsä esimerkiksi vakaviin haittoihin liittyviä keskusteluja.
Kontraktoreiden työ etenee tyypillisesti kolmessa vaiheessa. Ensin lukija näkee käyttäjän aidon promptin, sitten tiivistää, mitä käyttäjä hänen mukaansa pyytää, ja lopuksi arvioi neljää ChatGPT:n tuottamaa vastausta. Jokainen vastaus pisteytetään asteikolla 1-7. Ykkönen tarkoittaa käyttökelvotonta vastausta, seitsemän sellaista, jota olisi vaikea parantaa merkittävästi. Arvioijien on korostettava ainakin kolmea kohtaa vastauksesta ja perusteltava valintansa.
Tavoitteena vähemmän imartelua ja vähemmän ihmismäistä kieltä
Hankkeen tarkoitus ei ole vain yleinen laadunparannus. Sisäisten ohjeiden mukaan kontraktoreita ohjataan vähentämään mallin taipumusta antropomorfisoida itseään eli esiintyä ihmisen kaltaisena sekä suitsimaan sycophancy-ilmiötä, jossa malli imartelee käyttäjää tai myötäilee liikaa. 404 Media kytkee tämän OpenAI:n aiempiin ongelmiin GPT-4o-mallin yli-imartelevan sävyn kanssa, johon on viitattu myös oikeusprosesseissa.
Ohjeissa hyvän vastauksen kuvataan ymmärtävän käyttäjän tarkoituksen, tarjoavan hyödyllistä ja tarkkaa apua sekä kirjoittavan selkeällä, luonnollisella ja sopivan lämpimällä tyylillä. Samalla rangaistaan muun muassa ”AI-puhetta”, turhia emojeita, pakotettua käyttäjän tyylin matkimista ja väitteitä siitä, että mallilla olisi omia elämänkokemuksia tai tunteita.
Työntekijöitä rekrytoidaan 404 Median mukaan Crossing Hurdles -firman kautta, ja palkkaus kulkee AI-koulutukseen erikoistuneen Mercorin kautta. Yksi Pohjois-Amerikassa työskentelevä arvioija kertoi ansaitsevansa yli 50 dollaria tunnissa.
Yksityisyyssuodatin ei poista kaikkea tunnistettavaa
Kontraktoreille ei näytetä ChatGPT-käyttäjänimiä. OpenAI kertoi 404 Medialle käsittelevänsä keskustelut Privacy Filter -mallilla ennen kuin ne päätyvät ihmisten luettavaksi. Suodattimen tarkoitus on tunnistaa ja peittää henkilötietoja, kuten nimiä, yhteystietoja ja tunnisteita.
Yhtiö myöntää kuitenkin julkisessa kuvauksessaan, että Privacy Filter voi tehdä virheitä: se voi ohittaa harvinaisia tunnisteita tai moniselitteisiä yksityisiä viittauksia ja peittää liikaa tai liian vähän, kun konteksti on niukka. Lisäksi arvioijien näkymässä voi olla ”user memories summary” eli muistiyhteenveto, jossa näkyy aiempaa käyttöä ja joskus myös karkeaa tietoa siitä, missä päin maailmaa käyttäjä saattaa olla.
Tämä on keskeinen yksityisyysriski. Vaikka käyttäjätunnus puuttuu, keskustelun sisältö – terveystiedot, työkiistat, perheasiat tai tarkat elämäntilanteet – voi itsessään olla tunnistavaa. 404 Media kertoo nähneensä aitoja promptteja, joissa käyttäjä pyytää ChatGPT:tä pitämään sisällön luottamuksellisena. Yksi kontraktori arvioi, etteivät käyttäjät yleensä kuvittele ulkopuolisen lukevan keskustelujaan.
Suostumus ja oletusasetukset herättävät kysymyksiä
Kun 404 Media kysyi, missä OpenAI kertoo käyttäjille suoraan, että ihmiset voivat lukea promptteja mallin parantamiseksi, yhtiö ei aluksi vastannut. Myöhemmin se viittasi ohjesivuihin, joissa todetaan, että valtuutetut henkilöt ja luotetut palveluntarjoajat voivat tarkastella sisältöä mallin kehittämiseksi. Raporttien mukaan yhtiö myös päivitti ohjettaan median yhteydenoton jälkeen.
Käyttäjä voi estää uusien keskustelujen käytön mallin parantamiseen ChatGPT:n asetuksissa kohdasta Data Controls kytkemällä pois ”Improve the model for everyone” -asetuksen. Asetus on oletuksena päällä Free-, Plus- ja Pro-tileillä sekä oletuksena pois päältä Enterprise-, Business- ja Edu-asiakkailla. Muutos koskee lähinnä uusia keskusteluja: jo anonymisoituja ja tilistä irrotettuja keskusteluja ei raporttien mukaan voi välttämättä vetää jälkikäteen pois.
Temporary Chat -tila on toinen vaihtoehto: OpenAI:n mukaan sitä ei käytetä mallin parantamiseen, vaikka väärinkäytösten valvonta voi silti koskea sisältöä. Poistettujen keskustelujen osalta yhtiö on kertonut poistavansa aineistoa järjestelmistään yleensä 30 päivän kuluessa, ellei sisältöä ole jo anonymisoitu ja irrotettu tilistä mallin parantamista varten.
Eurooppalaisesta näkökulmasta The Next Web nosti esiin myös tietosuojavelvoitteen: rekisterinpitäjän on informoitava käyttäjiä asianmukaisesti keräämisvaiheessa. Aihe on ajankohtainen, koska monet käyttävät ChatGPT:tä kuin yksityistä neuvonantajaa tai ”digitaalista ystävää” ja syöttävät siihen arkaluonteisia tietoja.
Käytäntö ei ole vain OpenAI:n
404 Median mukaan Anthropic vahvisti käyttävänsä vastaavaa ihmisarviointia Clauden parantamiseen, kun käyttäjä on pitänyt mallin kehittämiseen liittyvän asetuksen päällä. Google on puolestaan kertonut Geminin yhteydessä, että ihmiset voivat tarkastella joitakin tallennettuja keskusteluja. Ihmispalaute (usein kuvattu RLHF-tyyppisenä koulutuksena, jossa ihmisten arviot ohjaavat mallia) on siis laajempi alan käytäntö, mutta Project Lily tekee näkyväksi, kuinka konkreettisesti ulkopuoliset lukijat käsittelevät tuotantokäytön keskusteluja.
Merkittävissä kansainvälisissä medioissa, kuten The Vergessä, TechCrunchissa, Wiredissä, Reutersissa tai Ars Technicassa, ei tämän jutun kirjoitushetkellä ollut laajaa itsenäistä jatkoselvitystä. Seuranta perustuu toistaiseksi 404 Median alkuperäisjuttuun ja saman vuorokauden aikana ilmestyneisiin yhteenvetoihin muun muassa THE DECODERissa, The Next Webissä, Tom’s Guidessa ja India Todayssa.
Painetta selkeyttää ilmoituksia ja oletuksia
Seuraavien päivien ja viikkojen kuluessa huomio kohdistunee siihen, päivittääkö OpenAI käyttöliittymässä näkyviä ilmoituksia entistä suoremmin, miten laajasti käyttäjät kytkevät ”Improve the model for everyone” -asetuksen pois ja reagoivatko tietosuojaviranomaiset erityisesti EU:ssa. Myös yrityskäyttäjät voivat tarkistaa, kulkevatko arkaluonteiset promptit kuluttajatuotteen kautta vai yrityssopimuksen kautta, jossa mallin parantaminen on oletuksena pois päältä.
Project Lily ei osoita tietomurtoa, vaan tuotantoprosessin suunnittelua: aitoja keskusteluja anonymisoidaan, suodatetaan ja annetaan ulkopuolisten arvioitavaksi mallin laadun vuoksi. Samalla se muistuttaa, että chatbotin tyhjä keskusteluikkuna voi tuntua yksityiseltä, vaikka taustalla kulkee ihmisluettava aineistovirta – ellei käyttäjä ole aktiivisesti rajoittanut sitä.
Lähteet
- 404 Media – Inside Project Lily: The Humans Reading Your ChatGPT Chats – 14.9.2026 – https://www.404media.co/inside-project-lily-the-humans-reading-your-chatgpt-chats/


Vastaa