Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

techcrunchtechcrunchtechcrunchNew York Timesin kolme vuotta kestäneen, OpenAIta ja Microsoftia vastaan nostetun tekijänoikeusoikeudenkäynnin uudet, sensuroimattomat asiakirjat paljastavat, että molempien yhtiöiden ylimmät johtajat myönsivät yksityisesti tekoälyn koulutuskäytäntöjensä vastaavan varkautta ja muodostavan eksistentiaalisen uhan julkaisijoille, joiden työ ruokki heidän mallejaan.
Torstaina julkistetut asiakirjat osoittavat, että Microsoftin soveltavan tieteen johtaja Brent Hecht kuvaili yhtiöiden massiivista uutissisällön keräämistä "hämmästyttäväksi, ennennäkemättömän mittakaavan varkaudeksi" ja "ihmiskunnan historian suurimmaksi työn varkaudeksi" tammikuun 2023 sisäisessä muistiossa. Tammikuun 2024 erillisessä esityksessä Hecht varoitti, että Microsoftin tekoälylähtöinen lähestymistapa oli luonut "tuomiokierteen", joka "vahingoittaisi malliemme suorituskykyä ja koko verkkoa samanaikaisesti".wsj+1
Microsoftin omat tiedot osoittivat, että sen Copilot-vastauskone sai Timesin verkkotunnuksen klikkausprosentit laskemaan jopa 93 % verrattuna perinteiseen Bing-hakuun. OpenAIn ChatGPT-yksikön johtaja Nick Turley kirjoitti sisäisesti, että julkaisijat kohtaavat "eksistentiaalisen uhan" chatbotien kaltaisista tuotteista, joita hän kuvaili "pitkälti korvaaviksi". OpenAIn presidentti Greg Brockman kutsui malleja "erinomaisiksi uutisissa", kun taas Microsoftin toimitusjohtaja Satya Nadella todisti valan alla, että chatbotien kanssa keskustelu "on korvannut… tiedon antamisen suoraan verkkosivustolla tekoälyalustalla sen sijaan, että käyttäjän pitäisi mennä alkuperäiseen lähteeseen".techcrunch
Asiakirjat paljastavat ensimmäistä kertaa väitetyn kopioinnin laajuuden: OpenAIn pelkät koulutuksen välivaiheen tietoaineistot sisälsivät yli 91 692 kopiota Timesin, Daily Newsin ja Center for Investigative Reportingin julkaisemista teoksista, kun taas Common Crawl -pohjainen aineisto sisälsi yli 2 miljoonaa dokumenttia nytimes.com-sivustolta. Yhtiöiden väitetään myös koonneen koulutusdataa Project Taxi ja Project Mango -nimisten aloitteiden kautta, joista jälkimmäinen sisälsi kopioita vähintään 160 903 uniikista uutisjulkaisijoiden teoksesta.techcrunch
Asiakirjoissa kuvataan, kuinka OpenAIn työntekijöiden väitetään kehittäneen menetelmiä maksumuurien kiertämiseksi huomaamatta. Kun tutkija Nick Ryder kertoi Brockmanille "hakkerointikeinosta nytimesin maksumuurin kiertämiseksi", Brockman vastasi: "ah, hienoa". Työntekijöiden väitetään myös poistaneen tekijänoikeusilmoitukset koulutusdatasta, koska tutkijat "eivät haluaisi mallin tuottavan" tällaisia ilmoituksia käyttäjille.techcrunch
Myönnytykset voivat heikentää OpenAIn vetoamista kohtuulliseen käyttöön, erityisesti vaatimusta siitä, ettei käyttö saa vahingoittaa alkuperäisen teoksen markkinoita. Nadella itse todisti, että "kaiken, mikä on maksumuurin takana, tulisi olla lisensoitua kenelle tahansa, joka haluaa käyttää sitä… pohjustusta tai koulutusta varten". TechCrunchin mukaan Trumpin hallinto jätti aiemmin tässä kuussa lausunnon, jossa se puolusti OpenAIn lisensoimatonta tekijänoikeudella suojatun materiaalin käyttöä. OpenAI ja Microsoft eivät vastanneet kommenttipyyntöihin.techcrunch