Markt & Trends

Microsoft-manager: nieuwsartikelen gebruiken voor AI-training is diefstal

Tweakers

Samenvatting

Microsoft-manager noemt AI-training met nieuwsartikelen ongekende diefstal in rechtszaak tegen OpenAI en Microsoft.

Microsoft-manager en AI-training: wat er gebeurt

Brent Hecht, Microsofts hoofd toegepaste wetenschap, noemt het gebruik van nieuwsartikelen voor AI-training een ongekende diefstal. Zijn uitspraken staan in documenten uit de rechtszaak van The New York Times tegen OpenAI en Microsoft.

Advocaten van de krant stellen dat OpenAI miljoenen artikelen kopieerde voor de training van taalmodellen, van GPT-3 tot GPT-4o. Die modellen ondersteunen onder meer ChatGPT en OpenAI-api’s voor ontwikkelaars. OpenAI en Microsoft verdedigen zich met fair use, maar Hecht vindt dat argument zelf onhoudbaar. Volgens de documenten omzeilde OpenAI bovendien bewust de paywall van The New York Times.

AI-training en fair use: waarom dit belangrijk is

De zaak gaat verder dan de vraag of één krant schade leed. Ze legt een directe koppeling tussen brongebruik, modeltraining en de manier waarop AI-diensten verkeer naar uitgevers sturen. Microsoft registreerde 83 tot 93 procent minder kliks op artikelen van sommige nieuwsmedia en 51 tot 94 procent bij andere media.

Ook binnen Microsoft klinkt twijfel over die uitkomst. Satya Nadella verklaarde dat hij modellen opnieuw zou hebben laten trainen als hij had geweten dat OpenAI paywalls omzeilde. Hij erkende daarnaast dat chatbots kliks van nieuwswebsites kunnen wegnemen wanneer ze informatie tonen zonder gebruikers naar de oorspronkelijke bron te sturen.

Voor BI-teams raakt dit aan de herkomst van trainingsdata achter AI-functies. Een model kan technisch goed presteren, terwijl de rechten op de gebruikte bronnen en de relatie met de oorspronkelijke uitgever ter discussie staan. De rechtszaak maakt die controle zichtbaar als onderdeel van AI-governance, niet als een los juridisch detail.

AI-training: concrete takeaway

Leg bij elk AI-model of AI-product vast welke bronnen zijn gebruikt, hoe die bronnen zijn verkregen en welke rechten de leverancier claimt. Vraag bij externe AI-diensten specifiek naar trainingsdata, paywallgebruik, bronverwijzingen en de gevolgen van een gewijzigde rechterlijke uitspraak.

Lees het volledige artikel
Meer over Markt & Trends →