ChatGPT, Reddit en Roblox moeten voldoen aan de Europese Digital Services Act, meldde Tweakers onlangs. Iets preciezer: ChatGPT geldt nu als zeer grote onlinezoekmachine, en Reddit en Roblox zijn aangemerkt als zeer grote onlineplatforms. Vooral voor Ome Sjet zal dat forse impact hebben.
Een zeer groot online platform of VLOP is de term uit de DSA voor een platform dat 45 miljoen actieve gebruikers kent. Voor zoekmachines is de afkorting VLOSE. Het idee achter dat getal is dat het makkelijk meetbaar is, meer niet. Hiermee kun je dan makkelijk vaststellen of er “risico’s voor de samenleving [zijn] die qua reikwijdte en impact verschillen van die van kleinere platforms”:
Zodra het aantal actieve afnemers van een onlineplatform of actieve afnemers van een onlinezoekmachine, berekend als een gemiddelde over een periode van zes maanden, een aanzienlijk deel van de bevolking van de Unie bereikt, kunnen de systeemrisico’s van het onlineplatform of de onlinezoekmachine een onevenredige impact in de Unie hebben.De kwalificatie van OpenAI’s dienst ChatGPT als zoekmachine verbaast misschien. Het is eerst en vooral een dienst waarmee je teksten en afbeeldingen laat maken. Maar ChatGPT kan daarbij ook het web afstruinen en relevante informatie in die teksten betrekken. En dan kom je bij deze definitie:
een tussenhandeldienst die gebruikers de mogelijkheid biedt zoekopdrachten in te voeren om zoekacties uit te voeren op in beginsel alle websites of alle websites in een bepaalde taal, op basis van een zoekopdracht over eender welk onderwerp in de vorm van een trefwoord, een gesproken verzoek, een frase of andere input, en die resultaten in eender welk formaat oplevert met informatie over de opgevraagde inhoud;De definitie lijkt geschreven voor klassieke diensten waar je een mooie set termen opgeeft en passende resultaten terugkrijgt. Maar “schrijf een rapport over kwantumcryptografie, betrek bronnen en maak geen fouten” als prompt voldoet aan de definitie van “andere input” en de dienst gaat dan ook werkelijk zoeken.
Een kwalificatie als online platform (VLOP) had voor ChatGPT niet gekund. Daarvoor is namelijk nodig dat de dienst
op verzoek van een afnemer van de dienst, informatie opslaat en verspreidt bij het publiek, tenzij (…)De dienst ChatGPT is immers besloten, chats worden hooguit in ondergeschikte gevallen gedeeld met derden. Vergelijk dat met Reddit waar alle discussies juist in principe openbaar zijn.
Het voelt gekunsteld: ChatGPT is gepositioneerd als een chatbot, niet als een zoekdienst. Maar volgens OpenAI zelf had de zoekdienst “approximately 159.1 million average monthly active recipients in the European Union”. En “active recipient” is de DSA term voor “mensen die zoekopdracht gaven”. Ter vergelijking: Google komt tot 768,9 miljoen bij datzelfde criterium (uitgesplitst naar ingelogde en losse gebruikers).
ChatGPT is óók een GPAI-systeem onder de AI-verordening. Handhaving van die twee wetten gaat (sinds de AI Omnibus Act) in een hand door de Commissie. De belangrijkste extra eis voor aanbieder OpenAI is nu dat zij een risicobeoordeling moet doen van systeemrisico’s rond haar dienst, waarbij chatverslaving en aanmaken van desinformatie er dan direct uitspringen.
Wat mag van jullie OpenAI als eerste gaan aanpakken?
Arnoud
Ik vraag me vooral af wat dit nu concreet gaan betekenen voor een platform als Reddit. Als ik het goed begrijp eist de DSA onder meer dan minderjarigen worden beschermd tegen inhoud die voor hen niet geschikt wordt geacht, maar de enige manier die ik zie om zoiets te implementeren is van alle bezoekers de leeftijd verifieeren en bij alle 18+ onderwerpen eisen dat de lezer inlogt in zijn of haar geverifieerd account. Dat is voor een platform als Reddit natuurlijk een enorme hoeveelheid werk; voor zover ik weet bepalen de eigenaren van subreddits nu zelf of hun subreddit wel of niet 18+ is. Wordt onder de DSA Reddit zelf verantwoordelijk om dat te bepalen? En op basis van welke criteria precies? De hele aard van Reddit is nu juist dat de inhoud gemaakt wordt door de bezoekers. Natuurlijk zijn er subreddits die evident 18+ zijn; wapens, porno, gore etc. Maar er zijn ook subs waarin het ene onderwerp misschien wel, maar het andere onderwerp niet 18+ is. Neem discussies van medische aard, of discussies over oorlog of conflicten.
Voor wat betreft Chatgpt, het ozu goed zijn als OpenAI beter duidelijk maakt wat het met de ingevoerde gegevens doet, hoe ze dat gebruiken, en hoe je dat uit kan zetten.
Voor een ieder nog een tip en link: Bij chatgpt settings en daar data controls kan je “improve the model for everyone” uit zetten, en ook je data exporteren. Dat duurt dan een dag of zo, maar die export kan je daarna uploaden bij Proton (https://lumo.proton.me/aitrail) en die laat dan zien wat ChatGPT allemaal kan afleiden uit de door jou gestelde vragen.
Ik vind dat de definitie van ChatGPT als zoekmachine eigenlijk wel past. Uiteindelijk is een zoekmachine een programma dat een samenvatting maakt van hetgeen te vinden is op het Internet (crawlen en indexeren) en gebruikers in staat brengt om aan de hand van die samenvattingen informatie te vinden (waarbij de bron van gegevens – lees URL – normaal gesproken een prominent onderdeel is). ChatGPT doet in feite hetzelfde, behalve dat de vorm van de indexering heel anders is, maar het model is in feite een samenvatting van het Internet waar het duidelijk is antwoorden wel degelijk zijn afgeleid van datgene op het Internet te vinden is. Daarnaast zijn de risico’s van ChatGPT vergelijkbaar, inclusief censuur, misleiding en bias.