Japanse overheid wijzigt regelgeving die gebruik van diskettes verplicht

“rainbow diskettes, IBM formatted” by frankieleon is licensed under CC BY 2.0

Het Japanse ministerie van Economie, Handel en Industrie heeft allerlei regelgeving aangepast die het gebruik van diskettes en cd-roms verplicht. Dat las ik bij Security.nl. De aangepaste verordeningen gebruiken nu techniekneutrale benamingen.

Waarom is mij niet duidelijk, maar Japan bleek bijna 2000 wetten en regels te hebben waarin expliciet naar floppydisks werd verwezen. De BBC legt uit:

This is not the first time Japan has hit the headlines for its old-fashioned habits – which remain a paradox given the country’s proficiency at developing exciting new products. Various explanations have been offered, including poor digital literacy and a bureaucratic culture with conservative attitudes.
Mijn gok zou zijn dat dit als stoffig detail in een wet staat en niemand zin had om daar een punt van te maken. Het gaat toch goed? Ik zie niemand op straat demonstreren. Nou dan.

Veel mensen linktipten me dit bericht vanuit een motivatie van “haha gekke juristen zijn zo ouderwets”. Dat zal zeker ook mee hebben gespeeld – maar de reden om zo ouderwets te doen is vaak simpel: (a) het werkt, (b) we weten dat het rechtsgeldig is. Dat moeten we met jouw flitsende app nog maar zien, en die floppy disk heeft géén ellenlange uitsluiting van aansprakelijkheid.

In Nederland hebben we nooit expliciete regels over floppy’s als verplicht medium gehad. Ja, er was de Aangiftediskette die in 2008 ‘abrupt’ werd afgeschaft, maar dat was een optie en geen plicht. De beste analogie is volgens mij de fax, die in 2021 bij de Rechtspraak als laatste werd afgeschaft. Ik schreef toen:

De overstap van post naar fax was destijds al een grote stap. Ik kon niet precies achterhalen wat de eerste uitspraak was waarin faxverkeer als rechtsgeldig werd erkend, de strafzaak HR 13 september 1988, NJ1989,12 lijkt de eerste uitspraak te zijn geweest. Hierin stond ter discussie of een gefaxte pleitnota wel rechtsgeldig ondertekend was door de advocaat. Immers, hoe controleer je de echtheid van een korrelig plaatje? Gelukkig was de advocaat-generaal van de HR behulpzaam:
Nodig is dat de advocaat telefonisch of schriftelijk aan de griffie van de HR laat weten dat de gefotocopieerde handtekening zijn handtekening is. Waar zo een nadere mededeling ontbreekt zal slechts een toevallige omstandigheid, zoals de aanwezigheid in het dossier van een brief van de indienende advocaat met diens originele handtekening en de mogelijkheid om de overeenkomst van die handtekeningen zonder moeite vast te stellen, de schriftuur met de gefotocopieerde of ‘gefaxte’ handtekening kunnen redden.
In andere zaken werd vergelijkbaar geoordeeld, waarbij ook wel als argument werd geaccepteerd dat je het origineel naleverde en dat men achteraf kon zien dat dit identiek was aan de fax. Dan heb je je origineel maar kan het allemaal net wat sneller. Daar kon niemand op tegen zijn, maar zeker woog ook mee dat professionele procespartijen zoals advocaten of rechters er geen belang bij zouden hebben om vervalste faxen te sturen. De kans op vervalsingen zou dus klein genoeg zijn.
Japan lijkt vergelijkbaar te hebben geoordeeld, waarbij informatiebeveiliging een argument was. Een floppy per koerier is immers lastiger te hacken dan een internetverbinding.

Arnoud

Populaire AI-tools geven juridische antwoorden vol fouten, joh wat dacht je zelluf

jambulboy / Pixabay

Chatbots van OpenAI, Google en Meta zijn zeer gevoelig voor ‘hallucinaties’ bij het beantwoorden van juridische vragen, zo las ik bij Advocatie. Men baseert zich op onderzoek van Stanford University, dat bij juridische vragen in driekwart van de antwoorden fouten vond. Fascinerend, maar het betekent hooguit dat je geen generieke chatbot voor een specifieke taak moet gebruiken.

Op voorhand ben ik altijd erg kritisch op onderzoeken die zich baseren op GPT-3.5, zeg maar de gratis versie van ChatGPT. De verschillen tussen 3.5 en 4 zijn echt enorm. Maar hier gaat het specifiek om de kwestie van juridische vragen in een algemeen taalmodel. En dan is het natuurlijk redelijk logisch dat daar rare, algemene antwoorden uit komen: al die juridische kennis zit niet in de dataset.

Maar belangrijker: generatieve AI is geen orakel dat antwoorden genereert op basis van een analyse van de vraag. Het zijn stochastische papegaaien, patroonzoekers die een leuk klinkende tekst produceren die redelijk aansluit op de invoerprompt. Of die vraag enige relatie heeft tot de werkelijkheid, is daarbij volkomen irrelevant.

Dit krijg je pas anders als je zo’n systeem voedt met specifieke juridische kennis, want dan kan het systeem in ieder geval de benodigde kennis reproduceren om het antwoord mee aan te kleden. Maar strak afstellen blijft noodzakelijk, zoals het DPD chatbot-incident laat zien.

Het probleem is dus eigenlijk fundamenteler: we gebruiken een tekstgenerator om antwoorden te zoeken. Dat is natuurlijk omdat die generatoren nu de hypewind mee hebben, maar eigenlijk is het raar. Er zijn genoeg juridische kennissystemen die wél gericht encorrect antwoorden op juridische vragen kunnen oplepelen. Koppel die dan aan zo’n tekstgenerator om het mooi te maken, zou je zeggen. Maar dat laat nog even op zich wachten.

Arnoud

 

Koninklijke Bibliotheek beperkt toegang tot collecties voor trainen commerciële AI

digitization, transformation, earth
Photo by geralt on Pixabay

De KB (nationale bibliotheek) wil niet dat commerciële bedrijven zonder toestemming digitale bronnen gebruiken voor het trainen van AI en heeft daarom de toegang tot collecties beperkt. Dat las ik bij Security.nl. In een verklaring verwijst men naar de “wijze waarop veel commerciële AI-modellen nu getraind worden – door zonder toestemming websites te crawlen”, die niet in het algemeen belang zou zijn.

De KB heeft een van de grootste Nederlandstalige collecties online staan, wat haar een dankbare bron maakt voor partijen die taalmodellen willen trainen. Hoe meer data hoe beter je uitvoerkwaliteit immers. Auteursrechthebbenden hebben hier moeite mee, want waarom moet daar niet voor worden betaald?

De Europese wetgever heeft een paar jaar terug een soort-van compromis in de wet opgenomen: gebruik van werk voor “text and data mining” (TDM) is wettelijk toegestaan (dus zonder vergoeding) tenzij een site een opt-out vermeldt. Die opt-out moet machineleesbaar zijn, omdat het anders geen doen is voor TDM dataverzamelaars.

Hoewel dit principieel en technisch onjuist is, is de trend om in robots.txt die opt-out te gaan coderen. Robots.txt is bedoeld om zoekmachinecrawlers buiten plekken te houden waar ze schade kunnen berokkenen of waar liever-niet content staat zoals stylesheets of grote bestanden die toch niet relevant zijn.

Het grote probleem is dat je met robots.txt kunt kiezen om álle robots ergens weg te houden, of alleen de genoemde robots. Je zou dus die van OpenAI kunnen blokkeren, maar dan heb je die van Bing nog niet. Blokkeer je Bing erbij, dan is er kennelijk geen bezwaar tegen mijn EngelfrietGPT-bot. En álles blokkeren betekent dat ook de zoekspider van Google er niet meer bij mag.

Er zijn ook uitgevers zoals The Guardian die in het commentaar van de robots.txt gebruik voor LLM verbieden. Dat is per definitie geen machineleesbare opt-out, want commentaar behoort een spider niet te lezen. Dat is dus zo’n geval “we moeten iets doen en dit is iets, dus laten we het doen”. Maar het komt mét Engelse advocaat die je heel welbespraakt gaat uitleggen waarom je toch echt onrechtmatig en zelfs strafbaar handelt door het te negeren.

De KB volgt desondanks deze trend door in de robots.txt van digitale collecties DBNL en Delpher de OpenAI bots (GPTBot en ChatGPT-User) toegang te ontzeggen. Dit is dus het probleem: de bot van Bing is niet uitgesloten, noch die van bijvoorbeeld Common Crawl om het over EngelfrietGPT maar niet te hebben.

En ja, in de gebruiksvoorwaarden staat ook een expliciet voorbehoud:

Voor commerciële partijen is het verboden om kopieën van auteursrechtelijk beschermde werken op onze website te maken ten behoeve van tekst- en datamining (TDM) waaronder training van AI-modellen. Dit verbod vormt een voorbehoud als bedoeld in artikel 15o Auteurswet en artikel 4(3) CDSM-richtlijn.
Dit is dus alleen niet rechtsgeldig als verbod, omdat het niet machineleesbaar is.

Natuurlijk, in de praktijk zal het vooral gaan om hoe strak men de toegang afschermt voor commerciële bots. Maar ik kan me dood ergeren aan dit soort maatregelen die gewoon principieel niet kloppen.

Arnoud

New York Times klaagt OpenAI aan om misbruik artikelen voor trainen van AI

The New York Times heeft OpenAI en Microsoft aangeklaagd voor het schenden van NYT’s auteursrecht. Dat meldde Tweakers in de kerstvakantie. De GPT taalmodellen van OpenAI zijn (mede) getraind op NYT-content, en met wat goed prompten kun je zelfs originele artikelen terugkrijgen, maar om het nou een kopieerapparaat te noemen? De vraag is dan ook fundamenteel: hóórt dit inbreuk op het auteursrecht te zijn?

De achterliggende reden is even banaal is veelvoorkomend: in april heeft de NYT onderhandeld met OpenAI en Microsoft om een betaalde licentiedeal te sluiten, maar dat is op niets uitgelopen. Er zijn meerdere van zulke gesprekken geweest, maar de details zijn schimmig. Het is goed gebruik dat als je onderhandelingen klappen, je naar de rechter stapt om ronde twee te initiëren met een miljardenclaim. (In de VS is auteursrechtelijke schade een vast bij wet vastgelegd bedrag, dus dat rekent makkelijk.)

Hoe toon je aan dat jouw content in de dataset zit waarmee GPT getraind is? Daar blogde ik in 2022 over: er zijn diverse trucs maar zekerheid heb je niet, want die diensten houden stevig de kaken op elkaar natuurlijk. Alleen bij de NYT ligt dat anders, want miljoenen van hun artikelen zijn opgenomen in de Common Crawl-dataset, de grootste dataset waarmee AI systemen worden getraind. En ook staat vast dat GPT getraind is met Common Crawl.

NYT ging nog een stapje verder: met een goed gekozen prompt krijg je gehele NYT artikelen eruit. Die “goed gekozen prompt” is dan wel de lead van het NYT artikel dat je wilde hebben, dus het voelt een tíkje sturend, en bovendien krijg je 95% van de originele tekst terug via de patroonherkenning die het LLM maakt. Het is geen kopieerapparaat maar een “raad het volgende woord” systeem, en dat wordt dan gedwongen om te raden met een zeer beperkte keuzevrijheid. LLMs slaan geen bronteksten op.

Is dat auteursrechtinbreuk? Voor mij voelt dat raar: OpenAI zoekt patronen in teksten, en gebruikt dat om nieuwe teksten te genereren. Dat is volkomen onvergelijkbaar met alle eerdere vormen van inbreuk die dankzij internet/ict mogelijk zijn gemaakt – die gingen allemaal over reproductie van de brontekst, zoals bij zoekmachines die snippets laten zien of torrentsites die helpen fragmenten te verzamelen. LLMs reproduceren de brontekst niet.

Dat roept natuurlijk het fairness argument op dat als jij miljoenen van iemands artikelen gebruikt om een systeem op te bouwen, die iemand daarvoor gecompenseerd zou moeten worden. Maar het auteursrecht is niet zo breed dat ieder gebruik of ieder voortbouwen op een werk automatisch inbreuk is, althans juridisch niet. De aanklacht van de NYT leunt zwaar op “journalistiek kost heel veel geld dus is het fair dat wij een vergoeding van OpenAI krijgen”, maar dat is geen juridisch argument.

Binnen de wet krijg je dan discussie hoe je termen als ‘openbaarmaking’ of ‘werk’ moet interpreteren in de context van dit soort verwerking van de data daaruit. Deze rechtszaak zou daar een gezaghebbend antwoord op kunnen geven – hoewel ik vrij zeker weet dat er geschikt wordt voordat het zover is, want OpenAI en Microsoft hebben al het geld (market cap 350x die van NYT) en de NYT heeft natuurlijk principes maar daar kan de kachel niet van branden.

Arnoud

 

 

 

 

 

Hand opsteken als je op je verjaardag een AI Act cadeau krijgt

De AI Act komt er definitief, al is het nog spannend wanneer precies. In een marathonsessie (22uur, pauze, 14uur) is de Europese wetgever eruit gekomen op alle belangrijke punten. De definitieve tekst moet nog afgerond, maar dit is wat we nu weten.

Het grootste deel van de discussie ging op aan de vraag hoe biometrie op afstand te reguleren, met name omdat politie en veiligheidsdiensten daar graag gebruik van willen maken maar dat op gespannen voet staat met mensenrechten. Uiteindelijk is gekozen voor een verbod met enkele uitzonderingen: bestrijding terrorisme, gericht volgen van een verdachte en opsporing van ernstige misdrijven. Of daarmee de risico’s van predictive policing zijn weggenomen, betwijfel ik zeer.

De definitie van een AI is overgenomen van de OECD, en komt neer op “alle autonoom opererende systemen waarvan de uitvoer direct van invloed is op de omgeving”. Welke technologie er achter zit, is dus niet relevant, net als of de AI standaard is of zeer vernieuwend. Het gaat erom of het ding zelfstandig in de rondte mag slaan.

Als iets aan die definitie voldoet, is de volgende vraag of dat fysiek in de EU gebeurt of dat de uitvoer bedoeld is om in de EU te gebruiken. Zo ja, dan is de AI Act van toepassing. En dan komen we gelijk bij de vraag hoe erg de risico’s van deze AI zijn.

De strengste regel is voor de engste vormen van AI. “Verboden praktijken” moeten binnen zes maanden na inwerkingtreding van de AI Act (beoogd is januari) volledig stoppen. Hieronder vallen onder meer onbewuste manipulatie, social credit scoring en realtime biometrie op afstand. Nieuw is een verbod op emotieherkenning op het werk, zoals bij assessments van sollicitanten of het monitoren van personeel (tenzij het gaat om veiligheidsscans zoals bij slapende machinisten).

De ‘lichtste’ vormen van AI kennen geen bijzondere risico’s en krijgen alleen transparantieplichten opgelegd. Kort gezegd moeten deze duidelijk aangeven dat ze AI zijn (“Dag, ik ben een chatbot, hoe kan ik u helpen?”). Ook hun uitvoer moet gemarkeerd zijn als van AI afkomstig, maar het is nog niet duidelijk of dit zou betekenen dat alle AI-gegenereerde tekst of beeld een watermerk moet krijgen.

De meeste aandacht gaat uit naar de “hoog risico” AI, AI systemen die bijzondere risico’s voor mens of maatschappij opleveren. Dat kan variëren van discriminatie van personen tot fysiek letsel, fouten bij het bereiden van voedsel of het vervuilen van het milieu door een verkeerde inschatting. Allereerst moet hierbij een fundamental rights impact assessment of FRIA worden uitgevoerd. En als dat gedaan is, dan kan het echte werk beginnen: kwaliteitsborging, verantwoordingsprocessen, documentatie, logging en menselijk toezicht op hun inzet. De inzet van een aparte AI Compliance Officer is dan ook zeer aan te raden.

Ook is veel aandacht gegaan naar de zogeheten foundation modellen, de algemene modellen zoals Google’s Bard of ChatGPT. Deze kunnen alles, en zijn dus niet aan een specifiek risico te koppelen. Aanbieders hiervan krijgen basisverplichtingen over transparantie en het aanpakken van generieke risico’s op zich, maar een aanbieder die zo’n foundation model inzet voor een specifieke toepassing moet zélf de uiteindelijke verantwoording dragen. Een aanbieder van bijvoorbeeld een contractenscanner die met ChatGPT teksten analyseert, moet zelf de kwaliteit van de contractenscanning borgen en mag niet simpelweg vertrouwen op wat ChatGPT kan.

Open source modellen zijn in principe uitgesloten van de AI Act. Dit betreft modellen die onder een open of vrije licentie gedeeld worden en waarvan de broncode en de parameters openbaar zijn voor een ieder. Veel innovatie drijft op dergelijke modellen, en hiermee blijft bijvoorbeeld wetenschappelijk onderzoek mogelijk. Wanneer een open source model specifiek ingezet wordt voor een hoog risico toepassing, gaat echter wél de AI Act gewoon gelden.

De boetes zijn niet mals: tot 35 miljoen euro per overtreding of 7% van de wereldwijde omzet van het concern waarbinnen de overtreding wordt gemaakt. Voor ‘kleine’, administratieve overtredingen is dit 7,5 miljoen of 1.5%. Naast deze boetes kunnen de toezichthouders ook bevelen dat een specifieke AI-toepassing wordt bijgesteld of van de markt gehaald.

De beoogde datum van inwerkingtreding was 1 januari 2024, maar omdat er nog flink aan de tekst gesleuteld moet worden om alle compromissen te verwerken én omdat alles in 24 talen vertaald moet worden, is het zeer de vraag of dit gehaald wordt. De bedoeling is dan wel zo snel mogelijk daarna de wet te publiceren.

Er is beperkt overgangsrecht: de verboden praktijken moeten dus binnen 6 maanden stoppen, maar voor de hoog risico AI’s geldt een (sommige bronnen: twee) jaar overgangsrecht waarbinnen alle compliance vereisten moeten zijn verwerkt. Dat is korter dan je denkt: tuig maar eens een data-kwaliteitssysteem op als dat er nog geheel niet is.

Er is van vele kanten kritiek geuit op de AI Act. Enerzijds dat er niet streng genoeg wordt opgetreden tegen de grote risico’s van deze nieuwe technologie, en anderzijds dat regulering juist de innovatie geheel de nek om zal draaien.

Wat dat laatste betreft: ik geloof er niet in dat innovatie alleen goed mogelijk is als er nul regulering is. Ja, je krijgt méér experimenten, maar veel daarvan geven eerder gevaar dan voordeel voor de maatschappij. Het gaat immers niet om hoe geavanceerd de technologie is, maar om autonome inzet – een zelfrijdende auto kan mensen aanrijden, en of dat nou komt door een pulsed neural netwerk dat verkeerde conclusies trok of een beslisboom die niet voorzag in het concept “bakfiets” is volstrekt irrelevant.

Het voor mij grootste probleem zit hem in die hoogrisicotoepassingen, met name omdat dit vaak zwakkere groepen raakt. Werknemers die worden gescreend en beoordeeld door AI, zonder daar weerwoord tegen te kunnen geven. Burgers die geen ambtenaar maar een AI tegenover zich zien en dan hun bijzondere omstandigheden niet kwijt kunnen. Mensen die door een politie-AI worden ‘herkend’ en gevolgd, zonder dat zij dit weten of kunnen klagen dat die herkenning ten onrechte is. Dát is het probleem dat de AI Act probeert op te lossen.

Arnoud PS, jaja, 0x31 alweer vandaag, dank u dank u.

 

Gaat de VS Europa links inhalen met haar AI regulering?

Met een presidentieel decreet wil de Amerikaanse president Joe Biden toekomstige AI-modellen van vangrails voorzien. Dat las ik bij De Tijd dinsdag. Het nieuws komt een week nadat de Europese wetgever er nog niet uit is met de AI Act, dus het is nogal een verrassing: krijgt de VS nu ineens méér regulering dan Europa?

De Wall Street Journal noemt de Executive Order van Biden (want dat is het) een “emergency federal power”. Want Biden kan als president geen wetten invoeren. Met een executive order of decreet kan hij de federale overheidsorganen aansturen, wat indirect behoorlijk wat impact op de maatschappij kan hebben.

Eerder had het Witte Huis al een “Blueprint for an AI Bill of Rights” uitgegeven, een streven met vijf beginselen voor wat wij trustworthy AI zouden noemen. Biden maakt in zijn XO daar nu acht uitgangspunten van. Ik citeer de belangrijkste passage van iedere, namelijk het punt waar hij ingaat op wat zijn overheidsorganen gaan doen:

  1. My Administration will help develop effective labeling and content provenance mechanisms, so that Americans are able to determine when content is generated using AI and when it is not.
  2. The Federal Government will promote a fair, open, and competitive ecosystem and marketplace for AI and related technologies so that small developers and entrepreneurs can continue to drive innovation.
  3. My Administration will seek to adapt job training and education to support a diverse workforce and help provide access to opportunities that AI creates.
  4. Ty Administration will build on the important steps that have already been taken […] in seeking to ensure that AI complies with all Federal laws and to promote robust technical evaluations, careful oversight, engagement with affected communities, and rigorous regulation.
  5. The Federal Government will enforce existing consumer protection laws and principles and enact appropriate safeguards against fraud, unintended bias, discrimination, infringements on privacy, and other harms from AI.
  6. The Federal Government will ensure that the collection, use, and retention of data is lawful, is secure, and mitigates privacy and confidentiality risks.
  7. My Administration will take steps to attract, retain, and develop public service-oriented AI professionals (…)   The Federal Government will work to ensure that all members of its workforce receive adequate training (…).
  8. My Administration will engage with international allies and partners in developing a framework to manage AI’s risks, unlock AI’s potential for good, and promote common approaches to shared challenges.
Allemaal zaken die de overheid zelf gaat regelen dus. Burgers en bedrijven hebben daar niet direct mee te maken, behalve als ze willen verkopen aan de overheid. Nog steeds niet spannend, een overheid kan inkoopvoorwaarden hanteren immers.

Wél spannend wordt het wanneer Biden de Defense Production Act uit 1950 inroept. Deze wet is aangenomen aan het begin van de Korea-oorlog en geeft de president de bevoegdheid om producten onder de DPA te scharen wanneer dat noodzakelijk is voor de nationale veiligheid.

Biden rekent daar nu de enorme foundation models onder die het leeuwendeel van de nieuwe AI uitmaken, zoals GPT4 en Google’s modellen. De insteek is dat deze ook voor kwaadaardige cyberactiviteit ingezet kunnen worden, waarmee de VS kwetsbaarder wordt jegens buitenlandse actoren. Wederverkoop of IaaS-levering van zulke modellen aan buitenlanders wordt hiermee gereguleerd, de minister van Handel mag ingrijpen als zo’n transactie onwenselijk is vanuit de staatsveiligheid en inzet van AI in kritieke sectoren wordt aan overheidstoezicht onderworpen en zo nog het een en ander.

Opmerkelijk is vooral de eis aan generative AI: veel media melden dat generatoren hun content moeten gaan watermerken. Dat staat er niet: er komt onderzoek naar effectieve technieken om ‘synthetische’ content te kunnen onderscheiden van echte, en daaruit wordt dan een standaard afgeleid. Maar buiten de bovengenoemde scope kan de president private partijen niet bevelen uitvoer van hun tooling te watermerken.

De XO is natuurlijk wel een enorm sterk signaal dat er regulering aan zit te komen, en omdat alle grote AI providers ook willen leveren aan de overheid is de kans groot dat men deze standaarden gaat ondersteunen in ál hun producten en diensten. In combinatie met de AI Act die we in januari verwachten, levert dat in 2024 ineens een enorme regulering op van de wildwestsector die we nu hebben.

Arnoud

 

Inleveren digitale pasfoto voor paspoort wettelijk al mogelijk, maar of dat handig is?

De overheid kijkt naar het uitfaseren van geprinte pasfoto’s, zodat er alleen met ingeleverde digitale pasfoto’s voor paspoorten of identiteitskaarten wordt gewerkt. Dat las ik bij Security.nl. In een voortgangsbrief laat demissionair staatssecretaris Van Huffelen van Digitalisering weten dat de huidige hardware en koppelingen met bestaande systemen het probleem zijn bij het volledig digitaal verwerken van pasfoto’s voor identiteitsbewijzen.

Vorig jaar bleek dat het nog wel eens misgaat: corrupte ambtenaren leverden paspoorten met ‘gelijkende’ pasfoto’s aan criminelen. Het doel van deze nieuwe maatregel is dan ook vooral het bestrijden van dit probleem.

Bij de aankondiging van de antifraudemaatregelen liet de staatssecretaris ook weten dat het ministerie van Binnenlandse Zaken eind 2021 een project heeft opgezet (Modernisering Afname Biometrie) met als doel om de geprinte pasfoto uit te faseren. “Een ter plekke gemaakte gezichtsopname verkleint de kans op het onjuist koppelen van een afbeelding aan een persoon, voorkomt de manipulatie van foto’s in het aanvraagproces en verhoogt de kwaliteit van de afbeelding”, aldus Van Huffelen destijds.
Het is dus nadrukkelijk nog steeds de bedoeling dat je naar de balie van het gemeentehuis gaat om je paspoort mee te nemen. Het nieuwe proces is dan vooral dat de foto bij de intake ter plekke wordt genomen, op kwaliteit gecontroleerd en op je paspoort gezet wordt. Niet dat je paspoorten aanvraagt op afstand en deze thuisgestuurd krijgt, zeg maar.

(Pet peeve: een rijbewijs is een identiteitsbewijs; noem het geen legitimatiebewijs tenzij je de politie bent die nagaat of iemand mag rijden.)

Arnoud

Hoe citeer je ChatGPT in een juridisch artikel?

Een intrigerende via Linkedin:

Is er al een ‘Leidraad voor Juridische Auteurs-richtlijn’ voor het verwijzen naar ChatGPT of andere generatieve AI? Ik zie wel APA-richtlijnen, maar zijn er ook al voorbeelden bekend van juridische auteurs die ChatGPT citeerden? Hoe zou jij ChatGPT citeren conform Leidraad?
Ik was een beetje verbaasd, want om nou te zeggen dat ChatGPT bekend staat om haar inventief onderzoek of hoogdravende analyses, nee. Maar goed, dat is geen argument bij de vraag, hoe citeer je een tekst die je op ChatGPT.com aantreft.

In de comments geeft Vincent Bontrop een voorbeeld van een persistente link naar een ChatGPT uitvoer. Als ik daarop de regels van de Leidraad voor juridische auteurs loslaat, dan krijg je ‘Communicatie in psychologie’, ChatGPT.com 3 september 3, 2023 <url hier>.

Ik zit wel te twijfelen of deze uitvoer geschikt is als bron. Citeren uit Wikipedia is ook altijd op het randje: wat daar staat, mag je meestal als algemeen bekende kennis aanmerken en dat behoeft geen bron. En als het wél specifieke kennis is, dan verwijst Wikipedia naar een echte bron en dan citeer je die. Dus ik weet geen situatie waarin je Wikipedia als bron opvoert.

ChatGPT geeft evenzo algemeen bekende kennis aan, maar geen eigen opinie, inschatting of nieuw ontdekte feiten. Er is dus geen reden om ChatGPT als bron van wat dan ook op te voeren. Dit geheel los van de vraag of ChatGPT een auteur is.

Arnoud

Mag een AI-gedreven zoekmachine advertenties in haar uitvoertekst verwerken?

Eduard Blacquière deed een interessante observatie: in de nieuwe zoekresultaten van Bing staan advertenties. Maar let op: die resultaten zijn geen lijstjes met sites, het is een lopende tekst gegenereerd door Edge CoPilot, de AI van Microsoft. “U kunt ook genieten van een drankje bij HIGH Bar Stockholm [ad]“. Mag dat?

De DSA is duidelijk over advertenties, of beter gezegd “commerciële communicatie” (art. 26):

Aanbieders van onlineplatforms die op hun online-interfaces reclame tonen, zorgen ervoor dat de afnemers van de dienst voor elke specifieke reclame die aan elke individuele afnemer wordt getoond, op een duidelijke, beknopte en ondubbelzinnige wijze en in real time het volgende kunnen vaststellen:
  1. dat de informatie reclame is, onder meer door opvallende markeringen, die standaarden kunnen volgen krachtens artikel 44;
  2. de natuurlijke of rechtspersoon namens wie de reclame wordt getoond;
  3. de natuurlijke of rechtspersoon die de reclame heeft betaald indien die persoon verschilt van de in punt b) bedoelde natuurlijke of rechtspersoon;
  4. vanaf de reclame rechtstreeks en gemakkelijk toegankelijke nuttige informatie over de belangrijkste parameters die worden gebruikt om te bepalen aan welke afnemer de reclame wordt getoond en in voorkomend geval over de wijze waarop die parameters kunnen worden veranderd.
Laten we de tekst van Microsoft erbij pakken (rechtsboven, klik voor groot). Deze tekst is een reactie op een vraag om leuke dingen voor op vakantie in Stockholm, Bing geeft een bolletjeslijst met dingen, zoals het Vasa-oorlogsschip dat bij tewaterlating zonk en 333 jaar onder water bleef liggen. Op zich prima.

De advertentie is de tweede helft van een bolletje over eten en drinken, waarbij eerst zo te zien een organisch resultaat (fusionrestaurant EAT) wordt getoond en dan dus de advertentietekst voor de HIGH Bar. Er staat een markering bij (het blokje “Ad”), ik kan dit niet heel erg opvallend noemen omdat er meteen ook een voetnoot bij staat voor de bronvermelding. Dus dat is meteen een vraagteken.

Het tweede punt van de DSA is namens wie de reclame wordt getoond (en punt 3 wie betaalde, indien anders). Uit de bronvermelding moet ik halen dat de adverteerder Tripadvisor is. Oftewel: deze vermelding van de HIGH Bar is opgenomen omdat Tripadvisor haar diensten wil promoten, niet omdat de HIGH Bar graag meer bezoekers wil.

Waar het volgens mij misgaat, is punt 4: waarom wordt deze advertentie getoond? Ik kan er wel een slag naar slaan, maar de DSA eist dat je uitleg kunt krijgen, en dat lijkt vooralsnog te ontbreken. (Mogelijk ligt dat aan het screenshot. Ik krijg zelf geen enkel zoekresultaat met advertenties.)

Wat dan weer wél kan, is via de Ad Library meer informatie opvragen over een advertentie. Hier vind je dan alle wettelijk verplichte informatie. Deze library volgt ook uit artikel 26 DSA. En dat lijkt me ook een prettig werkbare oplossing.

Arnoud

Mag je het nieuws herschrijven met AI?

Er duiken steeds meer nieuwssites op die kunstmatige intelligentie (AI) gebruiken om razendsnel artikelen van gerenommeerde media te hergebruiken. Dat meldde Nu.nl een tijdje terug (sorry). De kern is dat je die artikelen dan in ChatGPT duwt met de instructie “herschrijf dit”, waarna het resultaat automatisch online gaat. Mag dat?

De Amerikaanse nieuwswaakhond NewsGuard heeft 37 van die sites aangetroffen, wat vrij eenvoudig was omdat men soms fouten maakte in de prompt en dan de standaardtekst “Als AI-taalmodel kan ik niet …” liet staan. Dus het betrappen dat iemand dit doet, dat lukt nog wel.

Het Nu.nl-artikel heeft het dan over ‘plagiaat’, maar dat is geen juridische term. Plagiëren kan ook gaan over het  (zonder naamsvermelding) overnemen van iemands idee, ontdekking of werkwijze, zaken die juridisch prima mogen maar waar men met name in de wetenschap ernstig gefronste wenkbrauwen van krijgt.

De juridische term is gewoon “auteursrechtinbreuk”, en dat is nog geen uitgemaakte zaak. Auteursrecht krijg je namelijk op jouw uitwerking van een idee of jouw vertelling van een serie feiten. En specifiek bij nieuws kan dat vrij dun zijn: je kunt het op heel veel manieren vertellen, maar als het neerkomt op “er staat een file op de A12” dan is dat feit vrij voor iedereen om in eigen woorden door te vertellen.

Het meekijken met andermans nieuws en dat in eigen woorden doorvertellen is al zo oud als het nieuws, volgens mij. Het was alleen altijd vrij veel werk, omdat je echt wel je best moet doen als mens om een artikel echt opnieuw te schrijven. Dat laatste is nu een kwestie van iets aan ChatGPT vragen (bron, klik voor groot):

Met een paar API-koppelingen kun je dit volledig automatiseren, zodat je bij ieder nieuwsbericht op een bronsite vrijwel direct een herschreven kopie op je eigen site krijg.

Auteursrechtelijk is dit volgens mij aan de goede kant van de streep, omdat de zinnen duidelijk afstand houden van het origineel. Ze bevatten dezelfde feiten, maar dat is dus geen probleem, de opbouw is anders en er worden geen zinsconstructies letterlijk herhaald. Ik zie niet hoe dat auteursrechtinbreuk zou zijn.

Natuurlijk, het voelt onrechtvaardig, maar dat is omdat het hiermee zó makkelijk is geworden om mee te rijden op andermans werk zonder dat daar een juridisch eenvoudig trucje (een DSA copyright takedown) tegen is. Maar dat is echt een heel andere discussie.

Arnoud