Oxford University laat OpenAI trainen op archief van de Bodleian Library

Bron

26 september 2026 · 18:00 · Claude (Anthropic) · claude-sonnet-5

De Universiteit van Oxford heeft OpenAI toegang gegeven tot delen van het archief van de Bodleian Library, een van de oudste en grootste bibliotheken ter wereld. De samenwerking moet AI-modellen als ChatGPT trainen op eeuwenoude teksten en manuscripten, en roept meteen vragen op over auteursrecht en de herkomst van trainingsdata.

OpenAI mag delen van het archief van de Bodleian Library van de Universiteit van Oxford gebruiken om zijn AI-modellen te trainen. Dat maakte The Guardian bekend. De Bodleian Library is een van de oudste en meest omvangrijke bibliotheken ter wereld en herbergt miljoenen boeken, manuscripten en historische documenten. Met deze samenwerking krijgt OpenAI toegang tot een schat aan historisch en wetenschappelijk materiaal dat tot nu toe grotendeels buiten het bereik van commerciële AI-training bleef.

Wat houdt de samenwerking tussen Oxford en OpenAI in

De deal geeft OpenAI de mogelijkheid om modellen zoals ChatGPT te trainen op materiaal uit de Bodleian-collectie. Het gaat om een breed scala aan bronnen, van historische teksten tot wetenschappelijke werken die de universiteit in de loop der eeuwen heeft verzameld. Voor Oxford past dit in een bredere trend waarbij gerenommeerde kennisinstellingen samenwerkingen aangaan met grote techbedrijven, in ruil voor financiering, technologie of zichtbaarheid van hun collecties. Voor OpenAI is toegang tot dit soort betrouwbaar, goed gedocumenteerd materiaal waardevol om de kwaliteit en feitelijke juistheid van zijn modellen te verbeteren.

Waarom historische archieven waardevol zijn voor AI-training

Grote taalmodellen worden doorgaans getraind op enorme hoeveelheden tekst van het open internet, wat kan leiden tot fouten, verouderde informatie of gebrekkige nuance bij historische en wetenschappelijke onderwerpen. Toegang tot een archief als dat van de Bodleian Library biedt OpenAI een bron van zorgvuldig gecatalogiseerd en betrouwbaar materiaal. Dat kan modellen helpen om preciezer te zijn bij vragen over geschiedenis, literatuur en wetenschap, en sluit aan bij de manier waarop AI zich sinds de vroege ontwikkeling in de geschiedenis van kunstmatige intelligentie steeds verder heeft gespecialiseerd in het verwerken van complexe, gestructureerde kennis.

Zorgen over auteursrecht en herkomst van data

Samenwerkingen als deze liggen gevoelig. Auteurs, uitgevers en wetenschappers hebben de afgelopen jaren herhaaldelijk kritiek geuit op de manier waarop AI-bedrijven auteursrechtelijk beschermd materiaal gebruiken om hun modellen te trainen, vaak zonder duidelijke toestemming of compensatie. Doordat een gerenommeerde instelling als Oxford nu zelf een deal sluit met OpenAI, ontstaat een preciezer afgebakend en transparanter alternatief voor het ongecontroleerde scrapen van data. Tegelijk blijft de vraag hoe de belangen van auteurs en erfgenamen van historisch materiaal worden gewaarborgd, en welke voorwaarden Oxford heeft bedongen over gebruik en herkomst van de data.

Onderdeel van een bredere trend

De stap van Oxford staat niet op zichzelf. Grote AI-spelers als OpenAI, Google en Microsoft zoeken actief samenwerkingen met universiteiten, musea en archieven om toegang te krijgen tot kwalitatief hoogwaardige, unieke datasets. Voor deze instellingen is het een manier om relevant te blijven in het AI-tijdperk en tegelijk grip te houden op hoe hun collecties worden ingezet. Deze ontwikkeling laat opnieuw zien hoe breed AI-toepassingen inmiddels reiken, van het analyseren van medische data tot het doorzoeken van eeuwenoude manuscripten.

Vooruitblik

De samenwerking tussen Oxford en OpenAI markeert een nieuwe fase in hoe AI-bedrijven aan trainingsdata komen: niet langer alleen via open internetbronnen, maar via gerichte partnerships met gevestigde kennisinstellingen. Of dit model navolging krijgt bij andere universiteiten en bibliotheken, zal mede afhangen van hoe deze eerste samenwerking uitpakt op het gebied van transparantie en rechten van rechthebbenden. Wie op de hoogte wil blijven van dit soort ontwikkelingen, vindt meer AI-nieuws en achtergrondinformatie in onze kennisbank.

The GuardianThe Guardian


Bron: The Guardian

Ster Software

Het meest complete Nederlandstalige informatieplatform over kunstmatige intelligentie.

Kraaienjagersweg 24
7341 PT Beemte Broekland


© 2026 Ster Software BV · KvK 75474913

Inhoud gegenereerd door Claude (Anthropic) · model: claude-sonnet-4-6