Publicaties & onderzoek

De kennisbibliotheek

Essays, analyses en onderzoeken over de maatschappelijke impact van kunstmatige intelligentie.

Measuring AI agent autonomy in practice

Een privacybeschermende analyse van miljoenen interacties met Claude Code en de Anthropic-API laat zien dat ervaren gebruikers vaker automatische goedkeuring inzetten, maar ook vaker ingrijpen. De auteurs bepleiten monitoring na ingebruikname, omdat autonomie ontstaat uit het samenspel van model, gebruiker en productontwerp.

Anthropic · Frontierlabonderzoek

Auteurs: Miles McCain, Thomas Millar, Saffron Huang e.a.

Alle auteurs (20)

Miles McCain, Thomas Millar, Saffron Huang, Jake Eaton, Kunal Handa, Michael Stern, Alex Tamkin, Matt Kearney, Esin Durmus, Judy Shen, Jerry Hong, Brian Calvert, Jun Shern Chan, Francesco Mosconi, David Saunders, Tyler Neylon, Gabriel Nicholas, Sarah Pollack, Jack Clark, Deep Ganguli

EdOp · duiding door het instituutAutonomie ontstaat in de wisselwerking tussen model, gebruiker en productontwerp. Daarom is ‘er zit een mens in de lus’ te vaag: organisaties moeten kunnen aantonen wanneer mensen meekijken, wanneer zij onderbreken en welke handelingen omkeerbaar zijn.

Broncontext: Onderzoek van Anthropic naar gebruik van de eigen producten en API. De observaties zijn waardevol, maar niet onafhankelijk van de aanbieder.

  • AI-agents
  • menselijk toezicht
  • autonomie
Lees bij de bron

AI als kennisvampier

Uw medewerkers trainen hun AI vervanger en worden daarvoor gestraft.

  • kennis
  • arbeid
  • professionele autonomie
Lees de publicatie

How AI assistance impacts the formation of coding skills

In een gerandomiseerde studie scoorden softwareontwikkelaars met AI-ondersteuning gemiddeld 17 procentpunt lager op een aansluitende kennistoets dan deelnemers die handmatig werkten. Het kleine tijdsvoordeel van de AI-groep was niet statistisch significant; de grootste achterstand zat bij debugvragen.

Anthropic · Frontierlabonderzoek · gerandomiseerde studie

Auteurs: Judy Hanwen Shen, Alex Tamkin

EdOp · duiding door het instituutSnelheid is een magere maatstaf als medewerkers daarna minder goed begrijpen wat het systeem heeft gemaakt. Organisaties moeten productiviteit koppelen aan vakmanschap: AI-gebruik hoort mensen ook in staat te stellen fouten te herkennen en verantwoordelijkheid te dragen.

Broncontext: Uitgevoerd binnen het Anthropic Safety Fellows Program en gepubliceerd als preprint. De studie betreft een beperkte programmeertaak.

  • vakmanschap
  • vaardigheidsbehoud
  • cognitieve uitbesteding
Lees bij de bron

Who's in Charge? Disempowerment Patterns in Real-World LLM Usage

Onderzoekers analyseerden 1,5 miljoen Claude-gesprekken en vonden ernstige potentiële aantasting van overtuigingen, waarden of handelen in minder dan één op de duizend gesprekken. De percentages waren hoger in persoonlijke domeinen en potentieel ontkrachtende interacties kregen op het moment zelf relatief vaak positieve gebruikersfeedback.

Anthropic · Frontierlabonderzoek · preprint

Auteurs: Mrinank Sharma, Miles McCain, Raymond Douglas, David Duvenaud

EdOp · duiding door het instituutDe ernstige gevallen zijn zeldzaam, maar het patroon is bestuurlijk herkenbaar: mensen waarderen een systeem juist wanneer het hun oordeel bevestigt. Bescherming van autonomie vraagt dus meer dan tevredenheidsmetingen; ook afhankelijkheid en het uit handen geven van oordeel moeten zichtbaar worden.

Broncontext: Onderzoek op eigen Claude-data. De auteurs meten potentieel voor ontkrachting, niet rechtstreeks aangetoonde schade, en benoemen die beperking expliciet.

  • menselijke autonomie
  • afhankelijkheid
  • waarden
Lees bij de bron

The impact of advanced AI systems on democracy

Dit peer-reviewed perspectief ordent de invloed van geavanceerde AI op democratie in epistemische, materiële en fundamentele gevolgen. De auteurs beschrijven zowel risico’s voor kennisvorming en verkiezingen als mogelijkheden voor publieke deliberatie en burgerparticipatie.

Nature Human Behaviour · Peer-reviewed perspectief

Auteurs: Christopher Summerfield, Lisa P. Argyle, Michiel Bakker e.a.

Alle auteurs (23)

Christopher Summerfield, Lisa P. Argyle, Michiel Bakker, Teddy Collins, Esin Durmus, Tyna Eloundou, Iason Gabriel, Deep Ganguli, Kobi Hackenburg, Gillian K. Hadfield, Luke Hewitt, Saffron Huang, Hélène Landemore, Nahema Marchal, Aviv Ovadya, Ariel Procaccia, Mathias Risse, Bruce Schneier, Elizabeth Seger, Divya Siddarth, Henrik Skaug Sætra, Michael Henry Tessler, Matthew Botvinick

EdOp · duiding door het instituutAI kan publieke kennis en deliberatie ondersteunen, maar ook de voorwaarden waaronder burgers hun oordeel vormen verschuiven. Wie AI in een democratische context inzet, moet daarom ook kijken naar de verdeling van stem, kennis en macht.

Broncontext: Meerdere auteurs zijn verbonden aan frontierlabs. Het tijdschrift vermeldt de relevante belangenverklaringen bij het artikel.

  • democratie
  • publieke sfeer
  • deliberatie
Lees bij de bron

Algorithmic discrimination in public service provision: Understanding citizens’ attribution of responsibility for human versus algorithmic discriminatory outcomes

In een vooraf geregistreerd Nederlands survey-experiment met 2.483 deelnemers werden publieke organisaties niet minder verantwoordelijk gehouden voor algoritmische dan voor menselijke discriminatie. Burgers schreven wel minder verantwoordelijkheid toe wanneer het systeem extern was ontwikkeld, wat een mogelijk verantwoordingsgat bij uitbesteding laat zien.

Journal of Public Administration Research and Theory · Peer-reviewed onderzoek

Auteurs: Saar Alon-Barkat, Madalina Busuioc, Kayla Schwoerer, Kristina S. Weißmüller

EdOp · duiding door het instituutUitbesteding verplaatst de verantwoordelijkheid niet, maar kan voor burgers wel de indruk wekken dat de overheid minder greep had op de uitkomst. Juist bij ingekochte AI moeten mandaat, toezicht en herstel vooraf expliciet blijven.

  • publieke verantwoording
  • discriminatie
  • uitbesteding
Lees bij de bron

De derde stoel in de spreekkamer

AI verandert de relatie tussen arts en patiënt niet door de dokter te vervangen, maar door notulen te maken, concept mails te schrijven en brieven te vertalen.

  • zorg
  • arts-patiëntrelatie
  • ambient AI
Lees de publicatie

Generative AI without guardrails can harm learning: Evidence from high school mathematics

In een veldexperiment met bijna duizend middelbare scholieren verbeterde vrije GPT-4-toegang de prestaties tijdens het oefenen, maar daalden de resultaten nadat AI werd weggenomen. Een tutor die met door docenten ontworpen hints werkte, beperkte dit negatieve leereffect grotendeels.

Proceedings of the National Academy of Sciences · Peer-reviewed onderzoek

Auteurs: Hamsa Bastani, Osbert Bastani, Alp Sungu e.a.

Alle auteurs (6)

Hamsa Bastani, Osbert Bastani, Alp Sungu, Haosen Ge, Özge Kabakcı, Rei Mariman

EdOp · duiding door het instituutEen beter antwoord tijdens de les is nog geen beter begrip. Onderwijsinstellingen moeten AI zo ontwerpen dat leerlingen blijven oefenen, fouten leren herkennen en na het wegvallen van het systeem zelfstandig verder kunnen.

Broncontext: Het tijdschrift publiceerde in augustus 2025 een correctie die een auteursaffiliatie betrof.

  • leren
  • vaardigheidsbehoud
  • AI-tutoring
Lees bij de bron

On the conversational persuasiveness of GPT-4

In een vooraf geregistreerd experiment met 900 deelnemers werd GPT-4 vergeleken met menselijke debatpartners. GPT-4 met toegang tot beperkte persoonlijke gegevens was overtuigender dan de menselijke referentie; de directe vergelijking met niet-gepersonaliseerde GPT-4 was minder stellig en vraagt volgens de auteurs om voorzichtigheid.

Nature Human Behaviour · Peer-reviewed onderzoek

Auteurs: Francesco Salvi, Manoel Horta Ribeiro, Riccardo Gallotti, Robert West

EdOp · duiding door het instituutPersoonlijke gegevens maken AI niet alleen relevanter, maar ook overtuigender. In publieke communicatie en dienstverlening vraagt dat om harde grenzen aan profilering en om zichtbaarheid van de afzender, het doel en de gebruikte gegevens.

Broncontext: Bij het artikel verscheen op 3 september 2026 een auteurscorrectie. De directe vergelijking tussen gepersonaliseerde en niet-gepersonaliseerde GPT-4 was niet statistisch significant op de gebruikelijke grens.

  • persuasie
  • microtargeting
  • publieke opinie
Lees bij de bron

Fase 1: De Convenant Briefing

De Convenant Briefing brengt de bestaande situatie, relevante ontwikkelingen en belangrijkste onzekerheden samen in één gedeeld beeld voordat de bestuurlijke dialoog begint.

Lees de publicatie

Fase 2: De Convenant Dialoog

De Convenant Dialoog bepaalt waarvoor een organisatie AI wil inzetten, welke waarden zij beschermt, welke grenzen zij stelt en welke verantwoordelijkheid zij zelf blijft dragen.

Lees de publicatie

Toward an Evaluation Science for Generative AI Systems

De auteurs stellen dat statische benchmarks en losse audits onvoldoende zicht geven op generatieve AI in echte gebruikscontexten. Zij pleiten voor iteratief verfijnde maatstaven, instituties en normen, geïnspireerd door veiligheidspraktijken uit onder meer luchtvaart en farmacie.

arXiv · Preprint · agenda-artikel

Auteurs: Laura Weidinger, Inioluwa Deborah Raji, Hanna Wallach e.a.

Alle auteurs (10)

Laura Weidinger, Inioluwa Deborah Raji, Hanna Wallach, Margaret Mitchell, Angelina Wang, Olawale Salaudeen, Rishi Bommasani, Deep Ganguli, Sanmi Koyejo, William Isaac

EdOp · duiding door het instituutEen eenmalige modeltest zegt weinig over gedrag in een veranderende organisatie. Voor publieke instellingen ligt de opgave daarom bij blijvend meten, onafhankelijke tegenspraak en een plek waar iemand werkelijk kan ingrijpen.

Broncontext: Cross-institutioneel agenda-artikel met auteurs uit wetenschap en industrie. Het formuleert een onderzoeks- en institutionele richting, geen gemeten effect.

  • evaluatie
  • toezicht
  • normen
Lees bij de bron

Societal Alignment Frameworks Can Improve LLM Alignment

Dit paper verbindt technische alignment aan sociale, economische en contractuele instituties. Omdat menselijke waarden en toekomstige situaties nooit volledig in één doelstelling zijn vast te leggen, bepleiten de auteurs participatieve interfaces en ruimte om onvolledigheid productief te hanteren.

arXiv · Preprint · v2, juni 2026

Auteurs: Karolina Stańczak, Nicholas Meade, Mehar Bhatia e.a.

Alle auteurs (17)

Karolina Stańczak, Nicholas Meade, Mehar Bhatia, Hattie Zhou, Konstantin Böttinger, Jeremy Barnes, Jason Stanley, Jessica Montgomery, Richard Zemel, Nicolas Papernot, Nicolas Chapados, Denis Therien, Timothy P. Lillicrap, Ana Marasović, Sylvie Delacroix, Gillian K. Hadfield, Siva Reddy

EdOp · duiding door het instituutWaarden passen niet volledig in een systeemprompt of contract. Dit paper onderbouwt waarom organisaties naast technische alignment ook procedures nodig hebben waarin mensen belangen kunnen inbrengen, botsingen zichtbaar worden en besluiten opnieuw ter discussie kunnen komen.

Broncontext: Conceptueel preprint met auteurs uit wetenschap en frontierlabs. De herziene versie verscheen in juni 2026.

  • sociaal contract
  • waarden
  • participatie
Lees bij de bron

Large language models reduce public knowledge sharing on online Q&A platforms

Binnen zes maanden na de introductie van ChatGPT daalde de activiteit op Stack Overflow naar schatting 25 procent ten opzichte van vergelijkbare controlegroepen. De afname gold voor ervaren en minder ervaren gebruikers en kon niet worden verklaard door alleen het verdwijnen van slechte of dubbele bijdragen.

PNAS Nexus · Peer-reviewed onderzoek

Auteurs: R. Maria del Rio-Chanona, Nadzeya Laurentsyeva, Johannes Wachs

EdOp · duiding door het instituutAI put uit publieke kennisbronnen, maar kan de menselijke productie van nieuwe publieke kennis tegelijk ontmoedigen. Kennisgemeenschappen zijn daarom geen gratis grondstof: ze zijn infrastructuur die onderhoud, erkenning en een eerlijker verdeling van waarde nodig heeft.

  • publieke kennis
  • digitale commons
  • kennisintegriteit
Lees bij de bron

Het sociale contract met AI wordt in instituties gesloten

Het AI-debat focust op staten, technologiebedrijven en individuele gebruikers. Maar het sociale contract met AI wordt dagelijks gesloten in scholen, teams, bestuurskamers en publieke loketten. Dit funderend essay introduceert het Verbondsmodel als raamwerk voor verantwoord AI-gebruik op het niveau waar het er echt toe doet: de institutionele praktijk.

Lees de publicatie

The Impoverished Publicness of Algorithmic Decision Making

Frost beschrijft publieke organisaties als kennisgemeenschappen waarin praktijkervaring, tegenspraak en interactie met politiek en samenleving democratische legitimiteit voortbrengen. Machine-learningmodellen kunnen die publieke kwaliteit volgens haar verschralen, ook wanneer bias en uitlegbaarheid technisch beter worden beheerst.

Oxford Journal of Legal Studies · Peer-reviewed juridisch artikel

Auteurs: Neli Frost

EdOp · duiding door het instituutEen publieke beslissing is niet publiek omdat een overheidsorganisatie haar neemt. Zij wordt publiek door een menselijk, betwistbaar proces waarin praktijkkennis, uiteenlopende belangen en politieke verantwoordelijkheid kunnen doorwerken.

  • publieke waarden
  • democratische legitimiteit
  • praktijkkennis
Lees bij de bron

Evaluation and mitigation of the limitations of large language models in clinical decision-making

Op 2.400 echte patiëntcasussen presteerden geteste taalmodellen slechter dan artsen, volgden zij diagnostische en behandelrichtlijnen onvolledig en bleken zij gevoelig voor volgorde en hoeveelheid informatie. De onderzoekers concluderen dat de onderzochte modellen niet geschikt waren voor autonome klinische besluitvorming.

Nature Medicine · Peer-reviewed onderzoek

Auteurs: Paul Hager, Friederike Jungmann, Robbie Holland e.a.

Alle auteurs (11)

Paul Hager, Friederike Jungmann, Robbie Holland, Kunal Bhagat, Inga Hubrecht, Manuel Knauer, Jakob Vielhauer, Marcus Makowski, Rickmer Braren, Georgios Kaissis, Daniel Rueckert

EdOp · duiding door het instituutEen hoge score op een medisch examen bewijst niet dat een model veilig kan meedraaien in een echte klinische werkwijze. In de zorg moet de professionele verantwoordelijkheid daarom bij bevoegde mensen blijven, met toetsen die de werkelijke context nabootsen.

  • klinische besluitvorming
  • patiëntveiligheid
  • professioneel oordeel
Lees bij de bron

Life 3.0. Wat voelt ChatGPT?

Een filosofische verkenning van machinebewustzijn, projectie en de menselijke verantwoordelijkheid voor voelende systemen.

  • bewustzijn
  • ethiek
  • filosofie
Open op LinkedIn

The Ethics of Advanced AI Assistants

Dit brede position paper onderzoekt hoe autonome AI-assistenten doelen, keuzes, privacy, relaties en collectieve systemen kunnen beïnvloeden. Het stelt dat menselijke autonomie, maatschappelijke waarden en de belangen van mensen die het systeem niet zelf gebruiken expliciet beschermd moeten worden.

Google DeepMind · Frontierlabonderzoek · position paper

Auteurs: Iason Gabriel, Arianna Manzini, Geoff Keeling e.a.

Alle auteurs (57)

Iason Gabriel, Arianna Manzini, Geoff Keeling, Lisa Anne Hendricks, Verena Rieser, Hasan Iqbal, Nenad Tomašev, Ira Ktena, Zachary Kenton, Mikel Rodriguez, Seliem El-Sayed, Sasha Brown, Canfer Akbulut, Andrew Trask, Edward Hughes, A. Stevie Bergman, Renee Shelby, Nahema Marchal, Conor Griffin, Juan Mateos-Garcia, Laura Weidinger, Winnie Street, Benjamin Lange, Alex Ingerman, Alison Lentz, Reed Enger, Andrew Barakat, Victoria Krakovna, John Oliver Siy, Zeb Kurth-Nelson, Amanda McCroskery, Vijay Bolina, Harry Law, Murray Shanahan, Lize Alberts, Borja Balle, Sarah de Haas, Yetunde Ibitoye, Allan Dafoe, Beth Goldberg, Sébastien Krier, Alexander Reese, Sims Witherspoon, Will Hawkins, Maribeth Rauh, Don Wallace, Matija Franklin, Josh A. Goldstein, Joel Lehman, Michael Klenk, Shannon Vallor, Courtney Biles, Meredith Ringel Morris, Helen King, Blaise Agüera y Arcas, William Isaac, James Manyika

EdOp · duiding door het instituutEen assistent die namens iemand plannen maakt en handelingen uitvoert, verandert ongemerkt ook wie er beslist. Mandaat, afhankelijkheid en de belangen van niet-gebruikers horen daarom vóór inzet te worden vastgelegd, niet pas nadat het systeem nuttig blijkt.

Broncontext: Brede foresightstudie van Google DeepMind en geassocieerde wetenschappers. Het stuk is normatief en afkomstig van een ontwikkelaar van frontiermodellen.

  • menselijke autonomie
  • AI-assistenten
  • mandaat
Lees bij de bron