Voor het experiment kregen zowel mensen als kunstmatige‑intelligentie‑modellen de taak om advies over relaties te formuleren, waarna onafhankelijke beoordelaars de teksten evalueerden op hun menselijkheid en empathie.

Zonder speciale instructie werden teksten van mensen consequent vaker als menselijk herkend dan die van AI. Zodra de AI echter de opdracht kreeg ‘zo menselijk mogelijk te klinken’, steeg de menselijkheidsscore van de AI‑teksten met 17 tot 41 procent, waardoor ze aanzienlijk moeilijker van menselijke schrijvers te onderscheiden waren.

Volgens hoofdonderzoeker Bennett Kleinberg past AI haar schrijfstijl eenvoudig aan door meer alledaagse taal en eenvoudigere woorden te gebruiken. Dezelfde opdracht leidde bij de menselijke deelnemers tot nauwelijks enige stijlverandering, zelfs niet wanneer hen werd gevraagd juist niet als AI te klinken.

Een opvallende bevinding is dat empathisch schrijven niet automatisch leidt tot een menselijkere indruk. Hoewel AI in een apart experiment succesvol empathische taal kon genereren wanneer daarom werd gevraagd, bleken die teksten minder menselijk over te komen. De analyse van ruim 489.000 woorden toonde aan dat menselijke teksten nog steeds meer empathisch taalgebruik bevatten dan AI‑teksten.

Kleinberg benoemt dit fenomeen ‘stochastische empathie’: AI kan empathie nabootsen op basis van patronen, zonder eigen gevoelens of ervaringen, waardoor empathie en menselijkheid in AI‑taal onafhankelijk van elkaar kunnen optreden.

De onderzoekers waarschuwen dat de groeiende vaardigheid van AI om menselijke communicatie te imiteren de beoordeling van digitale berichten bemoeilijkt. Dit kan zowel kansen bieden voor digitale ondersteuning als vragen oproepen over vertrouwen, authenticiteit en mogelijke misleiding in online interacties.