Een bedrijf dat AI-detectie uitvoert, ontdekte dat de hoeveelheid AI-content die gebruikers daadwerkelijk te zien krijgen tijdens hun dagelijkse internetgebruik schrikbarend hoog is.
Een schokkend groot deel van de content die gebruikers tegenkomen op populaire sociale mediawebsites is waarschijnlijk door AI gegenereerd, blijkt uit gegevens van een bedrijf dat AI-teksten detecteert. Maar liefst 41 procent van de langere teksten die gebruikers op LinkedIn zien, is waarschijnlijk volledig door AI gegenereerd en ongeveer een derde van de langere berichten op X is AI-gegenereerd; ongeveer één op de tien langere berichten op Reddit en Substack is AI, aldus de gegevens .
De gegevens werden verzameld met behulp van een Chrome-extensie van Pangram, een bedrijf dat AI-gegenereerde teksten detecteert. De Chrome-extensie van Pangram scant teksten die gebruikers tegenkomen tijdens het browsen en bepaalt of een bericht waarschijnlijk door AI is gegenereerd of door een mens is geschreven. Omdat Pangram passief op de achtergrond werkt terwijl een gebruiker op internet surft, scant het alleen berichten die gebruikers daadwerkelijk zien.
Dit helpt de vraag te beantwoorden of AI-rommel het internet dat mensen daadwerkelijk gebruiken vergiftigt, of dat het het internet in bredere zin vervuilt. Het antwoord is ondubbelzinnig: AI-rommel is niet alleen te vinden op impopulaire geautomatiseerde SEO-farms of spamsites die niemand leest; mensen moeten regelmatig door AI-onzin heen ploeteren op enorm populaire websites.
“Dit is iets wat nog niet eerder echt onderzocht is: hoeveel AI-content mensen daadwerkelijk te zien krijgen”, vertelde Max Spero, de CEO van Pangram, me in een telefonisch interview. “AI-content is een belasting voor de tijd van de lezers.”

(Pangram adverteerde voorheen op 404 Media. Ik behandel deze gegevens omdat ik veel artikelen heb geschreven over hoe door AI gegenereerde content sociale media overneemt en de algoritmes van sociale media manipuleert , en ik heb geen andere gegevens gezien die de werkelijke populariteit van dergelijke content proberen te meten.)
Voor dit onderzoek heeft Pangram gebruikers van zijn Chrome-extensie specifiek gevraagd om toestemming te geven voor het delen van Pangram-browseresultaten met het bedrijf. Het bedrijf analyseerde ongeveer een miljoen berichten die gebruikers organisch scrolden op LinkedIn, Medium, X, Reddit en Substack gedurende een periode van twee maanden.
Pangram ontdekte dat, universeel gezien, langere berichten op alle platforms vaker door AI zijn gegenereerd dan kortere berichten. Het bedrijf verdeelde de geanalyseerde content in ‘korte berichten’ (tussen 50 en 250 woorden) en ‘lange berichten’ (langer dan 250 woorden).
De data suggereert, wellicht niet geheel verrassend, dat een groot deel van de lange berichten op LinkedIn en het nieuwe artikelformaat van X volledig door AI gegenereerd of met AI-ondersteuning geschreven is (wat betekent dat ze door AI zijn opgesteld, bewerkt of herschreven, met enkele menselijke elementen).
Veertig procent van de geanalyseerde lange LinkedIn-berichten was volledig door AI geschreven; een kwart van de X-artikelen was volledig door AI geschreven, maar nog eens 23 procent van de X-artikelen was met AI-ondersteuning geschreven, aldus het bedrijf.
Het is intuïtief logisch dat langere content vaker door AI gegenereerd wordt, omdat mensen doorgaans niet de moeite nemen om een reactie van een paar woorden of een bondige opmerking bij een quote-tweet door AI te laten genereren. AI staat er bovendien om bekend dat het veel woorden gebruikt , wat betekent dat door AI gegenereerde content vaker voorkomt in langere berichten.

“Onze gegevens tonen aan dat door AI gegenereerde content een probleem is op alle platforms, en dat het vooral lange teksten hard raakt”, schreef het bedrijf in een blogpost. “In tegenstelling tot wat je zou verwachten, zijn mensen over het algemeen bereid om AI te gebruiken om namens hen te spreken in professionele omgevingen die gekoppeld zijn aan hun echte identiteit, en minder geneigd om het te gebruiken op informele en anonieme platforms.”
Uit het onderzoek bleek ook dat topberichten op LinkedIn en Reddit veel vaker door AI zijn gegenereerd dan de reacties onder een origineel bericht.
Ik gebruik de Pangram Chrome-extensie nu al een paar maanden, nadat ik Spero interviewde voor een artikel dat ik schreef met de titel ” Jouw AI-gebruik maakt mijn hersenen kapot “. In dat artikel schreef ik over de cognitieve belasting van de constante beoordelingen die ik maak tijdens het surfen op internet, om te bepalen of een tekst door AI is gegenereerd of niet. Na het schrijven van dat artikel besloot ik de Pangram Chrome-extensie te proberen om te zien of de beoordelingen van de extensie over mogelijk door AI gegenereerde teksten overeenkwamen met mijn eigen beoordelingen.
Na de extensie bijna twee maanden te hebben gebruikt, komt mijn ervaring grotendeels overeen met wat de data van Pangram suggereert: veel van de lange artikelen die ik op X zie, zijn duidelijk door AI gegenereerd en worden door Pangram als zodanig gedetecteerd. Een groot deel van de LinkedIn-berichten die ik zie, is overduidelijk door AI gegenereerd.
Door de manier waarop het onderzoek is uitgevoerd – door passief AI-gegenereerde content te detecteren die mensen tijdens hun normale internetgebruik tegenkomen – zijn de gegevens mogelijk nuttiger dan die van andere onderzoeken die weliswaar het ruwe percentage AI-gegenereerde content op internet probeerden te schatten, maar niet of iemand die content daadwerkelijk zag. Deze eerdere onderzoeken, die aantoonden dat maar liefst een derde van de nieuwe websites door AI is gemaakt , hielden rekening met de mogelijkheid dat AI-gegenereerde content het internet overspoelde, maar van zo’n lage kwaliteit was dat mensen die content mogelijk niet zagen.
De Pangram-gegevens roepen vragen op over wat platforms doen om AI-onzin te bevorderen of juist te ontmoedigen. LinkedIn had bijvoorbeeld jarenlang AI-schrijftools ingebouwd in zijn platform, waardoor het ongelooflijk gemakkelijk was om door AI gegenereerde content op het platform te plaatsen en waardoor AI-content enorm veel voorkwam.
In mei kondigde het bedrijf aan dat het AI-content probeert te ontmoedigen om “echte gesprekken te behouden”, en de AI-schrijfassistent is niet langer geïntegreerd in de postknop. Reddit is ondertussen een platform geworden voor bedrijven die LLM-tools proberen te misbruiken door hun producten op de site te promoten, omdat AI-zoektools vaak Reddit doorzoeken. Maar de moderators van Reddit zijn ook overwegend anti-AI, en het bedrijf heeft zich ingespannen om door AI gegenereerde berichten te verwijderen en accounts te blokkeren die spammen.
Op maandag publiceerde Reddit een blogpost waarin stond dat “in het tijdperk van AI spam, botactiviteit en onauthentieke content bovenaan de prioriteitenlijst staan van mensen die van Reddit (en van mensen) houden.” De afgelopen weken lanceerde Reddit een reclamecampagne met de slogan “people are best”, waarin specifiek werd benadrukt dat de gebruikers menselijk zijn. Een woordvoerder van Reddit verwees ons naar het blogbericht toen we om commentaar vroegen.
Zoals we eerder al hebben gemeld, is geen enkele AI-detector 100 procent waterdicht , en Pangram heeft zeker zowel valse positieven (door mensen gemaakte content die als AI wordt gedetecteerd) als valse negatieven (door AI gegenereerde content die als door mensen wordt gedetecteerd). Spero zei dat het bedrijf constant werkt aan het minimaliseren van beide, en dat het de kans op valse positieven schat op ongeveer één op de 10.000.
Hij zei dat hij denkt dat de Pangram-gegevens waarschijnlijk een “ondergrens” zijn en dat het werkelijke probleem waarschijnlijk groter is, omdat mensen die bereid zijn AI-detectoren in hun browsers te installeren, waarschijnlijk proberen door AI gegenereerde content te vermijden.
“Ik denk dat de gegevens ook gelden voor mensen die geen Pangram gebruiken, maar dat het een ondergrens is voor AI-content. Iemand met de Pangram-extensie geeft waarschijnlijk meer om het zien van AI-content dan de gemiddelde persoon en zal eerder geneigd zijn AI-gebruikers te blokkeren of te dempen,” zei hij.
Een woordvoerder van LinkedIn vertelde in een verklaring: “Professionals komen naar LinkedIn om te luisteren naar echte mensen en hun unieke inzichten en perspectieven. We werken er actief aan om content van lage kwaliteit, geautomatiseerde content of generieke content te verminderen. Hoewel AI kan worden ingezet om het probleem van lege pagina’s op te lossen, ligt onze focus op het naar boven halen van professionele gesprekken die mensen helpen hun carrière vooruit te helpen.”
Substack en X hebben niet gereageerd op een verzoek om commentaar.
