Hoe accuraat zijn de voorspellingen van AI-scepticus Ed Zitron?
Een opmerking die ik vaak hoor van AI-sceptici wanneer iemand reageert op een scepticus, is dat iedereen die beweert dat AI niet 'nep' is, een leugenaar is met eigenbelangen. Persoonlijk heb ik geen specifiek financieel belang bij AI-bedrijven. Ik bezit alleen het standaard aandeel via saaie indexfondsen. Ik heb enkele investeringen in de beginfase, maar door de timing en welke bedrijven groot zijn geworden, is dat deel van mijn portfolio ondergewogen op AI. Ik werk niet bij een AI-lab of bij een bedrijf dat AI-labs bevoorraadt. Ik heb eerder vermeld dat ik hilarisch slecht ben in sollicitatiegesprekken; ik heb een aantal jaar geleden gesolliciteerd bij een AI-lab en ben al tijdens het telefoongesprek afgewezen. Het was een prestatie die waarschijnlijk inspiratie vormde voor het beroemde artikel van Jeff Atwood, Why Can’t Programmers... Program?, waarin hij concludeert dat er veel neppe programmeurs moeten zijn, omdat niemand zo slecht zou kunnen scoren in een codeer-interview als ze wisten hoe ze moesten programmeren. Ik profiteer dus op geen enkele bijzondere manier als AI succesvol is, behalve voor zover iedereen met brede indexfondsen profiteert, maar ik hecht wel waarde aan accuratesse.
2024: Meta, Google en Microsoft gaan ten onder
Omdat er vrij veel voorspellingen zijn, kijken we er eerst één in detail naar voordat we naar de volledige lijst gaan, om een idee te krijgen van de redenering die Zitron gebruikt. We kijken willekeurig naar een presentatie uit november 2024 waarin Zitron onder andere zegt dat de grote techbedrijven (zoals Meta en Google) stervende zijn en dat ze wanhopig acties ondernemen op het gebied van AI omdat ze niet weten hoe ze moeten groeien.
Zitron noemde Meta specifiek als een bedrijf dat stervende is ("het is een stervend product, en in feite een stervend bedrijf"). De omzet en winst (GAAP-bedrijfswinst) van Meta zagen er als volgt uit:
| Periode | Omzet (Bedrag) | Omzet (%) | Winst (Bedrag) | Winst (%) |
|---|---|---|---|---|
| 2023 | $135B | 16% | $47B | 62% |
| 2024 | $165B | 22% | $69B | 48% |
| 2025 | $201B | 22% | $83B | 20% |
| Eerste helft 2026 | $117B | 30% | $42B | 10% |
Wanneer hij sprak over bedrijven die niet meer weten hoe ze moeten groeien ("geen van deze bedrijven weet meer echt hoe ze moeten groeien... in de wanhoop om groei te herontsteken in een stervend ecosysteem gaat de techindustrie deze [AI] troep in alles duwen"), noemde hij Google en Microsoft. Alphabet (het moederbedrijf van Google) had de volgende cijfers voor omzet en winst:
| Periode | Omzet (Bedrag) | Omzet (%) | Winst (Bedrag) | Winst (%) |
|---|---|---|---|---|
| 2023 | $307B | 9% | $84B | 13% |
| 2024 | $350B | 14% | $112B | 33% |
| 2025 | $403B | 15% | $129B | 15% |
| Eerste helft 2026 | $230B | 23% | $80B | 30% |
En de cijfers van Microsoft waren (let op: voor de consistentie zijn dit kalenderjaren en geen fiscale jaren):
| Periode | Omzet (Bedrag) | Omzet (%) | Winst (Bedrag) | Winst (%) |
|---|---|---|---|---|
| 2023 | $228B | 12% | $101B | 21% |
| 2024 | $262B | 15% | $118B | 17% |
| 2025 | $305B | 17% | $143B | 21% |
| Eerste helft 2026 | $173B | 18% | $79B | 19% |
Hoewel dit niet in de geest van Zitrons uitspraak zou zijn, zou men kunnen beargumenteren dat Meta eigenlijk stervende is, maar dat het simpelweg nog niet is gebeurd. De redenering in het argument van Zitron is hier echter onjuist—de ecosystemen van Meta, Google en Microsoft zijn niet stervende. Gezien de snelheid waarmee deze bedrijven groeien (in termen van omzet en winst), lijkt AI niet de wanhoopsdaad te zijn die Zitron suggereert, omdat ze "niet weten hoe ze moeten groeien" en geen ideeën meer hebben.
Om aan te tonen dat deze zaken stervende zijn, grijpt hij terug op kleine problemen die niet gepositioneerd zijn om de enorme veranderingen te veroorzaken die hij voorspelt. Voor Meta citeerde hij een vermeende daling in het aantal maandelijkse actieve gebruikers (MAU) van Facebook. In plaats van de eigen MAU-cijfers van Meta of omzet- en winstcijfers te gebruiken, lijkt hij cijfers van Similarweb te hebben gebruikt. Mijn ervaring met dergelijke trackingcijfers van derden is dat ze vrij onnauwkeurig zijn en over het algemeen nutteloos voor alles behalve een grove schatting van de grootte, wat de door Zitron genoemde daling betekenisloos maakt (de gerapporteerde cijfers van Meta tonen geen dergelijke aanhoudende daling).
Voor Google citeert hij Prabhakar Raghavan, die hij "werkelijk slecht" noemt en een "computerwetenschapper en klassenverrader die de zijde van de managementconsultancy-sekte heeft gekozen", als iemand die ernstige schade heeft toegebracht aan Google Search. In zijn tirades over Raghavan stelt hij nooit geloofwaardig vast dat Raghavan ernstige schade toebrengt aan Google Search, en de Google Search-engineers die op zijn tirade hebben gereageerd, lijken het er niet mee eens dat Raghavan de enige of zelfs de belangrijkste reden is voor problemen met de zoekfunctie.
Maar zelfs als we aannemen dat Zitron gelijk heeft en dat de schurk Prabhakar Raghavan de held Ben Gomes heeft verslagen, waardoor er problemen zijn ontstaan voor Google Search, bewijst dit nog steeds niet dat de omzetgroei van Google in het algemeen in gevaar is. Ze hebben namelijk een aantal andere grote producten (zoals YouTube en Google Cloud) die de groei kunnen stimuleren, zelfs als de zoekfunctie niet zou groeien.
Elk significant deel van de redenering hier is niet alleen onjuist, maar ook onwaarschijnlijk als je iets weet over Google of grote bedrijven in het algemeen. Ik ben de eerste die zal zeggen dat de kwaliteit van Google Search ernstige problemen heeft en dat Google naarmate de tijd verstreek de relatieve prioriteit van omzet boven de gebruikerservaring heeft verhoogd. Dit was een bron van zorg voor een aantal gebruikersgerichte engineers bij Google toen ik daar in 2013 werkte.
Voor een van de problemen die Zitron noemt—dat advertenties verwarrend zijn voor gebruikers—vroeg ik in 2013 aan een search-engineer waarom Google de achtergrondkleur van advertenties veranderde zodat ze meer op zoekresultaten leken. Er was een eerdere studie die liet zien dat hoe meer een advertentie op een zoekresultaat leek, hoe vaker gebruikers in de war raakten. Ik had gehoord dat Google advertenties juist bewust anders maakte om verwarring te voorkomen. De engineer vertelde me dat, omdat sommige mensen niet wilden dat gebruikers in de war raakten, het onmogelijk was om advertenties in één enkele wijziging bijna identiek te maken aan zoekresultaten, omdat dat te duidelijk zou zijn.
De aanpak was dat elke keer dat ze via A/B-testen de advertenties een klein beetje meer lieten lijken op zoekresultaten, ze meer geld verdienden. De verandering zou dus over meerdere jaren en in meerdere delen gebeuren, elk klein genoeg zodat mensen die hiertegen wilden vechten, geen sterke zaak hadden. Dat gebeurde precies zoals deze engineer voorspelde, maar dat zou gebeuren ongeacht of Raghavan de leiding kreeg over Search. En natuurlijk zorgt dit soort zaken er niet voor dat Google geen ruimte meer heeft om te groeien en wanhopig wordt om groei te herontsteken in een stervend ecosysteem. Of je nu vindt dat Google dit zou moeten doen of niet, het levert Google meer geld op.
Hoe citeren mensen Zitron?
Voor zover ik kan zien, citeren mensen Zitron als een autoriteit, zodat ze kunnen zeggen dat iemand die naar de cijfers heeft gekeken deze claim heeft gemaakt, en dat hun claim dus wordt ondersteund door de cijfers. Het blijkt dat als je naar de claims kijkt die Zitron maakt en iets weet over het onderwerp, de claims onzinnig zijn, maar ik denk niet dat dat het punt is. Het punt is dat men kan zeggen dat iemand naar de cijfers heeft gekeken. Een ander punt lijkt te zijn dat deze man boos is, wat een goede manier is om engagement te stimuleren.
Maar wanneer mensen hem aanhalen, citeren ze natuurlijk over het algemeen niet zijn woede; ze zeggen: "hier is iemand die naar de cijfers heeft gekeken en, als jij boos bent over AI, is hij erbij en heeft hij cijfers aan zijn zijde." Zoals ik hierboven al zei, wil ik niet in dit detail ingaan voor elke claim; dit is slechts een illustratief voorbeeld. In alle berichten die ik van hem heb gelezen, worden er wel cijfers genoemd, maar die cijfers maken geen deel uit van een coherent argument. In veel gevallen ondersteunen de cijfers zijn argument zelfs niet (zoals een daling van de MAU bij Facebook die financiële problemen bij Meta zou veroorzaken, wat Meta vervolgens zou dwingen om AI op onlogische plaatsen in te voegen). Ik vermoed dat hij erop vertrouwt dat mensen glazige ogen krijgen wanneer ze cijfers zien en niet nadenken over wat die cijfers betekenen.
Bij de onderstaande voorspellingen zou iemand met exact hetzelfde resultaat heel redelijke redenen kunnen hebben gehad die simpelweg niet uitkwamen. Of iemand zou in elk geval correct kunnen zijn, maar toch ongelijk hebben omdat al zijn redenen onjuist zijn. Iemand als dat laatste zou een intuïtie kunnen hebben die hij niet kan verwoorden, of misschien heeft hij gewoon geluk gehad. Gelukkig hoeven we dat moeilijke oordeel niet te vellen, want Zitron heeft ongelijk over de voorspellingen én over de redenering.
Mensen met oog voor detail over Zitron
Omdat ik jarenlang onder een steen heb geleefd en pas net kennismaak met het AI-discours, had ik eigenlijk niets van Zitron of andere grote AI-commentatoren gelezen of bekeken. Maar toen ik opzocht wat mensen met een goed oordeel zeggen, bleek dat zij ook vinden dat het gebruik van cijfers door Zitron een soort goocheltruc is. Zo zegt Juho Snellman:
"Zijn schrijfstijl is zeker flamboyant, maar de agressie en krachttermen lijken meer gericht op het hypen van mensen die al geloven wat hij schrijft, dan op het veranderen van meningen. Hij heeft een niche gevonden in de 'anti-tech grift' en exploiteert die nu maximaal. Maar je wilt een paar van de dingen die hij zegt en die je overtuigen waarschijnlijk fact-checken, want voor zover het gaat om zijn geschreven artikelen is basisch gezien alles verzonnen of verkeerd gepresenteerd. Er zijn zeker veel links naar bronnen, maar als je naar de primaire bron gaat, is wat daar staat heel anders dan wat Zitron suggereert."
Hier is een voorbeeld waarbij commentatoren ervan uitgaan dat de analyse van Zitron goed is, waarop Juho Snellman reageert:
"Het belangrijkste probleem is dat zijn economische analyse absolute troep is. Ik dacht eerst dat hij er simpelweg incompetent in was, maar gezien de bias in de fouten is het vrij duidelijk dat het om opzettelijke misleiding gaat. Maar het is vaak lastig om dat aan te kaarten, omdat elk artikel dat hij schrijft een 'gish gallop' van 10.000 woorden is. Ik heb geprobeerd om een paar keer kernpunten te ontkrachten in HN-comments voor slechts één van de opzettelijke fouten die hij maakt, en mensen klagen dat de reactie te lang is."
Bijvoorbeeld, toen Timothy B. Lee keek naar een spreadsheet die Zitron gebruikte om een projectie van de omzet van Anthropic te maken, ontdekte hij:
"Hij telt 1-10 februari niet mee, telt 1-10 maart twee keer, telt 21 augustus tot 21 oktober als één maand in plaats van twee, en telt 21 oktober tot 1 november niet mee. [een andere commentator merkt op dat zijn spreadsheet ook 30 februari bevat] ... Ed beweert dat hij de omzet van Anthropic voor 2025 heeft berekend en uitkwam op $3,6 miljard, wat suggereert dat er vreemde zaken aan de hand zijn [maar de cijfers kloppen zodra je de fouten corrigeert]."
Enkele voorspellingen van Zitron
- Februari 2024: "Ik geloof dat we de bovengrens bereiken van wat generatieve AI kan doen en hoe accuraat de outputs kunnen zijn." → Fout
- Maart 2024: "Have We Reached Peak AI?"; een andere voorspelling dat hallucinaties betekenen dat AI-vooruitgang beperkt is tot de toenmalige niveaus. → Fout
- April 2024: "Zoals ik eerder waarschuwde, raken AI-bedrijven door de data heen..."; een voorspelling dat modellen niet kunnen verbeteren omdat er geen data meer is. → Fout
- Juni 2024: De groei van OpenAI stagneert (met de implicatie dat dit zal aanhouden), wat zal leiden tot een soort instorting van OpenAI. → Fout (OpenAI zou kunnen instorten, maar dat zou niet komen door een groeistagnatie in 2024).
- Juli 2024: "Generatieve AI is aan het pieken, zo niet al gepiekt. Het kan niet veel meer doen dan het nu al doet, behalve meer ervan doen, sneller, met enkele nieuwe inputs." → Fout
- Juli 2024: "Generatieve AI-modellen worden niet energie-efficiënter, noch worden ze 'krachtiger' op een manier die hun functionaliteit zou vergroten." → Fout (modellen bleven krachtiger worden).
- Augustus 2024: "generatieve AI is een doodlopende technologie die gepiekt is." → Fout
- Augustus 2024: Herhaling dat de AI-bubbel drie kwartalen de tijd heeft om zichzelf te bewijzen (vanaf maart 2024) of er volgt een instorting. → Fout (Sommigen zeggen 'Correct' omdat AI zichzelf bewees, maar volgens Zitrons eigen logica dat er geen verbetering is, is het 'Fout').
- September 2024: "o1 laat zien dat OpenAI zowel wanhopig is als geen ideeën meer heeft", met een herhaling van het idee dat modellen niet kunnen verbeteren door gebrek aan data. → Fout
- Oktober 2024: De prognose van OpenAI van $3,7 miljard omzet in 2024, $11,6 miljard in 2025 en $100 miljard in 2029 is absurd, "een uitspraak die zo grotesk is dat ik verbaasd ben dat het geen financieel misdrijf is om dit hardop te zeggen." → Fout (doel voor 2025 overtroffen, 2029 moet nog blijken, maar is niet op het niveau van een financieel misdrijf onwaarschijnlijk).
- Oktober 2024: "[De omzetgroei van OpenAI] vertraagt al, en zal drastisch vertragen zodra we het nieuwe jaar ingaan." → Fout (OpenAI overtrof de prognoses en bleef snel groeien).
- December 2024: "Ik heb jullie in maart gewaarschuwd dat generatieve AI al gepiekt was." → Fout (en vreemd genoeg suggereert hij dat er geen progressie is sinds maart 2024).
- Januari 2025: "Ik geloof dat we op de piek van AI zitten." → Fout
- Januari 2025: "DeepSeek heeft de [LLM] gecommoditiseerd." → Fout (OpenAI en Anthropic hadden en hebben nog steeds aanzienlijke prijskracht en kunnen prijzen ver boven DeepSeek handhaven).
- Februari 2025: Dat Anthropic in 2027 $34,5 miljard aan omzet zou genereren is "op vele niveaus lachwekkend, vooral omdat OpenAI, die in 2024 ongeveer twee keer zoveel omzet draaide als Anthropic, in hetzelfde jaar nauwelijks een miljard verdiende aan API-calls." → Fout (ongeacht of ze dat in 2027 halen, hun ARR voor 2026 overstijgt dat ruimschoots, wat de schatting voor 2027 niet lachwekkend maakt).
- Februari 2025: "Sundar Pichai wil dat Gemini voor het einde van 2025 door 500 miljoen mensen wordt gebruikt, een getal dat zo onrealistisch is dat iemand bij Google ontslagen zou moeten worden, en diegene is Sundar Pichai." → Fout (Gemini bereikte 750 miljoen gebruikers).
- Februari 2025: "Het feit dat Sam Altman Orion degradeert van GPT-5 naar GPT-4.5 suggereert dat OpenAI tegen een muur is gelopen bij het maken van hun volgende model, waardoor hij de verwachtingen moet bijstellen." → Fout (GPT-5 was een aanzienlijke verbetering ten opzichte van GPT-4.5).
- Februari 2025: "Ik blijf dit schrijven tot ik bewezen word dat ik ongelijk heb." → Fout (Zitron schrijft door, ondanks dat hij herhaaldelijk ongelijk is bewezen).
- Maart 2025: "In mijn jaren dat ik deze nieuwsbrief schrijf, ben ik weinig bedrijven tegengekomen die zo rot zijn als CoreWeave ..." Zitron stelt dat het bedrijf niet zes maanden kan overleven zonder nieuwe financiering, hoewel $4 miljard hen een jaar zou kunnen geven. → Fout (CoreWeave bestaat nog steeds en staat momenteel op meer dan het dubbele van zijn IPO-prijs; CoreWeave haalde slechts $1,5 miljard op bij de IPO).
- April 2025: Zitron roept opnieuw dat de bubbel gaat knappen en zegt: "We gaan er nu achter komen of ik gelijk heb." → Fout (Zitron suggereerde dat er monumentale gebeurtenissen op komden die hem gelijk zouden geven, maar die gebeurden niet).
- April 2025: "Het is op dit punt vrij duidelijk dat generatieve AI niet veel meer gaat doen dan het vandaag doet." → Fout
- Mei 2025: "Ik weet niet hoe je dit verhaal kunt lezen en niet denken dat Cohere doodgaat. Hun projecties liggen zo ver af van de realiteit." → Technisch gezien niet te falsifiëren (omdat er geen einddatum is), maar de impliciete claim is fout.
- Juli 2025: "Ik probeer niet dramatisch te zijn, maar het is vrij gemakkelijk om tot de conclusie te komen dat Cursor doodgaat." → Fout (Cursor krijgt een exit van $60 miljard).
- Augustus 2025: "Deze modellen zijn duidelijk tegen een muur gelopen waarbij training op afnemende rendementen stuit." → Fout
- Augustus 2025: Zitron zegt dat Cursor stervende is en verwacht dat het voor een bodemprijs verkocht wordt; een prijs van $10 miljard is niet plausibel: "Is Cursor $10 miljard waard? Nee! Ongeacht hoe goed het product is, het is niet goed genoeg om verkocht te worden voor een prijs die niet vereist dat Cursor honderden miljoenen dollars verbrandt zonder einde in zicht." → Fout
- Oktober 2025: Op de vraag "Als je een gok moet wagen, wat is de tijdlijn waarop de AI-bubbel knapt?", antwoordt Zitron: "Niet later dan Q2 2026." → Fout
- November 2025: "Het feit dat we door de hoogwaardige trainingsdata heen zijn en tegen de muren van de scaling laws lopen... deze modellen worden niet beter. Wat we vandaag zien is pretty much hoe ze altijd zullen zijn." → Fout
Na dit punt waren de meeste verdere voorspellingen die ik zag ofwel niet te falsifiëren of lossen ze in de toekomst op. Let op dat ik geen poging heb gedaan om uitspraken te catalogiseren die onzinnig waren of simpelweg feitelijk onjuist op het moment dat ze werden gedaan, zoals zijn claim uit december 2024 dat "producten van generatieve AI effectief al meer dan een jaar in barnsteen zijn gevangen." Of zijn claim uit januari 2026 dat "[modellen] in feite hetzelfde zijn als een jaar geleden. Ze hebben dezelfde effectiviteit".
Zitron heeft niet alleen vooruitblikende uitspraken gedaan dat AI-mogelijkheden niet zouden verbeteren, maar hij heeft consequent achteruitblikende uitspraken gedaan dat mogelijkheden niet waren verbeterd, wat op dat moment overduidelijk onjuist was, maar schijnbaar goed in de smaak valt bij zijn achterban. Als je al zijn uitspraken verbindt, wordt er gesuggereerd dat AI in januari 2026 dezelfde mogelijkheden had als in december 2023 (en als je latere uitspraken verbindt, wordt zelfs gesuggereerd dat mogelijkheden in augustus 2026 hetzelfde zijn als in december 2023, hoewel hij zichzelf vaak tegenspreekt en in medio 2026 toegaf dat er beperkte verbeteringen waren).
Zelfs als je aannemt dat hij colloquial spreekt (informeel), suggereert de collectie uitspraken nog steeds dat verbeteringen van december 2023 tot augustus 2026 minimaal waren.
Vergelijking met gerespecteerde futuristen
Als we Zitron vergelijken met de futuristen uit onze eerdere analyse, dan leunt Zitron qua stijl veel zwaarder op woede. Wat betreft de kwaliteit van de redenering was hij waarschijnlijk gemiddeld vergeleken met de futuristen. Ondanks dat hij op vrijwel alles ongelijk had, is hij niet onredelijker dan iemand als Buckminster Fuller, die suggereerde dat we mensen via radio zouden kunnen versturen omdat atomen frequenties hebben en radiogolven frequenties hebben.
Wat betreft de stijl van redeneren lijkt hij het meest op Kurzweil, in die zin dat hij cijfers gebruikt om een aura van geloofwaardigheid te creëren, maar als je iets weet over het onderwerp of naar de cijfers kijkt, valt de redenering uit elkaar. Zijn redenering is niet slechter dan die van Kurzweil, die bijvoorbeeld voortdurend nieuwe voorspellingen deed van extreem snelle vooruitgang die niet uitkwamen (zoals in 2001 voorspellen dat er in 2011 onbeperkte levensduur zou zijn). Voortdurend voorspellen dat AI-vooruitgang zal stoppen om redenen die onjuist zijn, is simpelweg de andere kant van de weddenschap op vooruitgang. In plaats van oneindige vooruitgang, krijgen we geen vooruitgang. Elke keer dat die voorspelling onjuist blijkt, kun je gewoon een nieuwe, soortgelijke voorspelling doen en de datum iets naar voren schuiven. Michał Zalewski (lcamtuf) heeft hierover het volgende te zeggen:
"De zekerste manier om een populair following op te bouwen is door posities in te nemen die scherp zijn, sterk zijn en geen ruimte laten voor twijfel. Je krijgt niet veel podcast- of tv-optredens uit 'nou, de markt kan beide kanten op gaan', 'beide politieke partijen hebben goede punten', 'er is merit maar ook hype bij AI'. Of, om het voorbeeld in het bericht te volgen, 'Harry Potter is een oké boek'.
In feite is er een positieve feedbackloop. Als je een provocerende, edgy positie inneemt, krijg je meer aandacht en likes, dus ga je op een bepaalde manier... jezelf radicaliseren? Op een gegeven moment is het niet langer een mening die kan worden veranderd. Het is een identiteit, een persoonlijk merk. Dat is waarom Ed Zitron een blockbuster-blog heeft over hoe het allemaal één grote scam is. Als je een genuanceerder standpunt inneemt, krijg je in het beste geval geen reactie, of in het slechtste geval lok je minachting uit van beide kanten."
Voor wie op zoek is naar goed onderbouwde anti-AI-standpunten, vind ik whitequark vrij goed (niet dat ik het ermee eens ben, maar ik denk dat de redenering solide is). Maar natuurlijk trekt whitequark niet het soort grote publiek dat Zitron trekt.
Hoe lang kun je een onjuist standpunt handhaven?
Ik ben benieuwd wat mensen doen nadat ze aan de verkeerde kant hebben gestaan van een reeks mislukte voorspellingen over vooruitgang. Voor de futuristen, zelfs degenen die bijna volledig ongelijk hadden, kunnen ze nog steeds een soort argument maken als: "een kwart van de dingen die ik zei dat zouden gebeuren, zijn gebeurd, het duurde alleen twintig keer langer dan ik verwachtte." En als ze niet strikt op accuratesse zitten, ronden ze dit af naar: "de dingen die ik zei dat zouden gebeuren, zijn gebeurd."
Maar wat gebeurt er met iemand als Paul Ehrlich, die een naderende catastrofe voorspelde terwijl dat overduidelijk niet gebeurde? Op zijn Wikipedia-pagina lezen we:
"Een veelgehoorde kritiek is dat Ehrlichs voorspellingen routinematig niet uitkwamen; bijvoorbeeld noemde Ronald Bailey van Reason magazine hem een 'onstuitbare doomster... die, voor zover ik kan vaststellen, nooit gelijk heeft gehad in een van zijn voorspellingen van een naderende catastrofe.' Op de eerste Earth Day in 1970 waarschuwde hij dat 'over tien jaar al het belangrijke dierlijke leven in de zee is uitgestorven. Grote delen van de kustlijn zullen geëvacueerd moeten worden vanwege de stank van dode vissen.'"
In een toespraak uit 1971 voorspelde hij: "Tegen het jaar 2000 zal het Verenigd Koninkrijk simpelweg een kleine groep verarmde eilanden zijn, bewoond door ongeveer 70 miljoen hongerige mensen." Toen dit scenario niet optrad, reageerde hij: "Wanneer je de toekomst voorspelt, maak je fouten. Hoe fout dat is, is een andere vraag. Ik zou de weddenschap hebben verloren. Maar als je goed naar Engeland kijkt, wat kan ik je vertellen? Ze hebben allerlei problemen, net als iedereen."
Ehrlich schreef in The Population Bomb dat "India onmogelijk tweehonderd miljoen mensen meer kon voeden tegen 1980." In 1967 noemde hij het stopzetten van noodhulp aan India "hopeloos". Deze positie werd later bekritiseerd, omdat de voedselproductie in India vervolgens explodeerde door de Groene Revolutie.
Verbazingwekkend genoeg, na deze reeks onjuiste voorspellingen, volgde hij dit op met The Population Explosion in 1990 en bleef hij beweren dat wereldwijde overbevolking een dire crisis veroorzaakt of zal veroorzaken. Het lijkt erop dat de enige reden dat hij dit vandaag niet meer zegt, is dat hij begin dit jaar is overleden. In 2015, refererend aan zijn onjuiste boek uit 1968, zei hij: "mijn taalgebruik zou vandaag zelfs nog apocalyptischer zijn". Dat is het patroon dat we hebben gezien bij Zitron. Misschien krijgen we nog 50 jaar aan Zitron die het einde van de AI-vooruitgang voorspelt.
Reacties op Zitron
In een van de citaten van Juho Snellman wordt gesproken over "gish gallop", een term voor wanneer iemand je overspoelt met zoveel goedkope onzin dat niemand de tijd wil nemen om het te weerleggen. In de discussie over één klein deel van Zitrons presentatie hebben we meer dan 1000 woorden besteed aan het uitleggen waarom Zitron een onjuist begrip heeft van hoe bedrijven werken. Iemand kan dat lezen en dan zeggen: "maar je hebt X niet behandeld" in de presentatie.
Omdat Zitron gewoon een reeks onzin uitspreekt, kan hij dat heel goedkoop doen, terwijl het 30-60 minuten kost om 90 seconden van zijn onzin te weerleggen als je alle feiten bij de hand hebt. Wanneer iemand met een goed oordeel zoiets ziet, negeren ze die persoon meestal direct. Een vriend van mij zei over een podcast met Zitron:
"Ik luisterde naar deze podcast en ik kon er niet doorheen. Mijn hartslag ging omhoog omdat hij steeds iets onjuists zei en dan de interviewer, die redelijk was, vroeg: 'hoe zit het met X?', en dan sprongen we gewoon naar een andere onwaarheid... voordat ik afhaakte, vertelde hij hoe LLM's het afgelopen jaar niet veel beter zijn geworden, en de interviewer zegt dat mensen ze gebruiken en dat ze absoluut veel beter zijn geworden, en Zitron ontkent dit en vraagt 'zijn ze dat?'. Op dat moment denk ik: waarom luister ik naar dit gesprek?"
Zitron hanteert daarnaast een extreem hoog niveau van uitgesproken zekerheid. Hij noemt de prognose van OpenAI "een uitspraak die zo grotesk is dat ik verbaasd ben dat het geen financieel misdrijf is om dit hardop te zeggen" (terwijl ze dit tot nu toe hebben behaald). Hij claimt dat de voorspelling van Google voor Gemini-gebruikers "een getal is dat zo onrealistisch is dat iemand bij Google ontslagen zou moeten worden, en diegene is Sundar Pichai" (terwijl ze de prognose met 50% overtroffen).
Ik heb zelf ook veel voorspellingen gedaan, en veel daarvan waren fout. Maar ik heb nooit ongelijk gehad bij een voorspelling waar ik een zekerheidsniveau aan koppelde dat in de buurt komt van wat Zitron doet. Gegeven het uitgesproken niveau van zekerheid, zou zelfs één onjuiste voorspelling een teken zijn van extreme overmoed. Zitron is echter routinematig onjuist over voorspellingen die hij doet met het retorisch hoogst mogelijke niveau van zekerheid.
Bovendien is er een inconsistentie in zijn claims. Hij zegt dat Google niet weet hoe het moet groeien en daarom AI overal in duwt, maar tegelijkertijd zegt hij dat het onrealistisch is dat Gemini 500 miljoen gebruikers haalt. Als Google AI inderdaad overal in duwt, kunnen ze de gebruikersaantallen naar elk gewenst getal brengen. Je kunt niet tegelijkertijd serieus nemen dat Google's gebrek aan groei leidt tot AI-wanhoop én dat Sundar Pichai grove nalatigheid begaat door een getal als 500 miljoen gebruikers te noemen.
Zijn positie wordt samengevat door de zin: "Er zijn zoveel mensen op wie je op dit moment boos kunt zijn." Hij wijst naar personen als Marc Andreessen en maakt van hen de "slechte schurken" in een verhaal. Als Marc Andreessen nooit had bestaan, zouden Meta, Google en Microsoft waarschijnlijk nog steeds proberen te groeien. Hij creëert een held-schurk-narratief, alsof zijn model van hoe bedrijven werken afkomstig is uit films over bedrijven.
Hoe kunnen mensen dit serieus nemen?
Ik heb discussies over Zitron gelezen op HN en Lobsters. Een veelgehoorde verdediging is: "Sure, je hebt een paar punten weerlegd, maar je hebt X niet behandeld." Een andere verdediging is dat mensen Zitron aanvallen vanwege zijn stijl, maar nooit zijn punten adresseren. Vaak negeren verdedigers van Zitron de comments die zijn feitelijke fouten al aanstippen en beweren vervolgens dat niemand in staat is om fouten in zijn werk aan te wijzen. Dit is een zeer "Zitroniaanse" zet.
Andere verdedigers zeggen: "Maar wat dacht je van alle AI-hypisten die ongelijk hebben?". Zoals ik al zei, heb ik een post geschreven over hoe gerespecteerde futuristen ongelijk hadden. Maar het feit dat mensen die de toekomst hypen ongelijk hebben, maakt mensen als Ed Zitron of Paul Ehrlich niet minder ongelijk.
Toekomstige voorspellingen
Hoewel Zitrons voorspellingen tot nu toe over het algemeen onjuist waren, is het mogelijk dat hij in de toekomst over iets gelijk krijgt. Misschien dalen de waarderingen van sommige bedrijven. Maar zelfs als er een enorme AI-crash komt en OpenAI en Anthropic naar nul gaan, zal dat de maatschappelijke impact niet volledig stoppen. De vraag welk bedrijf succesvol is bepaalt wie rijk wordt, maar het falen van specifieke bedrijven stopt de veranderingen die voortvloeien uit de huidige of volgende generatie modelmogelijkheden niet.
Het is me niet unimportant wie er rijk wordt. Wat me wel interesseert is hoe capaciteiten zich hebben ontwikkeld en zullen ontwikkelen, waar hij tot op heden ongelijk over heeft gehad.
***
Bijlage: Ed Zitron over waarom mensen niet van Ed Zitron houden
In een Reddit-comment schrijft Zitron:
"... sommige mannen houden niet van mij omdat emotionele eerlijkheid en introspectie voor hen moeilijk zijn... Mensen vinden het echt niet leuk dat ik ben wie ik ben, en denken dat ik 'boos word als act', of beschrijven me zelfs als psychotisch, ongecontroleerd, enzovoorts... Mijn werk is ook grondig, wat frustrerend is voor mensen die geen grondig werk leveren. Ik heb elk punt dat ik heb doordacht, en ik doe mijn best om onderwerpen goed te kennen... Ik werk mijn kont af, ik schrijf meer dan wie dan ook, ik ben er."
Ik weet niet of hij dit meent, maar Zitron lijkt erg goed te zijn in het zeggen van wat zijn publiek wil horen. Wat betreft de "cliques en in-groups" waar hij over spreekt: op zijn eigen subreddit word je geband als je post dat AI is verbeterd (bijvoorbeeld door links naar benchmarks te delen), wat resulteert in een echo-kamer. Dit is het tegenovergestelde van het beeld dat hij schetst van iemand die openstaat voor discussie.
Ook zijn claim dat zijn werk "grondig" is, is interessant. Ik zou mijn eigen werk niet "grondig" noemen (ik forceer mezelf om te publiceren op een niveau dat boven gemiddeld is in grondigheid, maar ver verwijderd is van echt grondig), en toch lijkt mijn fact-checking-proces veel grondiger dan dat van Zitron.
Bijlage: Waarom dit schrijven?
Geen goede reden, eigenlijk. Ik had vier uur geslapen en zag iemand op Reddit een screenshot posten waarin Zitron's voorspellingsrecord werd afgebrand. Ik wilde controleren of die persoon bevooroordeeld was of niet. Om dat te doen, heb ik ChatGPT gevraagd om een lijst met voorspellingen van Zitron te maken, waarna ik de berichten heb gescand.
Ik denk niet dat de Redditor kersplukte, hoewel ze wel enkele van de meest absurde voorspellingen kozen. Maar de grotere kwestie is zijn redenering.
Zitron is een soort "anti-Yegge": iemand met een slecht voorspellingsrecord wiens voorspellingen eigenlijk nog slechter zijn dan het record alleen al suggereert.
Bijlage: Fouten in dit bericht
Ik denk dat dit bericht meerdere fouten bevat. Het is erg moeilijk om een lange stroom van onjuiste redeneringen te lezen zonder zelf slordig te worden. Ik heb ChatGPT en Claude gevraagd dit bericht te fact-checken; ze vonden enkele kleine fouten die zijn gecorrigeerd.
Tegen alle beweringen van Zitron in, verwacht ik dat deze AI-factcheckers zullen blijven verbeteren. In dit specifieke geval was ChatGPT grondiger dan Claude, hoewel ChatGPT soms overijverig was en "fouten" aangaf die eigenlijk tong-in-cheek opmerkingen waren.
Groetjes,