Industry Wire

Geplaatst door Onder.nl

Welk AI-model voorspelde het WK het beste?

Hoe accuraat zijn de voorspellingen van AI? Zes weken lang liet Bureau Onder ChatGPT, Claude, Gemini, Copilot en Perplexity alle 104 wedstrijden van het WK 2026 voorspellen. De resultaten werden realtime bijgehouden met het puntensysteem van Scorito. Nu het toernooi is afgelopen, kunnen we de balans opmaken: welk AI-model presteerde het best?

ChatGPT kwam als beste voorspeller uit de bus, met 35 punten voorsprong op nummer twee Claude. Maar ook de winnaar zat er geregeld naast: van de 104 wedstrijden voorspelde ChatGPT 33 keer de verkeerde uitslag, en de exacte eindstand klopte slechts bij 14 duels. Gemini presteerde het slechtst van de vijf en eindigde als laatste.

Drie van de vijf hadden gelijk
De vijf modellen kregen dezelfde gestructureerde prompt met onder meer het officiële FIFA-speelschema, FIFA-rankings, de laatste vijf wedstrijden per land en de eis hun werkwijze te verantwoorden. Vooraf kozen drie modellen (ChatGPT, Claude en Perplexity) Spanje als wereldkampioen, Copilot koos Argentinië en Gemini voorspelde Brazilië.

Over alle 104 voorspelde wedstrijden week ieder model een wisselend aantal keer af van de andere vier. ChatGPT deed dat maar één keer, en die ene afwijkende voorspelling kwam ook nog exact uit. Claude week vier keer af, Gemini zes keer, Perplexity zeven keer en Copilot het vaakst: acht keer, onder meer in de finale zelf.

Meer informatie over hoe de voorspelling tot stand kwam en de volledige einduitslag vind je op onder.nl/ai-wk-voorspelling-battle.

Wat dit zegt over vertrouwen in AI-antwoorden
Dit experiment stelt de vraag die elke marketeer en contentstrateeg kent: als je vijf AI-modellen hetzelfde vraagt, welk antwoord vertrouw je? Het WK bood zes weken meetbare, objectieve uitkomsten, iets wat bij de meeste AI-toepassingen ontbreekt. Het model dat het minst afweek van de consensus (ChatGPT) kreeg ook het vaakst gelijk; het model met de meest aanvallende voorspellingen (Gemini, gemiddeld 2,71 doelpunten per wedstrijd) eindigde onderaan.

Toch relativeert de uitkomst het beeld van AI als voetbalorakel. Zelfs ChatGPT voorspelde bij 33 van de 104 wedstrijden de verkeerde uitslag. Voor wie AI inzet om keuzes te onderbouwen, is dat een relevante les: vertrouw niet blind op AI, maar vergelijk meerdere antwoorden, toets ze aan een onafhankelijke bron en vorm zelf een oordeel voordat je een AI-antwoord als waarheid aanneemt.

Noot voor de redactie

Het onderzoek werd uitgevoerd door Onder (onder.nl). Ingezet zijn de uitgebreide versies van ChatGPT (OpenAI), Claude (Anthropic), Copilot (Microsoft), Gemini (Google) en Perplexity. Alle modellen ontvingen op 8 juni 2026 exact dezelfde prompt, inclusief het officiele FIFA-speelschema voor alle 72 groepswedstrijden en de volledige knockoutstructuur tot en met de finale op 19 juli. Er zijn geen modelspecifieke aanpassingen gedaan.

De prompt stelde expliciete eisen aan de methodologische verantwoording. Elk model moest voor aanvang van de voorspelling opgeven: welke factoren het meewoog (recente vorm, selectiekwaliteit, FIFA-ranking, blessures, toernooicontext), hoe zwaar elke factor telde in procenten tot 100 procent, en welke bronnen het per factor had gebruikt. Dit maakt de vergelijking niet alleen meetbaar op uitkomst, maar ook inzichtelijk op redeneerproces.

Meer informatie over hoe de voorspelling tot stand kwam en de volledige einduitslag vind je op onder.nl/ai-wk-voorspelling-battle. Alle tabellen en visuals zijn vrij te gebruiken met bronvermelding Bureau Onder, onder.nl.

Dit artikel is een ingezonden bericht en valt buiten de verantwoordelijkheid van de redactie.

Deel dit bericht