Naar hoofdinhoud springen

Kun je ChatGPT vertrouwen met de belastingen van je kleine bedrijf? Wat een vergelijkende AI-test uit 2026 aan het licht bracht

7 min leestijdMike ThriftMike Thrift
Kun je ChatGPT vertrouwen met de belastingen van je kleine bedrijf? Wat een vergelijkende AI-test uit 2026 aan het licht bracht

Je typt je belastingvraag in ChatGPT, en het antwoord komt direct, zelfverzekerd en opgemaakt alsof het uit een IRS-publicatie komt. Het klinkt correct. Het probleem is dat "klinkt correct" en "is correct" niet hetzelfde zijn, en toen NerdWallet in 2026 een gestructureerde vergelijkende test uitvoerde van ChatGPT, Gemini en Perplexity aan de hand van echte belastingscenario's, werd de kloof tussen de twee snel zichtbaar.

Voor een eigenaar van een klein bedrijf die overweegt om dit belastingseizoen op een chatbot te vertrouwen voor belastingvragen, is die kloof van belang. Hier volgt wat de test daadwerkelijk aan het licht bracht, waar AI standhoudt, waar het stilletjes tekortschiet, en hoe je het kunt gebruiken zonder dat een gehallucineerd antwoord je geld kost.

De test: eenvoudige vragen versus persoonlijk advies

Het onderzoeksteam van NerdWallet stelde 63 chatgesprekken samen door ChatGPT, Gemini en Perplexity elk zeven vragen te stellen. Drie van de vragen kwamen rechtstreeks uit oefenexamens voor IRS enrolled agents — het soort vraag met één objectief juist antwoord. De andere vier waren open scenario's opgebouwd rond fictieve belastingplichtigen, bedoeld om te testen hoe goed elke chatbot advies kon toespitsen op een specifieke financiële situatie.

Het verschil in resultaten was groot. Bij de oefenexamenvragen presteerden alle drie de chatbots goed en scoorden ze bijna perfect op het meerkeuzemateriaal. Dat is het soort vraag waar AI goed in is: een afgebakend feit met een gedocumenteerd antwoord, duidelijk geformuleerd, zonder onduidelijkheid over welk belastingjaar of welke situatie van de belastingplichtige van toepassing is.

De open, persoonlijke vragen waren een ander verhaal. Daar begonnen de chatbots het soort fouten te maken dat er voor een echte bedrijfseigenaar toe zou doen:

  • Onjuiste bedragen voor de standaardaftrek — in één testcase bijna $3.000 verkeerd
  • Onjuiste beweringen over recht op een belastingkorting voor elektrische voertuigen voor een belastingplichtige die daar niet voor in aanmerking kwam
  • Verkeerde aanbevelingen over de staat waarin aangifte moet worden gedaan, waaronder het verwarren van de studiestaat van een belastingplichtige met diens werkstaat
  • Inconsistente antwoorden — hetzelfde fictieve profiel kreeg verschillende aanbevelingen voor belastingsoftware, afhankelijk van welke chatbot (of welke run) antwoordde
  • Verzonnen biografische aannames, overgenomen uit eerdere chatgeschiedenis, die niet klopten

Geen van deze fouten ging gepaard met een voorbehoud of waarschuwing. Zoals de onderzoekers het verwoordden, kunnen de antwoorden "correct klinken" puur vanwege de zelfverzekerde toon waarmee ze worden gepresenteerd — die toon verandert niets aan de vraag of het onderliggende cijfer klopt.

Dit is geen incident

De resultaten van NerdWallet sluiten aan bij een breder patroon dat onderzoekers het hele jaar al documenteren. Een studie van Loyola University Chicago wees uit dat chatbots een eenvoudige belastingvraag in twee derde van de gevallen verkeerd beantwoordden, en dat de meest geavanceerde modellen zelfs bij vereenvoudigde testgevallen minder dan een derde van de federale inkomstenbelastingaangiftes correct berekenden. Belastingprofessionals hebben afzonderlijk AI-fouten gesignaleerd bij K-1- en 1099-inkomsten, bij staatsregels die afwijken van de federale regels, en bij 2026-specifieke bepalingen die samenhangen met recente wijzigingen in de belastingwetgeving — precies het soort nuance waar een eigenaar van een klein bedrijf waarschijnlijk naar zou vragen.

De financiële gevolgen worden in de praktijk al zichtbaar. Uit een enquête onder Britse accountants en boekhouders bleek dat de helft van de kantoren had gezien dat een klant een direct financieel verlies leed — een te hoge betaling, een gemiste aftrekpost, een boete — dat te herleiden was tot AI-gegenereerd belasting- of financieel advies. Dat is geen hypothetisch risico; het is een doorlopende kostenpost die sommige kleine bedrijven nu al voor hun rekening nemen.

Waarom AI specifiek moeite heeft met belastingvragen

Belastingadvies is slecht afgestemd op de manier waarop grote taalmodellen antwoorden genereren. Een paar redenen waarom zelfs de meest geavanceerde modellen hier telkens over struikelen:

Belastingregels zijn gestapeld per rechtsgebied. Federale, staats- en soms lokale regels werken op elkaar in, en een chatbot die vooral is getraind op federale content, valt vaak terug op federale antwoorden, zelfs wanneer de vraag afhangt van staatsspecifieke details — precies zo ontstonden de "verkeerde staat"-fouten tijdens de test.

Het juiste antwoord hangt af van feiten die het model niet betrouwbaar bijhoudt. De aftrek, het recht op een belastingkorting of de juiste staat voor aangifte van een alleenstaande belastingplichtige hangt af van details die verspreid zijn over een gesprek. Zodra het model meerdere feiten over jou tegelijk moet vasthouden — in plaats van één schoon feit uit trainingsdata op te halen — daalt de nauwkeurigheid.

Zelfverzekerdheid is niet gekalibreerd op juistheid. Deze modellen zijn gebouwd om vloeiende, volledig klinkende antwoorden te produceren, niet om onzekerheid te signaleren. Een verkeerd antwoord over je standaardaftrek klinkt precies even gezaghebbend als een correct antwoord.

Strategisch advies vergroot het risico. Een verkeerd antwoord op "wat is het kilometertarief" is makkelijk te ontdekken. Een verkeerd antwoord op een meerjarige belastingstrategievraag komt mogelijk pas als probleem aan het licht bij een controle, twee of drie jaar later — tegen die tijd is de correctie veel duurder dan een snelle aanpassing destijds zou zijn geweest.

Hoe je AI daadwerkelijk kunt gebruiken voor belastingvragen zonder je vingers te branden

Dit betekent niet dat AI-chatbots nutteloos zijn voor belastingzaken — het betekent dat ze bruikbaar zijn voor een beperktere taak dan veel gebruikers aannemen. Een redelijke, veiligere werkwijze ziet er als volgt uit:

  1. Gebruik AI om je te oriënteren, niet om een definitief cijfer te krijgen. Vraag het om een concept uit te leggen, samen te vatten waar een formulier voor dient, of een lijst met vragen op te stellen om aan je accountant voor te leggen. Vraag het niet om je daadwerkelijke belastingschuld te berekenen of om te bepalen voor welke belastingkortingen je in aanmerking komt, en laat het daar niet bij.

  2. Stem de vraag af op het juiste hulpmiddel. Een feitelijke opzoeking ("wat is de deadline voor Formulier 941") is laag risico. Een persoonlijke beoordeling ("moet ik dit jaar kiezen voor S-corp-status") valt precies in de categorie waarin uit de test blijkt dat chatbots het vaakst fout gaan — dat is een vraag voor een professional, of op zijn minst een controle aan de hand van de daadwerkelijke IRS-richtlijnen.

  3. Ken je vangnet. Als je AI-ondersteunde uitvoer gebruikt binnen belastingsoftware, kan de eigen foutcontrole van de software sommige fouten opvangen voordat je aangifte doet. Als je AI-advies rechtstreeks overneemt zonder tweede controle, heb je helemaal geen vangnet.

  4. Controleer welk model en welke versie je antwoord gaf. Nauwkeurigheid en gedrag verschillen tussen modelversies, en een screenshot van een vriend die een andere chatbot gebruikt (of een oudere versie van dezelfde chatbot) is geen garantie dat jouw resultaat overeenkomt.

  5. Controleer alles wat staatsspecifiek is of met belastingkortingen te maken heeft aan de hand van de bron. Dit waren de twee meest voorkomende foutcategorieën in de test. Wanneer een chatbot een specifieke dollargrens, aftrekbedrag of regel voor het recht op een belastingkorting noemt, is dat het moment om IRS.gov of de site van de belastingdienst van je staat te openen en het rechtstreeks te bevestigen.

De veiligste manier om ernaar te kijken: AI kan je de uren besparen die je anders zou besteden aan het doorzoeken van IRS-publicaties om een concept te begrijpen of goede vragen voor te bereiden. Het zou niet de laatste stap moeten zijn voordat je aangifte doet.

Houd je financiële administratie op orde, welke tools je ook gebruikt

De belastingvragen waar AI-chatbots het meest over struikelen — recht op aftrekposten, staatsspecifieke aangiftenuances, entiteitsspecifieke regels — zijn veel makkelijker correct te beantwoorden wanneer je onderliggende boekhouding om te beginnen al accuraat en goed georganiseerd is. Dat geldt of je nu een chatbot, een accountant raadpleegt, of het zelf doet. Beancount.io biedt plain-text accounting dat je volledige transparantie geeft over je financiële gegevens — versiebeheerd, controleerbaar en eenvoudig te delen met welke adviseur (mens of AI) je dit belastingseizoen ook raadpleegt. Ga gratis aan de slag en zorg dat je cijfers vanaf de bron betrouwbaar zijn.

Dit artikel delen