OpenAI rolt
ChatGPT Health breder uit en presenteerde daarbij een opvallende vergelijking. Op een eigen evaluatie werden antwoorden van GPT-5.5 Instant door artsen op meerdere criteria hoger beoordeeld dan antwoorden die door andere artsen waren geschreven.
Dat klinkt al snel als: ChatGPT is een betere dokter.
Die conclusie gaat veel te ver.
De test laat zien dat een modern taalmodel bij zorgvuldig geselecteerde schriftelijke gezondheidssituaties zeer sterke uitleg kan geven. Hij bewijst niet dat ChatGPT zelfstandig een patiënt kan onderzoeken, een betrouwbare diagnose kan stellen of een behandelend arts kan vervangen.
AI Wereld meldde eerder de brede uitrol van
ChatGPT Health en OpenAI's opvallende vergelijking met artsen. Dit is wat er achter die claim zit.
Wat is ChatGPT Health?
ChatGPT Health is een afzonderlijke omgeving binnen ChatGPT voor vragen over gezondheid en welzijn. Gebruikers kunnen er gesprekken voeren en, wanneer de koppelingen beschikbaar zijn, medische dossiers en informatie uit Apple Health of andere ondersteunde diensten toevoegen.
OpenAI zegt dat Health extra beveiliging en scheiding gebruikt. Gezondheidsgesprekken, aangesloten medische dossiers en Apple Health-gegevens worden volgens het bedrijf niet gebruikt om de basismodellen te trainen of advertenties te richten.
De functie wordt sinds juli 2026 uitgerold naar volwassen gebruikers in de Verenigde Staten op web en iOS. Voor Nederlandse gebruikers is de volledige ervaring met gekoppelde medische dossiers op het moment van schrijven nog niet algemeen beschikbaar.
Ook zonder aparte Health-omgeving stellen veel mensen medische vragen in de gewone versie van ChatGPT. OpenAI spreekt inmiddels over honderden miljoenen mensen per week.
Wat heeft OpenAI precies getest?
OpenAI gebruikt onder meer HealthBench Professional om medische antwoorden te beoordelen. Artsen schrijven daarvoor beoordelingscriteria die verder gaan dan alleen het noemen van het juiste feit.
Er wordt bijvoorbeeld gekeken naar:
- medische juistheid;
- veiligheid;
- duidelijke communicatie;
- omgaan met onzekerheid;
- herkennen van alarmsignalen;
- vragen om ontbrekende context;
- en op het juiste moment verwijzen naar professionele zorg.
Voor de vergelijking liet OpenAI artsen antwoorden schrijven op representatieve gezondheidsgesprekken. Zij kregen daarvoor onbeperkte tijd en toegang tot internet, maar mochten geen AI gebruiken. Een andere groep artsen vergeleek vervolgens deze teksten met antwoorden van verschillende modellen.
Over 3.500 beoordeelde antwoorden scoorde GPT-5.5 Instant volgens
OpenAI's technische uitleg hoger dan de geschreven artsenantwoorden op de gecombineerde criteria.
Dat is een betekenisvol resultaat. Een goedkoop en breed beschikbaar model kan kennelijk zeer goede schriftelijke uitleg produceren.
Waarom dit niet betekent dat ChatGPT een betere arts is
Een arts doet veel meer dan een antwoord op een scherm schrijven.
Een medisch professional kan:
- lichamelijk onderzoek uitvoeren;
- vitale waarden meten;
- zien hoe een patiënt beweegt en reageert;
- gerichte vervolgvragen stellen;
- afwijkingen in samenhang beoordelen;
- toegang krijgen tot gevalideerde dossiers;
- verantwoordelijkheid nemen voor een diagnose;
- behandeling starten en het effect volgen.
Een taalmodel krijgt alleen de informatie die de gebruiker aanlevert. Als die informatie onvolledig, verkeerd begrepen of onjuist is, kan het model vanuit een verkeerde basis toch een overtuigend antwoord formuleren.
De evaluatie vergelijkt bovendien teksten, niet complete consulten of patiëntuitkomsten. Een helder geschreven antwoord kan hoog scoren zonder dat is bewezen dat dezelfde aanpak in alle echte situaties veiliger is.
OpenAI formuleert zelf een belangrijke beperking
In de
officiële uitleg over ChatGPT Health schrijft OpenAI dat de dienst is bedoeld om zorg te ondersteunen, niet te vervangen. Health is niet bedoeld voor diagnose of behandeling.
Die formulering is meer dan een juridische voetnoot. Het is een praktische grens.
ChatGPT kan nuttig zijn om:
- een medische brief in gewone taal uit te leggen;
- vragen voor een afspraak voor te bereiden;
- begrippen uit een laboratoriumuitslag te begrijpen;
- verschillende behandelopties op hoofdlijnen te ordenen;
- een lijst van klachten en tijdstippen samen te vatten;
- informatie van een arts achteraf nog eens rustig door te nemen.
Het systeem hoort niet zelfstandig te bepalen dat een ernstige klacht onschuldig is of dat voorgeschreven medicatie kan worden aangepast.
Wat zijn de grootste risico's?
Onvolledige informatie
Een gebruiker noemt misschien hoofdpijn, maar vergeet medicatie, zwangerschap, leeftijd, recent letsel of andere relevante klachten. Het model kan niet weten wat niet is verteld.
Overtuigende fouten
Taalmodellen kunnen onjuiste informatie vloeiend formuleren. De kwaliteit is sterk verbeterd, maar een lage foutkans is niet hetzelfde als nul risico.
Verkeerde geruststelling
Bij medische spoed kan vertraging gevaarlijk zijn. Een AI die te lang doorvraagt of een zeldzame maar ernstige mogelijkheid mist, kan een gebruiker onterecht laten wachten.
Privacy
Medische informatie is bijzonder gevoelig. Een volledige dossierupload bevat vaak meer gegevens dan voor één vraag nodig zijn, waaronder namen, adressen, identificatienummers en informatie over familieleden.
Geen lokale context
Zorgpaden, medicijnnamen, verzekeringen en noodnummers verschillen per land. Een antwoord dat in de Verenigde Staten logisch is, kan in Nederland onbruikbaar zijn.
De Wereldgezondheidsorganisatie adviseert daarom al langer voorzichtigheid bij generatieve AI in de zorg. De
WHO-richtlijn over AI en gezondheid benadrukt onder meer toezicht, transparantie, privacy en menselijke verantwoordelijkheid.
Hoe gebruik je ChatGPT verantwoord voor gezondheid?
1. Gebruik AI om je gesprek met een arts beter te maken
Vraag om uitleg en voorbereiding, niet om een definitief oordeel. Een goede prompt is bijvoorbeeld:
Zet deze uitslag om in begrijpelijke taal. Geef aan welke onderdelen ik met mijn arts moet bespreken en benoem onzekerheden expliciet. Stel geen diagnose.
2. Deel zo weinig mogelijk identificerende informatie
Verwijder naam, adres, patiëntnummer, burgerservicenummer en andere gegevens die niet nodig zijn voor de vraag. Controleer ook afbeeldingen en PDF-metadata.
3. Noem land, leeftijdscategorie en relevante context
Dat helpt het model om minder algemene antwoorden te geven. Deel alleen informatie die werkelijk nodig is.
4. Vraag naar onzekerheid en alarmsignalen
Laat ChatGPT niet alleen het meest waarschijnlijke scenario noemen. Vraag welke ontbrekende informatie het antwoord kan veranderen en bij welke signalen directe zorg nodig is.
5. Verander geen behandeling zonder professional
Stop of wijzig medicatie niet op basis van een chatbotantwoord. Neem contact op met arts of apotheker.
6. Gebruik bij spoed geen chatbot als tussenstap
Bij acute of levensbedreigende klachten hoort professionele spoedzorg de eerste stap te zijn.
Ook professionele tests vallen soms tegen
Goede benchmarks zijn nuttig, maar niet iedere praktijktest levert hetzelfde optimistische beeld op. AI Wereld schreef eerder over
onderzoekers die AI als een echte zorgmedewerker testten en teleurstellende resultaten zagen.
Dat verschil is precies waarom woorden als 'beter dan artsen' voorzichtig moeten worden gebruikt. Een model kan uitstekend scoren op geschreven medische uitleg en toch moeite hebben met een rommelige werkdag, ontbrekende gegevens, lokale protocollen of onverwachte menselijke reacties.
Wie eerst wil begrijpen welke modellen en functies in de gewone dienst zitten, kan onze
complete ChatGPT-uitleg raadplegen.
Conclusie
OpenAI heeft niet bewezen dat ChatGPT een betere arts is. Het bedrijf heeft laten zien dat GPT-5.5 Instant in een specifieke, door artsen beoordeelde schrijftest sterkere antwoorden kon geven dan een verzameling door artsen geschreven reacties.
Dat is indrukwekkend en praktisch relevant. ChatGPT kan patiënten helpen om informatie te begrijpen, betere vragen te stellen en beter voorbereid een consult in te gaan.
Maar medische zorg is geen schrijfwedstrijd. Onderzoek, context, verantwoordelijkheid en opvolging blijven menselijk werk.
De veiligste rol voor ChatGPT Health is daarom niet die van dokter, maar die van goed geïnformeerde voorbereiding naast een echte zorgverlener.