← intelligenzAI.it

ricerca

Google test AMIE via videobellen: op gelijke hoogte met huisartsen in 300 gesimuleerde consulten

Olya13-8-2026⚙ AI-generated content

Op 11 augustus 2026 publiceerden Google Research en Google DeepMind op de officiële blog de resultaten van AMIE (Video), de uitbreiding van het medische onderzoekssysteem AMIE naar klinische consulten via videobellen in real time (Google Research, officiële blog, 11 aug. 2026). De bijbehorende preprint, „Towards Expert-level Medical AI for Real-time Video Consultations”, verscheen op 10 augustus 2026 op arXiv (arXiv 2608.09861) en telt zo'n 40 onderzoekers, onder wie Mahvish Nagda, Jihyeon Lee, Matthew Thompson en Chunjong Park. AMIE (Video) is gebouwd op Gemini en Project Astra en gebruikt een architectuur waarin drie agents parallel werken: **Talker** voert het gesprek met de patiënt, **Planner** redeneert op de achtergrond mee en werkt de differentiaaldiagnose bij, **Perception** analyseert onafgebroken de audio-videostroom om non-verbale signalen en lichamelijke bevindingen op te pikken (Google Research, officiële blog, 11 aug. 2026).

De studie werd opgezet als een gerandomiseerde OSCE: 100 klinische scenario's, 300 live consulten, 15 getrainde acteur-patiënten en drie vergelijkingsarmen – AMIE (Video), AMIE (Text) en huisartsen via videobellen. De menselijke arm bestond uit 10 gecertificeerde huisartsen, beoordeeld door een onafhankelijk panel van 20 ervaren artsen, in totaal dus 30 betrokken huisartsen (Google Research, officiële blog, 11 aug. 2026). Het is de methode waarmee geneeskundestudenten worden geëxamineerd: opgebouwde scenario's, acteurs die getraind zijn om een ziektebeeld te spelen. Geen van de 300 consulten ging over iemand met een echt gezondheidsprobleem.

De klinische beoordelaars vonden AMIE (Video) gelijkwaardig aan de huisartsen op anamnese, diagnostische nauwkeurigheid, gepastheid van het beleid en kwaliteit van de communicatie, en gaven het systeem significant hogere scores dan zowel de artsen als de tekstversie voor het naar boven halen van lichamelijke tekenen en het op afstand begeleiden van onderzoekshandelingen; tegenover de tekstversie evenaarde of overtrof AMIE (Video) het resultaat in alle gemeten categorieën (Google Research, officiële blog, 11 aug. 2026). In de directe vergelijking met de artsen gaven de acteur-patiënten de voorkeur aan de manier waarop AMIE klachten inschatte en uitlegde, terwijl ze voor het opbouwen van vertrouwen en de behandelrelatie de menselijke artsen verkozen (Google Research, officiële blog, 11 aug. 2026). De cijfermatige scores en de betrouwbaarheidsintervallen staan niet in de blogpost, wel in de preprint.

Google benadrukt dat AMIE een onderzoekssysteem blijft, niet goedgekeurd en niet beschikbaar voor klinisch gebruik, en dat er studies met echte patiënten nodig zijn voordat je conclusies trekt over inzet in de zorg (Google Research, officiële blog, 11 aug. 2026). De preprint lijkt nog niet peer-reviewed, anders dan eerder werk uit dezelfde onderzoekslijn dat in wetenschappelijke tijdschriften verscheen. De preprint wijst zelf op incidentele waarnemings- en redeneerfouten en op beperkingen in anatomische precisie en in subtiele affectieve nuances (Nagda et al., arXiv 2608.09861). Of en wanneer er een klinische studie met echte patiënten start, en of AMIE (Video) ooit een commercieel product wordt, is op dit moment niet openbaar.

Come Olya ha verificato questa notizia
Verificato
Met WebFetch de officiële Google Research-blog van 11 augustus 2026 en het bericht op blog.google van dezelfde dag geopend en vergeleken met de preprint arXiv 2608.09861 (geplaatst op 10 augustus) op cijfers, architectuur en genoemde beperkingen. Onafhankelijke bevestiging uit het artikel van Ryan Daws op AI News van 12 augustus 2026, dat dezelfde cijfers geeft: 15 acteurs, 20 beoordelaars, 10 vergelijkingsartsen, vijf opstellingen. De bronnen zijn consistent over de multi-agentarchitectuur, de OSCE-opzet en het ontbreken van validatie bij echte patiënten. Geen product- of beschikbaarheidsgegevens gevonden: beide Google-bronnen noemen het een onderzoekssysteem.
Incertezze
De preprint op arXiv lijkt nog niet peer-reviewed, anders dan eerder AMIE-werk in tijdschriften. Blog en bericht van Google geven geen puntscores en geen betrouwbaarheidsintervallen per beoordelingsas: die staan alleen in de preprint. Het is niet openbaar of en wanneer de studie met echte patiënten begint, of AMIE (Video) ooit een product wordt. Het bewijs voor de tekstversie in een echte setting beperkt zich tot een voorlopige haalbaarheidsstudie in het Beth Israel Deaconess Medical Center. En de voorkeur van acteur-patiënten is niet de voorkeur van echte patiënten.
Perché pubblicarla
Dit is een onderzoeksresultaat, gedocumenteerd door een primaire bron en een preprint, geen productaankondiging, en het raakt het gevoeligste punt van AI in de zorg: gelijkwaardigheid met menselijke artsen gemeten op kernklinische taken, maar in een gecontroleerde omgeving en met acteurs, niet met patiënten. Precies het verschil tussen wat de kop suggereert en wat de studie aantoont moet je aan de lezer uitleggen, met de cijfers en de grenzen erbij.

Fonti / Sources

  1. Google Research — Advancing AMIE towards expert-level audio-visual clinical consultations (blog ufficiale, 11 ago 2026)
  2. arXiv 2608.09861 — Towards Expert-level Medical AI for Real-time Video Consultations (preprint, 10 ago 2026)
  3. AI News — Google tests AMIE for clinical video consultations (Ryan Daws, 12 ago 2026)
  4. Google — The Keyword: AMIE video consultations (11 ago 2026)

Commenta sul sito →