Analyse de cas cliniques

Des LLM plus précis qu’un étudiant en médecine mais moins que des radiologues juniors

Article réservé aux abonnés

Le 03/02/25 à 7:00

Les auteurs de l’étude ont par conséquent constaté que GPT-4o était le plus précis des LLM, avec une précision de 59,6, surpassant un étudiant en médecine, mais n'a pas surpassé les professeurs juniors ou le radiologue en formation. (Photo d'illustration).

Les grands modèles de langage multimodaux (LLM), capables de traiter des données textuelles et visuelles, sont de plus en plus expérimentés dans le domaine de la radiologie. Dans une étude parue dans la revue Radiology, des chercheurs de l’Université Yonsei de Séoul, en Corée du Sud, ont évalué la précision de plusieurs d'entre eux face à celle de lecteurs humains, ayant différents niveaux d’expérience, dans des cas cliniques issus d'articles de la revue New England Journal of Medicine (NEJM), publiés de 2005 à 2024.

272 cas test avec des données textuelles et visuelles

Les LLM, dont GPT-4V, GPT-4 Omni (GPT-4o), DeepMind Gemini 1.5 Pro et Claude 3, ont été mis à l'épreuve sur 272 cas, avec des données textuelles et visuelles. Le groupe de lecteurs humains incluait sept radiologues juniors, deux cliniciens, un radiologue en formation et un étudiant en médecine, en aveugle face aux réponses publiées.

GPT-4o plus précis qu’un étudiant en médecine

Premier constat : GPT-4o était le plus

Il vous reste 49% de l’article à lire

Docteur Imago réserve cet article à ses abonnés

Vous avez déjà un compte ? Se connecter

Tous les contenus « abonnés » en illimité
Le journal numérique en avant-première
Newsletters exclusives, club abonnés

Abonnez-vous !

Docteur Imago en illimité sur desktop, tablette, smartphone, une offre 100% numérique

Offre mensuelle 100 % numérique

23 €

par mois

S’abonner à Docteur Imago

Auteurs

Solenn Duplessy

Voir la fiche de l’auteur

Bibliographie

Suh PS, Shim WH, Suh CH, et al (2024) Comparing Large Language Model and Human Reader Accuracy with New England Journal of Medicine Image Challenge Case Image Inputs. Radiology 313:e241668. https://doi.org/10.1148/radiol.241668

Discussion

Aucun commentaire

Commenter cet article

Laisser un commentaire Annuler la réponse

You must be logged in to post a comment.

Dans le dossier

L’intelligence artificielle en langage naturel

Voir le dossier

Le fil Docteur Imago

20 Juin

16:00

La Société européenne de radiologie gastro-intestinale et abdominale (ESGAR) a publié des recommandations pratiques pour le diagnostic et l'évaluation de la réponse au traitement chez les patients souffrant d'une maladie de Crohn luminale. L'entéro-IRM et l'échographie sont les examens radiologiques de première ligne, tandis que le scanner peut être utile en seconde ligne ou dans l'aigu, souligne notamment l'article.

15:00

Dépistage du cancer du sein

La dématérialisation prend corps en Corse

Reportage

13:30

L'embolisation de l'artère méningée moyenne avec des microparticules pour prévenir la récidive des hématomes sous-duraux chroniques chez les patients déjà traités par chirurgie ne fait pas mieux que la prise en charge standard, selon une étude randomisée multicentrique française (342 patients) parue dans le JAMA. Le professeur de radiologie Laurent Spelle avait déjà indiqué dans nos colonnes des résultats préliminaires négatifs pour cette étude.

11:00

Modèle de fondation

Philips et Nvidia s’associent pour développer un système d’IRM augmenté par l’IA

Actualité / Produits

7:30

50 personnes ont participé au RI challenge avec 368 posts LinkedIn, a annoncé Mehdi Lebbadi, co-organisateur du défi dédié à mettre en avant la radiologie interventionnelle, que nous avions interrogé à ce sujet. Ces posts ont généré 19 422 « likes », et sont apparus plus de 500 000 fois à l'écran d'utilisateurs LinkedIn. « J'organise actuellement la même chose à l'échelle européenne, juste avant le congrès du CIRSE [la Société européenne de radiologie cardiovasculaire et interventionnelle, NDLR] mi-septembre. L'enthousiasme est déjà palpable », se réjouit le praticien.

7:00

Démographie et formation

Le projet européen EU-REST délivre ses recos pour les effectifs requis et la formation des radiologues

Socioprofessionnel

272 cas test avec des données textuelles et visuelles

GPT-4o plus précis qu’un étudiant en médecine

Laisser un commentaire Annuler la réponse

<img src="https://admin.docteurimago.fr/app/themes/docteurimago/src/img/Icon-Abonnes.svg" alt="icon réservé aux abonnés" /> Les LLM en radiologie rencontrent leurs premiers succès et des défis

<img src="https://admin.docteurimago.fr/app/themes/docteurimago/src/img/Icon-Abonnes.svg" alt="icon réservé aux abonnés" /> Un modèle de langage géré localement peut extraire des données des comptes rendus en préservant l’anonymat des patients

L’intelligence artificielle en langage naturel

<img src="https://admin.docteurimago.fr/app/themes/docteurimago/src/img/Icon-Abonnes.svg" alt="icon réservé aux abonnés" /> La dématérialisation prend corps en Corse

<img src="https://admin.docteurimago.fr/app/themes/docteurimago/src/img/Icon-Abonnes.svg" alt="icon réservé aux abonnés" /> Philips et Nvidia s’associent pour développer un système d’IRM augmenté par l’IA

<img src="https://admin.docteurimago.fr/app/themes/docteurimago/src/img/Icon-Abonnes.svg" alt="icon réservé aux abonnés" /> Le projet européen EU-REST délivre ses recos pour les effectifs requis et la formation des radiologues

Les LLM en radiologie rencontrent leurs premiers succès et des défis

Un modèle de langage géré localement peut extraire des données des comptes rendus en préservant l’anonymat des patients

La dématérialisation prend corps en Corse

Philips et Nvidia s’associent pour développer un système d’IRM augmenté par l’IA

Le projet européen EU-REST délivre ses recos pour les effectifs requis et la formation des radiologues