Aller au contenu principal
Accès ouvert déclaré 2026 article

Comparative evaluation of artificial intelligence chatbots for real-time guidance during intraoperative anesthetic crises: A simulation-based study

1Citations signalées — pas une note de qualité
2Institutions déclarées
2Pays d’affiliation déclarés

Résumé fourni par la source

Background: Artificial intelligence (AI) chatbots are increasingly used in healthcare, but their ability to interpret anesthetic monitoring data during intraoperative crises remains unclear. Objective: To evaluate AI chatbots' responses to simulated anesthetic emergencies, with a focus on visual monitor interpretation compared to contextual case information. Methods: This simulation-based study was conducted using a high-fidelity patient monitor. Twenty intraoperative emergencies were designed as static monitor images with minimal clinical context. Five AI platforms, ChatGPT, Claude, Gemini, Copilot, and DeepSeek, were tested. Each scenario was submitted in a separate, new conversation with no advanced reasoning tools enabled. Six blinded evaluators scored 100 responses using the validated CLEAR tool. The primary outcome was the mean total score per chatbot; secondary outcomes included domain-specific scores and differences between visual and contextual scenarios. Results: < 0.001). Its accuracy was consistent between contextual (4.6 ± 0.3) and visual (4.1 ± 0.9) scenarios. DeepSeek scored the lowest overall score (2.7 ± 1.1), and had a mean 2.3 ± 1.1 in "lack of false information", often due to misinterpreting monitor values, reducing its visual scenario performance. Overall, contextual scenarios scores were higher than visual ones across all platforms. Conclusion: Among AI chatbots, ChatGPT demonstrated the most consistent and guideline-concordant responses to simulated anesthetic crises as of March 2025. This study provides a benchmark for evaluating clinical AI performance and supports the selective integration of such tools in anesthesia decision-making workflows.

Ce résumé expose les affirmations des auteurs. BNTIC ne l’interprète pas comme une validation indépendante des résultats.

Contrôle bibliographique ouvert

DOI retrouvé dans Crossref DOI retrouvé ; titre concordant.

Titre Crossref
Comparative evaluation of artificial intelligence chatbots for real-time guidance during intraoperative anesthetic crises: A simulation-based study
Date Crossref
01/04/2026
Éditeur
Ovid Technologies (Wolters Kluwer Health)
Type
journal-article

Ce recoupement confirme des métadonnées liées au DOI. Il ne confirme ni la méthode ni les conclusions de l’étude et ne compte pas comme une seconde source scientifique indépendante.

Institutions déclarées

Une affiliation ne permet pas de déduire la nationalité d’un auteur.

Sujets associés

Artificial Intelligence in Healthcare and EducationSimulation-Based Education in HealthcareHealthcare Technology and Patient Monitoring

BNTIC News n’est pas le producteur de ces données. Recherche à la demande dans Crossref et Europe PMC, sans clé ; OpenAlex reste optionnel. Aucun service payant requis, aucune réponse conservée. Sources et limites.