Aller au contenu principal
Accès ouvert déclaré 2026 article

An evaluation of uncertainty quantification methods and measures for deep learning outcome prediction models in head and neck cancer radiotherapy

1Citations signalées, ce qui n’est pas une note de qualité
2Institutions déclarées
1Pays d’affiliation déclarés

Rattachement africain : nl. Niveau de preuve : code pays fourni par la source.

Le résumé fourni par la source

Background and Purpose: Deep learning (DL) outcome prediction models show promise in radiotherapy but face limited clinical adoption due to concerns about prediction reliability. Although uncertainty quantification (UQ) can provide confidence estimates alongside predictions, there is currently little consensus on appropriate UQ approaches for DL-based outcome prediction. This study therefore evaluates and compares different UQ approaches for normal tissue complication probability (NTCP) and tumour control probability (TCP) models in head and neck cancer. Materials and Methods: Four published DL models were reproduced: two NTCP models predicting xerostomia and dysphagia at six months post-treatment, and two TCP models predicting two-year survival and locoregional control. Three UQ methods-Monte Carlo dropout, deep ensembles, and test-time augmentation-and three uncertainty measures-predictive entropy, variance, and mutual information-were evaluated. Models were retrained on development sets (NTCP: 964 patients, TCP: 255 patients), and assessed on independent validation sets (NTCP: 241 patients, TCP: 85 patients) using discriminative performance, calibration metrics, and sparsification analysis. Results: Incorporating UQ methods maintained comparable discriminative performance to baseline models across all endpoints (mean AUC: 0.72-0.73 vs 0.72). Deep ensembles and Monte Carlo dropout demonstrated strong calibration between uncertainty values and prediction accuracy, while test-time augmentation showed variable reliability. Entropy and variance consistently correlated with prediction accuracy, whereas mutual information proved unstable. Conclusions: Monte Carlo dropout and deep ensembles provide meaningful uncertainty estimates for NTCP and TCP prediction without compromising model performance. These methods show potential for selective prediction workflows where high-confidence predictions guide treatment decisions while uncertain cases are flagged.

Ce résumé expose les affirmations des auteurs. BNTIC ne l’interprète pas comme une validation indépendante des résultats.

Le contrôle bibliographique ouvert

DOI retrouvé dans Crossref DOI retrouvé ; titre concordant.

Titre Crossref
An evaluation of uncertainty quantification methods and measures for deep learning outcome prediction models in head and neck cancer radiotherapy
Date Crossref
01/05/2026
Éditeur
Elsevier BV
Type
journal-article

Ce recoupement confirme des métadonnées liées au DOI. Il ne confirme ni la méthode ni les conclusions de l’étude, et il ne compte pas comme une seconde source scientifique indépendante.

Les institutions déclarées

Une affiliation ne permet pas de déduire la nationalité d’un auteur.

Les sujets associés

Advanced Radiotherapy TechniquesRadiomics and Machine Learning in Medical ImagingArtificial Intelligence in Healthcare and Education

BNTIC News n’est pas le producteur de ces données. Les publications sont interrogées à la demande dans Crossref, OpenAIRE, DOAJ, Europe PMC, HAL, DataCite, AfricArXiv, ROR et la Banque mondiale, sans clé d’accès. OpenAlex reste optionnel. Aucun service payant n’est nécessaire et aucune donnée externe n’est enregistrée en base. Consulter les sources et leurs limites.