Aller au contenu principal
Accès ouvert déclaré 2026 preprint

π-MSNet: A billion-scale, AI-ready living proteomics data portal

0Citations signalées, ce qui n’est pas une note de qualité
9Institutions déclarées
3Pays d’affiliation déclarés

Rattachement africain : cn, de, gb. Niveau de preuve : code pays fourni par la source.

Le résumé fourni par la source

Abstract Artificial intelligence (AI) is reshaping proteomics workflows, delivering remarkable gains in both peptide identification sensitivity and quantitative performance. However, the potential of deep learning models in proteomics has not been fully exploited due to the scarcity of large-scale, high-quality and consistently labeled datasets. Here, we present π-MSNet, a billion-scale, AI-ready living mass spectrometry (MS) data portal. Using a uniform identification and quality control workflow, it comprises over 1.66 billion MS/MS spectra, 501 million peptide-spectrum matches (PSMs), and 9 million precursors from 36,356 LC-MS/MS runs across ten instrument types and 55 diverse species. Through community collaboration, the data are shared via international, interactive, and living web resources. Enabled by the built-in MSNetLoader Python API for seamless and scalable data access—with native support for PyTorch and TensorFlow—π-MSNet provides an AI-ready data framework for efficient training and systematic benchmarking of multiple models across three representative tasks (e.g., MS/MS spectrum prediction, retention time prediction, and de novo peptide sequencing). In particular, by retraining multiple models on π-MSNet, we achieved consistent performance improvements over their original versions. These improved models were subsequently integrated into the π-MSNet agent to enable interactive, deployment-free use. Through SDRF (Sample and Data Relationship Format) metadata, an open-source cloud analysis workflow, and a community-driven interactive data portal that supports continuous data submission, π-MSNet serves as a living, AI-ready resource for reproducible benchmarking, robust model training, and accelerated AI innovation in proteomics.

Ce résumé expose les affirmations des auteurs. BNTIC ne l’interprète pas comme une validation indépendante des résultats.

Le contrôle bibliographique ouvert

DOI retrouvé dans Crossref DOI retrouvé ; titre concordant.

Titre Crossref
π-MSNet: A billion-scale, AI-ready living proteomics data portal
Date Crossref
15/04/2026
Éditeur
openRxiv
Type
posted-content

Ce recoupement confirme des métadonnées liées au DOI. Il ne confirme ni la méthode ni les conclusions de l’étude, et il ne compte pas comme une seconde source scientifique indépendante.

Les institutions déclarées

Une affiliation ne permet pas de déduire la nationalité d’un auteur.

Les sujets associés

Advanced Proteomics Techniques and Applicationsvaccines and immunoinformatics approachesMachine Learning in Bioinformatics

BNTIC News n’est pas le producteur de ces données. Les publications sont interrogées à la demande dans Crossref, OpenAIRE, DOAJ, Europe PMC, HAL, DataCite, AfricArXiv, ROR et la Banque mondiale, sans clé d’accès. OpenAlex reste optionnel. Aucun service payant n’est nécessaire et aucune donnée externe n’est enregistrée en base. Consulter les sources et leurs limites.