Back

Peptide:MHC Binding Stability Prediction Using Protein Language Models

Karthikeyan, D.; Vincent, B.; Rubinsteyn, A.

2026-06-29 bioinformatics
10.64898/2026.06.28.735023 bioRxiv
Show abstract

AO_SCPLOWBSTRACTC_SCPLOWPeptide:MHC class I (pMHC-I) binding stability governs the persistence of antigenic complexes at the cell surface and plays a key role in facilitating downstream immunological signals such as antigen presentation, T-cell activation, and immunodominance. However, methods for in silico stability prediction remain underexplored relative to binding affinity prediction, in part because available half-life datasets are sparse and expensive to collect. Here, we perform a systematic reassessment of pMHC-I stability prediction using controlled, similarity-aware data splits and apply a recently introduced supervised transfer-learning strategy to MINT, an interaction-aware protein language model, pre-trained on binding affinity and fine-tuned for quantitative half-life prediction. We show that MINT improves stability prediction over standard ESM-2 representations and existing predictors, and that assay-conditioned recalibration corrects systematic shifts across experimental measurement modalities. Across eluted ligand, immunogenicity, and personalized neoantigen prioritization benchmarks, predicted stability provides signal beyond binding affinity, enriching for naturally presented and immunogenic peptides within affinity-filtered candidate sets. These results establish pMHC-I half-life as an orthogonal and transferable biophysical signal connecting peptide binding, surface presentation, and T-cell recognition, and provide a leakage-aware, assay-aware framework for future antigen-presentation modeling.

Matching journals

The top 8 journals account for 50% of the predicted probability mass.

1
mAbs
32 papers in training set
Top 0.1%
9.4%
2
Nature Communications
5641 papers in training set
Top 19%
9.4%
3
Nature Machine Intelligence
70 papers in training set
Top 0.2%
8.7%
4
Cell Systems
201 papers in training set
Top 0.6%
6.6%
5
PLOS Computational Biology
1863 papers in training set
Top 6%
6.6%
6
Briefings in Bioinformatics
354 papers in training set
Top 2%
4.2%
7
Cell Reports Methods
165 papers in training set
Top 0.4%
4.2%
8
Bioinformatics
1204 papers in training set
Top 5%
3.9%
50% of probability mass above
9
Scientific Reports
3612 papers in training set
Top 31%
3.3%
10
Advanced Science
286 papers in training set
Top 3%
3.1%
11
Molecular Systems Biology
162 papers in training set
Top 0.7%
3.1%
12
eLife
5828 papers in training set
Top 36%
3.1%
13
Proceedings of the National Academy of Sciences
2444 papers in training set
Top 19%
3.0%
14
Patterns
78 papers in training set
Top 0.8%
2.6%
15
Computational and Structural Biotechnology Journal
242 papers in training set
Top 2%
2.6%
16
Nucleic Acids Research
1281 papers in training set
Top 7%
2.4%
17
Communications Biology
993 papers in training set
Top 11%
2.1%
18
Nature Methods
385 papers in training set
Top 5%
1.1%
19
Science Advances
1243 papers in training set
Top 26%
1.1%
20
Journal of Chemical Information and Modeling
238 papers in training set
Top 2%
1.1%
21
Frontiers in Immunology
638 papers in training set
Top 8%
1.1%
22
iScience
1154 papers in training set
Top 27%
1.1%
23
Nature Biotechnology
172 papers in training set
Top 4%
1.0%
24
Bioinformatics Advances
203 papers in training set
Top 4%
1.0%
25
Cell Reports
1498 papers in training set
Top 26%
0.9%
26
PLOS ONE
5266 papers in training set
Top 63%
0.8%
27
Protein Science
246 papers in training set
Top 4%
0.8%
28
BioData Mining
22 papers in training set
Top 1%
0.6%
29
ImmunoInformatics
12 papers in training set
Top 0.2%
0.6%
30
PRX Life
42 papers in training set
Top 1%
0.6%