Back

IgGM2: An All-Atom Foundation Model for Adaptive Immune Receptor Design

Ma, J.; Wu, F.; Yao, L.; Gao, J.; Wang, R.; Li, Q.; Yang, N.; Jiang, S.; Huang, D.; Pan, X.; Zhu, Y.; Hou, T.; Yao, J.; Yan, J.

2026-07-09 bioinformatics
10.64898/2026.07.09.737510 bioRxiv
Show abstract

Accurate immune receptor design requires modeling the coupled variation of amino-acid sequence, full-atom conformation, and target-binding geometry across antibodies, nanobodies, and T-cell receptors (TCRs). Existing methods often address only part of this problem, either by separating structure generation from sequence design, relying on fixed-backbone inverse folding, or focusing on a single receptor class. We introduce IgGM2, a unified all-atom generative framework for immune receptor structure prediction and CDR sequence-structure co-design. IgGM2 follows a structure-to-design strategy: it first learns how immune receptors are positioned around fixed target structures, and then transfers this target-conditioned structural prior to CDR design. Unlike modular design pipelines, IgGM2 jointly generates CDR residue identities and full-atom receptor structures, allowing framework geometry to adapt to designed CDRs without separate inverse folding or external sidechain packing. Unlike continuous residue encodings based on virtual-atom geometry, IgGM2 keeps sequence prediction explicit while using atom14 placeholders only for full-atom representation. On structure prediction benchmarks, IgGM2 better captures receptor-target spatial relationships than AlphaFold3 on FoldBench and achieves strong performance on TCR-pMHC modeling. On sequence design benchmarks, IgGM2 improves amino-acid recovery and Rosetta-based interface preference metrics, suggesting more favorable generated binding interfaces. These results support IgGM2 as a unified all-atom framework for adaptive immune receptor structure prediction and design.

Matching journals

The top 8 journals account for 50% of the predicted probability mass.

1
Bioinformatics
1204 papers in training set
Top 2%
10.7%
2
Cell Systems
201 papers in training set
Top 0.4%
7.7%
3
Briefings in Bioinformatics
354 papers in training set
Top 1%
6.6%
4
PLOS Computational Biology
1863 papers in training set
Top 6%
6.6%
5
mAbs
32 papers in training set
Top 0.1%
6.1%
6
Bioinformatics Advances
203 papers in training set
Top 1.0%
5.3%
7
Nature Communications
5641 papers in training set
Top 28%
5.3%
8
Frontiers in Immunology
638 papers in training set
Top 3%
5.0%
50% of probability mass above
9
Nature Machine Intelligence
70 papers in training set
Top 0.6%
4.7%
10
Nature Methods
385 papers in training set
Top 2%
4.3%
11
Journal of Chemical Information and Modeling
238 papers in training set
Top 1%
3.4%
12
Computational and Structural Biotechnology Journal
242 papers in training set
Top 2%
3.2%
13
ImmunoInformatics
12 papers in training set
Top 0.1%
3.1%
14
Nucleic Acids Research
1281 papers in training set
Top 7%
2.3%
15
Proceedings of the National Academy of Sciences
2444 papers in training set
Top 29%
1.7%
16
Protein Science
246 papers in training set
Top 2%
1.7%
17
Advanced Science
286 papers in training set
Top 6%
1.3%
18
Nature Computational Science
55 papers in training set
Top 0.9%
1.3%
19
PRX Life
42 papers in training set
Top 0.8%
1.1%
20
Communications Biology
993 papers in training set
Top 23%
1.1%
21
Cell Reports Methods
165 papers in training set
Top 3%
1.1%
22
Scientific Reports
3612 papers in training set
Top 70%
1.0%
23
iScience
1154 papers in training set
Top 30%
1.0%
24
Patterns
78 papers in training set
Top 2%
1.0%
25
Nature Biotechnology
172 papers in training set
Top 4%
1.0%
26
BMC Bioinformatics
457 papers in training set
Top 6%
0.8%
27
Cell Reports
1498 papers in training set
Top 30%
0.6%
28
Science China Life Sciences
29 papers in training set
Top 0.8%
0.6%
29
Journal of Cheminformatics
29 papers in training set
Top 0.8%
0.6%
30
Communications Chemistry
48 papers in training set
Top 2%
0.6%