Back

From GWAS to drug: A framework for drug candidate prioritisation using a gene expression signature matching approach

Chauquet, S.; Jiang, J.-C.; Barker, L. F.; Hunter, Z. L.; Singh, G.; Wray, N. R.; McRae, A. F.; Shah, S.

2026-04-24 genetic and genomic medicine
10.64898/2026.04.22.26349470 medRxiv
Show abstract

Drug targets supported by human genetic evidence have significantly higher approval rates, making genome-wide association studies a valuable resource for drug candidate prioritisation. Transcriptome-wide association study signature-matching is an emerging in silico approach that integrates GWAS data with expression quantitative trait loci to generate a disease gene expression signature, which is then compared against drug perturbation databases such as the Connectivity Map. Despite recent adoption, there is no consensus on optimal methodology. Here, we systematically benchmark key parameters, including TWAS method, eQTL tissue model, similarity metric, gene set size, and CMap cell line, using LDL cholesterol, familial combined hyperlipidemia, and asthma as proof-of-concept traits. We demonstrate that while TWAS signature-matching can successfully prioritise known first-line treatments, performance is highly sensitive to parameter choice; for instance, the selection of the cell line used for drug signatures alone can dramatically alter drug prioritisation. Based on these findings, we propose a best-practice framework for robust, genetically-informed drug prioritisation using TWAS signature-matching.

Matching journals

The top 10 journals account for 50% of the predicted probability mass.

1
Human Genetics and Genomics Advances
84 papers in training set
Top 0.1%
9.5%
2
Scientific Reports
3612 papers in training set
Top 11%
6.6%
3
Bioinformatics
1204 papers in training set
Top 4%
6.6%
4
Nature Communications
5641 papers in training set
Top 26%
6.1%
5
Briefings in Bioinformatics
354 papers in training set
Top 2%
4.7%
6
Genome Medicine
183 papers in training set
Top 0.8%
4.7%
7
Communications Medicine
113 papers in training set
Top 0.8%
4.0%
8
The American Journal of Human Genetics
234 papers in training set
Top 1%
3.4%
9
Genetic Epidemiology
55 papers in training set
Top 0.2%
3.4%
10
PLOS Computational Biology
1863 papers in training set
Top 10%
3.2%
50% of probability mass above
11
Bioinformatics Advances
203 papers in training set
Top 2%
2.4%
12
Computational and Structural Biotechnology Journal
242 papers in training set
Top 2%
2.4%
13
NAR Genomics and Bioinformatics
242 papers in training set
Top 2%
2.3%
14
Cell Genomics
172 papers in training set
Top 2%
2.3%
15
npj Digital Medicine
118 papers in training set
Top 2%
2.3%
16
Patterns
78 papers in training set
Top 1%
2.1%
17
Genome Biology
637 papers in training set
Top 6%
1.7%
18
IEEE/ACM Transactions on Computational Biology and Bioinformatics
38 papers in training set
Top 0.6%
1.7%
19
Artificial Intelligence in the Life Sciences
13 papers in training set
Top 0.1%
1.7%
20
PLOS ONE
5266 papers in training set
Top 53%
1.3%
21
Communications Biology
993 papers in training set
Top 23%
1.1%
22
International Journal of Molecular Sciences
494 papers in training set
Top 12%
1.1%
23
Frontiers in Pharmacology
111 papers in training set
Top 2%
1.1%
24
iScience
1154 papers in training set
Top 27%
1.1%
25
eLife
5828 papers in training set
Top 59%
1.1%
26
BMC Medical Genomics
50 papers in training set
Top 1.0%
1.0%
27
Journal of the American Medical Informatics Association
71 papers in training set
Top 2%
1.0%
28
Proceedings of the National Academy of Sciences
2444 papers in training set
Top 39%
1.0%
29
Nature Genetics
286 papers in training set
Top 5%
1.0%
30
eBioMedicine
183 papers in training set
Top 7%
0.8%