Back

A deep-learning based analysis framework for ultra-high throughput screening time-series data

Balzerowski, P.; Gnutt, D.; Hebing, L.; Lima, F. d. A. e.; Manesso, E.; Mueller, T.; Diedam, H.

2024-08-22 bioinformatics
10.1101/2024.08.22.609110 bioRxiv
Show abstract

Analysis of ultra-high-throughput screening data sets is a highly critical step in drug discovery campaigns. Due to various environmental and experimental error sources fast and reliable identification of possible candidate compounds is challenging. In this work, we introduce a novel deep-learning based analysis framework to analyze uHTS time-series data sets. Our framework is based on two independent deep-learning models. A deep-learning regression model reduces temporal and spatial signal variation across multitier plates caused by systematic and random errors and a separate variational autoencoder model is used for dimensionality reduction. In contrast to classical evaluation methods our approach is capable to derive lower dimensional representations of time-series signals without a-priori knowledge of the data generating mechanism. We tested our analysis framework on an experimental uHTS data set and identified two distinct classes of substances in the screened library which could be attributed to two biological modes of action. Selected substances belonging to both modes of action were successfully validated in a secondary screening experiment.

Matching journals

The top 7 journals account for 50% of the predicted probability mass.

1
Scientific Reports
3612 papers in training set
Top 1%
15.2%
2
Analytical Chemistry
218 papers in training set
Top 0.5%
7.9%
3
SLAS Discovery
25 papers in training set
Top 0.1%
7.3%
4
Artificial Intelligence in the Life Sciences
13 papers in training set
Top 0.1%
6.8%
5
PLOS Computational Biology
1863 papers in training set
Top 7%
4.9%
6
Bioinformatics
1204 papers in training set
Top 4%
4.4%
7
Communications Chemistry
48 papers in training set
Top 0.1%
4.1%
50% of probability mass above
8
PLOS ONE
5266 papers in training set
Top 38%
3.2%
9
Computational and Structural Biotechnology Journal
242 papers in training set
Top 2%
2.8%
10
Nature Communications
5641 papers in training set
Top 39%
2.5%
11
Lab on a Chip
96 papers in training set
Top 0.5%
2.1%
12
iScience
1154 papers in training set
Top 13%
2.1%
13
International Journal of Molecular Sciences
494 papers in training set
Top 8%
1.7%
14
Methods
34 papers in training set
Top 0.3%
1.7%
15
SLAS Technology
14 papers in training set
Top 0.1%
1.4%
16
Journal of Chemical Information and Modeling
238 papers in training set
Top 2%
1.4%
17
BMC Bioinformatics
457 papers in training set
Top 4%
1.3%
18
Computers in Biology and Medicine
128 papers in training set
Top 3%
1.3%
19
npj Systems Biology and Applications
125 papers in training set
Top 1%
1.3%
20
eLife
5828 papers in training set
Top 57%
1.1%
21
Communications Biology
993 papers in training set
Top 21%
1.1%
22
ACS Omega
105 papers in training set
Top 3%
1.1%
23
Briefings in Bioinformatics
354 papers in training set
Top 6%
1.0%
24
Sensors
43 papers in training set
Top 1%
1.0%
25
Journal of Cheminformatics
29 papers in training set
Top 0.6%
1.0%
26
Patterns
78 papers in training set
Top 2%
0.9%
27
ACS Pharmacology & Translational Science
40 papers in training set
Top 0.7%
0.9%
28
Nano Letters
71 papers in training set
Top 1%
0.6%
29
Nucleic Acids Research
1281 papers in training set
Top 15%
0.6%
30
Bioinformatics Advances
203 papers in training set
Top 5%
0.6%