Back

Reproducible and shareable bioinformatics pipelines from natural-language prompts

Kim, H.-M.; Jeong, H.; Mekonnen, A. M.; Kim, Y.; Oh, Y.; Lee, H.; Jung, C.; Park, J.

2026-06-01 bioinformatics
10.64898/2026.05.28.719125 bioRxiv
Show abstract

Large language models (LLMs) are increasingly used to generate bioinformatics pipelines and to carry out analyses from natural-language prompts. However, the resulting analyses are often difficult to reproduce across sessions, owing to the non-deterministic nature of LLM-driven conversations and heterogeneity of local execution environments, and cannot run on remote high-performance computing (HPC) servers or be shared and reused. We present Autopipe, a platform that guides any Model Context Protocol (MCP) - compatible LLM to produce, execute, and publish source-preserved, re-executable containerized pipelines. Autopipe enables users to execute bioinformatics pipelines on any on-premises remote servers - supported by comprehensive setup documentation aimed at researchers without prior server-administration experience - and to visualize results through an extensible web-based viewer. The Autopipe platform comprises four components: a desktop application with an embedded MCP server for pipeline management and remote execution, an online registry for pipeline and plugin discovery, a web-based result viewer, and a CLI tool for customizing viewer plugins. Autopipe turns conversational analysis into re-executable and shareable workflows. Autopipe is freely available at https://autopipe.org/.

Matching journals

The top 6 journals account for 50% of the predicted probability mass.

1
Bioinformatics
1204 papers in training set
Top 2%
15.0%
2
GigaScience
212 papers in training set
Top 0.1%
11.0%
3
Genome Biology
637 papers in training set
Top 1%
7.8%
4
BMC Bioinformatics
457 papers in training set
Top 1%
7.2%
5
Journal of Open Source Software
25 papers in training set
Top 0.1%
4.8%
6
PLOS Computational Biology
1863 papers in training set
Top 8%
4.3%
50% of probability mass above
7
Bioinformatics Advances
203 papers in training set
Top 1%
4.3%
8
NAR Genomics and Bioinformatics
242 papers in training set
Top 1%
3.4%
9
Nucleic Acids Research
1281 papers in training set
Top 6%
3.2%
10
Journal of Molecular Biology
232 papers in training set
Top 0.9%
3.2%
11
Nature Communications
5641 papers in training set
Top 38%
2.8%
12
Nature Methods
385 papers in training set
Top 3%
2.6%
13
Cell Systems
201 papers in training set
Top 2%
2.6%
14
PLOS ONE
5266 papers in training set
Top 41%
2.6%
15
Computational and Structural Biotechnology Journal
242 papers in training set
Top 4%
1.7%
16
Journal of Chemical Information and Modeling
238 papers in training set
Top 2%
1.4%
17
SoftwareX
15 papers in training set
Top 0.2%
1.1%
18
F1000Research
88 papers in training set
Top 2%
1.1%
19
Protein Science
246 papers in training set
Top 3%
1.1%
20
Patterns
78 papers in training set
Top 2%
1.1%
21
Scientific Reports
3612 papers in training set
Top 65%
1.1%
22
Briefings in Bioinformatics
354 papers in training set
Top 6%
1.0%
23
Molecular Biology and Evolution
542 papers in training set
Top 5%
0.8%
24
Cell Reports Methods
165 papers in training set
Top 4%
0.8%
25
Genome Research
468 papers in training set
Top 6%
0.8%
26
PeerJ
308 papers in training set
Top 11%
0.8%
27
PLOS Biology
486 papers in training set
Top 12%
0.8%
28
Database
61 papers in training set
Top 1%
0.6%
29
Journal of Bioinformatics and Systems Biology
15 papers in training set
Top 0.4%
0.6%
30
Nature Computational Science
55 papers in training set
Top 2%
0.6%