Back

SPEAK: Spatial Prompting with Expert Aligned Knowledge for Tissue Domain Identification in Spatial Transcriptomics

Wei, H.; Luo, X.; Yu, H.; Liang, J.; Yang, L.; Sauler, M.; Kaminski, N.; Popa, A.; Yan, X.

2026-06-26 bioinformatics
10.64898/2026.06.22.733750 bioRxiv
Show abstract

Spatially resolved transcriptomic (SRT) data requires spatial domain identification to enable tissue microenvironment-specific downstream analyses. Here we present SPEAK (Spatial Prompting with Expert-Aligned Knowledge), a large language model (LLM)-based method to identify spatial domains from SRT data by taking advantage of the prior knowledge from both LLM and human experts. SPEAK constructs a spatial context prompt for each cell/spot based on cell types and marker genes of its neighboring cells, enabling zero-shot inference, expert-guided fine-tuning, and prototype updating through two-stage prompting. Applications to STARmap, Visium, MERFISH and Xenium datasets showed advantages of SPEAK over existing spatial domain identification methods in domain prediction accuracy, robustness to limited prior knowledge, biological interpretability, and capacity for efficient expert-guided fine-tuning with generalizability to other tissue sections.

Matching journals

The top 5 journals account for 50% of the predicted probability mass.

1
Nature Communications
5641 papers in training set
Top 14%
12.8%
2
Genome Biology
637 papers in training set
Top 0.8%
11.8%
3
Nature Methods
385 papers in training set
Top 0.8%
11.8%
4
Cell Systems
201 papers in training set
Top 0.3%
8.8%
5
Nucleic Acids Research
1281 papers in training set
Top 3%
6.2%
50% of probability mass above
6
Nature Biotechnology
172 papers in training set
Top 0.5%
6.2%
7
Bioinformatics
1204 papers in training set
Top 5%
4.3%
8
Genome Research
468 papers in training set
Top 1%
4.3%
9
Briefings in Bioinformatics
354 papers in training set
Top 2%
4.0%
10
PLOS Computational Biology
1863 papers in training set
Top 12%
2.4%
11
Cell Reports Methods
165 papers in training set
Top 1%
2.1%
12
Nature Machine Intelligence
70 papers in training set
Top 1%
1.7%
13
GigaScience
212 papers in training set
Top 3%
1.5%
14
Advanced Science
286 papers in training set
Top 6%
1.4%
15
iScience
1154 papers in training set
Top 23%
1.3%
16
Patterns
78 papers in training set
Top 2%
1.0%
17
Proceedings of the National Academy of Sciences
2444 papers in training set
Top 38%
1.0%
18
Communications Biology
993 papers in training set
Top 27%
1.0%
19
Nature Genetics
286 papers in training set
Top 5%
0.9%
20
PLOS ONE
5266 papers in training set
Top 60%
0.9%
21
Genome Medicine
183 papers in training set
Top 5%
0.8%
22
Nature Computational Science
55 papers in training set
Top 2%
0.8%
23
Molecular Systems Biology
162 papers in training set
Top 4%
0.6%
24
Cell
431 papers in training set
Top 11%
0.6%
25
NAR Genomics and Bioinformatics
242 papers in training set
Top 5%
0.6%
26
Journal of Genetics and Genomics
38 papers in training set
Top 0.9%
0.6%