evidence_id	paper_id	publication_year	paper_title	doi	article_gene_name	article_gene_or_locus_id	accession	sequence_database	sequence_type	article_reported_length	retrieved_nucleotide_length	retrieved_protein_length	current_ncbi_loc_id	website_standard_gene_id	current_ncbi_geneid	ncbi_protein_id	reference_assembly_accession	alignment_source	percent_identity	query_coverage_percent	alignment_length	mapping_confidence	website_annotation	current_site_predicted_localization	mapping_evidence	article_experimental_localization	article_direct_interactor	nucleotide_sequence_5_to_3	protein_sequence_1_letter	sequence_source	sequence_availability	evidence_classification	source_url
P026_HQ676610	P026	2016	SmLEA2, a gene for late embryogenesis abundant protein isolated from Salvia miltiorrhiza, confers tolerance to drought and salt stress in Escherichia coli and S. miltiorrhiza.	10.1007/s00709-016-0981-z	SmLEA2		HQ676610	NCBI GenBank	full-length ORF	not reported in the checked text	1017	319	LOC130995557	SmilChr01G003727	130995557	XP_057776873.1	GCF_028751815.1	protein	99.687	100.0	319	Exact or near-exact sequence match	uncharacterized LOC130995557	Secreted (1.000); Secreted (1.000)	Live BLAST against current website CDS/protein sequences on 2026-08-29			"ATGGCGTCTTATGATAAGCCAGATGTGTCCGAAAGGGAAGTGAGGGACAGAGGGGAGAAA
GAGGAAAAGAAAGAAGAGGAGAAGGGTGGCTTTCTGGACAAGGTTAAAGATTTCATCCAC
GACATAGGTGAGAAAATCGAGGAAGCAGTCGGAGTTGGGAAGCCGACTGCGGATGTTACC
GAAATCCACATTCCCCATATCAGTATGGAGAAGGCCGAGATAGTTGTGGACGTCCTTGTC
ACGAACCCGAATCCTGTTCCAATCCCTCTCATCGACATAAACTATTTGATCGAGAGCGAT
GGGAGGAAGCTGGTTTCTGGATTGATCCCTGATGCTGGGACGATACACGCACATGGCTCT
GAGACTGTTAAGCTGCCACTTTGTCTTATATACGATGATATCAAGAGCACGTACGATGAT
ATACAACCAGGAAGTGTGATTCCTTATAGGGTTAAGGTCGACCTCATTGTGGACGTGCCC
GTGTTTGGTAGGCTTACTTTCCCCCTTGAGAAGACCGGAGAGATCCCCGTCCCTTACAAA
CCACAAATCGATCTTGAGAAGGTTCAGTTTGACAAGTTCTCATTCGAGGAAACCACTGCC
ACTCTTCATCTGAAGCTGGGAAACAAGAACGACTTTGACCTATGCCTTAATGACATTGAC
TTTGAGGTTTGGCTATGCGACGTGAGCATTGGCCGCGCTGATCTGAGCAAGTCTACTAAC
ATTGCGAAGAACGGGGAAGGCTACATTGATGTCCCCATCACGTTTCGGCCCAAGGACTGC
GGCTCTGCTCTTTGGGATATGATACGAGGGAAGGGGACGGGGTACGCCATCAAAGGGAAT
ATCAATGTGGACACGCCTTTCGGGGCTATGAAGCTTCCTATCACCAAGGAGGGCGGTGAA
ACTCGTCTCAAGAAGAACAAGGAAGGTGGAGGCGACGAGGATGATGAGGTATGCTTATAA
TGTTGTGCTCATTCATATTCGTTTTCTTCTTTCCTTAGCTGGTATACATTCATCACT"	"MASYDKPDVSEREVRDRGEKEEKKEEEKGGFLDKVKDFIHDIGEKIEEAVGVGKPTADVT
EIHIPHISMEKAEIVVDVLVTNPNPVPIPLIDINYLIESDGRKLVSGLIPDAGTIHAHGS
ETVKLPLCLIYDDIKSTYDDIQPGSVIPYRVKVDLIVDVPVFGRLTFPLEKTGEIPVPYK
PQIDLEKVQFDKFSFEETTATLHLKLGNKNDFDLCLNDIDFEVWLCDVSIGRADLSKSTN
IAKNGEGYIDVPITFRPKDCGSALWDMIRGKGTGYAIKGNINVDTPFGAMKLPITKEGGE
TRLKKNKEGGGDEDDEVCL"	nucleotide FASTA and GenBank CDS translation retrieved from NCBI	nucleotide_and_protein	Article accession plus sequence alignment to current reference	https://doi.org/10.1007/s00709-016-0981-z
