evidence_id	paper_id	publication_year	paper_title	doi	article_gene_name	article_gene_or_locus_id	accession	sequence_database	sequence_type	article_reported_length	retrieved_nucleotide_length	retrieved_protein_length	current_ncbi_loc_id	website_standard_gene_id	current_ncbi_geneid	ncbi_protein_id	reference_assembly_accession	alignment_source	percent_identity	query_coverage_percent	alignment_length	mapping_confidence	website_annotation	current_site_predicted_localization	mapping_evidence	article_experimental_localization	article_direct_interactor	nucleotide_sequence_5_to_3	protein_sequence_1_letter	sequence_source	sequence_availability	evidence_classification	source_url
P031_OP009356	P031	2023	SmWD40-2 functions as a positive regulator of both tanshinones and phenolic acids biosynthesis in Salvia miltiorrhiza Bunge hairy roots		SmWD40-2		OP009356	NCBI GenBank	complete CDS	not reported in the checked text	1275	424	LOC131018845	SmilChr01G001557	131018845		GCF_028751815.1	nucleotide	100.0	100.0	1275	Exact or near-exact sequence match	WD-40 repeat-containing protein MSI1-like	Nucleus (1.000); Nucleoplasm (0.600)	Live BLAST against current website CDS/protein sequences on 2026-08-29	SmWD40-2: mainly nucleus; weak cell-membrane signal		"ATGGAAAAAGACGACGACGAGATGAGGGGGGAGATTGAGGAGCGGCTGGTAAATGAGGAG
TACAAGATTTGGAAGAAGAACACGCCGTTCCTCTACGATTTGGTCGTCACTCACGCGCTC
GAGTGGCCGTCGCTGACCGTGGAGTGGCTGCCCGACCGGGAGGAGCCGCCGGGCAAGGAT
TACTCTGCCCAGAAGATGATTCTCGGTACCCACACTTCCGAGAACGAGCCCAATTACCTC
ATGCTCGCCAGGATTCAGCTGCCTCTCGAGGACACCGAGAACGATTCCCGCCATTACGAC
GATGAACGGTCTGAATTCGGTGGATTTGGCTGCACTAATGGCAAGGTTCAAATTATCCAG
CAAATAAATCATGATGGGGAGGTCAATCGAGCCCGTTACATGCCCCAAAATCCATTTATT
ATCGCCACCAAGACTGTTAGTGCGGAAGTTTATGTTTTCGACTATAGCAAACATCCCTCA
AAGCCTCCTCTAGATGGTGCATGTAACCCTGATTTGAGGCTAAGGGGCCACAGCACTGAA
GGGTATGGTTTATCGTGGAGTCAGTTCAAGGATGGTCATCTTTTGAGTGGTTCGGATGAT
GCCCAAATATGTTTGTGGGATATAAATGCAACTCCGAAGAATAATGCTCTAGATGCAATG
CAAACATTTAAGATTCATGAAGGTGTTGTTGAAGATGTGGCATGGCACCTCAGGCATGAA
TATCTGTTTGGGTCGGTTGGAGATGACCAGCATCTTCATATATGGGATCTCCGATCTCCT
TCAGTCAACAAGCCGATACAATCTGTAGTAGCCCATCAAAGCGAGGTAAACTGTTTGGCT
TTCAATCCTTTTAATGAGTGGGTTCTGGCAACGGGTTCCACTGACAAGACTGTCAAGTTA
TTTGACATGCGAAGGATTTCTACCGCACTCCACAAATTTGACTGTCACAAGGAGGAGGTT
TTCCAGGTCGGATGGAACCCAAAGAACGAGACCATCTTAGCTTCGTGTTGTCTTGGTAGA
AGACTGATGGTCTGGGATCTCAGCAGGATTAATGAAGAGCAGTCGTCGGAGGATGCTGAG
GATGGACCACCGGAGCTCGTATTCATTCATGGTGGCCATACGAGTAAAATCTCCGACTTC
TCATGGAACCCTTGTGAAGACTGGGTTGTTGCTAGCGTGGCGGAGGACAACATACTTCAA
ATATGGCAGATGTCTGAGAACATCTACCATGATGAAGATGATGTGCCTGTGAATGACGCC
ATGAAAGGCTCCTAG"	"MEKDDDEMRGEIEERLVNEEYKIWKKNTPFLYDLVVTHALEWPSLTVEWLPDREEPPGKD
YSAQKMILGTHTSENEPNYLMLARIQLPLEDTENDSRHYDDERSEFGGFGCTNGKVQIIQ
QINHDGEVNRARYMPQNPFIIATKTVSAEVYVFDYSKHPSKPPLDGACNPDLRLRGHSTE
GYGLSWSQFKDGHLLSGSDDAQICLWDINATPKNNALDAMQTFKIHEGVVEDVAWHLRHE
YLFGSVGDDQHLHIWDLRSPSVNKPIQSVVAHQSEVNCLAFNPFNEWVLATGSTDKTVKL
FDMRRISTALHKFDCHKEEVFQVGWNPKNETILASCCLGRRLMVWDLSRINEEQSSEDAE
DGPPELVFIHGGHTSKISDFSWNPCEDWVVASVAEDNILQIWQMSENIYHDEDDVPVNDA
MKGS"	nucleotide FASTA and GenBank CDS translation retrieved from NCBI	nucleotide_and_protein	Article accession plus sequence alignment to current reference	https://www.ncbi.nlm.nih.gov/nuccore/OP009356
