Summary
Resource Type
mRNA
Organism
Persea americana-Anise
Name
Chr01.g02273.m1
Identifier
Chr01.g02273.m1
Protein Sequence
MAAEVKGETAHGRLCFVCAGNELVWRGLYGDWRKRRLQLYIGYQAYSQWF
LTVLHRAIVVPSNALFVEEGFQTEMPWLLSTMTLGIDLNRPNSLFVAFVS
EVASSVSICKNLSKGSISTGLRAYPLVGNLPDFIKNRHRILEWLTEIVIE
HPTNTVTFRRPGKVQGIITANPMNVEHMLKTNFENYPKGERSTALLHDFL
GTGIFNSDGETWKAQRKTASFEFSKRSLRNFVMETVQQEIQNRLLPLLQT
AMKTNKTIDLQDILERFAFDNICMVAFNQDPKCLFFDSSCNLSSSPFARA
FEQAANLSAERFRYTFPFILKIKKHFNLGSETILKQSISTVHDFAMNIIR
SRKTSNNKENAQETDLLSRFIISTNNDTISNNSEEFLRDIIISFILAGRD
TTSSTLAWFFWLLSSNPRVERKIIRELQSVRAQFQKSPSEMFDFEELREM
QYLHAAITEALRLYPPVAVDTRACKEDDVMPDGTVVKKGWFVTYNAYAMG
RLEGIWGRDCGSFVPERWLDEKGMFRAESPYRFPAFHAGPRMCLGKEMAY
IQMKSIVACLVERFVIDVLGKDKCPDHFLSLTMRVKGVVFTAYSLAPSVG
NLNKKLVSTMPPKTRNGEGPSKGKALSIQPTLAQNLPPPPPQQRRSGGRS
PTVQTESRSRGVTMLSLRDVPPPEQPRHSHGRGRQGDKSVTKPHEKSARA
GSQSNHQASLDQNEDPRLDDIRAQNRLIQEQNELIQRLRQQLDDKKGRSP
PPRRLGHGQDLRYVLNSKRRDRDQEEEGSSSSYKHEGPKKQRQVSEDQEL
KQWIDQQVKQTIRHNMEIAGIDRDRYTAFEAEDTGASPFSREIRKYTLPE
KFSVPRFTLYDGTSDPAAHLRHYIQRMSVWGDDDSLNCRVFSSSLADLPL
RWFCSLPEDSISSWRQLRTSFLGKFQAHRVIPKTDADLMALQMQEDENVT
QFARRFWTVYSQIECASEELAVRSFQLALQPCIPLRAQLVMYPVTTMKEL
MAQANRFILAEEDEARGRENFGLTKKSQPAKGDSRSSRREDRRKDPSPDR
RKARSTEHRRTPSASAAASGSGRRSGHEPTSHVAVNTIFKEPIYRLLNKI
KAQPFFKWPRPMTTDPSSRDQSRFCAYHKQNGHRTDECKSYKFHLENLVK
EGHLREYIKKEGRGDDRPPRRDADNHDSEPEGIINVIHLAAPPKKSSQAR
AEARRASHQKQVLTAAPEPAAKKARTEGVRIWFSDRDLEDVELPHNDALV
LTLKLQNFLVQRALVDPGSSSEVLYYDCFKKLKLKDEDLQPARTPLVGFS
SEPVYPKGKISLRVQVGGACRQVEFLVVDVPSPYNVIMGRTWLHSMEAVP
STRHQKLKFPLESQSGRTDVITVRGDQHMARQCLLAVLPGEAESSQVNMT
ELDKEAELGDVGRAPAEKSIEDLTKVNIDPADPDRFFLVGSQLPESEKTE
LLDLLVENKAVFAWTPYEMPGIDPTVICHELKVDPNHRPVLQKPRRTGVP
QTEAMVEEVQKLLEAGAIKEVHYPQWLANTVVVKKKTGKWRVCVDFTDLN
KACPKDSFPLPKIDQLIDATAGHDRMSFLDAYWGYHQIPLYAADQEKTAF
ITPRGTYCYKVMPFGLKNAGATYQRLATKMFQAQLGKTVEVYIDDMVVKS
KKSEDHLTDLRQIFDIHRQLRQSYTNQGPVVIPPSRLGASVQRANRPKLG
ACTSLGGTAKSIRVW*
Properties
Coding Sequence (CDS)
ATGGCAGCAGAAGTTAAAGGAGAGACGGCTCATGGTCGACTTTGTTTTGT
GTGTGCTGGAAATGAGTTGGTTTGGAGAGGGTTATATGGGGATTGGAGAA
AGCGTCGACTGCAACTCTACATCGGCTACCAGGCGTATTCACAGTGGTTC
TTAACGGTCCTCCATCGAGCCATTGTGGTCCCCTCCAACGCCCTCTTTGT
TGAAGAAGGTTTTCAAACAGAAATGCCATGGCTTTTATCCACCATGACTT
TGGGCATCGATTTGAATAGGCCGAACTCACTATTTGTTGCATTTGTGTCT
GAAGTTGCCTCTAGTGTTTCCATTTGTAAGAATCTATCAAAAGGGAGCAT
CTCCACTGGCCTTAGAGCATATCCACTCGTCGGAAACTTGCCTGATTTTA
TCAAAAACCGCCACAGAATACTCGAATGGCTGACCGAAATCGTCATCGAG
CACCCGACGAACACGGTCACCTTCCGACGCCCTGGAAAAGTCCAAGGGAT
CATCACGGCTAACCCAATGAATGTGGAACACATGCTCAAGACCAACTTCG
AGAATTATCCGAAAGGCGAACGGTCCACGGCCTTGTTACATGACTTCCTC
GGCACTGGCATCTTCAACTCAGACGGAGAGACTTGGAAGGCCCAAAGGAA
GACTGCAAGCTTCGAATTCAGCAAGAGGTCTCTCCGAAACTTCGTCATGG
AGACTGTCCAACAAGAGATCCAAAACCGCCTCCTCCCACTCCTCCAAACA
GCCATGAAAACCAACAAAACCATCGACCTTCAAGACATCCTCGAGCGCTT
CGCGTTCGACAACATCTGCATGGTCGCCTTCAACCAAGACCCCAAGTGCC
TCTTCTTCGACTCCTCCTGCAATCTCTCCTCCTCCCCCTTCGCTCGTGCC
TTCGAACAAGCCGCCAACCTCTCCGCGGAGCGCTTCCGATACACCTTCCC
ATTCATCTTGAAAATAAAAAAACACTTCAATCTCGGCTCGGAAACCATCT
TGAAACAATCCATTTCCACCGTCCACGACTTCGCCATGAACATCATAAGA
TCCAGGAAAACCTCTAATAACAAAGAAAACGCCCAAGAAACGGACCTTCT
ATCTCGATTCATCATCTCAACCAACAATGACACTATTAGTAACAATTCAG
AGGAGTTCCTCAGAGACATCATCATAAGCTTCATCCTCGCAGGCCGCGAC
ACGACGTCTTCAACACTAGCATGGTTCTTTTGGCTGCTGTCATCCAATCC
CCGAGTCGAGCGAAAGATCATTCGAGAGCTCCAATCAGTAAGAGCCCAGT
TCCAGAAAAGTCCTTCTGAGATGTTTGATTTCGAAGAGTTGCGAGAAATG
CAGTATCTGCATGCGGCCATCACTGAGGCTCTGAGGCTGTATCCGCCTGT
AGCGGTAGACACGAGAGCCTGTAAGGAAGATGATGTGATGCCGGATGGGA
CAGTGGTGAAGAAGGGGTGGTTTGTGACGTATAATGCGTATGCGATGGGG
AGATTGGAGGGGATTTGGGGGAGAGATTGTGGTAGTTTTGTGCCGGAGAG
ATGGTTGGATGAGAAAGGGATGTTTCGGGCTGAGAGTCCGTATCGGTTTC
CGGCGTTTCATGCAGGGCCTAGAATGTGTTTGGGAAAGGAGATGGCTTAT
ATACAAATGAAGTCGATCGTTGCATGTCTAGTGGAGAGATTTGTGATTGA
TGTTTTGGGGAAGGATAAGTGTCCTGATCATTTTCTCTCTTTGACGATGA
GGGTCAAAGGTGTCGTTTTTACCGCCTACAGTTTGGCGCCGTCTGTGGGA
AACTTGAACAAAAAGCTTGTAAGCACCATGCCTCCAAAAACCAGAAATGG
CGAAGGACCCTCCAAAGGCAAGGCTTTGTCCATACAGCCTACGCTGGCAC
AGAATCTTCCACCTCCACCCCCTCAGCAGAGGAGGTCGGGGGGGAGGTCT
CCCACGGTCCAGACAGAGTCACGATCTAGGGGAGTGACCATGCTTTCCCT
TCGCGACGTCCCACCTCCTGAACAGCCCCGCCATAGCCATGGGCGGGGCA
GGCAAGGCGACAAGTCAGTCACCAAGCCACACGAGAAGTCAGCGCGGGCT
GGATCACAGTCGAACCATCAAGCCAGCCTCGATCAAAACGAAGACCCCCG
CCTGGATGACATCAGGGCTCAGAACCGCCTCATCCAGGAGCAGAACGAGC
TTATCCAACGGCTCAGGCAGCAGCTCGACGACAAGAAGGGTCGGAGCCCG
CCGCCCAGGCGCCTGGGCCACGGGCAAGACCTGAGGTACGTCCTCAACAG
TAAGAGGCGCGACCGAGACCAAGAGGAAGAAGGCTCCAGCAGCAGTTACA
AGCACGAAGGGCCGAAGAAGCAACGCCAGGTTTCAGAGGATCAAGAGCTG
AAGCAGTGGATCGACCAACAGGTGAAGCAAACGATCCGCCATAATATGGA
GATTGCTGGTATCGACCGAGACCGGTATACCGCCTTCGAAGCTGAGGACA
CTGGCGCGTCTCCCTTCTCTAGGGAGATAAGAAAATACACGCTCCCCGAG
AAGTTCAGCGTCCCGAGGTTCACCCTGTATGACGGAACCTCGGACCCCGC
AGCTCATCTCCGACATTACATCCAGAGGATGTCGGTCTGGGGGGATGATG
ACTCCTTGAACTGTCGAGTTTTCTCCTCCAGTTTGGCGGATCTCCCCCTG
CGGTGGTTTTGCTCGCTTCCTGAAGACTCCATCTCCAGTTGGCGGCAGCT
CCGGACCTCCTTCCTGGGAAAATTCCAGGCTCATCGCGTCATCCCAAAGA
CCGATGCCGACCTGATGGCCCTCCAAATGCAGGAGGATGAGAACGTCACC
CAGTTCGCTCGCCGGTTCTGGACTGTCTACAGCCAGATCGAGTGCGCCTC
TGAAGAGCTAGCAGTGAGGTCCTTCCAGCTGGCTCTGCAGCCATGCATCC
CGCTTCGGGCGCAGCTGGTCATGTACCCCGTGACCACCATGAAGGAGCTG
ATGGCCCAAGCCAATCGGTTCATCCTGGCGGAAGAAGACGAGGCGCGAGG
ACGAGAGAACTTCGGCCTCACTAAGAAGAGCCAACCGGCCAAGGGAGACA
GCAGGTCCTCCAGGAGGGAGGACCGTCGCAAAGACCCATCCCCGGATCGG
CGCAAGGCCCGGTCCACGGAGCACCGCCGAACTCCCTCTGCCTCGGCAGC
GGCATCGGGGAGCGGCAGAAGGTCTGGCCACGAGCCGACCTCCCATGTGG
CAGTCAATACCATCTTTAAGGAGCCGATCTATAGGCTCCTCAACAAAATA
AAAGCGCAGCCTTTCTTCAAATGGCCACGGCCAATGACGACCGACCCCTC
CTCCCGGGACCAGAGTAGGTTCTGTGCCTACCACAAGCAGAATGGGCACA
GGACCGACGAATGTAAGAGCTATAAGTTCCACCTGGAAAACCTCGTGAAG
GAGGGGCACCTCAGGGAGTACATCAAGAAGGAGGGCCGAGGTGATGACCG
ACCTCCGCGGCGAGACGCTGACAACCACGACAGCGAGCCGGAGGGTATCA
TCAACGTCATTCACCTCGCCGCCCCACCTAAGAAGAGCTCTCAGGCCCGC
GCCGAGGCCAGGCGCGCCTCCCACCAAAAGCAGGTGCTGACCGCGGCACC
AGAGCCGGCCGCGAAGAAGGCCAGAACGGAGGGGGTCAGAATATGGTTTT
CTGACAGAGACTTGGAAGACGTCGAGCTCCCGCACAACGACGCTCTAGTG
CTCACCTTGAAGCTGCAAAACTTCTTGGTTCAGAGAGCCCTTGTCGACCC
TGGCAGTTCGTCCGAAGTCCTCTACTACGATTGTTTCAAAAAGTTAAAGC
TGAAGGACGAGGACCTCCAGCCAGCCCGCACCCCTCTGGTCGGCTTCAGC
TCCGAGCCTGTCTATCCCAAGGGTAAGATCTCCCTCAGAGTCCAAGTGGG
AGGCGCCTGCAGGCAGGTTGAATTCCTGGTAGTCGATGTCCCCTCCCCAT
ACAATGTCATAATGGGGAGGACGTGGCTGCATAGCATGGAGGCGGTGCCC
TCCACCCGGCATCAGAAGCTCAAATTTCCTTTGGAAAGCCAGTCAGGTCG
GACGGACGTTATCACCGTCAGAGGCGACCAGCACATGGCCAGGCAATGCC
TGCTGGCCGTGCTGCCTGGCGAGGCCGAATCGTCCCAGGTCAATATGACC
GAACTGGACAAAGAGGCCGAGCTCGGGGACGTTGGCAGGGCTCCGGCAGA
GAAAAGCATCGAGGACCTCACCAAGGTCAACATTGATCCCGCCGACCCTG
ACAGATTCTTCCTTGTTGGAAGCCAGCTCCCCGAGTCCGAGAAGACAGAA
TTGCTCGACCTCCTTGTGGAGAATAAGGCGGTCTTTGCCTGGACACCCTA
TGAGATGCCCGGCATTGACCCGACAGTCATCTGCCACGAACTGAAGGTGG
ATCCCAACCATAGGCCCGTGCTTCAAAAGCCGCGCCGGACTGGGGTCCCG
CAGACTGAGGCCATGGTTGAGGAAGTTCAGAAACTCCTCGAGGCAGGCGC
AATAAAGGAAGTCCACTATCCGCAGTGGCTAGCTAACACCGTGGTGGTCA
AAAAGAAGACGGGAAAATGGAGGGTCTGCGTGGATTTCACCGACCTCAAT
AAGGCCTGTCCCAAAGACAGCTTCCCTCTTCCGAAGATAGACCAGCTCAT
CGACGCCACTGCCGGACATGACCGGATGAGTTTCCTGGATGCCTACTGGG
GGTACCATCAGATCCCCCTGTACGCGGCAGACCAGGAAAAGACAGCTTTC
ATCACTCCCAGGGGCACCTATTGTTACAAGGTGATGCCCTTCGGGCTAAA
AAATGCGGGAGCAACGTACCAGCGGCTGGCGACAAAGATGTTCCAGGCCC
AGCTCGGCAAGACGGTGGAGGTCTACATCGATGATATGGTCGTCAAATCC
AAAAAGTCGGAGGACCATTTGACCGACCTCCGCCAGATTTTTGACATCCA
TCGCCAACTCCGACAAAGCTATACAAATCAGGGTCCGGTAGTAATACCAC
CCTCGCGGCTCGGCGCCTCTGTCCAGAGGGCCAACCGTCCTAAGCTCGGT
GCTTGCACCAGCCTGGGCGGCACAGCCAAAAGCATCAGGGTCTGGTAG
Sequences
Sequence
ATGGCAGCAGAAGTTAAAGGAGAGACGGCTCATGGTCGACTTTGTTTTGT
GTGTGCTGGAAATGAGTTGGTTTGGAGAGGGTTATATGGGGATTGGAGAA
AGCGTCGACTGCAACTCTACATCGGCTACCAGGCGTATTCACAGTGGTTC
TTAACGGTCCTCCATCGAGCCATTGTGGTCCCCTCCAACGCCCTCTTTGT
TGAAGAAGGTTTTCAAACAGAAATGCCATGGCTTTTATCCACCATGACTT
TGGGCATCGATTTGAATAGGCCGAACTCACTATTTGTTGCATTTGTGTCT
GAAGTTGCCTCTAGTGTTTCCATTTGTAAGAATCTATCAAAAGGGAGCAT
CTCCACTGGCCTTAGAGCATATCCACTCGTCGGAAACTTGCCTGATTTTA
TCAAAAACCGCCACAGAATACTCGAATGGCTGACCGAAATCGTCATCGAG
CACCCGACGAACACGGTCACCTTCCGACGCCCTGGAAAAGTCCAAGGGAT
CATCACGGCTAACCCAATGAATGTGGAACACATGCTCAAGACCAACTTCG
AGAATTATCCGAAAGGCGAACGGTCCACGGCCTTGTTACATGACTTCCTC
GGCACTGGCATCTTCAACTCAGACGGAGAGACTTGGAAGGCCCAAAGGAA
GACTGCAAGCTTCGAATTCAGCAAGAGGTCTCTCCGAAACTTCGTCATGG
AGACTGTCCAACAAGAGATCCAAAACCGCCTCCTCCCACTCCTCCAAACA
GCCATGAAAACCAACAAAACCATCGACCTTCAAGACATCCTCGAGCGCTT
CGCGTTCGACAACATCTGCATGGTCGCCTTCAACCAAGACCCCAAGTGCC
TCTTCTTCGACTCCTCCTGCAATCTCTCCTCCTCCCCCTTCGCTCGTGCC
TTCGAACAAGCCGCCAACCTCTCCGCGGAGCGCTTCCGATACACCTTCCC
ATTCATCTTGAAAATAAAAAAACACTTCAATCTCGGCTCGGAAACCATCT
TGAAACAATCCATTTCCACCGTCCACGACTTCGCCATGAACATCATAAGA
TCCAGGAAAACCTCTAATAACAAAGAAAACGCCCAAGAAACGGACCTTCT
ATCTCGATTCATCATCTCAACCAACAATGACACTATTAGTAACAATTCAG
AGGAGTTCCTCAGAGACATCATCATAAGCTTCATCCTCGCAGGCCGCGAC
ACGACGTCTTCAACACTAGCATGGTTCTTTTGGCTGCTGTCATCCAATCC
CCGAGTCGAGCGAAAGATCATTCGAGAGCTCCAATCAGTAAGAGCCCAGT
TCCAGAAAAGTCCTTCTGAGATGTTTGATTTCGAAGAGTTGCGAGAAATG
CAGTATCTGCATGCGGCCATCACTGAGGCTCTGAGGCTGTATCCGCCTGT
AGCGGTAGACACGAGAGCCTGTAAGGAAGATGATGTGATGCCGGATGGGA
CAGTGGTGAAGAAGGGGTGGTTTGTGACGTATAATGCGTATGCGATGGGG
AGATTGGAGGGGATTTGGGGGAGAGATTGTGGTAGTTTTGTGCCGGAGAG
ATGGTTGGATGAGAAAGGGATGTTTCGGGCTGAGAGTCCGTATCGGTTTC
CGGCGTTTCATGCAGGGCCTAGAATGTGTTTGGGAAAGGAGATGGCTTAT
ATACAAATGAAGTCGATCGTTGCATGTCTAGTGGAGAGATTTGTGATTGA
TGTTTTGGGGAAGGATAAGTGTCCTGATCATTTTCTCTCTTTGACGATGA
GGGTCAAAGGTGTCGTTTTTACCGCCTACAGTTTGGCGCCGTCTGTGGGA
AACTTGAACAAAAAGCTTGTAAGCACCATGCCTCCAAAAACCAGAAATGG
CGAAGGACCCTCCAAAGGCAAGGCTTTGTCCATACAGCCTACGCTGGCAC
AGAATCTTCCACCTCCACCCCCTCAGCAGAGGAGGTCGGGGGGGAGGTCT
CCCACGGTCCAGACAGAGTCACGATCTAGGGGAGTGACCATGCTTTCCCT
TCGCGACGTCCCACCTCCTGAACAGCCCCGCCATAGCCATGGGCGGGGCA
GGCAAGGCGACAAGTCAGTCACCAAGCCACACGAGAAGTCAGCGCGGGCT
GGATCACAGTCGAACCATCAAGCCAGCCTCGATCAAAACGAAGACCCCCG
CCTGGATGACATCAGGGCTCAGAACCGCCTCATCCAGGAGCAGAACGAGC
TTATCCAACGGCTCAGGCAGCAGCTCGACGACAAGAAGGGTCGGAGCCCG
CCGCCCAGGCGCCTGGGCCACGGGCAAGACCTGAGGTACGTCCTCAACAG
TAAGAGGCGCGACCGAGACCAAGAGGAAGAAGGCTCCAGCAGCAGTTACA
AGCACGAAGGGCCGAAGAAGCAACGCCAGGTTTCAGAGGATCAAGAGCTG
AAGCAGTGGATCGACCAACAGGTGAAGCAAACGATCCGCCATAATATGGA
GATTGCTGGTATCGACCGAGACCGGTATACCGCCTTCGAAGCTGAGGACA
CTGGCGCGTCTCCCTTCTCTAGGGAGATAAGAAAATACACGCTCCCCGAG
AAGTTCAGCGTCCCGAGGTTCACCCTGTATGACGGAACCTCGGACCCCGC
AGCTCATCTCCGACATTACATCCAGAGGATGTCGGTCTGGGGGGATGATG
ACTCCTTGAACTGTCGAGTTTTCTCCTCCAGTTTGGCGGATCTCCCCCTG
CGGTGGTTTTGCTCGCTTCCTGAAGACTCCATCTCCAGTTGGCGGCAGCT
CCGGACCTCCTTCCTGGGAAAATTCCAGGCTCATCGCGTCATCCCAAAGA
CCGATGCCGACCTGATGGCCCTCCAAATGCAGGAGGATGAGAACGTCACC
CAGTTCGCTCGCCGGTTCTGGACTGTCTACAGCCAGATCGAGTGCGCCTC
TGAAGAGCTAGCAGTGAGGTCCTTCCAGCTGGCTCTGCAGCCATGCATCC
CGCTTCGGGCGCAGCTGGTCATGTACCCCGTGACCACCATGAAGGAGCTG
ATGGCCCAAGCCAATCGGTTCATCCTGGCGGAAGAAGACGAGGCGCGAGG
ACGAGAGAACTTCGGCCTCACTAAGAAGAGCCAACCGGCCAAGGGAGACA
GCAGGTCCTCCAGGAGGGAGGACCGTCGCAAAGACCCATCCCCGGATCGG
CGCAAGGCCCGGTCCACGGAGCACCGCCGAACTCCCTCTGCCTCGGCAGC
GGCATCGGGGAGCGGCAGAAGGTCTGGCCACGAGCCGACCTCCCATGTGG
CAGTCAATACCATCTTTAAGGAGCCGATCTATAGGCTCCTCAACAAAATA
AAAGCGCAGCCTTTCTTCAAATGGCCACGGCCAATGACGACCGACCCCTC
CTCCCGGGACCAGAGTAGGTTCTGTGCCTACCACAAGCAGAATGGGCACA
GGACCGACGAATGTAAGAGCTATAAGTTCCACCTGGAAAACCTCGTGAAG
GAGGGGCACCTCAGGGAGTACATCAAGAAGGAGGGCCGAGGTGATGACCG
ACCTCCGCGGCGAGACGCTGACAACCACGACAGCGAGCCGGAGGGTATCA
TCAACGTCATTCACCTCGCCGCCCCACCTAAGAAGAGCTCTCAGGCCCGC
GCCGAGGCCAGGCGCGCCTCCCACCAAAAGCAGGTGCTGACCGCGGCACC
AGAGCCGGCCGCGAAGAAGGCCAGAACGGAGGGGGTCAGAATATGGTTTT
CTGACAGAGACTTGGAAGACGTCGAGCTCCCGCACAACGACGCTCTAGTG
CTCACCTTGAAGCTGCAAAACTTCTTGGTTCAGAGAGCCCTTGTCGACCC
TGGCAGTTCGTCCGAAGTCCTCTACTACGATTGTTTCAAAAAGTTAAAGC
TGAAGGACGAGGACCTCCAGCCAGCCCGCACCCCTCTGGTCGGCTTCAGC
TCCGAGCCTGTCTATCCCAAGGGTAAGATCTCCCTCAGAGTCCAAGTGGG
AGGCGCCTGCAGGCAGGTTGAATTCCTGGTAGTCGATGTCCCCTCCCCAT
ACAATGTCATAATGGGGAGGACGTGGCTGCATAGCATGGAGGCGGTGCCC
TCCACCCGGCATCAGAAGCTCAAATTTCCTTTGGAAAGCCAGTCAGGTCG
GACGGACGTTATCACCGTCAGAGGCGACCAGCACATGGCCAGGCAATGCC
TGCTGGCCGTGCTGCCTGGCGAGGCCGAATCGTCCCAGGTCAATATGACC
GAACTGGACAAAGAGGCCGAGCTCGGGGACGTTGGCAGGGCTCCGGCAGA
GAAAAGCATCGAGGACCTCACCAAGGTCAACATTGATCCCGCCGACCCTG
ACAGATTCTTCCTTGTTGGAAGCCAGCTCCCCGAGTCCGAGAAGACAGAA
TTGCTCGACCTCCTTGTGGAGAATAAGGCGGTCTTTGCCTGGACACCCTA
TGAGATGCCCGGCATTGACCCGACAGTCATCTGCCACGAACTGAAGGTGG
ATCCCAACCATAGGCCCGTGCTTCAAAAGCCGCGCCGGACTGGGGTCCCG
CAGACTGAGGCCATGGTTGAGGAAGTTCAGAAACTCCTCGAGGCAGGCGC
AATAAAGGAAGTCCACTATCCGCAGTGGCTAGCTAACACCGTGGTGGTCA
AAAAGAAGACGGGAAAATGGAGGGTCTGCGTGGATTTCACCGACCTCAAT
AAGGCCTGTCCCAAAGACAGCTTCCCTCTTCCGAAGATAGACCAGCTCAT
CGACGCCACTGCCGGACATGACCGGATGAGTTTCCTGGATGCCTACTGGG
GGTACCATCAGATCCCCCTGTACGCGGCAGACCAGGAAAAGACAGCTTTC
ATCACTCCCAGGGGCACCTATTGTTACAAGGTGATGCCCTTCGGGCTAAA
AAATGCGGGAGCAACGTACCAGCGGCTGGCGACAAAGATGTTCCAGGCCC
AGCTCGGCAAGACGGTGGAGGTCTACATCGATGATATGGTCGTCAAATCC
AAAAAGTCGGAGGACCATTTGACCGACCTCCGCCAGATTTTTGACATCCA
TCGCCAACTCCGACAAAGCTATACAAATCAGGGTCCGGTAGTAATACCAC
CCTCGCGGCTCGGCGCCTCTGTCCAGAGGGCCAACCGTCCTAAGCTCGGT
GCTTGCACCAGCCTGGGCGGCACAGCCAAAAGCATCAGGGTCTGGTAG
Sequence Length
5148