Summary
Resource Type
mRNA
Organism
Persea americana-Anise
Name
Chr04.g35578.m1
Identifier
Chr04.g35578.m1
Protein Sequence
MVRLLGLNRSEADDSSPREITRTIPTGESGSGGGESGWLIRFFDSAFFCE
WIAVSYLYKHDHPGVRDYLCNRMYTLPLSGIESYLFQICYMLVHKPSPSL
DKFVIDVCSKSLQIALKVHWFLMAELEDCDEDNEGISRIQEKCQIAATLM
GEWPPLVRPPAPATADSSKSRPVLNRILSSKQRLLSLASSVSPPRSVSLT
SPPPGNHPLQEDGSGNKLTPDDNKLFKKLIPGTKVRDALFFRKSVDKEEE
GSDKDGFFKRLMRDSKDEEEELSASSEGFFKRLFRDNKSDLDDKSGGGGG
AKAGEVDEKEGFFRRLFKDKHDEKKEENERTDDEEKMNGVCEEEEHSEFL
SLRRLFRVHPEDVKTPLPSENGIAGSPFESSPGTESFFRRLFRDRDRSME
DSELFGSKKQKEKRPGSPKQRNEKSYSKPPLPSNVMSQIRKGTYHVSLDF
VQSLCETSYGLVDIFPIEDRKSALRESLVEINSHIAAAQNSGGVCFPMGK
GMYRVVHIPEDEAVLLNSREKAPYLICVEVLKGEIPSQTKETSDAQKLSR
GGIPLANGDVQLPKPPPWAYPLSSAQDTHYNGSDRMSRSASQAIDQAMAH
IWDAKVKFVLVTLSVEKQPVDDLQGSEDHDMGWVSVFLSADAGVKMEDIE
DQVPRRKEHRRVPSTIAIENVKAAAAKGEAPVGLPLKGAAGQGSSDSQSK
VINGGVPKASDALSGELWEEKKERIRKASAYGGSPGWDLRSIIVKSGDDC
RQEHLAVQLVYHFYDIFQEAGLPLWLRPYEVLVTSSYTALIETIPDTASI
HAIKNRFPSITSLRDFFIAKYGENSSSFKLAQRNFVESMAGYSILCYLLQ
VKDRHNGNLLMDEDGHIIHIDFGFLLSNSPGGVNFESAPFKLTRELLEVM
DSDAEGIPSEFFNYFKVLCIQGFLTCRKHAERIILLVEMLQDSGFPCFKG
GPRTIQNLRKRFHLSLTEEQCVSLVLSLISSSLDAWRTRQYDYYQREQLM
ICRKRLETAECRADSLSLSLSLSLYLLFSHSSLSRDLLLLPGSHRHAKCL
YISATNICTLFIVIFVFWIAIGIRFHPTDVELVMYYLKRKVMGIQFPFEV
ISEIDLYKFEPWDLPEMSCLKSRDLVWFFFCSPDKKYATGLRKKRVTDIG
FWKVTGNDTPIFYDSRIVGMKRSLVFHRGKAGRGDRTDWVMHEYRLEDKM
LSDASISQDAFVLCKIFEKSGRGSKNGEQYGAPFKEEDWNDDDDGEGNDS
FMPIPCAGTISPSPRPEDEQNEEMILSAFKSGNGHNSMARPLPQQSMTPV
VTEQHPSSVEHDDIREMFLKVTDEDGDTLTSNRVSVDEKVDSAVPNKSIV
QDAEDHEIFMGLEDITGNVVLNSNELDCPNENMQYQRLSRFSEGLYLEDL
QDPTEVGGAYLEFKDLCHPMEPNFPGHGRSHCLSVHYGTPVLPDLGARDS
LGGSWEGQEPTYGSASFST*
Properties
Coding Sequence (CDS)
ATGGTGCGGCTCCTCGGATTGAACCGATCCGAAGCGGACGACTCGTCCCC
ACGAGAGATCACCCGGACGATCCCGACCGGCGAGAGCGGCAGCGGCGGCG
GCGAGAGCGGCTGGCTGATCCGATTCTTCGACTCGGCGTTCTTCTGCGAA
TGGATCGCCGTGAGCTATCTGTACAAGCACGACCACCCGGGCGTGCGGGA
CTACCTCTGCAATCGCATGTATACGCTTCCTCTCTCTGGCATCGAGAGCT
ACCTCTTTCAGATTTGTTACATGCTCGTCCACAAGCCCAGCCCTTCGCTT
GACAAGTTCGTGATCGATGTCTGCTCAAAATCCCTCCAAATTGCCCTCAA
AGTGCATTGGTTTCTGATGGCGGAGCTCGAAGACTGCGATGAGGACAATG
AAGGCATCAGCAGAATCCAAGAGAAGTGCCAGATCGCCGCCACGCTTATG
GGCGAGTGGCCTCCACTTGTTCGCCCGCCCGCACCTGCCACCGCAGATAG
TTCCAAGAGTCGCCCGGTTCTCAATCGGATTCTATCGTCGAAGCAGAGGT
TGCTGTCGTTGGCCTCGTCGGTGTCGCCGCCCCGGTCCGTGTCTTTAACC
TCGCCACCACCGGGTAATCACCCATTGCAGGAGGATGGAAGTGGCAATAA
GCTCACCCCAGATGATAACAAGCTGTTTAAGAAGCTTATACCGGGTACAA
AGGTGAGGGATGCCCTGTTCTTCCGAAAATCGGTCGATAAAGAGGAGGAG
GGCTCGGATAAAGATGGGTTCTTTAAGAGGCTTATGAGGGACAGTAAGGA
TGAGGAGGAAGAGCTTTCGGCTAGCTCCGAAGGGTTTTTCAAGCGGTTGT
TTCGAGATAACAAGAGCGATTTGGATGACAAAAGCGGTGGTGGGGGTGGG
GCGAAGGCGGGGGAAGTGGATGAGAAGGAGGGGTTCTTTCGAAGGTTATT
TAAGGATAAGCATGATGAGAAGAAAGAGGAAAATGAGAGGACTGACGATG
AAGAGAAGATGAATGGGGTGTGTGAGGAAGAGGAGCATTCTGAGTTTTTG
TCATTGAGGAGGTTGTTTAGGGTGCATCCTGAAGATGTGAAGACTCCATT
GCCAAGTGAAAACGGCATTGCGGGTAGCCCATTTGAAAGCAGTCCAGGAA
CAGAGAGCTTCTTCCGCAGGCTGTTTAGAGACCGAGACAGGTCAATGGAA
GACTCCGAGCTGTTTGGTTCAAAGAAGCAGAAAGAGAAGCGTCCTGGATC
ACCCAAGCAACGGAATGAGAAGTCGTACTCCAAACCTCCATTGCCCAGTA
ATGTCATGTCTCAGATTCGCAAAGGAACATATCATGTTTCATTGGACTTT
GTTCAGTCATTATGTGAGACATCGTATGGTTTGGTGGACATATTTCCTAT
TGAAGATCGCAAAAGTGCCCTTCGTGAGTCTCTTGTAGAGATCAATTCCC
ATATTGCCGCTGCTCAAAACAGTGGAGGAGTGTGCTTTCCAATGGGGAAG
GGGATGTATAGAGTGGTTCACATACCTGAAGATGAAGCAGTTCTTCTGAA
TTCTAGGGAGAAAGCGCCTTATCTTATATGCGTCGAGGTTTTGAAAGGTG
AAATCCCAAGCCAGACAAAAGAGACATCAGATGCTCAAAAACTTTCTCGA
GGAGGGATTCCTTTAGCAAATGGAGATGTGCAGTTGCCGAAGCCTCCTCC
TTGGGCATATCCTTTGTCGAGTGCACAGGATACTCACTATAATGGTTCTG
ATAGAATGTCAAGATCTGCTTCTCAAGCTATTGATCAGGCAATGGCTCAT
ATATGGGACGCCAAAGTAAAATTTGTTCTTGTGACTCTTTCGGTAGAGAA
GCAACCTGTTGATGACCTTCAGGGTAGTGAAGATCATGATATGGGATGGG
TGAGTGTCTTTTTGTCAGCAGATGCTGGGGTCAAGATGGAAGACATAGAG
GATCAAGTGCCACGTCGAAAGGAACATCGTCGTGTTCCAAGCACAATTGC
TATAGAGAATGTAAAGGCTGCAGCAGCAAAAGGAGAGGCGCCTGTTGGTC
TCCCTTTAAAAGGGGCTGCTGGTCAGGGTTCGTCAGATTCACAATCAAAG
GTTATTAATGGTGGTGTTCCTAAGGCTAGTGATGCCTTATCTGGTGAACT
TTGGGAGGAAAAGAAAGAGAGAATACGCAAAGCCTCAGCATATGGCGGAT
CACCAGGCTGGGACCTGCGTTCAATCATTGTGAAGAGCGGTGATGATTGC
AGGCAGGAGCATCTTGCTGTGCAACTTGTTTATCATTTTTATGATATATT
CCAAGAAGCCGGTTTGCCGCTATGGTTGCGCCCATATGAAGTCCTGGTTA
CTTCCTCATACACAGCCCTAATTGAAACAATTCCAGATACGGCTTCAATT
CATGCTATTAAGAATCGGTTTCCCAGCATAACAAGTTTGCGTGACTTCTT
CATAGCCAAATATGGAGAAAATTCTTCCAGTTTCAAGCTTGCCCAGAGAA
ATTTTGTTGAGAGCATGGCTGGATATTCTATATTATGCTACCTTTTACAG
GTCAAGGATCGACACAATGGAAACCTCTTGATGGATGAAGACGGGCATAT
CATTCATATAGATTTTGGTTTTCTGCTTTCTAATTCGCCTGGGGGTGTGA
ATTTTGAGAGTGCTCCATTTAAGTTAACGCGTGAACTTCTTGAGGTGATG
GATTCTGATGCAGAGGGAATTCCCAGCGAGTTTTTCAACTATTTCAAAGT
GTTATGCATACAAGGTTTCCTCACTTGTCGTAAGCATGCTGAGCGCATCA
TACTTCTTGTTGAAATGCTGCAGGACTCTGGTTTCCCGTGCTTCAAAGGT
GGCCCACGGACAATACAGAACTTGAGGAAAAGGTTCCATTTAAGCCTAAC
AGAAGAGCAATGTGTCTCCTTGGTGCTCTCCTTGATAAGTAGCAGCTTAG
ATGCATGGCGTACAAGGCAATATGATTATTACCAAAGGGAACAATTGATG
ATTTGCCGCAAGCGTTTAGAGACAGCAGAGTGCAGAGCAGACTCTCTCTC
CCTCTCTCTCTCTCTCTCTCTCTATCTTTTATTTTCTCATTCGTCCTTAT
CTCGCGATCTTCTACTTTTGCCAGGGTCTCACCGGCACGCCAAATGTCTT
TATATCTCAGCAACAAATATTTGTACTTTGTTCATTGTGATTTTTGTTTT
TTGGATCGCGATAGGAATTCGTTTTCATCCAACCGATGTTGAGCTGGTTA
TGTACTACCTAAAAAGAAAGGTCATGGGGATACAGTTTCCTTTTGAAGTT
ATTTCTGAGATAGACTTGTACAAATTTGAACCTTGGGATCTTCCAGAAAT
GTCTTGTTTGAAAAGCAGAGATCTGGTGTGGTTTTTCTTTTGTTCTCCAG
ATAAGAAATATGCCACTGGGTTGAGGAAAAAACGTGTCACTGATATTGGA
TTCTGGAAAGTTACTGGAAATGATACCCCCATCTTTTATGATTCGCGAAT
TGTGGGGATGAAAAGGAGTCTGGTATTCCATAGAGGCAAGGCAGGTCGTG
GAGATCGAACTGATTGGGTCATGCATGAGTATAGGCTTGAAGACAAGATG
CTGTCCGATGCAAGTATTTCTCAGGATGCATTTGTCCTATGCAAAATCTT
CGAAAAGAGTGGCCGAGGTTCCAAAAATGGGGAACAGTATGGGGCACCAT
TCAAAGAGGAAGATTGGAATGATGATGATGATGGTGAGGGCAATGATTCT
TTTATGCCTATTCCTTGTGCCGGCACAATCTCTCCTTCACCCAGGCCAGA
GGATGAGCAAAATGAGGAAATGATTTTGAGCGCATTCAAGTCTGGGAATG
GACACAACTCGATGGCACGACCTTTGCCGCAGCAGTCCATGACTCCTGTC
GTCACTGAGCAGCATCCATCCTCTGTCGAACATGATGACATTCGCGAAAT
GTTTCTCAAAGTCACTGATGAGGATGGTGATACTTTAACTTCCAATAGAG
TTAGTGTTGATGAGAAGGTGGATTCAGCTGTCCCAAATAAAAGCATTGTT
CAAGATGCAGAAGATCATGAGATTTTCATGGGTTTAGAAGATATCACTGG
TAATGTAGTGCTGAATTCTAATGAACTGGACTGTCCCAATGAGAATATGC
AGTACCAAAGGCTGTCAAGATTCAGTGAAGGGCTGTATCTAGAGGATCTT
CAGGATCCAACGGAAGTTGGGGGGGCTTACCTGGAGTTTAAAGATCTTTG
TCACCCAATGGAACCCAATTTTCCTGGGCATGGAAGGTCTCATTGTCTTT
CTGTCCATTATGGCACACCAGTTTTGCCTGATCTTGGGGCAAGGGACAGT
TTGGGTGGCAGTTGGGAGGGTCAGGAACCCACATATGGCTCTGCTTCCTT
TTCAACTTGA
Sequences
Sequence
ATGGTGCGGCTCCTCGGATTGAACCGATCCGAAGCGGACGACTCGTCCCC
ACGAGAGATCACCCGGACGATCCCGACCGGCGAGAGCGGCAGCGGCGGCG
GCGAGAGCGGCTGGCTGATCCGATTCTTCGACTCGGCGTTCTTCTGCGAA
TGGATCGCCGTGAGCTATCTGTACAAGCACGACCACCCGGGCGTGCGGGA
CTACCTCTGCAATCGCATGTATACGCTTCCTCTCTCTGGCATCGAGAGCT
ACCTCTTTCAGATTTGTTACATGCTCGTCCACAAGCCCAGCCCTTCGCTT
GACAAGTTCGTGATCGATGTCTGCTCAAAATCCCTCCAAATTGCCCTCAA
AGTGCATTGGTTTCTGATGGCGGAGCTCGAAGACTGCGATGAGGACAATG
AAGGCATCAGCAGAATCCAAGAGAAGTGCCAGATCGCCGCCACGCTTATG
GGCGAGTGGCCTCCACTTGTTCGCCCGCCCGCACCTGCCACCGCAGATAG
TTCCAAGAGTCGCCCGGTTCTCAATCGGATTCTATCGTCGAAGCAGAGGT
TGCTGTCGTTGGCCTCGTCGGTGTCGCCGCCCCGGTCCGTGTCTTTAACC
TCGCCACCACCGGGTAATCACCCATTGCAGGAGGATGGAAGTGGCAATAA
GCTCACCCCAGATGATAACAAGCTGTTTAAGAAGCTTATACCGGGTACAA
AGGTGAGGGATGCCCTGTTCTTCCGAAAATCGGTCGATAAAGAGGAGGAG
GGCTCGGATAAAGATGGGTTCTTTAAGAGGCTTATGAGGGACAGTAAGGA
TGAGGAGGAAGAGCTTTCGGCTAGCTCCGAAGGGTTTTTCAAGCGGTTGT
TTCGAGATAACAAGAGCGATTTGGATGACAAAAGCGGTGGTGGGGGTGGG
GCGAAGGCGGGGGAAGTGGATGAGAAGGAGGGGTTCTTTCGAAGGTTATT
TAAGGATAAGCATGATGAGAAGAAAGAGGAAAATGAGAGGACTGACGATG
AAGAGAAGATGAATGGGGTGTGTGAGGAAGAGGAGCATTCTGAGTTTTTG
TCATTGAGGAGGTTGTTTAGGGTGCATCCTGAAGATGTGAAGACTCCATT
GCCAAGTGAAAACGGCATTGCGGGTAGCCCATTTGAAAGCAGTCCAGGAA
CAGAGAGCTTCTTCCGCAGGCTGTTTAGAGACCGAGACAGGTCAATGGAA
GACTCCGAGCTGTTTGGTTCAAAGAAGCAGAAAGAGAAGCGTCCTGGATC
ACCCAAGCAACGGAATGAGAAGTCGTACTCCAAACCTCCATTGCCCAGTA
ATGTCATGTCTCAGATTCGCAAAGGAACATATCATGTTTCATTGGACTTT
GTTCAGTCATTATGTGAGACATCGTATGGTTTGGTGGACATATTTCCTAT
TGAAGATCGCAAAAGTGCCCTTCGTGAGTCTCTTGTAGAGATCAATTCCC
ATATTGCCGCTGCTCAAAACAGTGGAGGAGTGTGCTTTCCAATGGGGAAG
GGGATGTATAGAGTGGTTCACATACCTGAAGATGAAGCAGTTCTTCTGAA
TTCTAGGGAGAAAGCGCCTTATCTTATATGCGTCGAGGTTTTGAAAGGTG
AAATCCCAAGCCAGACAAAAGAGACATCAGATGCTCAAAAACTTTCTCGA
GGAGGGATTCCTTTAGCAAATGGAGATGTGCAGTTGCCGAAGCCTCCTCC
TTGGGCATATCCTTTGTCGAGTGCACAGGATACTCACTATAATGGTTCTG
ATAGAATGTCAAGATCTGCTTCTCAAGCTATTGATCAGGCAATGGCTCAT
ATATGGGACGCCAAAGTAAAATTTGTTCTTGTGACTCTTTCGGTAGAGAA
GCAACCTGTTGATGACCTTCAGGGTAGTGAAGATCATGATATGGGATGGG
TGAGTGTCTTTTTGTCAGCAGATGCTGGGGTCAAGATGGAAGACATAGAG
GATCAAGTGCCACGTCGAAAGGAACATCGTCGTGTTCCAAGCACAATTGC
TATAGAGAATGTAAAGGCTGCAGCAGCAAAAGGAGAGGCGCCTGTTGGTC
TCCCTTTAAAAGGGGCTGCTGGTCAGGGTTCGTCAGATTCACAATCAAAG
GTTATTAATGGTGGTGTTCCTAAGGCTAGTGATGCCTTATCTGGTGAACT
TTGGGAGGAAAAGAAAGAGAGAATACGCAAAGCCTCAGCATATGGCGGAT
CACCAGGCTGGGACCTGCGTTCAATCATTGTGAAGAGCGGTGATGATTGC
AGGCAGGAGCATCTTGCTGTGCAACTTGTTTATCATTTTTATGATATATT
CCAAGAAGCCGGTTTGCCGCTATGGTTGCGCCCATATGAAGTCCTGGTTA
CTTCCTCATACACAGCCCTAATTGAAACAATTCCAGATACGGCTTCAATT
CATGCTATTAAGAATCGGTTTCCCAGCATAACAAGTTTGCGTGACTTCTT
CATAGCCAAATATGGAGAAAATTCTTCCAGTTTCAAGCTTGCCCAGAGAA
ATTTTGTTGAGAGCATGGCTGGATATTCTATATTATGCTACCTTTTACAG
GTCAAGGATCGACACAATGGAAACCTCTTGATGGATGAAGACGGGCATAT
CATTCATATAGATTTTGGTTTTCTGCTTTCTAATTCGCCTGGGGGTGTGA
ATTTTGAGAGTGCTCCATTTAAGTTAACGCGTGAACTTCTTGAGGTGATG
GATTCTGATGCAGAGGGAATTCCCAGCGAGTTTTTCAACTATTTCAAAGT
GTTATGCATACAAGGTTTCCTCACTTGTCGTAAGCATGCTGAGCGCATCA
TACTTCTTGTTGAAATGCTGCAGGACTCTGGTTTCCCGTGCTTCAAAGGT
GGCCCACGGACAATACAGAACTTGAGGAAAAGGTTCCATTTAAGCCTAAC
AGAAGAGCAATGTGTCTCCTTGGTGCTCTCCTTGATAAGTAGCAGCTTAG
ATGCATGGCGTACAAGGCAATATGATTATTACCAAAGGGAACAATTGATG
ATTTGCCGCAAGCGTTTAGAGACAGCAGAGTGCAGAGCAGACTCTCTCTC
CCTCTCTCTCTCTCTCTCTCTCTATCTTTTATTTTCTCATTCGTCCTTAT
CTCGCGATCTTCTACTTTTGCCAGGGTCTCACCGGCACGCCAAATGTCTT
TATATCTCAGCAACAAATATTTGTACTTTGTTCATTGTGATTTTTGTTTT
TTGGATCGCGATAGGAATTCGTTTTCATCCAACCGATGTTGAGCTGGTTA
TGTACTACCTAAAAAGAAAGGTCATGGGGATACAGTTTCCTTTTGAAGTT
ATTTCTGAGATAGACTTGTACAAATTTGAACCTTGGGATCTTCCAGAAAT
GTCTTGTTTGAAAAGCAGAGATCTGGTGTGGTTTTTCTTTTGTTCTCCAG
ATAAGAAATATGCCACTGGGTTGAGGAAAAAACGTGTCACTGATATTGGA
TTCTGGAAAGTTACTGGAAATGATACCCCCATCTTTTATGATTCGCGAAT
TGTGGGGATGAAAAGGAGTCTGGTATTCCATAGAGGCAAGGCAGGTCGTG
GAGATCGAACTGATTGGGTCATGCATGAGTATAGGCTTGAAGACAAGATG
CTGTCCGATGCAAGTATTTCTCAGGATGCATTTGTCCTATGCAAAATCTT
CGAAAAGAGTGGCCGAGGTTCCAAAAATGGGGAACAGTATGGGGCACCAT
TCAAAGAGGAAGATTGGAATGATGATGATGATGGTGAGGGCAATGATTCT
TTTATGCCTATTCCTTGTGCCGGCACAATCTCTCCTTCACCCAGGCCAGA
GGATGAGCAAAATGAGGAAATGATTTTGAGCGCATTCAAGTCTGGGAATG
GACACAACTCGATGGCACGACCTTTGCCGCAGCAGTCCATGACTCCTGTC
GTCACTGAGCAGCATCCATCCTCTGTCGAACATGATGACATTCGCGAAAT
GTTTCTCAAAGTCACTGATGAGGATGGTGATACTTTAACTTCCAATAGAG
TTAGTGTTGATGAGAAGGTGGATTCAGCTGTCCCAAATAAAAGCATTGTT
CAAGATGCAGAAGATCATGAGATTTTCATGGGTTTAGAAGATATCACTGG
TAATGTAGTGCTGAATTCTAATGAACTGGACTGTCCCAATGAGAATATGC
AGTACCAAAGGCTGTCAAGATTCAGTGAAGGGCTGTATCTAGAGGATCTT
CAGGATCCAACGGAAGTTGGGGGGGCTTACCTGGAGTTTAAAGATCTTTG
TCACCCAATGGAACCCAATTTTCCTGGGCATGGAAGGTCTCATTGTCTTT
CTGTCCATTATGGCACACCAGTTTTGCCTGATCTTGGGGCAAGGGACAGT
TTGGGTGGCAGTTGGGAGGGTCAGGAACCCACATATGGCTCTGCTTCCTT
TTCAACTTGA
Sequence Length
4410