Summary
Resource Type
mRNA
Organism
Persea americana-Anise
Name
Chr05.g43214.m1
Identifier
Chr05.g43214.m1
Protein Sequence
MKLGFVQHTQEGEKRCLNSELWHACAGPLVSLPAIGSRVVYFPQGHSEQV
AASTNKEVDTHIPNYPGLPPQLICQLHNVTMHADVETEEVYAQMTLQPLS
QQEQKDAYFPAELGNLGKQPTNYFSKTLTASDTSTHGGFSVPRRAAEKVF
PPLDFSQQPPAQELIARDLHDNEWKFRHIFRGQPKRHLLTTGWSVFVSAK
RLVAGDSVLFIWNEKNQLLLGIRRANRSQTFMPSSVLSSDSMHIGLLAAA
AHAAATNSRFTIFYNPRASPSEFIIPLAKYVKAVYHTRVSVGMRFRMLFE
TEESSVRRYMGTITGVSDLDPVRWPNSHWRSVKVGWDESTAGERQPRVSL
WEIEPLTTFPVYPTSFPLRLKRPWPPGLPSLYGGKDDDLGLNSPVMWLRD
GGNQGIQSLSFQGHGVTPWMQPRFDVASLGLHPDVYQGVAAAALKEMRGV
DPLKQASSSLLQFQQPSIPDGSTYLSPSQILQQSQAQLPQSFLHTIQENQ
PPAQSHSHLLQHHLQLHHPINDQQQILQHQQQHQQQPPHHYSDQQQLVHT
MSTFSQVVSASQPQKPSLQAISSTPQPPNLPETNGNPVITSTLSPLHSIL
GDEASSLHFPRNSPLVPSATWLPRRVAFESMLHSGTQCVTPQVDQLDLGP
LQPIVPQHSISLPPFPGRECPVDQEGSTDPQNNLLFGVNIDTPSLLIQNN
MSSLAGVGDESDESDMPLAASNIMRSTGDDYLLNTEITTSSCLDESGLLQ
SPNNGGHRNPPNRTFVKVYKSGSLGRSLDITRFSSYNELRGELARMFGLQ
GQLEDPPRSGWQLVFVDRENDVLLLGDDPWQEFLSSVWCIKILSPQEMHQ
MGKHDSELLNSIPIQRLSNNSCDDYVSRHGSRNLSTGIASEGL*
Properties
Coding Sequence (CDS)
ATGAAGCTCGGTTTTGTGCAGCACACGCAGGAAGGAGAAAAGCGGTGCCT
GAATTCTGAGCTTTGGCATGCATGTGCTGGCCCTCTTGTATCTTTGCCTG
CCATTGGAAGCCGCGTAGTCTACTTCCCACAAGGTCATAGTGAGCAGGTT
GCTGCATCAACGAACAAGGAAGTCGATACCCACATACCTAATTACCCAGG
CTTACCTCCCCAGTTGATCTGTCAGCTGCACAATGTTACCATGCATGCAG
ATGTGGAGACAGAGGAAGTTTATGCTCAAATGACCTTGCAACCACTGAGC
CAGCAAGAGCAAAAGGATGCCTACTTCCCTGCCGAACTGGGTAACCTCGG
CAAGCAGCCAACCAATTATTTTTCTAAGACACTCACTGCAAGTGATACTA
GTACTCATGGGGGATTCTCTGTTCCTCGTCGAGCTGCTGAAAAAGTGTTT
CCTCCATTGGACTTCTCTCAGCAACCTCCTGCCCAAGAGTTGATTGCAAG
AGATCTTCACGACAATGAATGGAAATTTCGACATATTTTTCGCGGCCAGC
CTAAGCGTCATCTTCTCACAACTGGTTGGAGTGTGTTTGTAAGTGCAAAG
AGGCTTGTTGCGGGTGATTCAGTTCTTTTTATCTGGAATGAAAAGAATCA
GTTACTCCTTGGAATCCGGCGTGCTAATCGGTCTCAGACTTTCATGCCTT
CATCGGTTCTATCAAGTGATAGCATGCACATAGGGTTACTTGCAGCAGCA
GCTCATGCTGCAGCAACAAATAGTCGTTTCACTATATTCTATAACCCAAG
GGCAAGTCCATCAGAATTTATCATACCACTGGCCAAATATGTTAAAGCAG
TCTACCACACCCGTGTTTCTGTTGGCATGCGCTTTCGAATGCTGTTTGAA
ACAGAAGAGTCAAGTGTTCGCCGGTACATGGGCACAATTACTGGCGTAAG
TGACTTAGATCCTGTTCGTTGGCCAAATTCTCATTGGCGCTCTGTAAAGG
TTGGTTGGGATGAGTCAACAGCAGGAGAAAGGCAACCAAGAGTATCACTA
TGGGAGATTGAGCCTTTAACGACATTCCCAGTGTACCCAACTTCATTTCC
TCTCAGGCTAAAGCGACCATGGCCGCCAGGACTGCCATCTCTATATGGTG
GCAAGGATGATGACCTGGGGCTGAATTCTCCTGTAATGTGGCTTCGAGAT
GGTGGAAACCAGGGGATTCAATCTCTAAGTTTCCAGGGTCATGGAGTCAC
ACCCTGGATGCAACCAAGGTTTGATGTTGCTTCGCTCGGTCTCCATCCAG
ATGTGTATCAAGGAGTGGCTGCAGCAGCACTCAAGGAGATGAGGGGTGTG
GACCCTTTGAAGCAGGCATCATCATCTCTTTTGCAATTCCAGCAACCTTC
CATTCCCGACGGATCCACTTATCTATCACCAAGTCAGATTTTGCAGCAAT
CCCAAGCACAATTACCACAATCATTTCTTCACACGATTCAAGAAAACCAA
CCACCGGCCCAGTCTCACTCTCATCTTCTTCAGCATCACTTGCAGCTTCA
CCACCCAATTAATGATCAACAGCAAATACTGCAGCATCAGCAGCAGCATC
AACAACAACCACCACACCATTATTCTGATCAGCAACAGCTCGTTCACACA
ATGTCGACCTTTTCTCAGGTTGTCTCAGCTTCTCAGCCCCAAAAACCATC
TTTGCAGGCCATATCTTCAACGCCCCAGCCACCAAACTTGCCAGAAACCA
ATGGAAATCCTGTTATCACATCTACTTTGTCTCCCTTACATAGCATTTTG
GGGGATGAAGCATCCTCTCTTCACTTTCCAAGAAACAGTCCATTGGTCCC
TTCGGCTACCTGGTTGCCCAGGAGAGTTGCTTTTGAATCGATGCTTCATT
CCGGAACTCAGTGTGTTACGCCCCAGGTTGATCAGTTGGACTTGGGTCCA
CTTCAGCCTATTGTCCCACAACATTCTATCTCATTACCACCATTTCCTGG
AAGAGAGTGCCCGGTTGACCAAGAAGGCAGTACAGATCCCCAGAATAATC
TTCTATTCGGGGTTAACATTGACACTCCATCCCTCTTAATACAGAACAAT
ATGTCAAGCCTCGCAGGTGTTGGTGACGAATCTGATGAATCAGACATGCC
GTTAGCAGCTTCCAATATTATGAGATCCACGGGAGATGATTATCTGCTGA
ACACCGAAATAACCACATCCAGTTGTCTAGATGAATCAGGTTTATTGCAG
TCGCCAAACAATGGGGGCCATAGAAACCCACCAAACAGAACCTTTGTGAA
GGTTTACAAGTCGGGGTCCTTAGGAAGATCACTGGATATCACCAGGTTTA
GCAGCTACAATGAGCTGCGTGGTGAGCTTGCACGTATGTTTGGCCTTCAA
GGCCAATTAGAGGATCCACCGAGATCAGGCTGGCAGCTTGTATTCGTTGA
CCGAGAGAATGATGTTCTTCTCCTCGGTGATGACCCCTGGCAGGAGTTTT
TAAGCAGCGTTTGGTGTATTAAAATACTATCACCCCAAGAAATGCACCAG
ATGGGCAAACATGACTCCGAGCTTCTGAATTCAATCCCAATCCAAAGGCT
TTCTAACAACAGTTGCGATGACTATGTGAGCCGACACGGATCAAGAAATT
TGAGTACCGGGATTGCATCTGAGGGTCTGTAG
Sequences
Sequence
AGTTCAAGTTCAAGTTCATAGGCCGATAGCTGTTTCGACCCTGCACTGTA
CATTTCACTCAAATACTCGAATTATACTTACTCCCTTTCCACTCTCATCA
CGAGTATAAGCTATAAAAACACCAAACACTCGCAAAAATTAATGGCGGTT
TTATCGATTGATTGCACGAGAGAAAAGGAGAGAAGGAAAGAGAATCAACG
ACTGCTCTCTCTCTCTCTCTCTCTTCCTGGAATTCGAAGCTACACAATTC
AATCGAAATCCCAGCTGCAATCTTTCGAAAAAGCTCTCCAAATTCTCTTA
TTCTTCCGAATCCCGAATTCGCACTGCGGATTCTAAATCTCTCGCGGCAA
TTCGAAGCATTTAGGGTTCATACGATGGAATCTCTCAATCGATGAAGCTT
GAGTTTGGTATTTTAGTTGAATCGTGCGACGAGGTCGGAAGAGCTTTGAA
GCAGCGACATAGGATGGAATCTCTGTGTTGCTGGAATTGGAAGCTACACA
AGGCAGCGATCGGAAACGAAAACGAAATCGAAATCTAAGTCTCAGCTCCG
ATCTTTCAAAAAAAGCTCTCCAAACTCGCTTGAATCCTTCATCTGAGGAC
GAATCCGCACTGTAAATTCTAGCATCTTGTTATGGTGATTACGACGGAAT
CTCTCGGGTGCTGAGACTCGACTGATGTATTTTTAGTTGAAGCGCGCGAT
TTTCAAGGTCAGAAAAGCTTTGATTGCATATTTTGACCGTTTCTGTTGAA
AAAGGGGCTTTTTGAAAGTTGTTTCTTGAGATCGGTGAGGTTTTTAAGAT
TTGGAGTGCGCATTTTTGTGGAGGAGCTTTGTGGTTTTAGCTGATGGAGA
TCGTTGCGTGGGGATAGACCTAGAATCTTCGGTTTTTGAGTGGATGTTTT
GAGAAACACGTGCTTTTGTTGGTTTGGAGGTTGGTGGAGGAGGGTTGGGA
ATTTGGAGCTTGTAGCTATTTTTCATGTTTCCGAATTGGCAATTCTGAGC
GGAAGATGCCCATGGTCTCGATTTCTGCTCATTTTTCTTTCTCTGATTCG
ATGAGGTATTGACCTTTTGATACCTTTATATTGCTGTGAAATTTGAAGAT
ATAGGAACTATGGTGATCTTCTTTTCCGCTACCAAGCTAAGGCGGAAGAC
TGTAATTGAAGTCTCCATTTGAAGACTGGCATGATAGGGCTTGTAGTGGC
GAATATCTGGACCTGGGCCGGATGAAGCTGAAAACTAGTGTTTCTTGCAG
CGGATTCGGTTTTGGGTGAGGGTTTGAACGGGGGCTGGGGTGCTGGTTTT
TTTACAGCACTAGTGTTTCTTGCAGTGGATAAGAGTTTTGCTGGGTTTTT
TTTGTGGAGTGCTGTTGGTGGAAATGGTGGGCCTAATTGTCACAGGATTG
GAGGAATAGTCTCTGATTTTATTGGAGTTGATGGTGACAATAAGGGGTTG
GTAAAGGCAAGGTAATCTTTTCTTGGAGGAGAGGTTAAGAAGACAGTTCG
ATGTTGGGCGCGGATTTAGCCGCTCTCAAAAGTGTTTGCCTGTCAGTGAG
GCTAAACTATTAGGACTTGGTTTTGGTGTCCCTCAATTTGCATTCCTTGC
GCGGTCCGTTCGTAATCCCCACAAATGAAGCTCGGTTTTGTGCAGCACAC
GCAGGAAGGAGAAAAGCGGTGCCTGAATTCTGAGCTTTGGCATGCATGTG
CTGGCCCTCTTGTATCTTTGCCTGCCATTGGAAGCCGCGTAGTCTACTTC
CCACAAGGTCATAGTGAGCAGGTTGCTGCATCAACGAACAAGGAAGTCGA
TACCCACATACCTAATTACCCAGGCTTACCTCCCCAGTTGATCTGTCAGC
TGCACAATGTTACCATGCATGCAGATGTGGAGACAGAGGAAGTTTATGCT
CAAATGACCTTGCAACCACTGAGCCAGCAAGAGCAAAAGGATGCCTACTT
CCCTGCCGAACTGGGTAACCTCGGCAAGCAGCCAACCAATTATTTTTCTA
AGACACTCACTGCAAGTGATACTAGTACTCATGGGGGATTCTCTGTTCCT
CGTCGAGCTGCTGAAAAAGTGTTTCCTCCATTGGACTTCTCTCAGCAACC
TCCTGCCCAAGAGTTGATTGCAAGAGATCTTCACGACAATGAATGGAAAT
TTCGACATATTTTTCGCGGCCAGCCTAAGCGTCATCTTCTCACAACTGGT
TGGAGTGTGTTTGTAAGTGCAAAGAGGCTTGTTGCGGGTGATTCAGTTCT
TTTTATCTGGAATGAAAAGAATCAGTTACTCCTTGGAATCCGGCGTGCTA
ATCGGTCTCAGACTTTCATGCCTTCATCGGTTCTATCAAGTGATAGCATG
CACATAGGGTTACTTGCAGCAGCAGCTCATGCTGCAGCAACAAATAGTCG
TTTCACTATATTCTATAACCCAAGGGCAAGTCCATCAGAATTTATCATAC
CACTGGCCAAATATGTTAAAGCAGTCTACCACACCCGTGTTTCTGTTGGC
ATGCGCTTTCGAATGCTGTTTGAAACAGAAGAGTCAAGTGTTCGCCGGTA
CATGGGCACAATTACTGGCGTAAGTGACTTAGATCCTGTTCGTTGGCCAA
ATTCTCATTGGCGCTCTGTAAAGGTTGGTTGGGATGAGTCAACAGCAGGA
GAAAGGCAACCAAGAGTATCACTATGGGAGATTGAGCCTTTAACGACATT
CCCAGTGTACCCAACTTCATTTCCTCTCAGGCTAAAGCGACCATGGCCGC
CAGGACTGCCATCTCTATATGGTGGCAAGGATGATGACCTGGGGCTGAAT
TCTCCTGTAATGTGGCTTCGAGATGGTGGAAACCAGGGGATTCAATCTCT
AAGTTTCCAGGGTCATGGAGTCACACCCTGGATGCAACCAAGGTTTGATG
TTGCTTCGCTCGGTCTCCATCCAGATGTGTATCAAGGAGTGGCTGCAGCA
GCACTCAAGGAGATGAGGGGTGTGGACCCTTTGAAGCAGGCATCATCATC
TCTTTTGCAATTCCAGCAACCTTCCATTCCCGACGGATCCACTTATCTAT
CACCAAGTCAGATTTTGCAGCAATCCCAAGCACAATTACCACAATCATTT
CTTCACACGATTCAAGAAAACCAACCACCGGCCCAGTCTCACTCTCATCT
TCTTCAGCATCACTTGCAGCTTCACCACCCAATTAATGATCAACAGCAAA
TACTGCAGCATCAGCAGCAGCATCAACAACAACCACCACACCATTATTCT
GATCAGCAACAGCTCGTTCACACAATGTCGACCTTTTCTCAGGTTGTCTC
AGCTTCTCAGCCCCAAAAACCATCTTTGCAGGCCATATCTTCAACGCCCC
AGCCACCAAACTTGCCAGAAACCAATGGAAATCCTGTTATCACATCTACT
TTGTCTCCCTTACATAGCATTTTGGGGGATGAAGCATCCTCTCTTCACTT
TCCAAGAAACAGTCCATTGGTCCCTTCGGCTACCTGGTTGCCCAGGAGAG
TTGCTTTTGAATCGATGCTTCATTCCGGAACTCAGTGTGTTACGCCCCAG
GTTGATCAGTTGGACTTGGGTCCACTTCAGCCTATTGTCCCACAACATTC
TATCTCATTACCACCATTTCCTGGAAGAGAGTGCCCGGTTGACCAAGAAG
GCAGTACAGATCCCCAGAATAATCTTCTATTCGGGGTTAACATTGACACT
CCATCCCTCTTAATACAGAACAATATGTCAAGCCTCGCAGGTGTTGGTGA
CGAATCTGATGAATCAGACATGCCGTTAGCAGCTTCCAATATTATGAGAT
CCACGGGAGATGATTATCTGCTGAACACCGAAATAACCACATCCAGTTGT
CTAGATGAATCAGGTTTATTGCAGTCGCCAAACAATGGGGGCCATAGAAA
CCCACCAAACAGAACCTTTGTGAAGGTTTACAAGTCGGGGTCCTTAGGAA
GATCACTGGATATCACCAGGTTTAGCAGCTACAATGAGCTGCGTGGTGAG
CTTGCACGTATGTTTGGCCTTCAAGGCCAATTAGAGGATCCACCGAGATC
AGGCTGGCAGCTTGTATTCGTTGACCGAGAGAATGATGTTCTTCTCCTCG
GTGATGACCCCTGGCAGGAGTTTTTAAGCAGCGTTTGGTGTATTAAAATA
CTATCACCCCAAGAAATGCACCAGATGGGCAAACATGACTCCGAGCTTCT
GAATTCAATCCCAATCCAAAGGCTTTCTAACAACAGTTGCGATGACTATG
TGAGCCGACACGGATCAAGAAATTTGAGTACCGGGATTGCATCTGAGGGT
CTGTAG
Sequence Length
4306