Summary
Resource Type
mRNA
Organism
Persea americana-Anise
Name
Chr01.g09931.m1
Identifier
Chr01.g09931.m1
Protein Sequence
MGSTSKTIVWFRRDLRIEDNPALAAAARDGCVLPVYIWCPKEEGQFYPGR
VSRWWLKQSLAQLDQTLRSLGSGLVLIKAETTLAALLRCIGAIGATRLVF
NHLYDPVSLVRDHNIKQQLVENGICVSSFNGDLLYEPWDVYDEKGRAFTT
FDAYWDKCMSMTIEPACLLPPWRLVPPAETVESCSIEELGLENEMEKSSN
ALLGKGWSPGWSNADKVLSEFVAHHLLNYSKNRLKVEGAATSLLSPYLHF
GELSVKKIFQCIRMKQISCTKEGNPVAEESVRLFLRAIGFREYSRYLCFN
FPFTHERSLMRNLRHFPWCANEGNFKAWRQGRTGYPLVDAGMRELWATGW
IHNRIRVIVSSFFVKFLLLPWTWGMKYFWDTLLDADLESDILGWQYISGS
LPDGHELDRLDSPQDQGCKFDPEGEYVRHWLPELARMPTEWIHHPWDAPR
SVLRASGVELGLNYPKPIVDINLARERLIDSISVMWESDTAARAAKLNGT
EEDVADNSNSMENQAIPRVVIKKDVSCASSAHDQRVPTLQKPKDGFYDQK
GLKASVLERENCVDLLGQVSKAGGSRKDEDLCSTAESSSVRKRSISESQC
VVPPSFSSSNGKYAVPLLASPSNGNQDNEGDCSNLDVQIESSSKRPWKEQ
STHQGFK*
Properties
Coding Sequence (CDS)
ATGGGTAGCACTTCTAAGACCATTGTTTGGTTTAGGAGGGACCTAAGGAT
TGAAGATAATCCTGCCTTAGCTGCCGCCGCTAGGGATGGATGTGTTCTTC
CTGTTTACATATGGTGTCCCAAAGAGGAAGGGCAATTCTACCCTGGCCGA
GTTTCAAGGTGGTGGCTGAAGCAATCTCTTGCCCAATTGGACCAGACCTT
GCGATCTCTTGGATCTGGTCTTGTCCTCATCAAAGCAGAGACTACTCTTG
CCGCTCTTTTGCGGTGCATCGGCGCTATTGGTGCAACCCGACTAGTCTTT
AACCATCTTTATGATCCTGTTTCGCTTGTCCGTGACCACAATATTAAACA
GCAACTGGTGGAGAATGGAATTTGTGTGAGCAGTTTTAATGGAGATTTAT
TGTATGAACCATGGGATGTATATGATGAAAAGGGTCGTGCTTTTACAACC
TTTGATGCATACTGGGACAAGTGCATGAGCATGACAATTGAACCGGCATG
TCTTCTTCCACCATGGAGATTGGTGCCACCAGCAGAAACTGTTGAGAGCT
GTTCGATTGAGGAATTGGGTCTTGAGAATGAAATGGAGAAATCTAGCAAT
GCATTGCTAGGTAAAGGATGGTCCCCGGGTTGGAGCAATGCAGATAAGGT
ACTATCAGAATTTGTGGCACATCATCTGCTCAACTATTCCAAGAACAGGC
TGAAGGTGGAGGGCGCCGCCACATCACTTTTGTCACCATATCTTCATTTT
GGAGAACTGAGTGTAAAAAAAATCTTCCAGTGCATACGAATGAAGCAGAT
ATCATGTACAAAAGAAGGGAACCCTGTCGCAGAAGAGAGCGTGAGACTCT
TCCTCAGAGCAATTGGTTTTCGAGAATATTCACGTTATCTTTGTTTTAAT
TTTCCCTTCACTCATGAAAGATCATTGATGAGAAACTTGAGGCATTTTCC
GTGGTGTGCCAATGAAGGTAATTTCAAGGCTTGGAGACAGGGTCGTACTG
GTTACCCATTAGTTGATGCAGGTATGAGAGAGCTATGGGCGACAGGATGG
ATACACAACAGAATCAGAGTAATTGTGTCAAGCTTTTTTGTAAAGTTCTT
GCTACTTCCTTGGACTTGGGGGATGAAATATTTTTGGGATACCTTATTGG
ATGCTGATCTAGAAAGTGACATCCTTGGTTGGCAGTACATCTCTGGCAGC
TTACCAGATGGGCATGAGCTTGACCGACTTGACAGCCCACAGGATCAAGG
ATGCAAATTTGATCCAGAGGGCGAATATGTGAGGCATTGGCTTCCTGAGC
TTGCAAGAATGCCAACTGAATGGATTCACCATCCGTGGGATGCTCCTAGA
TCTGTGCTGCGAGCATCAGGGGTGGAGTTGGGATTAAACTATCCAAAACC
TATTGTGGATATTAACTTGGCCAGAGAACGTTTGATAGATTCTATATCTG
TGATGTGGGAATCAGATACAGCTGCTAGAGCTGCTAAGTTGAATGGAACA
GAGGAAGACGTTGCTGACAATTCAAACAGTATGGAAAATCAAGCCATTCC
AAGGGTTGTCATTAAGAAGGATGTTTCTTGTGCTAGTTCAGCTCATGATC
AGAGAGTGCCCACATTACAGAAGCCCAAGGATGGTTTCTATGACCAAAAG
GGATTGAAAGCTTCGGTCCTTGAGAGAGAAAACTGTGTTGACTTACTTGG
TCAAGTCTCCAAAGCTGGGGGCTCACGGAAGGATGAAGATTTATGCTCTA
CAGCTGAATCTTCTTCAGTTAGGAAAAGAAGCATTAGTGAAAGCCAATGT
GTTGTTCCACCTTCATTTTCTTCATCAAATGGAAAATATGCTGTTCCACT
TTTGGCTTCTCCATCGAATGGAAATCAAGATAATGAGGGTGATTGTTCCA
ACCTCGATGTTCAGATTGAATCATCTTCGAAAAGACCATGGAAAGAACAA
TCAACACACCAAGGATTCAAATGA
Sequences
Sequence
AAAGAGACGAACAGTTGGCAGTAGGATAAAAAGTGGGGTTCTAGTTATAC
AGGCCAGACAGACTCAAAAGACTTTTATTTAAGACTTCTACAAGCCGGAC
AGGCTCTCCTTTTCAACTTTCCTGTAATAATAATTAATTAGTTTCTTTTG
ATTGATAGGGCCATAGGGTGAAGATGGGTGCATCTTGGGATCTAATCTAA
TTATGCTGACGCTGATGCTGATGCTGATGCTGCCGCTGATAGGTTTTCCA
TTGATTTTTTTTTTTTTTTTTTACCGAGGCAACTCAACTTTTAGATGGTT
TTGAGAGACTATTGATTTTGAGTGGGTGTGGGGGAATTGGTTTGGATGGA
AACACTTGTGTGTGCGGAGGATCTTTGGCTTTCGTTACTTTTTGATGAGT
CTCCTATAAAGACGATTTGCTTCCTCTTGATGATGCATGCTTTCTTTACT
TGGTAAGGTAAAGGTAATTCGGGCGATATTCGTTCTGCGATTCATTTCCG
GATACTTGCTGGAAGATGTTTGTTTGTTTGTTTTTTTTTATTTTGGAGAT
TTAGGGTTTCCATGTCCTGATCCTCTCGAGGCAATTAATTCCGGGGCCTT
TTGAGTGCTGGAGTTATATAGGATAAAGGTGCTGGCGAATCTCACTCTGA
TTGTGAATTGGGGCTTCGGAAGATGGCTGGGATTAATAATTTGGGTGGCA
TGTTGTAATGGTTTATGGTTTTAACTTGTTTGGCACCCATGTGAGCTTTC
TCGATGCTTTCCAACTTTTTGGTTGTGGCCTTCCTTATATACGAGTATTT
TGAGGGTAAATCAGAGGATCTGAAATAGTTAGGATCCAAGAGGCTGAATT
TTCAGAAGAAGAAGAAGAAAGAAGAAATGGGTAGCACTTCTAAGACCATT
GTTTGGTTTAGGAGGGACCTAAGGATTGAAGATAATCCTGCCTTAGCTGC
CGCCGCTAGGGATGGATGTGTTCTTCCTGTTTACATATGGTGTCCCAAAG
AGGAAGGGCAATTCTACCCTGGCCGAGTTTCAAGGTGGTGGCTGAAGCAA
TCTCTTGCCCAATTGGACCAGACCTTGCGATCTCTTGGATCTGGTCTTGT
CCTCATCAAAGCAGAGACTACTCTTGCCGCTCTTTTGCGGTGCATCGGCG
CTATTGGTGCAACCCGACTAGTCTTTAACCATCTTTATGATCCTGTTTCG
CTTGTCCGTGACCACAATATTAAACAGCAACTGGTGGAGAATGGAATTTG
TGTGAGCAGTTTTAATGGAGATTTATTGTATGAACCATGGGATGTATATG
ATGAAAAGGGTCGTGCTTTTACAACCTTTGATGCATACTGGGACAAGTGC
ATGAGCATGACAATTGAACCGGCATGTCTTCTTCCACCATGGAGATTGGT
GCCACCAGCAGAAACTGTTGAGAGCTGTTCGATTGAGGAATTGGGTCTTG
AGAATGAAATGGAGAAATCTAGCAATGCATTGCTAGGTAAAGGATGGTCC
CCGGGTTGGAGCAATGCAGATAAGGTACTATCAGAATTTGTGGCACATCA
TCTGCTCAACTATTCCAAGAACAGGCTGAAGGTGGAGGGCGCCGCCACAT
CACTTTTGTCACCATATCTTCATTTTGGAGAACTGAGTGTAAAAAAAATC
TTCCAGTGCATACGAATGAAGCAGATATCATGTACAAAAGAAGGGAACCC
TGTCGCAGAAGAGAGCGTGAGACTCTTCCTCAGAGCAATTGGTTTTCGAG
AATATTCACGTTATCTTTGTTTTAATTTTCCCTTCACTCATGAAAGATCA
TTGATGAGAAACTTGAGGCATTTTCCGTGGTGTGCCAATGAAGGTAATTT
CAAGGCTTGGAGACAGGGTCGTACTGGTTACCCATTAGTTGATGCAGGTA
TGAGAGAGCTATGGGCGACAGGATGGATACACAACAGAATCAGAGTAATT
GTGTCAAGCTTTTTTGTAAAGTTCTTGCTACTTCCTTGGACTTGGGGGAT
GAAATATTTTTGGGATACCTTATTGGATGCTGATCTAGAAAGTGACATCC
TTGGTTGGCAGTACATCTCTGGCAGCTTACCAGATGGGCATGAGCTTGAC
CGACTTGACAGCCCACAGGATCAAGGATGCAAATTTGATCCAGAGGGCGA
ATATGTGAGGCATTGGCTTCCTGAGCTTGCAAGAATGCCAACTGAATGGA
TTCACCATCCGTGGGATGCTCCTAGATCTGTGCTGCGAGCATCAGGGGTG
GAGTTGGGATTAAACTATCCAAAACCTATTGTGGATATTAACTTGGCCAG
AGAACGTTTGATAGATTCTATATCTGTGATGTGGGAATCAGATACAGCTG
CTAGAGCTGCTAAGTTGAATGGAACAGAGGAAGACGTTGCTGACAATTCA
AACAGTATGGAAAATCAAGCCATTCCAAGGGTTGTCATTAAGAAGGATGT
TTCTTGTGCTAGTTCAGCTCATGATCAGAGAGTGCCCACATTACAGAAGC
CCAAGGATGGTTTCTATGACCAAAAGGGATTGAAAGCTTCGGTCCTTGAG
AGAGAAAACTGTGTTGACTTACTTGGTCAAGTCTCCAAAGCTGGGGGCTC
ACGGAAGGATGAAGATTTATGCTCTACAGCTGAATCTTCTTCAGTTAGGA
AAAGAAGCATTAGTGAAAGCCAATGTGTTGTTCCACCTTCATTTTCTTCA
TCAAATGGAAAATATGCTGTTCCACTTTTGGCTTCTCCATCGAATGGAAA
TCAAGATAATGAGGGTGATTGTTCCAACCTCGATGTTCAGATTGAATCAT
CTTCGAAAAGACCATGGAAAGAACAATCAACACACCAAGGATTCAAATGA
AAGAGGAAGAATCAGATCTTGAGGTCTTTAACCTTCTAAAATCCATGAGG
CCTTGTAAGGGACCTCCATGATATCTGAGAAGATAAACTAGTAAGCAAGT
TTGTATATATATGTCACACTAACCTTGTAATCTTATATGACTCTTGCAAA
ATGGTCCAGTTATTTTTCATTAAAAGATGCTCACTCGGTGAGGCCCACTT
GAGTGCACGACGGTTAAGGGAGTCATGACGACGGATAGGCTCTGTTGTGG
ATCAAATGATCCTATACCTTAGTTTTAGGCCCTCGAAGTTTATTGGCTTT
GTGTCATGCAATATTATTGTGATAAAATCTAGCTGCAATTGGAGTCCAGA
TCAATGTCAAATTAAGATCGGAGC
Sequence Length
3224