mRNA_H-paniculata_contig30021.8153.1 (mRNA) Halopteris paniculata Hal_grac_a_UBK monoicous

You are viewing an mRNA, more information available on the corresponding polypeptide page

Overview
NamemRNA_H-paniculata_contig30021.8153.1
Unique NamemRNA_H-paniculata_contig30021.8153.1
TypemRNA
OrganismHalopteris paniculata Hal_grac_a_UBK monoicous (Halopteris paniculata Hal_grac_a_UBK monoicous)
Homology
BLAST of mRNA_H-paniculata_contig30021.8153.1 vs. uniprot
Match: A0A699HZ53_TANCI (Putative reverse transcriptase domain-containing protein n=1 Tax=Tanacetum cinerariifolium TaxID=118510 RepID=A0A699HZ53_TANCI)

HSP 1 Score: 62.8 bits (151), Expect = 1.090e-8
Identity = 44/147 (29.93%), Postives = 77/147 (52.38%), Query Frame = 1
Query:    1 RPICAGSKMRRTLAAVVVRQYRPKLEEVNLSERQYGVAVSGGAELM-----GLRAKTHHQLGHWLIALDCTNVFNSVKWATILEEVAIRTPRLTPFVVNCYGEKPADINIQMGTGERRKISSNTGIHQGDGLGPALLCMLVGPILRK 426
            RPI  G+  RR ++ V ++    ++ +  LS+ Q+GV VSGGAE +      + ++ H+     ++ +DC+N FN V  + +L EV+ + P ++ +V   YG+      + +G      I S T + Q D LGP    +++ P L K
Sbjct:  232 RPIAVGTIWRRLVSKVAMKGMGKEMLKY-LSDFQFGVGVSGGAEAILHSVNRVLSEYHNDGSLAMLIVDCSNAFNLVDRSALLHEVSAKCPSISLWVDFLYGKAS---RLYIGD---THIWSATEVQQCDPLGPLFFALILHPFLHK 371          
BLAST of mRNA_H-paniculata_contig30021.8153.1 vs. uniprot
Match: A0A2U1QGS1_ARTAN (Reverse transcriptase domain-containing protein n=1 Tax=Artemisia annua TaxID=35608 RepID=A0A2U1QGS1_ARTAN)

HSP 1 Score: 59.3 bits (142), Expect = 1.320e-7
Identity = 40/119 (33.61%), Postives = 66/119 (55.46%), Query Frame = 1
Query:   88 LSERQYGVAVSGGAELM------GLRAKTHHQLGHWLIALDCTNVFNSVKWATILEEVAIRTPRLTPFVVNCYGEKPADINIQMGTGERRKISSNTGIHQGDGLGPALLCMLVGPILRK 426
            LS+ Q+GV VSGGAE +      GL ++ H+     ++ +D +N FN V  + +L EV +R P ++ +V   YG+       ++  G+   I S TG+ QGD LGP L  +++  ++ K
Sbjct:   12 LSDFQFGVGVSGGAEAVLHSVNRGL-SEYHNDGSFAMLTVDFSNAFNLVDRSALLYEVRVRCPSISLWVDFLYGQA-----ARLYIGDTH-IWSATGVQQGDPLGPLLFALVLHRLVHK 123          
BLAST of mRNA_H-paniculata_contig30021.8153.1 vs. uniprot
Match: A0A6L2L3L9_TANCI (Putative reverse transcriptase domain-containing protein n=1 Tax=Tanacetum cinerariifolium TaxID=118510 RepID=A0A6L2L3L9_TANCI)

HSP 1 Score: 53.9 bits (128), Expect = 1.350e-5
Identity = 37/118 (31.36%), Postives = 62/118 (52.54%), Query Frame = 1
Query:   88 LSERQYGVAVSGGAELM-----GLRAKTHHQLGHWLIALDCTNVFNSVKWATILEEVAIRTPRLTPFVVNCYGEKPADINIQMGTGERRKISSNTGIHQGDGLGPALLCMLVGPILRK 426
            LS+ Q+GV VSGGAE +      + ++ H+     ++ +D +N FN V  + +L EV ++ P ++ +V   YG+      + +G      I S TG+ QGD L P L  +++   L K
Sbjct:  392 LSDFQFGVRVSGGAEAILHSVNRVLSEYHNDGSLAMLIMDFSNAFNLVDRSALLHEVRVKCPSISLWVDLLYGQAS---RLYIGD---THIWSATGVQQGDPLRPLLFALILHLQLHK 503          
BLAST of mRNA_H-paniculata_contig30021.8153.1 vs. uniprot
Match: A0A813L8P4_POLGL (Hypothetical protein n=1 Tax=Polarella glacialis TaxID=89957 RepID=A0A813L8P4_POLGL)

HSP 1 Score: 51.6 bits (122), Expect = 8.210e-5
Identity = 43/147 (29.25%), Postives = 64/147 (43.54%), Query Frame = 1
Query:    1 RPICAGSKMRRTLAAVVVRQYRPKLEEVNLSERQYGVAVSGG--AELMGLRA---KTHHQLGHWLIALDCTNVFNSVKWATILEEVAIRTPRLTPFVVNCYGEKPADINIQMGTGERRKISSNTGIHQGDGLGPALLCMLVGPILRK 426
            RPI  G  +RR +   +    + + +       Q GVA   G  A +   RA   ++       L+ LD  N FN V  + +LE+     P L  +   CY  +P+ +     T     ISS TG+ QGD LGP L    + PI+ +
Sbjct:    9 RPIAIGEVLRRIVGKCLCASVKEEAKRF-FHPSQVGVACPAGIDAAVHSARAWKNRSAADTSKALLKLDFANAFNCVSRSQVLEQTRRHFPSLARWSQWCYS-RPSKLVFGSYT-----ISSETGVQQGDPLGPLLFSAAIQPIVEQ 148          
The following BLAST results are available for this feature:
BLAST of mRNA_H-paniculata_contig30021.8153.1 vs. uniprot
Analysis Date: 2022-09-19 (Diamond blastx: OGS1.0 vs UniRef90)
Total hits: 4
Match NameE-valueIdentityDescription
A0A699HZ53_TANCI1.090e-829.93Putative reverse transcriptase domain-containing p... [more]
A0A2U1QGS1_ARTAN1.320e-733.61Reverse transcriptase domain-containing protein n=... [more]
A0A6L2L3L9_TANCI1.350e-531.36Putative reverse transcriptase domain-containing p... [more]
A0A813L8P4_POLGL8.210e-529.25Hypothetical protein n=1 Tax=Polarella glacialis T... [more]
back to top
Alignments
The following features are aligned
Aligned FeatureFeature TypeAlignment Location
H-paniculata_contig30021contigH-paniculata_contig30021:2104..2535 +
Analyses
This mRNA is derived from or has results from the following analyses
Analysis NameDate Performed
Diamond blastx: OGS1.0 vs UniRef902022-09-19
OGS1.0 of Halopteris paniculata Hal_grac_a_UBK monoicous2021-02-24
Properties
Property NameValue
Taxonomic scopeOpisthokonta
Seed ortholog score62.8
Seed ortholog evalue1.5e-07
Seed eggNOG ortholog400682.PAC_15701845
Hectar predicted targeting categoryother localisation
EggNOG free text desc.Reverse transcriptase (RNA-dependent DNA polymerase)
EggNOG OGs39QPF@33154,KOG1075@1,KOG1075@2759
COG Functional cat.S
Best tax levelOpisthokonta
Best eggNOG OGNA|NA|NA
Exons1
Model size432
Cds size408
Stop1
Start1
Relationships

The following UTR feature(s) are a part of this mRNA:

Feature NameUnique NameSpeciesTypePosition
1622929922.5885181-UTR-H-paniculata_contig30021:2103..21271622929922.5885181-UTR-H-paniculata_contig30021:2103..2127Halopteris paniculata Hal_grac_a_UBK monoicousUTRH-paniculata_contig30021 2104..2127 +
1691481071.1120229-UTR-H-paniculata_contig30021:2103..21271691481071.1120229-UTR-H-paniculata_contig30021:2103..2127Halopteris paniculata Hal_grac_a_UBK monoicousUTRH-paniculata_contig30021 2104..2127 +


The following CDS feature(s) are a part of this mRNA:

Feature NameUnique NameSpeciesTypePosition
1622929922.6054146-CDS-H-paniculata_contig30021:2127..25351622929922.6054146-CDS-H-paniculata_contig30021:2127..2535Halopteris paniculata Hal_grac_a_UBK monoicousCDSH-paniculata_contig30021 2128..2535 +
1691481071.1235778-CDS-H-paniculata_contig30021:2127..25351691481071.1235778-CDS-H-paniculata_contig30021:2127..2535Halopteris paniculata Hal_grac_a_UBK monoicousCDSH-paniculata_contig30021 2128..2535 +


The following polypeptide feature(s) derives from this mRNA:

Feature NameUnique NameSpeciesTypePosition
mRNA_H-paniculata_contig30021.8153.1prot_H-paniculata_contig30021.8153.1Halopteris paniculata Hal_grac_a_UBK monoicouspolypeptideH-paniculata_contig30021 2128..2535 +


Sequences
The following sequences are available for this feature:

protein sequence of mRNA_H-paniculata_contig30021.8153.1

>prot_H-paniculata_contig30021.8153.1 ID=prot_H-paniculata_contig30021.8153.1|Name=mRNA_H-paniculata_contig30021.8153.1|organism=Halopteris paniculata Hal_grac_a_UBK monoicous|type=polypeptide|length=136bp
MRRTLAAVVVRQYRPKLEEVNLSERQYGVAVSGGAELMGLRAKTHHQLGH
WLIALDCTNVFNSVKWATILEEVAIRTPRLTPFVVNCYGEKPADINIQMG
TGERRKISSNTGIHQGDGLGPALLCMLVGPILRKC*
back to top

mRNA from alignment at H-paniculata_contig30021:2104..2535+

Legend: UTRpolypeptideCDS
Hold the cursor over a type above to highlight its positions in the sequence below.
>mRNA_H-paniculata_contig30021.8153.1 ID=mRNA_H-paniculata_contig30021.8153.1|Name=mRNA_H-paniculata_contig30021.8153.1|organism=Halopteris paniculata Hal_grac_a_UBK monoicous|type=mRNA|length=432bp|location=Sequence derived from alignment at H-paniculata_contig30021:2104..2535+ (Halopteris paniculata Hal_grac_a_UBK monoicous)
CGCCCGATCTGCGCAGGATCTAAGATGCGGCGTACTTTGGCCGCTGTGGT GGTCAGGCAATACAGACCGAAACTGGAGGAGGTTAACTTGTCGGAGCGGC AGTACGGGGTAGCGGTCTCGGGTGGCGCGGAGCTCATGGGCCTCCGCGCG AAAACACACCACCAATTGGGTCATTGGCTTATCGCCCTCGACTGTACCAA TGTCTTCAACTCCGTCAAGTGGGCGACGATCTTGGAAGAAGTGGCAATCC GCACCCCGAGACTGACACCTTTCGTTGTCAACTGCTACGGGGAGAAGCCG GCAGATATAAATATCCAGATGGGTACCGGCGAACGCAGAAAAATTTCCTC GAACACGGGAATTCACCAGGGCGATGGACTAGGACCCGCCCTCTTGTGCA TGCTCGTGGGACCAATCTTGCGCAAGTGCTGA
back to top

Coding sequence (CDS) from alignment at H-paniculata_contig30021:2104..2535+

>mRNA_H-paniculata_contig30021.8153.1 ID=mRNA_H-paniculata_contig30021.8153.1|Name=mRNA_H-paniculata_contig30021.8153.1|organism=Halopteris paniculata Hal_grac_a_UBK monoicous|type=CDS|length=816bp|location=Sequence derived from alignment at H-paniculata_contig30021:2104..2535+ (Halopteris paniculata Hal_grac_a_UBK monoicous)
ATGCGGCGTACTTTGGCCGCTGTGGTGGTCAGGCAATACAGACCGAAACT
GGAGGAGGTTAACTTGTCGGAGCGGCAGTACGGGGTAGCGGTCTCGGGTG
GCGCGGAGCTCATGGGCCTCCGCGCGAAAACACACCACCAATTGGGTCAT
TGGCTTATCGCCCTCGACTGTACCAATGTCTTCAACTCCGTCAAGTGGGC
GACGATCTTGGAAGAAGTGGCAATCCGCACCCCGAGACTGACACCTTTCG
TTGTCAACTGCTACGGGGAGAAGCCGGCAGATATAAATATCCAGATGGGT
ACCGGCGAACGCAGAAAAATTTCCTCGAACACGGGAATTCACCAGGGCGA
TGGACTAGGACCCGCCCTCTTGTGCATGCTCGTGGGACCAATCTTGCGCA
AGTGCTGAATGCGGCGTACTTTGGCCGCTGTGGTGGTCAGGCAATACAGA
CCGAAACTGGAGGAGGTTAACTTGTCGGAGCGGCAGTACGGGGTAGCGGT
CTCGGGTGGCGCGGAGCTCATGGGCCTCCGCGCGAAAACACACCACCAAT
TGGGTCATTGGCTTATCGCCCTCGACTGTACCAATGTCTTCAACTCCGTC
AAGTGGGCGACGATCTTGGAAGAAGTGGCAATCCGCACCCCGAGACTGAC
ACCTTTCGTTGTCAACTGCTACGGGGAGAAGCCGGCAGATATAAATATCC
AGATGGGTACCGGCGAACGCAGAAAAATTTCCTCGAACACGGGAATTCAC
CAGGGCGATGGACTAGGACCCGCCCTCTTGTGCATGCTCGTGGGACCAAT
CTTGCGCAAGTGCTGA
back to top