mRNA_H-paniculata_contig34123.9116.1 (mRNA) Halopteris paniculata Hal_grac_a_UBK monoicous

You are viewing an mRNA, more information available on the corresponding polypeptide page

Overview
NamemRNA_H-paniculata_contig34123.9116.1
Unique NamemRNA_H-paniculata_contig34123.9116.1
TypemRNA
OrganismHalopteris paniculata Hal_grac_a_UBK monoicous (Halopteris paniculata Hal_grac_a_UBK monoicous)
Homology
BLAST of mRNA_H-paniculata_contig34123.9116.1 vs. uniprot
Match: A0A6H5L5H7_9PHAE (Reverse transcriptase domain-containing protein n=1 Tax=Ectocarpus sp. CCAP 1310/34 TaxID=867726 RepID=A0A6H5L5H7_9PHAE)

HSP 1 Score: 298 bits (763), Expect = 3.230e-87
Identity = 174/457 (38.07%), Postives = 252/457 (55.14%), Query Frame = 1
Query:    1 MKLGTLNINGVKGKLTQLQRLLEREDLACCALQETLLRPTDWRLKVPGYQSFSACGGNVASTRGVSLLVKKQFSAYTVGKGSAWHLLVRCFGSGLTQPWIVGTVYIPHRGTGDKPVGAILKDIAEVRRKYPNDSIAIMGDWNQTKNRVNKALAKKVDPELQINE--PRNAEFGTRNK-TNRCIDHIATLCNSTCETGRAA-ILRRVDLSDHFPVVCM-------VGCSNEVAPPLDLKTQSTRPRIDVRKLPRPETKKYCGKGPEGRTNHFNVIGSNYWAPLVDLLETQEDGWDKSEIQAKADASAEKLVSTCHTLANDYNLV-NPGTGGNQKLKSHIAKAIDQKEKTYERAMRTKLGSEKSQRRWKRYHQLRRKVKQLVKQDAKHRWARTLVKVSNQMVDDPREFWKWSSNLAGWRQATASYGVQPMCHPDSGELLTSVPHIRDAWAVHYGRLATD 1335
            +K+ TLNINGVK K  QLQR+L    + C ALQET L  TDW L VPGY++F+  G   +STRG ++L++ +  A TVGK S WH  VRC+                  G G  P+  +   + ++R KYPNDSI +MGD+N+ + RV +      +  +++ E   ++A+ GTR+  + R IDHI T      +T RA  +LR+VD+SDH+PVV             + V  P++ +T     RI+   +P P T  Y   GP GR NH  VI +NYW PL DL+E   +     +  A  DA+A ++V   H +A +     +  T     LK  IA+AID + + Y  A R +  S +++  W+RYH+ R K ++LV++D +  W + L   S Q+  DP+  W + S +AGW++  +S G+QP+ HPDS  LLTS   I  AW  HY RLA D
Sbjct:   33 LKVATLNINGVKSKKIQLQRVLAMYRINCIALQETTLTVTDWALNVPGYRTFAVYGERTSSTRGAAILLRNKMGAQTVGKSSPWHTFVRCY------------------GLGKVPLRTVRNQMRDLRVKYPNDSIILMGDFNRLRPRVEQWFNCAYES-IRVWELTGKDADLGTRDHGSKRVIDHIMTSLAHPQDTLRAPRVLRKVDISDHYPVVSTFRSDRADASTGDSVGVPINARTIQRGERINTGLIPMPGTHWYQESGPRGRANHQKVIHANYWEPLADLIEEGNEELSPEDTTALVDAAASRMVEASHQVARECGQTKDSSTQRAPALKPQIARAIDDRGRLYRAAKRLRKNSPRAKVAWERYHEARMKAERLVRKDRRRAWTKALCTASEQLRSDPKAAWHFMSAVAGWKRKDSSGGLQPVQHPDSRALLTSANDISAAWRTHYQRLAAD 470          
BLAST of mRNA_H-paniculata_contig34123.9116.1 vs. uniprot
Match: A0A7S1SJ55_9CHLO (Hypothetical protein (Fragment) n=1 Tax=Tetraselmis chuii TaxID=63592 RepID=A0A7S1SJ55_9CHLO)

HSP 1 Score: 81.3 bits (199), Expect = 1.290e-12
Identity = 97/363 (26.72%), Postives = 153/363 (42.15%), Query Frame = 1
Query:  307 TVYIPHRGTGDKPVGAILKDIAEVRRKYPNDSIAIMGDWNQTKNRVNKALAK-KVDPELQINEPRNAEFGTRNKTNR----CIDHIAT----LCNSTCETGRAAILRRVDLSDHFPVVC----MVGCSNEVA-PPLDLKTQSTRPRIDVRKLPRPETKKYCGKGP-EGRTNHFNVIGSNYWAPLVDLLETQEDGWDKSE---IQAKADASAEKLVSTCHTLANDYNLVNPGTGGNQKLKSHIAKAIDQKEKTYERAMRTKLGSEKSQRRWKRYHQLRRKVKQLVKQDAKHRWARTLVKVSNQMVDDP--REFWKWSSNLAGWRQATASYGVQPMCHPDSGELLTSVPHIRDAWAVHYGRLATD 1335
            +VY+P    G+     + +++A++R K+P D+I + GDWN  + +++  L + +  P+ +   PR+A    R    R     IDH       +  S        +    D SDHFPV      +VG S E   PPL L+      R+ VR +P+P      G  P E  T   + + +N +A L    +   +G    E   I A AD   + + ST   +           G    L+  I  AI ++   +    +   G  +S     RY   R +VK +V+ + + + AR + K  N        R FWKW+ ++A      ++   QP+  P SG L T    I   WA HY  L  D
Sbjct:   13 SVYLPTGSQGEPYRCRLREELAQLREKFPRDTIVVGGDWNLDEAQLDALLRRWRCVPDAKTIWPRDASARVRGTCRRGSCRVIDHFVAWPPVMGPSLSFPHSVFVDYSWDTSDHFPVFASVPRLVGDSFEHPHPPLMLE------RLSVRSIPKPAR----GDPPSEWPTPFRDFVTANPFAILAPPNDEPMEGAMSREPDSIDADADGFVQAVWSTARRVGAVSRTRRKSLG--PPLQRSILGAIARRRHAFLALCQEARGPIQSVA-LDRYIAARLRVKNMVRTNRRRQKARAIDKAINDFRQGGGRRGFWKWARSIAKGHPTQSNRAEQPVHDPTSGVLHTEPGEINACWARHYRELLRD 362          
BLAST of mRNA_H-paniculata_contig34123.9116.1 vs. uniprot
Match: F8P613_SERL9 (Endo/exonuclease/phosphatase domain-containing protein n=2 Tax=Serpula lacrymans var. lacrymans TaxID=341189 RepID=F8P613_SERL9)

HSP 1 Score: 67.0 bits (162), Expect = 3.550e-8
Identity = 62/230 (26.96%), Postives = 103/230 (44.78%), Query Frame = 1
Query:   13 TLNINGVKGKLTQLQRLLEREDLACCALQETLLRPTDWRLKVPGYQSFSACGGNVASTRGVSLLVKKQFSAYTVGKG-----SAWHLLVRCFGSGLT---QPWIVGTVYIPHRGTGDKPVGAILKDIAE----VRRKYPNDSIAIMGDWNQTKNRVNKALAKKVDPELQ---INEP--RNAEFGTRNKTNRCIDHIATLCNSTCETGRAAILRRVDLSDHFPVVCMVGCS 651
            TLNING + K   +Q +L+   +A CALQETL+ PT + L++ GY SF +    V   RG +LL+     AY + +      S    ++    SGL    +P      Y+P  G         L+ I +    +  K P   +  +GD N     +++ L +K +  ++   +  P  R   +GT     + IDHI     +     +  ++R   +SDH P++  +  S
Sbjct:  210 TLNINGFQKKKELVQDVLQTNRIAVCALQETLVAPTHFPLRIDGYNSFVSPW--VEGFRGQALLIDLSLPAYEIPRAKPDTPSGGRYVIHVKVSGLRDIKRPVHFLAAYLPSGGNFRLERKFALQSIVDRFDHILEKDPGALVVCLGDLNIDHETLDRRLKRKTNNVIRLPPVGSPLSRFPIWGTA----KAIDHILASPQAYNLLRKPRVIRSDCISDHRPLISHIRSS 433          
The following BLAST results are available for this feature:
BLAST of mRNA_H-paniculata_contig34123.9116.1 vs. uniprot
Analysis Date: 2022-09-19 (Diamond blastx: OGS1.0 vs UniRef90)
Total hits: 3
Match NameE-valueIdentityDescription
A0A6H5L5H7_9PHAE3.230e-8738.07Reverse transcriptase domain-containing protein n=... [more]
A0A7S1SJ55_9CHLO1.290e-1226.72Hypothetical protein (Fragment) n=1 Tax=Tetraselmi... [more]
F8P613_SERL93.550e-826.96Endo/exonuclease/phosphatase domain-containing pro... [more]
back to top
Alignments
The following features are aligned
Aligned FeatureFeature TypeAlignment Location
H-paniculata_contig34123contigH-paniculata_contig34123:34..1368 -
Analyses
This mRNA is derived from or has results from the following analyses
Analysis NameDate Performed
Diamond blastx: OGS1.0 vs UniRef902022-09-19
OGS1.0 of Halopteris paniculata Hal_grac_a_UBK monoicous2021-02-24
Properties
Property NameValue
Taxonomic scopeEukaryota
Seed ortholog score70.1
Seed ortholog evalue3e-09
Seed eggNOG ortholog5297.GMQ_19178T0
Hectar predicted targeting categoryother localisation
EggNOG free text desc.Ribonuclease H protein
EggNOG OGsKOG1075@1,KOG1075@2759
COG Functional cat.E
Best tax levelEukaryota
Best eggNOG OGNA|NA|NA
Exons1
Model size1335
Cds size1335
Stop0
Start1
Relationships

The following CDS feature(s) are a part of this mRNA:

Feature NameUnique NameSpeciesTypePosition
1622930053.5286033-CDS-H-paniculata_contig34123:33..13681622930053.5286033-CDS-H-paniculata_contig34123:33..1368Halopteris paniculata Hal_grac_a_UBK monoicousCDSH-paniculata_contig34123 34..1368 -
1691481127.6584382-CDS-H-paniculata_contig34123:33..13681691481127.6584382-CDS-H-paniculata_contig34123:33..1368Halopteris paniculata Hal_grac_a_UBK monoicousCDSH-paniculata_contig34123 34..1368 -


The following polypeptide feature(s) derives from this mRNA:

Feature NameUnique NameSpeciesTypePosition
mRNA_H-paniculata_contig34123.9116.1prot_H-paniculata_contig34123.9116.1Halopteris paniculata Hal_grac_a_UBK monoicouspolypeptideH-paniculata_contig34123 34..1368 -


Sequences
The following sequences are available for this feature:

protein sequence of mRNA_H-paniculata_contig34123.9116.1

>prot_H-paniculata_contig34123.9116.1 ID=prot_H-paniculata_contig34123.9116.1|Name=mRNA_H-paniculata_contig34123.9116.1|organism=Halopteris paniculata Hal_grac_a_UBK monoicous|type=polypeptide|length=445bp
MKLGTLNINGVKGKLTQLQRLLEREDLACCALQETLLRPTDWRLKVPGYQ
SFSACGGNVASTRGVSLLVKKQFSAYTVGKGSAWHLLVRCFGSGLTQPWI
VGTVYIPHRGTGDKPVGAILKDIAEVRRKYPNDSIAIMGDWNQTKNRVNK
ALAKKVDPELQINEPRNAEFGTRNKTNRCIDHIATLCNSTCETGRAAILR
RVDLSDHFPVVCMVGCSNEVAPPLDLKTQSTRPRIDVRKLPRPETKKYCG
KGPEGRTNHFNVIGSNYWAPLVDLLETQEDGWDKSEIQAKADASAEKLVS
TCHTLANDYNLVNPGTGGNQKLKSHIAKAIDQKEKTYERAMRTKLGSEKS
QRRWKRYHQLRRKVKQLVKQDAKHRWARTLVKVSNQMVDDPREFWKWSSN
LAGWRQATASYGVQPMCHPDSGELLTSVPHIRDAWAVHYGRLATD
back to top

mRNA from alignment at H-paniculata_contig34123:34..1368-

Legend: CDSpolypeptide
Hold the cursor over a type above to highlight its positions in the sequence below.
>mRNA_H-paniculata_contig34123.9116.1 ID=mRNA_H-paniculata_contig34123.9116.1|Name=mRNA_H-paniculata_contig34123.9116.1|organism=Halopteris paniculata Hal_grac_a_UBK monoicous|type=mRNA|length=1335bp|location=Sequence derived from alignment at H-paniculata_contig34123:34..1368- (Halopteris paniculata Hal_grac_a_UBK monoicous)
ATGAAGCTGGGAACGTTAAACATCAACGGGGTTAAGGGTAAGCTGACTCA ACTACAAAGACTATTGGAACGGGAAGATCTTGCATGTTGCGCCCTTCAGG AGACCCTATTGCGCCCGACGGATTGGAGACTAAAAGTACCTGGGTACCAA AGTTTCTCAGCTTGCGGGGGCAATGTGGCTTCCACGAGGGGTGTTTCATT ACTAGTTAAGAAACAGTTTAGTGCATACACTGTGGGAAAGGGGTCCGCTT GGCACTTGTTGGTCCGCTGCTTTGGCTCAGGATTAACCCAACCTTGGATA GTGGGAACGGTCTACATTCCCCATCGGGGAACGGGAGACAAACCGGTTGG GGCAATCCTGAAAGACATAGCAGAAGTTCGGCGAAAGTACCCCAATGATT CAATAGCAATCATGGGGGACTGGAACCAGACAAAGAACCGGGTTAACAAG GCTCTGGCGAAAAAGGTGGATCCCGAACTACAGATTAACGAACCTAGAAA TGCTGAATTCGGAACCCGTAACAAAACTAACAGGTGCATCGATCATATTG CAACACTTTGCAACTCGACCTGCGAAACAGGTCGAGCTGCGATCCTCAGA AGAGTAGACCTATCGGACCACTTTCCAGTGGTCTGCATGGTCGGATGCTC CAATGAGGTGGCCCCCCCCCTGGATCTGAAGACGCAATCCACGAGACCTC GCATTGATGTGAGGAAGCTCCCCCGACCCGAGACTAAGAAATACTGCGGA AAAGGCCCAGAAGGACGAACCAATCACTTTAATGTGATTGGGTCGAACTA CTGGGCTCCGCTAGTTGATCTATTGGAAACTCAAGAGGACGGGTGGGATA AGTCGGAAATCCAAGCCAAAGCTGACGCTTCGGCCGAGAAACTTGTGAGC ACGTGCCATACCCTTGCGAACGATTACAACTTGGTCAATCCGGGAACCGG AGGAAACCAGAAGTTGAAGTCACATATCGCAAAAGCGATTGATCAAAAGG AGAAGACGTACGAACGAGCGATGCGGACGAAGTTGGGATCGGAGAAATCG CAAAGACGATGGAAAAGATACCACCAGCTAAGGCGGAAAGTGAAGCAGTT GGTCAAGCAGGACGCGAAACATAGATGGGCGAGAACACTAGTGAAGGTTT CTAATCAGATGGTGGATGATCCGAGGGAATTCTGGAAGTGGTCGTCGAAC CTAGCTGGATGGCGTCAAGCTACAGCTAGTTACGGCGTCCAACCTATGTG TCACCCCGACTCTGGGGAACTCCTAACAAGTGTTCCCCACATAAGAGATG CGTGGGCCGTACACTATGGAAGATTGGCAACGGAC
back to top

Coding sequence (CDS) from alignment at H-paniculata_contig34123:34..1368-

>mRNA_H-paniculata_contig34123.9116.1 ID=mRNA_H-paniculata_contig34123.9116.1|Name=mRNA_H-paniculata_contig34123.9116.1|organism=Halopteris paniculata Hal_grac_a_UBK monoicous|type=CDS|length=2670bp|location=Sequence derived from alignment at H-paniculata_contig34123:34..1368- (Halopteris paniculata Hal_grac_a_UBK monoicous)
ATGAAGCTGGGAACGTTAAACATCAACGGGGTTAAGGGTAAGCTGACTCA
ACTACAAAGACTATTGGAACGGGAAGATCTTGCATGTTGCGCCCTTCAGG
AGACCCTATTGCGCCCGACGGATTGGAGACTAAAAGTACCTGGGTACCAA
AGTTTCTCAGCTTGCGGGGGCAATGTGGCTTCCACGAGGGGTGTTTCATT
ACTAGTTAAGAAACAGTTTAGTGCATACACTGTGGGAAAGGGGTCCGCTT
GGCACTTGTTGGTCCGCTGCTTTGGCTCAGGATTAACCCAACCTTGGATA
GTGGGAACGGTCTACATTCCCCATCGGGGAACGGGAGACAAACCGGTTGG
GGCAATCCTGAAAGACATAGCAGAAGTTCGGCGAAAGTACCCCAATGATT
CAATAGCAATCATGGGGGACTGGAACCAGACAAAGAACCGGGTTAACAAG
GCTCTGGCGAAAAAGGTGGATCCCGAACTACAGATTAACGAACCTAGAAA
TGCTGAATTCGGAACCCGTAACAAAACTAACAGGTGCATCGATCATATTG
CAACACTTTGCAACTCGACCTGCGAAACAGGTCGAGCTGCGATCCTCAGA
AGAGTAGACCTATCGGACCACTTTCCAGTGGTCTGCATGGTCGGATGCTC
CAATGAGGTGGCCCCCCCCCTGGATCTGAAGACGCAATCCACGAGACCTC
GCATTGATGTGAGGAAGCTCCCCCGACCCGAGACTAAGAAATACTGCGGA
AAAGGCCCAGAAGGACGAACCAATCACTTTAATGTGATTGGGTCGAACTA
CTGGGCTCCGCTAGTTGATCTATTGGAAACTCAAGAGGACGGGTGGGATA
AGTCGGAAATCCAAGCCAAAGCTGACGCTTCGGCCGAGAAACTTGTGAGC
ACGTGCCATACCCTTGCGAACGATTACAACTTGGTCAATCCGGGAACCGG
AGGAAACCAGAAGTTGAAGTCACATATCGCAAAAGCGATTGATCAAAAGG
AGAAGACGTACGAACGAGCGATGCGGACGAAGTTGGGATCGGAGAAATCG
CAAAGACGATGGAAAAGATACCACCAGCTAAGGCGGAAAGTGAAGCAGTT
GGTCAAGCAGGACGCGAAACATAGATGGGCGAGAACACTAGTGAAGGTTT
CTAATCAGATGGTGGATGATCCGAGGGAATTCTGGAAGTGGTCGTCGAAC
CTAGCTGGATGGCGTCAAGCTACAGCTAGTTACGGCGTCCAACCTATGTG
TCACCCCGACTCTGGGGAACTCCTAACAAGTGTTCCCCACATAAGAGATG
CGTGGGCCGTACACTATGGAAGATTGGCAACGGACATGAAGCTGGGAACG
TTAAACATCAACGGGGTTAAGGGTAAGCTGACTCAACTACAAAGACTATT
GGAACGGGAAGATCTTGCATGTTGCGCCCTTCAGGAGACCCTATTGCGCC
CGACGGATTGGAGACTAAAAGTACCTGGGTACCAAAGTTTCTCAGCTTGC
GGGGGCAATGTGGCTTCCACGAGGGGTGTTTCATTACTAGTTAAGAAACA
GTTTAGTGCATACACTGTGGGAAAGGGGTCCGCTTGGCACTTGTTGGTCC
GCTGCTTTGGCTCAGGATTAACCCAACCTTGGATAGTGGGAACGGTCTAC
ATTCCCCATCGGGGAACGGGAGACAAACCGGTTGGGGCAATCCTGAAAGA
CATAGCAGAAGTTCGGCGAAAGTACCCCAATGATTCAATAGCAATCATGG
GGGACTGGAACCAGACAAAGAACCGGGTTAACAAGGCTCTGGCGAAAAAG
GTGGATCCCGAACTACAGATTAACGAACCTAGAAATGCTGAATTCGGAAC
CCGTAACAAAACTAACAGGTGCATCGATCATATTGCAACACTTTGCAACT
CGACCTGCGAAACAGGTCGAGCTGCGATCCTCAGAAGAGTAGACCTATCG
GACCACTTTCCAGTGGTCTGCATGGTCGGATGCTCCAATGAGGTGGCCCC
CCCCCTGGATCTGAAGACGCAATCCACGAGACCTCGCATTGATGTGAGGA
AGCTCCCCCGACCCGAGACTAAGAAATACTGCGGAAAAGGCCCAGAAGGA
CGAACCAATCACTTTAATGTGATTGGGTCGAACTACTGGGCTCCGCTAGT
TGATCTATTGGAAACTCAAGAGGACGGGTGGGATAAGTCGGAAATCCAAG
CCAAAGCTGACGCTTCGGCCGAGAAACTTGTGAGCACGTGCCATACCCTT
GCGAACGATTACAACTTGGTCAATCCGGGAACCGGAGGAAACCAGAAGTT
GAAGTCACATATCGCAAAAGCGATTGATCAAAAGGAGAAGACGTACGAAC
GAGCGATGCGGACGAAGTTGGGATCGGAGAAATCGCAAAGACGATGGAAA
AGATACCACCAGCTAAGGCGGAAAGTGAAGCAGTTGGTCAAGCAGGACGC
GAAACATAGATGGGCGAGAACACTAGTGAAGGTTTCTAATCAGATGGTGG
ATGATCCGAGGGAATTCTGGAAGTGGTCGTCGAACCTAGCTGGATGGCGT
CAAGCTACAGCTAGTTACGGCGTCCAACCTATGTGTCACCCCGACTCTGG
GGAACTCCTAACAAGTGTTCCCCACATAAGAGATGCGTGGGCCGTACACT
ATGGAAGATTGGCAACGGAC
back to top