mRNA_H-paniculata_contig24086.6519.1 (mRNA) Halopteris paniculata Hal_grac_a_UBK monoicous

You are viewing an mRNA, more information available on the corresponding polypeptide page

Overview
NamemRNA_H-paniculata_contig24086.6519.1
Unique NamemRNA_H-paniculata_contig24086.6519.1
TypemRNA
OrganismHalopteris paniculata Hal_grac_a_UBK monoicous (Halopteris paniculata Hal_grac_a_UBK monoicous)
Homology
BLAST of mRNA_H-paniculata_contig24086.6519.1 vs. uniprot
Match: A0A6H5JT64_9PHAE (DUF676 domain-containing protein n=1 Tax=Ectocarpus sp. CCAP 1310/34 TaxID=867726 RepID=A0A6H5JT64_9PHAE)

HSP 1 Score: 117 bits (292), Expect = 2.980e-23
Identity = 102/234 (43.59%), Postives = 125/234 (53.42%), Query Frame = 1
Query:    7 QLRQRWACQTTLHTCSTLQ-----------TRPHGILPPTGT-------PRVKGSAMRAPRLSRLEPDIGSDSFGIALRMACADASAPYKLPLQDQHMFPEPEALLPVCLVQRFSTPPELKQGRRAAGRPGMIVVDTRVPGEHGPGST----------MDAQSTPITSPVIVPTSGSKSSAIPDASTKRGN-NSPKAAAVG----RATGTAERTPFYS-APPPRG--AESLSPR 600
            QLRQRWACQ TLHT S  Q               G  PP+          +V  S   +PRLSRLEP+I +D FG+A+RMACADASAPYKLPL+DQHMFP+ +  LPVCLVQR+   P+ ++G   +GR    V + R  G  G GS           + A ++P  SPV VP   +   A   AS+  G+ +SP    V     RAT TA  TP    A PPR   A S SPR
Sbjct:  644 QLRQRWACQATLHTSSVTQPLSLDPAAATAAAEPGTRPPSPALDGLGWASKVPTSEPGSPRLSRLEPEIAADHFGVAVRMACADASAPYKLPLRDQHMFPDGDVGLPVCLVQRYEYAPKDEEGG-GSGRGRKAVREIRQ-GSGGGGSLAVAAVDKEKLVVASTSPPVSPVWVP---AFRPAFRKASSLPGDPDSPPPPPVRMLPPRATATAPVTPVAGKARPPRHVRAASSSPR 872          
BLAST of mRNA_H-paniculata_contig24086.6519.1 vs. uniprot
Match: D8LMF3_ECTSI (DUF676 domain-containing protein n=1 Tax=Ectocarpus siliculosus TaxID=2880 RepID=D8LMF3_ECTSI)

HSP 1 Score: 116 bits (290), Expect = 5.160e-23
Identity = 67/131 (51.15%), Postives = 81/131 (61.83%), Query Frame = 1
Query:    7 QLRQRWACQTTLHTCSTLQTRPHGILPPTGT-----------PRVKGSAM---------RAPRLSRLEPDIGSDSFGIALRMACADASAPYKLPLQDQHMFPEPEALLPVCLVQRFSTPPELKQGRRAAGR 339
            QLRQRWACQ TLHT S   T+P  + P   T           P + GS            +PRLSRLEP+I +D FG A+RMACADASAPYKLPL+DQHMFP+ +  LPVCLVQR+   P+ ++G    GR
Sbjct:  744 QLRQRWACQATLHTSSA--TQPLSLDPAAATAAAEPGTRPPSPALDGSGRASKLPTSEPESPRLSRLEPEIAADHFGAAVRMACADASAPYKLPLRDQHMFPDGDVGLPVCLVQRYDYAPKEEEGGGGRGR 872          
The following BLAST results are available for this feature:
BLAST of mRNA_H-paniculata_contig24086.6519.1 vs. uniprot
Analysis Date: 2022-09-19 (Diamond blastx: OGS1.0 vs UniRef90)
Total hits: 2
Match NameE-valueIdentityDescription
A0A6H5JT64_9PHAE2.980e-2343.59DUF676 domain-containing protein n=1 Tax=Ectocarpu... [more]
D8LMF3_ECTSI5.160e-2351.15DUF676 domain-containing protein n=1 Tax=Ectocarpu... [more]
back to top
Alignments
The following features are aligned
Aligned FeatureFeature TypeAlignment Location
H-paniculata_contig24086contigH-paniculata_contig24086:690..3266 -
Analyses
This mRNA is derived from or has results from the following analyses
Analysis NameDate Performed
Diamond blastx: OGS1.0 vs UniRef902022-09-19
OGS1.0 of Halopteris paniculata Hal_grac_a_UBK monoicous2021-02-24
Properties
Property NameValue
Taxonomic scopeEukaryota
Seed ortholog score119.0
Seed ortholog evalue8.3e-24
Seed eggNOG ortholog2880.D8LMF3
Hectar predicted targeting categoryother localisation
EggNOG free text desc.carboxylic ester hydrolase activity
EggNOG OGsKOG2205@1,KOG2205@2759
COG Functional cat.S
Best tax levelEukaryota
Best eggNOG OGNA|NA|NA
Exons2
Model size1995
Cds size1995
Stop0
Start1
Relationships

The following CDS feature(s) are a part of this mRNA:

Feature NameUnique NameSpeciesTypePosition
1622929692.1573336-CDS-H-paniculata_contig24086:689..25781622929692.1573336-CDS-H-paniculata_contig24086:689..2578Halopteris paniculata Hal_grac_a_UBK monoicousCDSH-paniculata_contig24086 690..2578 -
1691480969.5254898-CDS-H-paniculata_contig24086:689..25781691480969.5254898-CDS-H-paniculata_contig24086:689..2578Halopteris paniculata Hal_grac_a_UBK monoicousCDSH-paniculata_contig24086 690..2578 -
1622929692.1776807-CDS-H-paniculata_contig24086:3160..32661622929692.1776807-CDS-H-paniculata_contig24086:3160..3266Halopteris paniculata Hal_grac_a_UBK monoicousCDSH-paniculata_contig24086 3161..3266 -
1691480969.5351694-CDS-H-paniculata_contig24086:3160..32661691480969.5351694-CDS-H-paniculata_contig24086:3160..3266Halopteris paniculata Hal_grac_a_UBK monoicousCDSH-paniculata_contig24086 3161..3266 -


The following polypeptide feature(s) derives from this mRNA:

Feature NameUnique NameSpeciesTypePosition
mRNA_H-paniculata_contig24086.6519.1prot_H-paniculata_contig24086.6519.1Halopteris paniculata Hal_grac_a_UBK monoicouspolypeptideH-paniculata_contig24086 690..3266 -


Sequences
The following sequences are available for this feature:

protein sequence of mRNA_H-paniculata_contig24086.6519.1

>prot_H-paniculata_contig24086.6519.1 ID=prot_H-paniculata_contig24086.6519.1|Name=mRNA_H-paniculata_contig24086.6519.1|organism=Halopteris paniculata Hal_grac_a_UBK monoicous|type=polypeptide|length=665bp
MPQLRQRWACQTTLHTCSTLQTRPHGILPPTGTPRVKGSAMRAPRLSRLE
PDIGSDSFGIALRMACADASAPYKLPLQDQHMFPEPEALLPVCLVQRFST
PPELKQGRRAAGRPGMIVVDTRVPGEHGPGSTMDAQSTPITSPVIVPTSG
SKSSAIPDASTKRGNNSPKAAAVGRATGTAERTPFYSAPPPRGAESLSPR
SRRVPPKEALEVFTATFAPPPVMGLAKSSGDSSPDSSTVSSPTRPTNFSV
TPTRRGRSTVITDRRSGHGPVLEGEPEAIPRRDLSPPMSPLALDANNGGD
NADHLRDSKSNTILPPFRVNGPPATPPSSGRSLAKNSRSLSPFFGNRTMV
FLSPISKRRARAQWMARSIVSGEAGASGGRGGGGGGGGGAGGGKMTVSKK
TGRVLKRSTSAMALSRTHLRTRSDGGIRISGWNAVGQAPRFSVQIQDSPI
VVPEGRRLSPSPAGGSRGTGVGRSSKSPPPPRMLPLASAFARSSGQPVSQ
AAVATTTPLMPPTPTSTSTLIPTPPPPPLLAQDLLSPPPTRQGVSSPRTG
GSTPRRRSLSISPRRPPPKQMTEVGPRTTDGYNGGNGEKLDGSSGLGSGS
GGSVSGTVSGSVTSRESVQPEDARTVSNASAKPKMSRAKSEMSLLDGVEQ
SSDLGTFFRRGEGHG
back to top

mRNA from alignment at H-paniculata_contig24086:690..3266-

Legend: polypeptideCDS
Hold the cursor over a type above to highlight its positions in the sequence below.
>mRNA_H-paniculata_contig24086.6519.1 ID=mRNA_H-paniculata_contig24086.6519.1|Name=mRNA_H-paniculata_contig24086.6519.1|organism=Halopteris paniculata Hal_grac_a_UBK monoicous|type=mRNA|length=2577bp|location=Sequence derived from alignment at H-paniculata_contig24086:690..3266- (Halopteris paniculata Hal_grac_a_UBK monoicous)
ATGCCACAGCTGCGACAGCGATGGGCTTGTCAGACCACGCTCCATACGTG CTCAACGCTGCAGACGCGCCCTCATGGAATATTGCCGCCCACAGGAACAC CACGTGGTGAGTCAGTCTTCAGCGACAACACAAAAGTGCGCCACTCTCCG TGCAAAAATGTGTCTTCTTGTGTCGTGTCGTATCGCGTCCTGCCGTCGTT TCTCCCCGGAGGCCACGAGAGACATGGTTGACACAGGCACCGCTTTGTAA GTCGCCCCAAGCTTCTTTTTGTATGGAAGGATGGTTGTCACGGATGCCGG TATCCCCCGACAGTATTGGCGTTTGTTCCGGCTGGGATAAGGAGATTTTC TTCCATATGTGACTATTTTTTTTAAGTACCGGTTGGTCGTTTTCTATTTT ATACTATTACGTGAGCAGGCGCCGAAATGCATACATGTACGGAGCTTGAT GGAAGGCGAAATCTACAAAAAGAAGGACGACCCCGTTCGTATTGAATGTT ACGCCACACGCCTCTAAGCGCTGCATGAGGCGTGCCTGGGCTTGAAGGTT GATGAAATTGAATACCTTTTTTTTTAGATCTTCAATGTAAGTGATTATCC GCAGATTTCCATTTTTTTTTCGAGGTAAAGATCGTCGTTACTTCTTTCAT TCTTACTCTCCTTCTCCGTCCCCCCTTCCTTCCCTCAGTAAAAGGTTCCG CGATGCGCGCCCCGAGATTATCACGCTTAGAACCGGACATCGGATCGGAC AGTTTTGGAATCGCACTAAGGATGGCATGTGCAGATGCATCCGCTCCATA CAAACTGCCGCTTCAAGACCAGCACATGTTCCCCGAGCCGGAAGCGTTGC TCCCCGTTTGCCTCGTGCAGAGATTCAGCACTCCGCCAGAGCTGAAGCAA GGCAGGAGAGCGGCAGGTCGACCGGGGATGATCGTTGTCGACACTCGTGT GCCGGGGGAGCATGGGCCGGGTTCTACCATGGACGCTCAGAGTACCCCCA TCACCTCCCCCGTCATTGTACCCACGTCCGGGAGTAAATCCTCGGCGATT CCGGATGCATCGACGAAGAGGGGAAACAACTCCCCGAAGGCGGCGGCGGT GGGGAGGGCGACAGGTACGGCGGAGCGCACGCCGTTCTATTCGGCCCCGC CCCCCCGCGGCGCCGAGTCACTTTCGCCGAGGAGCAGACGCGTTCCGCCC AAAGAAGCACTGGAGGTGTTCACCGCGACATTTGCGCCCCCTCCGGTCAT GGGCCTGGCCAAGTCGAGTGGGGATTCTTCCCCCGACTCGTCCACTGTGT CTTCGCCGACACGCCCGACGAATTTCAGCGTAACGCCAACACGTCGAGGA CGGTCGACTGTGATAACGGACAGAAGATCAGGTCACGGACCGGTCCTCGA AGGGGAGCCAGAAGCGATCCCCAGGCGAGATCTTTCCCCGCCTATGTCTC CCCTGGCACTAGACGCGAACAACGGTGGCGACAACGCCGACCACCTCCGT GACAGTAAGTCGAACACAATATTGCCGCCATTCAGGGTGAACGGCCCGCC GGCTACCCCGCCGTCGTCAGGTCGCTCGCTGGCCAAGAACAGCAGGAGCT TGAGCCCTTTCTTCGGCAACAGGACCATGGTGTTTTTGTCCCCGATTTCA AAGCGGAGGGCGCGCGCGCAGTGGATGGCACGATCCATAGTGAGCGGCGA GGCTGGGGCAAGCGGCGGCCGTGGCGGCGGCGGCGGAGGAGGAGGAGGAG CGGGAGGAGGTAAAATGACTGTGTCCAAGAAAACAGGCCGTGTGCTGAAG AGAAGTACCTCGGCGATGGCGCTGAGCCGCACCCACCTGAGAACGAGAAG CGACGGGGGAATTCGGATTTCTGGGTGGAACGCCGTGGGCCAAGCGCCCC GCTTTAGCGTGCAGATACAGGACTCGCCGATTGTTGTTCCCGAGGGGCGT CGGCTGTCACCGTCGCCGGCCGGCGGCAGCAGGGGCACTGGTGTCGGGAG GTCGTCTAAGTCTCCTCCGCCGCCGCGGATGCTTCCGCTAGCGAGCGCTT TCGCTCGTTCCTCCGGGCAGCCTGTATCGCAGGCAGCAGTAGCTACAACG ACTCCGCTGATGCCGCCAACGCCAACGTCAACGTCAACGCTAATACCAAC GCCACCACCTCCGCCACTCTTGGCGCAAGACCTATTATCTCCGCCGCCAA CGCGACAAGGAGTGTCATCGCCACGAACGGGAGGGTCTACTCCGAGGCGC CGCTCGCTGTCCATCTCCCCTAGACGCCCGCCACCTAAGCAGATGACGGA AGTAGGCCCACGTACTACAGATGGATATAACGGTGGTAATGGAGAGAAGC TTGATGGTAGTAGCGGACTGGGTTCCGGCAGCGGCGGATCTGTCTCAGGG ACAGTCTCGGGATCGGTCACCAGTAGAGAATCGGTTCAACCCGAGGACGC GCGGACGGTTTCCAACGCGTCAGCTAAGCCGAAAATGTCCAGAGCGAAGA GTGAAATGTCGCTTCTGGATGGTGTGGAGCAATCGAGTGACCTCGGGACG TTCTTCCGACGCGGGGAGGGCCATGGT
back to top

Coding sequence (CDS) from alignment at H-paniculata_contig24086:690..3266-

>mRNA_H-paniculata_contig24086.6519.1 ID=mRNA_H-paniculata_contig24086.6519.1|Name=mRNA_H-paniculata_contig24086.6519.1|organism=Halopteris paniculata Hal_grac_a_UBK monoicous|type=CDS|length=3990bp|location=Sequence derived from alignment at H-paniculata_contig24086:690..3266- (Halopteris paniculata Hal_grac_a_UBK monoicous)
ATGCCACAGCTGCGACAGCGATGGGCTTGTCAGACCACGCTCCATACGTG
CTCAACGCTGCAGACGCGCCCTCATGGAATATTGCCGCCCACAGGAACAC
CACGTGATGCCACAGCTGCGACAGCGATGGGCTTGTCAGACCACGCTCCA
TACGTGCTCAACGCTGCAGACGCGCCCTCATGGAATATTGCCGCCCACAG
GAACACCACGTGTAAAAGGTTCCGCGATGCGCGCCCCGAGATTATCACGC
TTAGAACCGGACATCGGATCGGACAGTTTTGGAATCGCACTAAGGATGGC
ATGTGCAGATGCATCCGCTCCATACAAACTGCCGCTTCAAGACCAGCACA
TGTTCCCCGAGCCGGAAGCGTTGCTCCCCGTTTGCCTCGTGCAGAGATTC
AGCACTCCGCCAGAGCTGAAGCAAGGCAGGAGAGCGGCAGGTCGACCGGG
GATGATCGTTGTCGACACTCGTGTGCCGGGGGAGCATGGGCCGGGTTCTA
CCATGGACGCTCAGAGTACCCCCATCACCTCCCCCGTCATTGTACCCACG
TCCGGGAGTAAATCCTCGGCGATTCCGGATGCATCGACGAAGAGGGGAAA
CAACTCCCCGAAGGCGGCGGCGGTGGGGAGGGCGACAGGTACGGCGGAGC
GCACGCCGTTCTATTCGGCCCCGCCCCCCCGCGGCGCCGAGTCACTTTCG
CCGAGGAGCAGACGCGTTCCGCCCAAAGAAGCACTGGAGGTGTTCACCGC
GACATTTGCGCCCCCTCCGGTCATGGGCCTGGCCAAGTCGAGTGGGGATT
CTTCCCCCGACTCGTCCACTGTGTCTTCGCCGACACGCCCGACGAATTTC
AGCGTAACGCCAACACGTCGAGGACGGTCGACTGTGATAACGGACAGAAG
ATCAGGTCACGGACCGGTCCTCGAAGGGGAGCCAGAAGCGATCCCCAGGC
GAGATCTTTCCCCGCCTATGTCTCCCCTGGCACTAGACGCGAACAACGGT
GGCGACAACGCCGACCACCTCCGTGACAGTAAGTCGAACACAATATTGCC
GCCATTCAGGGTGAACGGCCCGCCGGCTACCCCGCCGTCGTCAGGTCGCT
CGCTGGCCAAGAACAGCAGGAGCTTGAGCCCTTTCTTCGGCAACAGGACC
ATGGTGTTTTTGTCCCCGATTTCAAAGCGGAGGGCGCGCGCGCAGTGGAT
GGCACGATCCATAGTGAGCGGCGAGGCTGGGGCAAGCGGCGGCCGTGGCG
GCGGCGGCGGAGGAGGAGGAGGAGCGGGAGGAGGTAAAATGACTGTGTCC
AAGAAAACAGGCCGTGTGCTGAAGAGAAGTACCTCGGCGATGGCGCTGAG
CCGCACCCACCTGAGAACGAGAAGCGACGGGGGAATTCGGATTTCTGGGT
GGAACGCCGTGGGCCAAGCGCCCCGCTTTAGCGTGCAGATACAGGACTCG
CCGATTGTTGTTCCCGAGGGGCGTCGGCTGTCACCGTCGCCGGCCGGCGG
CAGCAGGGGCACTGGTGTCGGGAGGTCGTCTAAGTCTCCTCCGCCGCCGC
GGATGCTTCCGCTAGCGAGCGCTTTCGCTCGTTCCTCCGGGCAGCCTGTA
TCGCAGGCAGCAGTAGCTACAACGACTCCGCTGATGCCGCCAACGCCAAC
GTCAACGTCAACGCTAATACCAACGCCACCACCTCCGCCACTCTTGGCGC
AAGACCTATTATCTCCGCCGCCAACGCGACAAGGAGTGTCATCGCCACGA
ACGGGAGGGTCTACTCCGAGGCGCCGCTCGCTGTCCATCTCCCCTAGACG
CCCGCCACCTAAGCAGATGACGGAAGTAGGCCCACGTACTACAGATGGAT
ATAACGGTGGTAATGGAGAGAAGCTTGATGGTAGTAGCGGACTGGGTTCC
GGCAGCGGCGGATCTGTCTCAGGGACAGTCTCGGGATCGGTCACCAGTAG
AGAATCGGTTCAACCCGAGGACGCGCGGACGGTTTCCAACGCGTCAGCTA
AGCCGAAAATGTCCAGAGCGAAGAGTGAAATGTCGCTTCTGGATGGTGTG
GAGCAATCGAGTGACCTCGGGACGTTCTTCCGACGCGGGGAGGGCCATGG
TTAAAAGGTTCCGCGATGCGCGCCCCGAGATTATCACGCTTAGAACCGGA
CATCGGATCGGACAGTTTTGGAATCGCACTAAGGATGGCATGTGCAGATG
CATCCGCTCCATACAAACTGCCGCTTCAAGACCAGCACATGTTCCCCGAG
CCGGAAGCGTTGCTCCCCGTTTGCCTCGTGCAGAGATTCAGCACTCCGCC
AGAGCTGAAGCAAGGCAGGAGAGCGGCAGGTCGACCGGGGATGATCGTTG
TCGACACTCGTGTGCCGGGGGAGCATGGGCCGGGTTCTACCATGGACGCT
CAGAGTACCCCCATCACCTCCCCCGTCATTGTACCCACGTCCGGGAGTAA
ATCCTCGGCGATTCCGGATGCATCGACGAAGAGGGGAAACAACTCCCCGA
AGGCGGCGGCGGTGGGGAGGGCGACAGGTACGGCGGAGCGCACGCCGTTC
TATTCGGCCCCGCCCCCCCGCGGCGCCGAGTCACTTTCGCCGAGGAGCAG
ACGCGTTCCGCCCAAAGAAGCACTGGAGGTGTTCACCGCGACATTTGCGC
CCCCTCCGGTCATGGGCCTGGCCAAGTCGAGTGGGGATTCTTCCCCCGAC
TCGTCCACTGTGTCTTCGCCGACACGCCCGACGAATTTCAGCGTAACGCC
AACACGTCGAGGACGGTCGACTGTGATAACGGACAGAAGATCAGGTCACG
GACCGGTCCTCGAAGGGGAGCCAGAAGCGATCCCCAGGCGAGATCTTTCC
CCGCCTATGTCTCCCCTGGCACTAGACGCGAACAACGGTGGCGACAACGC
CGACCACCTCCGTGACAGTAAGTCGAACACAATATTGCCGCCATTCAGGG
TGAACGGCCCGCCGGCTACCCCGCCGTCGTCAGGTCGCTCGCTGGCCAAG
AACAGCAGGAGCTTGAGCCCTTTCTTCGGCAACAGGACCATGGTGTTTTT
GTCCCCGATTTCAAAGCGGAGGGCGCGCGCGCAGTGGATGGCACGATCCA
TAGTGAGCGGCGAGGCTGGGGCAAGCGGCGGCCGTGGCGGCGGCGGCGGA
GGAGGAGGAGGAGCGGGAGGAGGTAAAATGACTGTGTCCAAGAAAACAGG
CCGTGTGCTGAAGAGAAGTACCTCGGCGATGGCGCTGAGCCGCACCCACC
TGAGAACGAGAAGCGACGGGGGAATTCGGATTTCTGGGTGGAACGCCGTG
GGCCAAGCGCCCCGCTTTAGCGTGCAGATACAGGACTCGCCGATTGTTGT
TCCCGAGGGGCGTCGGCTGTCACCGTCGCCGGCCGGCGGCAGCAGGGGCA
CTGGTGTCGGGAGGTCGTCTAAGTCTCCTCCGCCGCCGCGGATGCTTCCG
CTAGCGAGCGCTTTCGCTCGTTCCTCCGGGCAGCCTGTATCGCAGGCAGC
AGTAGCTACAACGACTCCGCTGATGCCGCCAACGCCAACGTCAACGTCAA
CGCTAATACCAACGCCACCACCTCCGCCACTCTTGGCGCAAGACCTATTA
TCTCCGCCGCCAACGCGACAAGGAGTGTCATCGCCACGAACGGGAGGGTC
TACTCCGAGGCGCCGCTCGCTGTCCATCTCCCCTAGACGCCCGCCACCTA
AGCAGATGACGGAAGTAGGCCCACGTACTACAGATGGATATAACGGTGGT
AATGGAGAGAAGCTTGATGGTAGTAGCGGACTGGGTTCCGGCAGCGGCGG
ATCTGTCTCAGGGACAGTCTCGGGATCGGTCACCAGTAGAGAATCGGTTC
AACCCGAGGACGCGCGGACGGTTTCCAACGCGTCAGCTAAGCCGAAAATG
TCCAGAGCGAAGAGTGAAATGTCGCTTCTGGATGGTGTGGAGCAATCGAG
TGACCTCGGGACGTTCTTCCGACGCGGGGAGGGCCATGGT
back to top