prot_H-paniculata_contig243.6587.1 (polypeptide) Halopteris paniculata Hal_grac_a_UBK monoicous

You are viewing a polypeptide, more information available on the corresponding mRNA page

Overview
NamemRNA_H-paniculata_contig243.6587.1
Unique Nameprot_H-paniculata_contig243.6587.1
Typepolypeptide
OrganismHalopteris paniculata Hal_grac_a_UBK monoicous (Halopteris paniculata Hal_grac_a_UBK monoicous)
Sequence length3624
Homology
BLAST of mRNA_H-paniculata_contig243.6587.1 vs. uniprot
Match: D7G6Q5_ECTSI (Uncharacterized protein n=1 Tax=Ectocarpus siliculosus TaxID=2880 RepID=D7G6Q5_ECTSI)

HSP 1 Score: 328 bits (841), Expect = 8.550e-86
Identity = 446/1235 (36.11%), Postives = 549/1235 (44.45%), Query Frame = 0
Query: 2398 AEESELRSSSSGLSRALRSLVNVVQERETRVAALETELKQERDAARXXXXXXXXXXXXXIEAREMAVHDMEAQMADLXXXXXXXXXXXXXSKEISQDLESQIAMLSRQAEAAAIKAAATVSSLENDLNLSRKDTEVQEQERRDYREEMEGNLAEGHESILVLQGALEHAVNAAGGLLERAEAAASEAERGEVETLEAELRVFERRLPTIRSSRNLRRDTSIGRRSYYDTSRRSSSSPENRRVVFVGGYSRIAIPSLNGSGLPGNPRASWSHP-VVAKDAAQM-----DHSAFRGARSVGSLPRRGSGIQRKREGSFDVVSDGGGLRAEGDGDDVRAWPEFLGLVEAEAVVHRATSEMDEVCFDIEAFVLRQAIARAADMRSSFAQADSRQEAATAAA--VRPVDTEDKKNVLEEAWGGQVGGTEAEERLARLEAEAARAXXXXXXXXXXXXALKTQRETLIRRVAAAEAGAALSRAVAHTANSRSASLSPASTS----------------------------PQTRHATAEPVPSQMTHVAAAAVSTSTIETVAVAEAAETALAAARSDXXXXXXXXXXXXXXXXTLRAGVRISEAEDREQDHRLLLEQQKQEEXXXXXXXXXXXXXXXXXXXXXXXXXXXXXRERFEGXXXXXXXXXXXXXXXXXRQRLESSLREQQXXXXXXXXXXXXXXXXXXXXXXXXXXXXXXHVAAVAAEAVAEATAGLRAEISDITT-RAAAQEALS-AKKAGVELAQLESRLAARIVGLEDELARERKAMQEAERRVERVEARRRGL----------------------------EEGLEAXXXXXXXXXXXXXXXXXXXXXXXXXRQSLEHPLQHAETA-RRLKISGGGGLSNVEDAESSVASSTS------VLELRREVSRVTARAKVLGQRLDETVKRNRWLEKEVAQAVKLGARAEAELGAALAGERMQRDGELTEIKCVVDEMMTLDASASGGGIAGRGRDLFSPPR----------------RGAGGSRRSQAISHQPRSSSEAQHD--------------------------TTLNFMDVGAA-ARLTEAWSLLEASEAARRKLQGEVKSWADRAAKLEGALAAAEAAVEEGAREARLLAASLQDAREGLAAEEGARREAEGRAEALRVMLQAGDWGASGGGASPARGGGGGDVARGLEGQVKALRSRVEELLERAREAEVREVLEKRGRKAAQHALSEL 3516
            AEE    S SSGLSRALRSLV+ +QER+ R   LE E+ + R  A              + A E A   M A++  L             ++    +LE+ +   S  AEAA+  A A                 V  +ERR    ++E   A+G E +L L+ AL    +AA GLLERAEA  ++AE GEVETLEAELR  ERR P    SR     T+   R      RRS+S P             + +P+  G     +P  SW  P   + D  ++     +   + G+R + ++  RG+G  R  +G  DV SDGGG  A                           +EM+E   D+E FVLRQ IARA D+R   A A+SRQE + AA                E  W  +    EA  RLA LE   A              ALK QRE L+RRVA+AEA AAL+RAVA     RS++ SP+                               P    A A+ VPS   H AAA ++ +              LA ARSD  XXXXXXXXXXXXXX      R+SE    E+ HR  LE+Q + E                                                    R+R ES                                               EA +G R         R  A+  L  A++    L Q             +E A  R+A+  AER  ER++ +RRGL                                                           RQS++  L  AE   R L        + V+D      ++ +      V+ELR +VSR   RA++L +RLDET + NR LE+EVA+AV+LGARAEAELGAALAGER++RDGELTEIK VVDEMMTLD SASGGG+AG   DLFSPPR                RG+GG+  S  + +   SS   + +                          TT N   V AA ARL EAWSLLE+SEAARR+L  EVK+WA R A LE ALAAAEA  E  AREARLLAA LQDAR+GLA EE ARREAEGRA+ALR MLQAG                  DVAR L GQVKALRSRVEELLERAR+AEVREVLEKRGRKAAQ AL EL
Sbjct: 3322 AEERSSPSPSSGLSRALRSLVDALQERDARAQLLEDEVTRVRRGA--------------VAAAEAA--SMRAEVETLKASLAA-------TEAERLELETLLEDASHGAEAASRDAKAQXXXXXXXXXXXXXXXXVASEERR----QIEEAFADGQEGLLALREALGRTGDAARGLLERAEAVTADAEAGEVETLEAELRCLERRAP---HSRRRAPSTAAHHR------RRSASPPG------------LPLPAGRGLRSAVDPSFSWPQPRSPSTDGLRVSSVGGEDFRYSGSRRLWAV--RGAGGARHGQGDLDVGSDGGGRGA------------XXXXXXXXXXXXXXXAEMEEALLDVETFVLRQGIARAVDVRRREA-AESRQEVSAAAEEXXXXXXXXXXXRAREARWEAERSSLEA--RLANLEEXGASVRREADEQAAEVEALKIQRENLVRRVASAEAEAALARAVAE----RSSASSPSXXXXXXXXXXXXXXXXXXXXXXXXXXXXXXXPSALTAVADAVPSD--HHAAALLAAT--------------LAGARSDLGXXXXXXXXXXXXXXXXXX--RLSE----EEGHRQELERQFRVE----------------------------------------------------RERRES-----------------------------------------------EAVSGARXXXXXXXXGRDEAEGRLDVAQRTVTALEQKSGGXXXXXXXXXEEAAAARRALALAERERERLQGQRRGLGXXXXXXXXXXXXXXXXXXXXXXXXXXXXXXXXXAVVRARRGEESARELDDRLQLESRRRQSVDRALHDAEAKLRELNRRDETTAAPVDDLRRLATTAAAEENDAVVVELRGQVSRARERAEILEERLDETARVNRRLEREVAEAVELGARAEAELGAALAGERLRRDGELTEIKSVVDEMMTLDPSASGGGVAGISGDLFSPPRGGQRGGGLVVDRRSSGRGSGGAGHSGNLGYYNTSSRTLRAEERSANDTAAFPYPGVVVEPGWRSALTTTTNDGAVAAATARLAEAWSLLESSEAARRRLSEEVKAWAIRTAGLEEALAAAEATAEARAREARLLAAGLQDARDGLAVEEEARREAEGRADALRNMLQAGXXXXXXXXXXXXXXXX--DVARNLAGQVKALRSRVEELLERARDAEVREVLEKRGRKAAQRALREL 4364          
BLAST of mRNA_H-paniculata_contig243.6587.1 vs. uniprot
Match: A0A6H5JP43_9PHAE (Uncharacterized protein n=1 Tax=Ectocarpus sp. CCAP 1310/34 TaxID=867726 RepID=A0A6H5JP43_9PHAE)

HSP 1 Score: 275 bits (704), Expect = 3.140e-73
Identity = 201/334 (60.18%), Postives = 226/334 (67.66%), Query Frame = 0
Query: 3226 VLELRREVSRVTARAKVLGQRLDETVKRNRWLEKEVAQAVKLGARAEAELGAALAGERMQRDGELTEIKCVVDEMMTLDASASGGGIAGRGRDLFSPPR----------------RGAGGSRRS------QAISHQPRSSSEAQHDT--------------------TLNFMDVGAA-ARLTEAWSLLEASEAARRKLQGEVKSWADRAAKLEGALAAAEAAVEEGAREARLLAASLQDAREGLAAEEGARREAEGRAEALRVMLQAGDWGASGGGASPARGGGGGDVARGLEGQVKALRSRVEELLERAREAEVREVLEKRGRKAAQHALSEL 3516
            V+ELR +VSR   RA++L +RLDET + NR LE+EVA+AV++GARAEAELGAALAGER++RDGELTEIK VVDEMMTLD SASGGG+AG   DLFSPPR                RG+GG+  S         S   R+   + +DT                    T N   V AA ARL EAWSLLE+SEAARR+L  EVK+WA R A LE ALAAAEA  E  AREARLLAASLQDAR+GLA EE ARREAEGRA+ALR M+QAG  G               DVAR L GQVKALRSRVEELLERAR+AEVREVLEKRGRKAAQ AL EL
Sbjct:  386 VVELRGQVSRARERAEILEERLDETARVNRRLEREVAEAVEIGARAEAELGAALAGERLRRDGELTEIKSVVDEMMTLDPSASGGGVAGISGDLFSPPRGGQRGGGLVVDRRSSGRGSGGAGHSGNRGYYNTSSRTLRTEEGSANDTAALPYPGVVVEPGWSSALTTTTNDGGVAAATARLAEAWSLLESSEAARRRLSEEVKAWAIRTAGLEEALAAAEATAEARAREARLLAASLQDARDGLAVEEEARREAEGRADALRNMIQAG--GXXXXXXXXXXXXXXXDVARNLAGQVKALRSRVEELLERARDAEVREVLEKRGRKAAQRALREL 717          
BLAST of mRNA_H-paniculata_contig243.6587.1 vs. uniprot
Match: A0A6H5JDN1_9PHAE (Uncharacterized protein n=1 Tax=Ectocarpus sp. CCAP 1310/34 TaxID=867726 RepID=A0A6H5JDN1_9PHAE)

HSP 1 Score: 63.9 bits (154), Expect = 7.590e-6
Identity = 38/60 (63.33%), Postives = 46/60 (76.67%), Query Frame = 0
Query:  955 AVEVLREVEIMQATVWELEQHERTLLARLEDQAGALLSAEDSRRAAEGRANAAVAEVEQL 1014
            A++VLRE+E M A  WE EQ ERTLLARLEDQA  L +A+++R A EG A AAVAE E+L
Sbjct: 1102 AMDVLRELERMHAAAWEREQAERTLLARLEDQADGLRNADEAREAHEGAARAAVAEAERL 1161          
The following BLAST results are available for this feature:
BLAST of mRNA_H-paniculata_contig243.6587.1 vs. uniprot
Analysis Date: 2022-09-16 (Diamond blastp: OGS1.0 vs UniRef90)
Total hits: 3
Match NameE-valueIdentityDescription
D7G6Q5_ECTSI8.550e-8636.11Uncharacterized protein n=1 Tax=Ectocarpus silicul... [more]
A0A6H5JP43_9PHAE3.140e-7360.18Uncharacterized protein n=1 Tax=Ectocarpus sp. CCA... [more]
A0A6H5JDN1_9PHAE7.590e-663.33Uncharacterized protein n=1 Tax=Ectocarpus sp. CCA... [more]
back to top
InterPro
Analysis Name: InterProScan on OGS1.0
Date Performed: 2022-09-29
IPR TermIPR DescriptionSourceSource TermSource DescriptionAlignment
NoneNo IPR availableCOILSCoilCoilcoord: 419..460
NoneNo IPR availableCOILSCoilCoilcoord: 1379..1402
NoneNo IPR availableCOILSCoilCoilcoord: 1527..1547
NoneNo IPR availableCOILSCoilCoilcoord: 40..127
NoneNo IPR availableCOILSCoilCoilcoord: 627..672
NoneNo IPR availableCOILSCoilCoilcoord: 718..752
NoneNo IPR availableCOILSCoilCoilcoord: 1095..1136
NoneNo IPR availableCOILSCoilCoilcoord: 231..279
NoneNo IPR availableCOILSCoilCoilcoord: 2457..2484
NoneNo IPR availableCOILSCoilCoilcoord: 363..404
NoneNo IPR availableCOILSCoilCoilcoord: 1410..1444
NoneNo IPR availableCOILSCoilCoilcoord: 3471..3498
NoneNo IPR availableCOILSCoilCoilcoord: 304..345
NoneNo IPR availableCOILSCoilCoilcoord: 582..616
NoneNo IPR availableCOILSCoilCoilcoord: 1263..1283
NoneNo IPR availableCOILSCoilCoilcoord: 2811..2859
NoneNo IPR availableCOILSCoilCoilcoord: 2492..2512
NoneNo IPR availableCOILSCoilCoilcoord: 203..223
NoneNo IPR availableCOILSCoilCoilcoord: 2954..3011
NoneNo IPR availableCOILSCoilCoilcoord: 1039..1073
NoneNo IPR availableCOILSCoilCoilcoord: 3370..3411
NoneNo IPR availableCOILSCoilCoilcoord: 496..516
NoneNo IPR availableCOILSCoilCoilcoord: 1326..1360
NoneNo IPR availableCOILSCoilCoilcoord: 3123..3178
NoneNo IPR availableCOILSCoilCoilcoord: 997..1024
NoneNo IPR availableCOILSCoilCoilcoord: 1207..1241
NoneNo IPR availableCOILSCoilCoilcoord: 1144..1171
NoneNo IPR availableCOILSCoilCoilcoord: 1577..1597
NoneNo IPR availableCOILSCoilCoilcoord: 1665..1734
NoneNo IPR availableCOILSCoilCoilcoord: 1291..1311
NoneNo IPR availableCOILSCoilCoilcoord: 2582..2602
NoneNo IPR availableCOILSCoilCoilcoord: 2414..2452
NoneNo IPR availableCOILSCoilCoilcoord: 1623..1657
NoneNo IPR availableCOILSCoilCoilcoord: 1945..2021
NoneNo IPR availableCOILSCoilCoilcoord: 2917..2944
NoneNo IPR availableCOILSCoilCoilcoord: 3021..3044
NoneNo IPR availableCOILSCoilCoilcoord: 1852..1897
NoneNo IPR availablePANTHERPTHR34491FAMILY NOT NAMEDcoord: 43..539
NoneNo IPR availablePANTHERPTHR34491:SF9coord: 2362..3181
coord: 43..539
NoneNo IPR availablePANTHERPTHR34491FAMILY NOT NAMEDcoord: 2362..3181
coord: 593..2012
NoneNo IPR availablePANTHERPTHR34491:SF9coord: 593..2012
NoneNo IPR availableSUPERFAMILY57997Tropomyosincoord: 3101..3277

Alignments
The following features are aligned
Aligned FeatureFeature TypeAlignment Location
H-paniculata_contig243contigH-paniculata_contig243:661..42962 -
Analyses
This polypeptide is derived from or has results from the following analyses
Analysis NameDate Performed
InterProScan on OGS1.02022-09-29
Diamond blastp: OGS1.0 vs UniRef902022-09-16
OGS1.0 of Halopteris paniculata Hal_grac_a_UBK monoicous2021-02-24
Relationships

This polypeptide derives from the following mRNA feature(s):

Feature NameUnique NameSpeciesTypePosition
mRNA_H-paniculata_contig243.6587.1mRNA_H-paniculata_contig243.6587.1Halopteris paniculata Hal_grac_a_UBK monoicousmRNAH-paniculata_contig243 133..43655 -


Sequences
The following sequences are available for this feature:

polypeptide sequence

>prot_H-paniculata_contig243.6587.1 ID=prot_H-paniculata_contig243.6587.1|Name=mRNA_H-paniculata_contig243.6587.1|organism=Halopteris paniculata Hal_grac_a_UBK monoicous|type=polypeptide|length=3624bp
MDQLTLQAREEHSVTERERARLEGCVIQLERGKRATEGVLRATQEDLEEA
CLELEDASHRLAQSQHQLSAAKKDLSNARASLAVAQGELVEARNALSLAE
EELAAVKEELLSTRDALSAAREELRATNGEVNAARGADGDGAGVGSGGGS
ARAHRSAVADSRERANGGRRRTRQFAIVRQNLGAAEANAARSKGERTETR
QELEAATAALERTGALLQAAESERAMTDGELAVVRKNLEAAEADATRSTE
EREETEGELAAAMAAVDRTEALLRTAESERATADGELAVRREAEASASHR
QELLETAEEGAAASSERLEHANERRAAAEAKTADLIEKLAQVQAEAAVSA
AEAEQELKDNVGLTDEEKQRSQLEQEIERSEESRVLLEARLSSLENDLLA
ATRQFNERAARVGVLEDEIRSLSQEVRVQKASAAAAREEVVRLEAEQREA
EASAVDFQEQLQNALCQAKAVAADLEAARSRTRETEDALAERDTRVIAAQ
AECSAANQQRELLETRLALIQSKGEEVKVSQRELREETERRRLDRLLQET
HADLAAATAAAAAASTAETEAAACAQRARAAQESAEDGAAAAESRADRLE
AECVELTDAAERLGNQIADVAEREEVLQGLLQRAEEGRAEAERASEEARV
VVARERAELVSIRRRAEEGEEERRWLVGQVSLLQAKKDDGEELSALRAKS
AAVEEKASAVSREAEGQQRSLRAEIQARDARISELEAQVTTLVAARDRLA
RARDTLVADSFSSQDLLRGASNRLRRLRRPPTAISALGNGHRRAKSAIGV
AGGGGGGDDGNNVSASCLVFGTAYAVDDSIGSRSGRGGRGVRGDAGVTAA
RADDGKSNSHNNRCGSSDDGNRISTAAGKGRQEKLLSSCPPLFLDSPVDF
DGNTADYVNLRESMPGWAGGARGAGSLAQRALFRQGTRGLEEEGGEGGEG
AAGAAVEVLREVEIMQATVWELEQHERTLLARLEDQAGALLSAEDSRRAA
EGRANAAVAEVEQLSARAQSLEKGAASTSQRLADEEGTTSELQRRLDRSE
SIVDDLKAKLRGSKEEVRRLRGQLEATGLSDTAMMGLLRGKDAALAAAGA
RVSALESAKRELQEQLEATEEQRQEAQDLAESVRGQLEGRGTFDRRTRGR
LERAEEELEHLRVQAAEADAAAIALHERIDSSTGEAEILAAELHESEEAV
ATRDGLLREAEEAAELSKQRLARALDEREGAVRRAAEAEALAAAEGAAAV
RLRQEVESRDSRLSAVRKELEEAQVLLEEKLRVELSLTEAREEQSARLKQ
AEGALRQASEQLEASHVHRTAEECLKQDMETSIEAFRGEVEELRRQMTEM
ERGRAEAEVATKEAVLEAAKATTRIELGAKEIEEIKARLEATAAESRTAQ
EQGRTLAARVNMLEAELDGKTREAEELRVRSRETEMDAEKLRKRTTQLEG
KSAAREAQVALTTLVVEQAKVEQERAKTVALQVSLDASTKEAFLARETLA
EAKASLGMAREALHHAQTSLQVERVGSAAAKEDLATIRERLRKSQDEDLV
SALSELTASRGESARLVDERDSLVVRLKEALDARRAAEESAIESQRQAAD
TRNAAAGMREAARAREAEAAAGLEEALGVAEVAEAELAGARRELEAVERE
LAEACAGRRAAVGVAKVAEAELARAKRELEAVERELEAVERELAEAGAGR
QAAVGVAEVAEAELAKAKRELEAVERELAEACAGRQVAVGVAEVAEAELA
MAKRGLAEACAGRQVAEDAVRAGHGEVETLKESLCLAKEEALVQQQLTDR
LSSEELSLRQRLFDTEQALASVESELRATVDTALNDASAATVALRYDLAS
IRKAANDTRRGLEAEMMSLRQQLLASIESAERSKVEAEESAEAAAAQAAE
TAAASQHASVTNANALVALELALSAAKERTRIAEDTAATTAQRRQVEAAE
TIAEAERSAKAAEEQAAAAADQARGEQARAQALERTLETTRAALADASAR
RQAEEEEREEEERRAAAAEAVELRWLDGELDDLAECLRDAVARARSGEWS
ENVGGTDAVMSEGGSGDGVTTMATVAPACIAERGDDLGRLVGVAKEASAH
AKILREALAGTMGEADEAARELEATLGEVRRLTSHNAVLEETLDKVVATT
MTTTERRTTPAPPAVRHQTHGEQHSSAEDDTGGDSGGTDNLVDASTRAEA
LERTNQHLRGLLHSLFAVGHDEAAGAPAADAVVGNDGATGNTRGRDFLPS
SARATVPERSRSRNRRTQRWSYSGGAKGLEGAVSHHHARLGYSASNADSR
YAYRNGSGGGVKSFVGGSSKEANVGGAAAGAWLGVVEPVWLDGTDHDKDR
VLTTSLEGRCQQQQQDQQQQDQQQQDQRWWVRRRDNNGLSYDGGRYDAEE
SELRSSSSGLSRALRSLVNVVQERETRVAALETELKQERDAARSELKQAR
DGARGEIEAREMAVHDMEAQMADLRAEVESLRSESTASKEISQDLESQIA
MLSRQAEAAAIKAAATVSSLENDLNLSRKDTEVQEQERRDYREEMEGNLA
EGHESILVLQGALEHAVNAAGGLLERAEAAASEAERGEVETLEAELRVFE
RRLPTIRSSRNLRRDTSIGRRSYYDTSRRSSSSPENRRVVFVGGYSRIAI
PSLNGSGLPGNPRASWSHPVVAKDAAQMDHSAFRGARSVGSLPRRGSGIQ
RKREGSFDVVSDGGGLRAEGDGDDVRAWPEFLGLVEAEAVVHRATSEMDE
VCFDIEAFVLRQAIARAADMRSSFAQADSRQEAATAAAVRPVDTEDKKNV
LEEAWGGQVGGTEAEERLARLEAEAARARCEAEERTAELEALKTQRETLI
RRVAAAEAGAALSRAVAHTANSRSASLSPASTSPQTRHATAEPVPSQMTH
VAAAAVSTSTIETVAVAEAAETALAAARSDLATAHAELSAARDQLDTLRA
GVRISEAEDREQDHRLLLEQQKQEEEKQRLEGDRRRLKDDRRRLENDRMR
LGQERERFEGEERAKFEEEKQAVLHRERQRLESSLREQQRQQQQQRDCHN
DSRNSGSPAHEEESRKQQQHVAAVAAEAVAEATAGLRAEISDITTRAAAQ
EALSAKKAGVELAQLESRLAARIVGLEDELARERKAMQEAERRVERVEAR
RRGLEEGLEAANRRAKIREENVRDLESRLESGSRRRQSLEHPLQHAETAR
RLKISGGGGLSNVEDAESSVASSTSVLELRREVSRVTARAKVLGQRLDET
VKRNRWLEKEVAQAVKLGARAEAELGAALAGERMQRDGELTEIKCVVDEM
MTLDASASGGGIAGRGRDLFSPPRRGAGGSRRSQAISHQPRSSSEAQHDT
TLNFMDVGAAARLTEAWSLLEASEAARRKLQGEVKSWADRAAKLEGALAA
AEAAVEEGAREARLLAASLQDAREGLAAEEGARREAEGRAEALRVMLQAG
DWGASGGGASPARGGGGGDVARGLEGQVKALRSRVEELLERAREAEVREV
LEKRGRKAAQHALSELANQRISRPATAPAASGAKDKRRSTRQSKSSVARQ
THGGKDRKFVGKVIDSSVSGSGVDSPRERRGEEGNGLREGALGGGSGDGG
EDAVWLREAEALLAVSSSPDRGH*
back to top