prot_H-elongata_contig1173.1356.1 (polypeptide) Himanthalia elongata Himel1 dioecious

You are viewing a polypeptide, more information available on the corresponding mRNA page

Overview
NamemRNA_H-elongata_contig1173.1356.1
Unique Nameprot_H-elongata_contig1173.1356.1
Typepolypeptide
OrganismHimanthalia elongata Himel1 dioecious (Himanthalia elongata Himel1 dioecious)
Sequence length1958
Homology
BLAST of mRNA_H-elongata_contig1173.1356.1 vs. uniprot
Match: D8LLV3_ECTSI (DUF3730 domain-containing protein n=2 Tax=Ectocarpus TaxID=2879 RepID=D8LLV3_ECTSI)

HSP 1 Score: 1555 bits (4026), Expect = 0.000e+0
Identity = 1001/2033 (49.24%), Postives = 1272/2033 (62.57%), Query Frame = 0
Query:    1 MKDDIVSLLRRTAADEVETQYNAVDRLINILRGKMIARDKDGALAEARTALYGLLTSPRPAVVSKACQAGLSQLVLTKRPHTESAIPIVDEEEVIDQLVKALQTDLTRSEQHEQLKLQQPGGRQRRQRVGVTQALTKCMVDVMRKSARRGASRE------------RHGLIMTLLAMNRGLLFPALSHEATCFLGGADVDPSSVLCVTSPLTAAILLQPEYVNLRGIFLLKLSTASATASDIVKLCLIVLQAELLSFCAVYTEAHADIAASWCFALANAAISLESGVSWDRASCAVTGVTISLLAEFRERGFSIAPLLTSLRSMAAAGAVSLAAEVSFLGITALQTPCIDERDALLDIIGHTIR---------PIRLAGVVDTRELAWSLDTLVYPVISMAATGNKAAAQVLTPLEAAFSAMSRHRLKDEQIGESGMRARNNNNGDGDSAV-KYLRHRTAVALRVHRLGALDDDIE-LVRSCEGLRRRAEEHVRLRREGGGDEGGRRDKATLSSDLLELESSLCLLSPVILRPRLQRAHGAACAALVSVVRAVPTLGVRLLPFVLYTIRRLVGYAEPDVGGVLLPLLRVVPELGAHKVAVKQVTGTLKSLARAPQEAVRGLGLRLAARLIQINSRTFDQLQYLLVKIPADHLPPSPPEPEESRVCRVAGMLDVCMDKPELGLECVRPLQVLLSDPSAAVVALALRAIAALIRADCLDFDVALRIVNKKCKVAHAERDAGEDRGEPLVIESLVEVCGAGAEAVTMAAATESSXXXXXXXXXKVHGSQWGMKSAVEILLERNIGCHPDETVRRAVYSALAAHLPALLRAATYQEADEDAAVLVPRVRAFLSGAIFAEPSLSARSSLHNAVNIVLVAESLDSSTWRTSSGRAATAPGARVAHEKQQSGPSNRLLAALPRPEIVLESFRSDSSCCPGLAGAVLWCYPAPAVEMATARLDVIARELGELMMAEGTGAGLASCPWQRTLIPLGIQRFVRRLFATCLAAES--------ARSGNDLPTDVAAAVEACRSAIQDVRGVPQGLVAVAAASLAACVPVSCAYVAVEEATLGVRRLRDNSIDGAHMLLGSKELFPLAAAMAARALPVEAAQAQAEVADVLEALPSVQDKVGTDAQTPMVDSGIFSHGETPASFWACVAVGVASEWGIRHPTTPEARRAVSRGAWHLITGLASVMGSDHVASIADAWFCCKAKPESHEGQRPEIVKWDNIDVGSVLLRGGRPQMGLPTTARGSRCLALFLGLCSIPAGLRATGLHEELLQLFNIVRAWQE---AGVCGAAMCLPTAASECLSCGLIDSPVILDCLRSLSVALDGATSA-------AQDVCIGAAGLVASVHAKVVLPLGFTESMFEQLRKAAVAHHTDAGSGARVASLLALASMVGCPLLGVGEFVPRCMRLSSFASRRMVENLLQTVQEAMEGASLRAKNVGARVWGCLSAVGQDERSVEDRALRDALGWTEDGEL--LASAAGEFISPDALSVAREDTLMATVLTGLQAVAGGEGDIGEKGDGPANDRGENTASPDTLLRHPSLFTTSAMACLEEASPTLRVPHTQMAAVVGAIFRGGHGAHVETRCISLALALAGKHRAYSTWLGGLYRKPLFVNLPPKTRRHLVATFDRFGLAMSSKTIEDLMEGVWDSLAPTLFAR-ALPGGPGSTRVMSGDDKIIHQAAEFLSGMGRLARSASAATRATVQAVTTGIILPSVLNAFALRFDPNSLVV----GPMLDAFVELLSSLPPESVRLAISFGPKLSSLIPNS-NATQESIRAYLVSRLSA-GEGEGLYA-------------------------VVKWATSVRTDCEACAAVLPHLAESFARINAAASRRKWLQNLLDTAGLPENCPSRAAALLGGAAIVWNDSAIVGGSFVLKEKLDGLFGSAAFGGRGYRRGSLLCALSFAAPSAVAKIEEASSGVSTEVLTRLIRVSGLLRSRNRPGGSAPLMRRVDDEEEEIQLGFEGFIRGLRHAPQIMSGTLSRQFAAYAESIAAQEA 1958
            M+ D+ +LL R   D+VET  NA+ RL+     K++A D  G   +AR AL+G L S R AVVS  CQ GL+QL+        S I +++     D+LV+ L+  + R E       QQ  G +  Q  GVTQ LT+C+V + R SARR A                +G+   LL+MNRGLLFPALSHE TCFL   + DP   + V  PL +A+LLQPEY NLR  F+LKLS ASATASD VKLCL++LQAELL F A++T AHAD+AA W  +L N A+SL+S  +WDRAS A+ GV + LL+EFR RG  I P+L+S++ + AA  + LA EV+FLGITALQ+ CIDER+ALLDI+G T+          P  +   VD R  AWSL+TLVYP++SMAATGN  +A VL  LEAA   +   R K E + ++ +       GD  SA  ++LR  + VAL + RLG LD D + +V +C GL++RA +         G  GG  D    +S + +LE  LCLL+P++L+   ++ H A C  LV+VVRAVP+LGVRLLPFVLY IR+L G A    GG +  LL ++PELGAHK++ K V   +++LA+APQ+AVRGLG+RL A L+Q+N RTF+QLQ LL + PADH PP  PEP+ESR+CR AGML++C   PELGLECVRPLQ  L D S+AV ALAL+AIAAL R+DCLDF  ALRIV KK KVAH  RD  +  G+P V+ES+ ++CGAGAE           XXXXXXXXX   G  WGM  AVEILL   +GCHPD+ VR AVY AL  HLPALLRA + + A+E+A V    VR FL+ A+  + S   +S+L   V IV+  ES++ STW ++    A+  G +      + GPSNRL+AALP PE VL+ FR D S CPGLAGAVLW YP P      A  D++ R+ GELM  EGTG GLA CPWQR     GIQR+V RLFA C+AAES        AR G D+    AAAVEACR AI ++RGV  GLVAVA+ASLA+CVP S  +VAV E    V RLR     GA  LL  +E+FPL AAMA RALP  +        + +E   S   +  T ++      G         SFW+CVAVGVASEWG+RHPT P AR AV R    L+ GLA+ + SDH+ +I + WF       + E  R  +V W+++D+G  +      ++GLPTT RGS CLALFLGL S   GLRATGLH ELLQ+F+IV+A      AG+CGA +CL  AASEC+SCGL+D+PVIL CLRS+SV+LDG  +        AQD  +GAAGL+     KVVLP GF ES+FE LRKAA AH   A SG RVASLLALAS++GCPL+  GE VPR +R++S  +RRMV+ LLQ V EAM+G S+R KN  ARVWGCLSA+GQDERSV + +L+ +LGWTEDG    ++  A   I P AL VA++ TLM  VLTGLQ++A G  DI E GD  A    EN  +   +    SLF  SAMA L    PTLR+PH QMA V+ A+FRGGHG  V+ +CISL LALA K +AYSTWL GL+ +P FVNLP   + HLVA FD+  L + S+  +DL + +WD++ P  F   +   GP    V+    +   QAA FLSGM  L    +A TR  V+++T     PSVL+AF  R D +   +     P  DA V LLS LP E V+ AI+  P  ++    S    +E +R YL +RL+  GE   +++                         V +WAT +RTD +A AAVLP LAE+  RINA A+  KWL  LLDTA LPE+C  RAAAL GGA  +W  S    G  ++ E+ D L G  A+G       +L  +LS  AP AVA+++  S  VST+VL RL+R++GLL  R      A   RRV  E EE+  G EGFIRGLRHAP +++GTLSR FA Y ES+AA  A
Sbjct:    1 MRKDLTALLARAEVDQVETSQNAISRLV-----KLVAEDSSGV--DAREALFGCLGSSRLAVVSSGCQ-GLTQLL---ESQDSSGIDLIESG---DELVRHLKAAMAREEDQRN---QQGDGARHNQEHGVTQCLTRCLVAISRLSARREAQPTCGGEKGVWAGVAGNGVSAMLLSMNRGLLFPALSHETTCFLSRLNTDPREAVRVVCPLASALLLQPEYANLRSGFMLKLSMASATASDAVKLCLLILQAELLVFGAMHTGAHADVAAGWFCSLVNTAVSLDSDPAWDRASRALAGVGVFLLSEFRGRGVPITPVLSSMQFLVAADPLCLADEVAFLGITALQSHCIDEREALLDIVGRTLSAMAPRVFHDPKVIPDNVDVRVRAWSLETLVYPLVSMAATGNPVSANVLPLLEAALGGVY-SRSKFETMADARVE------GDRSSAGNEHLRLSSPVALGIRRLGVLDGDQQAMVVACMGLKQRANDLS-------GSNGGVTDAGRDASAVADLECGLCLLAPLLLQQH-EQTHEAVCTVLVAVVRAVPSLGVRLLPFVLYGIRKLGGVASE--GGSVARLLHLLPELGAHKLSAKPVAAVIQALAKAPQQAVRGLGMRLVAALVQVNPRTFNQLQSLLSETPADHTPPLSPEPDESRLCRAAGMLEICETDPELGLECVRPLQGFLGDGSSAVTALALKAIAALCRSDCLDFGAALRIVTKKGKVAHTGRDDSDAFGDPRVMESMAQLCGAGAEXXXXXXXXXXXXXXXXXXXXXXLG--WGMGKAVEILLAGGLGCHPDDGVRSAVYEALGFHLPALLRAVSGKNAEEEAIVAARHVRVFLAQAMSTDGSFMVQSNLRKVVQIVVAEESVEPSTWVSAKRDGASRDGGQK--RSVRPGPSNRLVAALPEPESVLQGFRQDDSSCPGLAGAVLWSYPTPQATAVVAHRDIMIRDFGELMAVEGTGGGLALCPWQRAGTLSGIQRYVARLFAACVAAESTEAAGRGEARGGTDV---TAAAVEACRQAIGNIRGVQGGLVAVASASLASCVPASFYHVAVVETGRAVDRLR-RCTGGAQTLLDGEEMFPLCAAMAVRALPEASTTLVESTLEEIERFHSTAVEGWTTSRDSAAAVGEAMTPNEAQSFWSCVAVGVASEWGLRHPTAPGARIAVLRAVRCLLAGLANAVRSDHIHAIVETWFGGNGSVAARE-DRAAVVDWESVDIGQAI-HWEDSEIGLPTTTRGSICLALFLGLSSSLPGLRATGLHSELLQVFSIVQALALKPLAGLCGATLCLAAAASECISCGLVDAPVILTCLRSVSVSLDGLANPSGSEKLPAQDTSLGAAGLIVVCEGKVVLPPGFAESLFESLRKAA-AHRRGANSGVRVASLLALASLIGCPLMAPGELVPRRLRVTSITNRRMVDTLLQDVLEAMQGTSIRLKNAAARVWGCLSALGQDERSVGNSSLQASLGWTEDGGTHGISGPATASIRPGALRVAQDGTLMNVVLTGLQSIATGLEDI-EDGDTKA----ENYKA--VVPVQSSLFAASAMASLTFC-PTLRIPHPQMAIVIEALFRGGHGVEVQVKCISLGLALADKEQAYSTWLRGLFDRPFFVNLPRDVQHHLVAVFDQIFLKLPSEIGKDLAKKLWDTITPRFFTSWSRASGPEREGVVVDGKEGSSQAAAFLSGMSTLV---AAGTRGEVESMTLTRFWPSVLHAFCTRDDLSRFDLDVEEAPFWDALVGLLSHLPWEQVQDAIASKPGATNTKTASVQLCEECLREYLTTRLTPPGEASTVFSTGGMFSRSSRPSVAATIVTAKALGSVARWATRIRTDRKASAAVLPRLAEALKRINATAAAGKWLVTLLDTAELPESCVVRAAALAGGATDIWEPSNT--GLLIVGERSDALLGCGAWGTA--HGCALWYSLSVTAPRAVARVDRTSPDVSTDVLARLLRLTGLLHGRIGDAKEATDQRRVV-ELEEVAYGVEGFIRGLRHAPAVLNGTLSRSFATYVESVAAHRA 1972          
The following BLAST results are available for this feature:
BLAST of mRNA_H-elongata_contig1173.1356.1 vs. uniprot
Analysis Date: 2022-09-16 (Diamond blastp: OGS1.0 vs UniRef90)
Total hits: 1
Match NameE-valueIdentityDescription
D8LLV3_ECTSI0.000e+049.24DUF3730 domain-containing protein n=2 Tax=Ectocarp... [more]
back to top
InterPro
Analysis Name: InterProScan on OGS1.0
Date Performed: 2022-09-29
IPR TermIPR DescriptionSourceSource TermSource DescriptionAlignment
IPR022542Domain of unknown function DUF3730PFAMPF12530DUF3730coord: 559..743
e-value: 4.9E-16
score: 59.0
NoneNo IPR availablePANTHERPTHR16212FAMILY NOT NAMEDcoord: 1..1026
IPR016024Armadillo-type foldSUPERFAMILY48371ARM repeatcoord: 5..1798

Alignments
The following features are aligned
Aligned FeatureFeature TypeAlignment Location
H-elongata_contig1173contigH-elongata_contig1173:7306..14838 -
Analyses
This polypeptide is derived from or has results from the following analyses
Analysis NameDate Performed
InterProScan on OGS1.02022-09-29
Diamond blastp: OGS1.0 vs UniRef902022-09-16
OGS1.0 of Himanthalia elongata Himel1 dioecious2021-02-24
Relationships

This polypeptide derives from the following mRNA feature(s):

Feature NameUnique NameSpeciesTypePosition
mRNA_H-elongata_contig1173.1356.1mRNA_H-elongata_contig1173.1356.1Himanthalia elongata Himel1 dioeciousmRNAH-elongata_contig1173 7306..14878 -


Sequences
The following sequences are available for this feature:

polypeptide sequence

>prot_H-elongata_contig1173.1356.1 ID=prot_H-elongata_contig1173.1356.1|Name=mRNA_H-elongata_contig1173.1356.1|organism=Himanthalia elongata Himel1 dioecious|type=polypeptide|length=1958bp
MKDDIVSLLRRTAADEVETQYNAVDRLINILRGKMIARDKDGALAEARTA
LYGLLTSPRPAVVSKACQAGLSQLVLTKRPHTESAIPIVDEEEVIDQLVK
ALQTDLTRSEQHEQLKLQQPGGRQRRQRVGVTQALTKCMVDVMRKSARRG
ASRERHGLIMTLLAMNRGLLFPALSHEATCFLGGADVDPSSVLCVTSPLT
AAILLQPEYVNLRGIFLLKLSTASATASDIVKLCLIVLQAELLSFCAVYT
EAHADIAASWCFALANAAISLESGVSWDRASCAVTGVTISLLAEFRERGF
SIAPLLTSLRSMAAAGAVSLAAEVSFLGITALQTPCIDERDALLDIIGHT
IRPIRLAGVVDTRELAWSLDTLVYPVISMAATGNKAAAQVLTPLEAAFSA
MSRHRLKDEQIGESGMRARNNNNGDGDSAVKYLRHRTAVALRVHRLGALD
DDIELVRSCEGLRRRAEEHVRLRREGGGDEGGRRDKATLSSDLLELESSL
CLLSPVILRPRLQRAHGAACAALVSVVRAVPTLGVRLLPFVLYTIRRLVG
YAEPDVGGVLLPLLRVVPELGAHKVAVKQVTGTLKSLARAPQEAVRGLGL
RLAARLIQINSRTFDQLQYLLVKIPADHLPPSPPEPEESRVCRVAGMLDV
CMDKPELGLECVRPLQVLLSDPSAAVVALALRAIAALIRADCLDFDVALR
IVNKKCKVAHAERDAGEDRGEPLVIESLVEVCGAGAEAVTMAAATESSEE
DSEEDSEKVHGSQWGMKSAVEILLERNIGCHPDETVRRAVYSALAAHLPA
LLRAATYQEADEDAAVLVPRVRAFLSGAIFAEPSLSARSSLHNAVNIVLV
AESLDSSTWRTSSGRAATAPGARVAHEKQQSGPSNRLLAALPRPEIVLES
FRSDSSCCPGLAGAVLWCYPAPAVEMATARLDVIARELGELMMAEGTGAG
LASCPWQRTLIPLGIQRFVRRLFATCLAAESARSGNDLPTDVAAAVEACR
SAIQDVRGVPQGLVAVAAASLAACVPVSCAYVAVEEATLGVRRLRDNSID
GAHMLLGSKELFPLAAAMAARALPVEAAQAQAEVADVLEALPSVQDKVGT
DAQTPMVDSGIFSHGETPASFWACVAVGVASEWGIRHPTTPEARRAVSRG
AWHLITGLASVMGSDHVASIADAWFCCKAKPESHEGQRPEIVKWDNIDVG
SVLLRGGRPQMGLPTTARGSRCLALFLGLCSIPAGLRATGLHEELLQLFN
IVRAWQEAGVCGAAMCLPTAASECLSCGLIDSPVILDCLRSLSVALDGAT
SAAQDVCIGAAGLVASVHAKVVLPLGFTESMFEQLRKAAVAHHTDAGSGA
RVASLLALASMVGCPLLGVGEFVPRCMRLSSFASRRMVENLLQTVQEAME
GASLRAKNVGARVWGCLSAVGQDERSVEDRALRDALGWTEDGELLASAAG
EFISPDALSVAREDTLMATVLTGLQAVAGGEGDIGEKGDGPANDRGENTA
SPDTLLRHPSLFTTSAMACLEEASPTLRVPHTQMAAVVGAIFRGGHGAHV
ETRCISLALALAGKHRAYSTWLGGLYRKPLFVNLPPKTRRHLVATFDRFG
LAMSSKTIEDLMEGVWDSLAPTLFARALPGGPGSTRVMSGDDKIIHQAAE
FLSGMGRLARSASAATRATVQAVTTGIILPSVLNAFALRFDPNSLVVGPM
LDAFVELLSSLPPESVRLAISFGPKLSSLIPNSNATQESIRAYLVSRLSA
GEGEGLYAVVKWATSVRTDCEACAAVLPHLAESFARINAAASRRKWLQNL
LDTAGLPENCPSRAAALLGGAAIVWNDSAIVGGSFVLKEKLDGLFGSAAF
GGRGYRRGSLLCALSFAAPSAVAKIEEASSGVSTEVLTRLIRVSGLLRSR
NRPGGSAPLMRRVDDEEEEIQLGFEGFIRGLRHAPQIMSGTLSRQFAAYA
ESIAAQEA
back to top
Annotated Terms
The following terms have been associated with this polypeptide:
Vocabulary: INTERPRO
TermDefinition
IPR022542DUF3730
IPR016024ARM-type_fold