mRNA_H-elongata_contig12037.1570.1 (mRNA) Himanthalia elongata Himel1 dioecious

You are viewing an mRNA, more information available on the corresponding polypeptide page

Overview
NamemRNA_H-elongata_contig12037.1570.1
Unique NamemRNA_H-elongata_contig12037.1570.1
TypemRNA
OrganismHimanthalia elongata Himel1 dioecious (Himanthalia elongata Himel1 dioecious)
Homology
BLAST of mRNA_H-elongata_contig12037.1570.1 vs. uniprot
Match: D7FSC3_ECTSI (Cellulose synthase (UDP-forming), family GT2 n=2 Tax=Ectocarpus TaxID=2879 RepID=D7FSC3_ECTSI)

HSP 1 Score: 1322 bits (3422), Expect = 0.000e+0
Identity = 639/757 (84.41%), Postives = 699/757 (92.34%), Query Frame = 1
Query:    1 AGAQETRLFPSAYLVRILAFANVCLGCLYLHWRWTETFPD-IGRWEYTHWQFYWWWCFFLAEIFLAIAVWIGLAQRLFPVQRIKVTMDDITSVDDQVGYNARVCILLPTAGENLEVVFKALVGSISQRLWDSGLPECQTLRVVVLDEKRRVEVYRVCAGLHRIGVLLAGRRVQQILMAEGVTELTPKGFIDWCRNGSGYERKHLYDDKKLNEAVQVLRLLDAMCLANGLTDAFALEARPSSATYNPITSAAWNAASRVSKANETTVETIADLNDSARSEAEAKMLGASAMNVTPGFYEIFGSGSNSGETGAGKDVQKGLPTLVYYSRKEAGSPKISPKAGNMNSAIFPLDDPQSEPLVGDATIVVVNDARHQLEANFLQRTVPYFFELTGGLPTVASGGRYRWAKVAFVQTPQRFRMELANDPLGNHAISQYDVINHGKDGIGAVSSSGQGSLWRVEALKGQQPDGKVVDDPKDLSLVGKKLGFRSEMLIEDTHTSVDLFRQGWRSVYVNEPGEVLAWCTHQPTSLTWRIKQVLRWHQGAVQLLLFKGLRYTSIGGYYPTIWHRLYAFDLATYYLQALPGYVLLVMPIVYGVTGKPPFITRLKDYFMYFTPFIVTALLPTAISSQWRKSDSHRLTRDEQTWLSTTYVQIFAFLQVIWTAITRKSHENAWVAKVPTWPLVVVFLGQIVAVAGGVYWVIEYGFVLWYANFFSIIVVAGLAMHALWPMVSQSLGWSIPSFYYIKLFLWIFLGFSAVVLAN 2268
            A  QE RLFPSA+LVR+LA AN  LG LYLHWR+T TFP  +GRW+Y  W+ YWWW FF AE FLAIAVW+GLAQRLFPVQRIKVTMDDITSVDDQVGYNARVCILLPTAGENLEVVFKALVG++SQRLWDSGLP  QTLRV+VLDEKRR+EVYRV AG+HRIG LLAGRR+QQILMAEGVTELT KGFIDWCRNGSGYERKHLYDDKKLNEAVQVLRLLDAMCLANGLTDAFALEARPSSATYNPIT+AAWNAA++  K+N+ +VE +A+++D+ARSEAEAKMLGASAMN+TPGF+E++G+  +       K+VQKGLPTL+YYSRK AG+PKISPKAGNMN+AIFP+DDP   PL G++TIVVVNDARHQLE NFLQRTVPYFFEL GG PTVASGGRYRWAKVAFVQTPQRFRMEL+NDPLGNHAISQYDVINHGKDGIGAVSSSGQGSLWRVEALKGQ+PDGK+VDDP +L LVGKKLGFRSEMLIEDTHTS++LFRQGWRSVYVNEPGEVLAWCTHQP+SLTWRIKQVLRWHQGAVQLLLFKG+RYTS GG++PT+WHRLYAFD ATYYLQA+PGYVLL+MPIVYGVTG PPF+T LKDYF YFTPFIVTALLPTAISSQWRK DSHRLTRDEQTWLSTTYVQI+AFLQV+WT +TRKS ENAWVAKVPTWPL  VFLGQ+ AVAGGVYWV++ GFV+WYANFFSI+VVAGLAMHALWPMVS SLGWSIPSFYYIKLFLW+FLGFSAVVL N
Sbjct:  255 ANPQEKRLFPSAHLVRVLAVANAGLGVLYLHWRYTSTFPPTVGRWDYMSWKLYWWWLFFSAEFFLAIAVWVGLAQRLFPVQRIKVTMDDITSVDDQVGYNARVCILLPTAGENLEVVFKALVGALSQRLWDSGLPGSQTLRVIVLDEKRRLEVYRVAAGVHRIGELLAGRRIQQILMAEGVTELTQKGFIDWCRNGSGYERKHLYDDKKLNEAVQVLRLLDAMCLANGLTDAFALEARPSSATYNPITAAAWNAAAQAQKSNKPSVEAMAEMSDAARSEAEAKMLGASAMNITPGFFEVYGTHLDPDNMETSKEVQKGLPTLIYYSRKNAGTPKISPKAGNMNAAIFPVDDPTMTPLTGESTIVVVNDARHQLEGNFLQRTVPYFFELAGGHPTVASGGRYRWAKVAFVQTPQRFRMELSNDPLGNHAISQYDVINHGKDGIGAVSSSGQGSLWRVEALKGQRPDGKIVDDPTELDLVGKKLGFRSEMLIEDTHTSIELFRQGWRSVYVNEPGEVLAWCTHQPSSLTWRIKQVLRWHQGAVQLLLFKGIRYTSFGGHFPTMWHRLYAFDQATYYLQAIPGYVLLIMPIVYGVTGTPPFVTSLKDYFQYFTPFIVTALLPTAISSQWRKIDSHRLTRDEQTWLSTTYVQIYAFLQVVWTGLTRKSPENAWVAKVPTWPLTFVFLGQVFAVAGGVYWVVQKGFVIWYANFFSIVVVAGLAMHALWPMVSLSLGWSIPSFYYIKLFLWVFLGFSAVVLTN 1011          
BLAST of mRNA_H-elongata_contig12037.1570.1 vs. uniprot
Match: D7FSC4_ECTSI (Cellulose synthase (UDP-forming), family GT2 n=2 Tax=Ectocarpus TaxID=2879 RepID=D7FSC4_ECTSI)

HSP 1 Score: 805 bits (2080), Expect = 1.520e-270
Identity = 417/760 (54.87%), Postives = 524/760 (68.95%), Query Frame = 1
Query:   10 QETRLFPSAYLVRILAFANVCLGCLYLHWRW--TETFPDIGRWEYTHWQFYWWWCFFLAEIFLAIAVWIGLAQRLFPVQRIKVTMDDITSVDDQVGYNARVCILLPTAGENLEVVFKALVGSISQRLWDSG----LPECQTLRVVVLDEKRRVEVYRVCAGLHRIGVLLAGRRVQQILMAEGVTELTPKGFIDWCRNGSGYERKHLYDDKKLNEAVQVLRLLDAMCLANGLTDAFALEARPSSATYNPITSAAWNAASRVSKANETTVETIADLNDSARSEAEAKMLGASAMNVTPGFYEIFGSGSNSGETGAGKDVQKGLPTLVYYSRKEAGSPKISPKAGNMNSAIFPLDDPQSEPLVGDATIVVVNDARHQLEANFLQRTVPYFFELTGGLPTVASGGRYRWAKVAFVQTPQRFRMELANDPLGNHAISQYDVINHGKDGIGAVSSSGQGSLWRVEALKGQQPDGKVVDDPKDLSLVGKKLGFRSEMLIEDTHTSVDLFRQGWRSVYVNEPGEVLAWCTHQPTSLTWRIKQVLRWHQGAVQLLLFKGLRYTSIGGYYPTIWHRLYAFDLATYYLQALPGYVLLVMPIVYGVTGKPPFITRLKDYFMYFTPFIVTALLPTAISSQWRKSDSHRLTRDEQTWLSTTYVQIFAFLQVIWTAITRKSHENAWVAKVPTWPLVVVFLGQIVAVAGGVYWVIEYGFVLWYANFFSIIVVAGLAMHALWPMVSQSLGWSIPSFYYIKLFLWIFLGFSAVVLANL 2271
            Q    F S++L+R +   NV  G  Y+ WR+  T+  P   +W            FF+ E+FL  A+W+G +QRLF VQRI+ TMD I S+D  VG NA V ILLPTAGE L+VV K L+G+ SQR W S     +     LRV+VLDEKRR EVY + +G+H +   +     ++IL AEGV  LTP  F +WC    G+ + H++ D  L+ AV ++R +D +   +   D + L+   S                 +SK+ E   + + +L           +L   ++++TPGF+++F            +   K    ++YYSRK+AG+P+ISPKAGNMN+A+FP+DDP S PL+G +TIVVVNDARHQL+  FLQRT PYFF++       A   +Y+WAKVAFVQTPQRFR +L +DPLGNHA SQYDVIN GKDGIGAVSSSGQGSLWRVEALKG+ PDGK   DPKDL LVGKKLGFR+EMLIEDTHTS++LFRQGWRSVYVNEPGEVLAWCTHQPT+LTWRIKQVLRWHQGAVQLL  KGLRYTS GG +PT++HR+YAFD ATYYLQA+PGYVLL+MP+VYGVTG+PPF T +  YF YF PFIVTA+LPT IS+QWR  DSHRLTRDEQTWLSTTYVQI+AFLQV WT + R + ++AWVA+VPTWPL +VF  Q VA+AG VYW +  GF  +Y N  SI   A L M  LWPM++  +G   PSF++ KL  ++ LG S V+L ++
Sbjct:   82 QTKESFSSSFLIRGVVVLNVASGFTYMVWRFLKTQDVPPEYKWXXX--------VFFMVEVFLLFAIWLGHSQRLFAVQRIRTTMDQIVSIDPAVGANAVVAILLPTAGERLDVVLKCLLGASSQRSWPSSSAAKMGRGDGLRVIVLDEKRRKEVYMLTSGVHALSTQILAPSTRKILQAEGVRNLTPLAFYEWCHEKRGFGKVHIFKDVGLSRAVAMVRQMDDLVTGDDGGDLYRLDRNQSFLNQGLDED--------ISKSKEG--DEVEELTHG------VSLLADESVHITPGFFQVF------------RGQAKQAACMIYYSRKDAGTPRISPKAGNMNAAMFPIDDPTSPPLIGPSTIVVVNDARHQLQPEFLQRTTPYFFDVD------AITQQYKWAKVAFVQTPQRFRKDLPDDPLGNHAASQYDVINIGKDGIGAVSSSGQGSLWRVEALKGRSPDGKTGVDPKDLGLVGKKLGFRAEMLIEDTHTSIELFRQGWRSVYVNEPGEVLAWCTHQPTNLTWRIKQVLRWHQGAVQLLYTKGLRYTSFGGSFPTVFHRMYAFDQATYYLQAIPGYVLLLMPVVYGVTGQPPFNTDITSYFSYFVPFIVTAVLPTVISAQWRSIDSHRLTRDEQTWLSTTYVQIYAFLQVSWTRLIRGNPDHAWVARVPTWPLTLVFAAQFVAIAGAVYWTLHNGFDTYYKNTLSICAGAFLGMFYLWPMMALQVGLGRPSFWFFKLGAYVVLGVSMVILGSI 799          
BLAST of mRNA_H-elongata_contig12037.1570.1 vs. uniprot
Match: A0A836CP13_9STRA (Glyco_trans_2-like domain-containing protein n=1 Tax=Tribonema minus TaxID=303371 RepID=A0A836CP13_9STRA)

HSP 1 Score: 780 bits (2013), Expect = 6.220e-257
Identity = 404/751 (53.79%), Postives = 503/751 (66.98%), Query Frame = 1
Query:   28 PSAYLVRILAFANVCLGCLYLHWRWTETFPDIGRWEYTHWQFY----WWWCFFLAEIFLAIAVWIGLAQRLFPVQRIKVTMDDITSVDDQVGYNARVCILLPTAGENLEVVFKALVGSISQRLWDSGLPECQTLRVVVLDEKRRVEVYRVCAGLHRIGVLLAGRRVQQILMAEGVTELTPKGFIDWCRNGSGYERKHLYDDKKLNEAVQVLRLLDAMCLANGLT-DAFALEARPSSATYNPITSAAWNAASRVSKANETTVETIADLNDSARSEAEAKMLGASAMNVTPGFYEIFGSGSNSGETGAGKDVQKGLPTLVYYSRKEAGSPKISPKAGNMNSAIFPLDDPQSEPLVGDATIVVVNDARHQLEANFLQRTVPYFFELTGGLPTVASGGRYRWAKVAFVQTPQRFRMEL-ANDPLGNHAISQYDVINHGKDGIGAVSSSGQGSLWRVEALKGQQPDGKVVDDPKDLSLVGKKLGFRSEMLIEDTHTSVDLFRQGWRSVYVNEPGEVLAWCTHQPTSLTWRIKQVLRWHQGAVQLLLFKGLRYTSIGGYYPTIWHRLYAFDLATYYLQALPGYVLLVMPIVYGVTGKPPFITRLKDYFMYFTPFIVTALLPTAISSQWRKSDSHRLTRDEQTWLSTTYVQIFAFLQVIWTAITRKSHENAWVAKVPTWPLVVVFLGQIVAVAGGVYWVIEYGFVLWYANFFSIIVVAGLAMHALWPMVSQSLGWSIPSFYYIKLFLWIFLGFSAVVL 2262
            PSA+++R +   N+C+ C YL WR T T   I  + +    F     W W F+  EI L IA+WIG  QRLF VQR+++TMDDI   DD VGYN+RV ILLPT GE L+VV KAL+G +S R WD+ + +C   RVVVLDEKRR  V  + A ++ +  ++    V  IL AEGV  +T KGF +W + G GY RKHLY+D  LN+A ++L  ++       +    F LE  P          A       V + ++ T +       SA S  +A  +G   + + PG+ + F             +    LPTL+YY+R++AG+PK+SPKAGNMNSA+F LD P   PL+G +TIVVVND RHQL+  FLQRTVPYFFEL       A G RYRWAKVAFVQTPQRF   + A+DPLGNHA  QYDVINHGKDGIGAVSSSGQGSLWRV ALKG   DG    D K+  LVG +LGFRSEMLIEDTHTS+++FR GW S YVNEPGE L+ CTHQP S+ WRIKQVLRWHQGAVQLL FKG+ +T  GG +PTI+HR+YAFD ATYYLQA+PGY+LL+MPI+YGV G+PPF T + ++F++FTPFIVTA+LPT IS  WR  DSHRLTRDEQ WLSTTYVQI+AFL + W  I  K   +AW  + PTWPL  VF G+  A+ G + WV + GF  W AN   +IV A LA+HALWPMVS  +GW +PS YY+KL  W+ +G   V++
Sbjct:  343 PSAFVIRAIVVLNICVSCAYLWWRVTRTIFQIDDYFFGI-PFLPVQGWAWAFYAVEICLTIAIWIGHTQRLFAVQRVRLTMDDIVREDDSVGYNSRVAILLPTNGEKLDVVMKALLGVVSLRGWDTSVEKCAAQRVVVLDEKRRKGVLNMAAAVYALATIVRHPNVLSILQAEGVHAITAKGFYEWWKTGGGYARKHLYNDHFLNQACRLLEYMEEEASTEAVAMSVFGLEELP----------AGVKGKQDVKRNSKKTTQA------SANSMLQAMNVGN--VTIEPGYVQTF-------------NTNVALPTLIYYTRRDAGTPKVSPKAGNMNSALFALDYPDMPPLIGSSTIVVVNDCRHQLQPEFLQRTVPYFFELD------ADGQRYRWAKVAFVQTPQRFTNNVQADDPLGNHAAVQYDVINHGKDGIGAVSSSGQGSLWRVAALKGVDADGNSYADVKERGLVGHRLGFRSEMLIEDTHTSIEMFRAGWSSRYVNEPGEHLSICTHQPNSIAWRIKQVLRWHQGAVQLLFFKGIGFTVWGGKFPTIFHRIYAFDQATYYLQAIPGYMLLLMPIIYGVCGQPPFNTTVGEFFLFFTPFIVTAMLPTVISGSWRGVDSHRLTRDEQVWLSTTYVQIYAFLSMCWQQIRCKGTADAWAVRAPTWPLFAVFAGEFGAIIGALVWVSQEGFERWAANLICVIVSASLAIHALWPMVSLQMGWQVPSLYYLKLLAWLLIGIFIVLI 1055          
BLAST of mRNA_H-elongata_contig12037.1570.1 vs. uniprot
Match: A0A835YSM9_9STRA (Cellulose synthase, family GT2 n=1 Tax=Tribonema minus TaxID=303371 RepID=A0A835YSM9_9STRA)

HSP 1 Score: 745 bits (1924), Expect = 2.330e-247
Identity = 384/747 (51.41%), Postives = 491/747 (65.73%), Query Frame = 1
Query:   28 PSAYLVRILAFANVCLGCLYLHWRWTETFPDIGRWEYTHWQFYWWWCFFLAEIFLAIAVWIGLAQRLFPVQRIKVTMDDITSVDDQVGYNARVCILLPTAGENLEVVFKALVGSISQRLWDSGLPECQTLRVVVLDEKRRVEVYRVCAGLHRIGVLLAGRRVQQILMAEGVTELTPKGFIDWCRNGSGYERKHLYDDKKLNEAVQVLRLLDAMCLANGLT-DAFALEARPSSATYNPITSAAWNAASRVSKANETTVETIADLNDSARSEAEAKMLGASAMNVTPGFYEIFGSGSNSGETGAGKDVQKGLPTLVYYSRKEAGSPKISPKAGNMNSAIFPLDDPQSEPLVGDATIVVVNDARHQLEANFLQRTVPYFFELTGGLPTVASGGRYRWAKVAFVQTPQRFRM-ELANDPLGNHAISQYDVINHGKDGIGAVSSSGQGSLWRVEALKGQQPDGKVVDDPKDLSLVGKKLGFRSEMLIEDTHTSVDLFRQGWRSVYVNEPGEVLAWCTHQPTSLTWRIKQVLRWHQGAVQLLLFKGLRYTSIGGYYPTIWHRLYAFDLATYYLQALPGYVLLVMPIVYGVTGKPPFITRLKDYFMYFTPFIVTALLPTAISSQWRKSDSHRLTRDEQTWLSTTYVQIFAFLQVIWTAITRKSHENAWVAKVPTWPLVVVFLGQIVAVAGGVYWVIEYGFVLWYANFFSIIVVAGLAMHALWPMVSQSLGWSIPSFYYIKLFLWIFLGFSAVVL 2262
            PSA ++R +   N+ +   YL+WR T T  +I               +F    +L +              RIK+TMD++   DD VGYN+RV ILLPT GENL+VV KA++G IS R WD+ + +C + RVV+LDEKRR  V  + A ++ +  ++    V  IL AEGV  +T KGF +W + G GY RKHLY+D  LN+A ++L  ++       +    F LE  P          A       V + ++ T +  A+           + L    + + PG+ + F             +    LPT +YY+R++AG+PK+SPKAGNMN+A+F LD P   PL+G++TIVVVND RHQL+  FLQRT+PYFFEL       A G RYRWAKVAFVQTPQRF+  + A+DPLGNHA  QYDVINHGKDGIGAVSSSGQGSLWRV ALKG   DG+   D +  SL+G +LGFRSEMLIEDTHTS+++FR GW S YVNEPGE L+ CTHQP S+ WRIKQVLRWHQGAVQLL FKG+ +T  GG +PTI+HR+YAFD ATYYLQA+PGY+LL+MPI+YGVTG+PPF T++ ++F++FTPFIVTA+LPT IS  WR  DSHRLTRDEQ WLSTTYVQI+AFL + W  I  K  ++AW  + PTWPL VVF G+  A+ G + WV + GF  W AN  SIIV A LA+HALWPMVS  +GW +PS YY+KL  W+ +G   VV+
Sbjct:  118 PSAMVIRAIVIINIGVSLAYLYWRVTHTITNIDS-------------YFFGITWLPV--------------RIKMTMDELVREDDSVGYNSRVAILLPTNGENLDVVMKAMLGCISLRGWDASVEKCISQRVVILDEKRRKGVLNMAAAVYALATIVRHPNVLSILQAEGVQAITAKGFYEWWKTGGGYARKHLYNDHFLNQACRLLEYMEEEAANEAVAMSVFGLEELP----------AGVKGKQDVKRNSKKTTQATAN--------HMLQALNVGNVTIEPGYVQTF-------------NTNVALPTFIYYTRRDAGTPKVSPKAGNMNAALFALDYPDMPPLIGNSTIVVVNDCRHQLQPEFLQRTIPYFFELD------ADGQRYRWAKVAFVQTPQRFQTNQQADDPLGNHAAVQYDVINHGKDGIGAVSSSGQGSLWRVAALKGVDADGQQYADTQQRSLIGHRLGFRSEMLIEDTHTSIEMFRAGWGSRYVNEPGEHLSMCTHQPNSIAWRIKQVLRWHQGAVQLLFFKGIGFTCWGGKFPTIFHRIYAFDQATYYLQAIPGYMLLLMPIIYGVTGEPPFNTKVGEFFLFFTPFIVTAMLPTVISGSWRGVDSHRLTRDEQVWLSTTYVQIYAFLSMCWQQIRCKGTDDAWAVRAPTWPLFVVFAGEFAAIVGAMIWVSKEGFEKWAANLISIIVSASLAIHALWPMVSLQMGWQVPSLYYLKLMAWLIIGIFIVVI 800          
BLAST of mRNA_H-elongata_contig12037.1570.1 vs. uniprot
Match: A0A835ZCE1_9STRA (Cellulose synthase, family GT2 n=1 Tax=Tribonema minus TaxID=303371 RepID=A0A835ZCE1_9STRA)

HSP 1 Score: 746 bits (1926), Expect = 1.870e-245
Identity = 395/770 (51.30%), Postives = 500/770 (64.94%), Query Frame = 1
Query:   31 SAYLVRILAFANVCLGCLYLHWRWTETFPDIGRWEYTHWQF---YWWWCFFLAEIFLAIAVWIGLAQRLFPVQRIKVTMDDITSVDDQVGYNARVCILLPTAGENLEVVFKALVGSISQRLWDSG-LPECQTLRVVVLDEKRRVEVYRVCAGLHRIGVLLAGRRVQQILMAEGVTELTPKGFIDWCRNGSGYERKHLYDDKKLNEAVQVLRLLDAMCLANGLTDAFALEARPSSATYNPITSAAWNAASRVSKANETTVETIADLNDSARSEAEAKMLGASAMN------------------VTPGFYEIFGSGSNSGETGAGKDVQKGLPTLVYYSRKEAGSPKISPKAGNMNSAIFPLDDPQSEPLVGDATIVVVNDARHQLEANFLQRTVPYFFELTGGLPTVASGGRYRWAKVAFVQTPQRFRME--LANDPLGNHAISQYDVINHGKDGIGAVSSSGQGSLWRVEALKGQQPDGKVVDDPKDLSLVGKKLGFRSEMLIEDTHTSVDLFRQGWRSVYVNEPGEVLAWCTHQPTSLTWRIKQVLRWHQGAVQLLLFKGLRYTSIGGYYPTIWHRLYAFDLATYYLQALPGYVLLVMPIVYGVTGKPPFITRLKDYFMYFTPFIVTALLPTAISSQWRKSDSHRLTRDEQTWLSTTYVQIFAFLQVIWTAITRKSHENAWVAKVPTWPLVVVFLGQIVAVAGGVYWVIEYGFVLWYANFFSIIVVAGLAMHALWPMVSQSLGWSIPSFYYIKLFLWIFLGFSAVVLAN 2268
            S  L+R++  ANV    LYL+WR T T   I  + Y    F    W W F+  EI L I + IG  QR+FP++R  V M+D+   DD VGYNARV ILLP+AGE L++V  AL+G++SQ  W  G     Q LR+++LDEKRR  V  + A ++ +G L+    V  IL AEG+     KGF DW + G GY RKHLY+D  LN+A  +L  ++         D+  L       +  PI +AA + A+   K          D+ + ARS  +A  +   + +                  V  G+   F S  +             LPTL+YY+RK+AG+P++SPKAGN+N+AIF +D P+ +PL+GDATIVVVND RHQL   FLQRTVPYFFEL       A G  Y WA+VAFVQTPQRF+ +    +DPLGNHA  QYDVIN GKDGIGAVSSSG GSLWRVEAL+G   DG+   DP  +  +GK LGFRS+MLIEDTHTS+D+FR GW S YVNEPGE L+ CTHQP S+ WRIKQVLRWHQGAVQLL +KG+ YTS GG +PT+WHR+YAFD ATYYLQA+PGY+LL+MPI+YG+TG  PF TR+ D+F+YFTP+IVT +LPT IS  W   D+++L RDEQ WLSTTYVQI+AFL ++WT++  + HENAW  K PTWPL  VF GQ+ A+ GG++WV +YGF  W  N  S+   A L MHALWPMVS  +GW IPS Y IK+ +W  LG   +VL N
Sbjct:  218 STPLLRLIMAANVGFSALYLYWRATSTITTIDTYFYNIKYFPVQIWAWVFYGVEICLTIGILIGHTQRMFPIKRAIVAMEDLVREDDCVGYNARVAILLPSAGERLDIVMLALLGAMSQSTWRGGNRTTSQMLRIIILDEKRRKGVLNMTAAVYALGTLIRNPEVVTILQAEGIDAENVKGFYDWWKFGGGYARKHLYNDPWLNKACLLLEYMEKHAGNGEDADSIFL------LSDMPIDAAAGSKAALHGK----------DVEEFARSMLQALNIPTPSPDAGXXXXXXXXXXXXXXXXVDAGYVHQFSSNPD-------------LPTLLYYTRKDAGTPRVSPKAGNLNAAIFAVDYPEDDPLIGDATIVVVNDCRHQLNPTFLQRTVPYFFELD------AEGQHYGWARVAFVQTPQRFKPDQMTLDDPLGNHAAVQYDVINRGKDGIGAVSSSGHGSLWRVEALRGADVDGRRYADPTVVDNIGKTLGFRSQMLIEDTHTSIDMFRHGWTSRYVNEPGEHLSICTHQPNSIAWRIKQVLRWHQGAVQLLFYKGISYTSFGGRFPTLWHRIYAFDQATYYLQAIPGYILLLMPIIYGLTGNSPFETRVADFFLYFTPYIVTGMLPTVISGSWGDVDANKLQRDEQVWLSTTYVQIYAFLSMLWTSLRCQKHENAWAIKAPTWPLFTVFFGQVAALGGGLFWVGKYGFRAWAQNLISVFASALLCMHALWPMVSLQMGWKIPSMYIIKILVWALLG-GFIVLIN 951          
BLAST of mRNA_H-elongata_contig12037.1570.1 vs. uniprot
Match: A0A835YVP7_9STRA (Cellulose synthase, family GT2 n=1 Tax=Tribonema minus TaxID=303371 RepID=A0A835YVP7_9STRA)

HSP 1 Score: 719 bits (1855), Expect = 7.630e-238
Identity = 375/758 (49.47%), Postives = 481/758 (63.46%), Query Frame = 1
Query:   10 QETRLFPSAYLVRILAFANVCLGCLYLHWRWTETFPDIGRWEYTHWQFY---------WWWCFFLAEIFLAIAVWIGLAQRLFPVQRIKVTMDDITSVDDQVGYNARVCILLPTAGENLEVVFKALVGSISQRLWDSGLPECQTL-RVVVLDEKRRVEVYRVCAGLHRIGVLLAGRRVQQILMAEGVTELTPKGFIDWCRNGSGYERKHLYDDKKLNEAVQVLRLLDAMCLANGLT-DAFALEARPSSATYNPITSAAWNAASRVSKANETTVETIADLNDSARSEAEAKMLGASAMNVTPGFYEIFGSGSNSGETGAGKDVQKGLPTLVYYSRKEAGSPKISPKAGNMNSAIFPLDDPQSEPLVGDATIVVVNDARHQLEANFLQRTVPYFFELTGGLPTVASGGRYRWAKVAFVQTPQRFR--MELANDPLGNHAISQYDVINHGKDGIGAVSSSGQGSLWRVEALKGQQPDGKVVDDPKDLSLVGKKLGFRSEMLIEDTHTSVDLFRQGWRSVYVNEPGEVLAWCTHQPTSLTWRIKQVLRWHQGAVQLLLFKGLRYTSIGGYYPTIWHRLYAFDLATYYLQALPGYVLLVMPIVYGVTGKPPFITRLKDYFMYFTPFIVTALLPTAISSQWRKSDSHRLTRDEQTWLSTTYVQIFAFLQVIWTAITRKSHENAWVAKVPTWPLVVVFLGQIVAVAGGVYWVIEYGFVLWYANFFSIIVVAGLAMHALWPMVSQSLGWSIPSFYYIKLFLWIFLG 2244
            Q T    S  L+R +  AN+    LYL WR T T   I         F+         W W F+  EI L I +WIG +QRLF V                  YNARVCILLPTAGE L++V  AL+G ISQR+W  G      + +V+VLDEKRR  V ++CA ++ +  L     + QIL AE    +  KG  +W R+G G+ R+HLY+D  LN A Q+L  +  + L  G   + F L   P     +P          +  ++    VE +           +A  +   A  + P F + F +       GA       LPTLVYY+R++ G+P++SPKAGNMNSA+FP+D P  E LVGD+TI+ VND RHQL+ NFLQRTVPYFF+L        SG  Y W +VAFVQTPQRF   M   +DPLGN+A  QYD+INHGKDGIGAVSSSG GSLWRVEALKG   DG    DP + +L+G ++GFRSEMLIEDTHTS+D+FR GW S YVNEPGE L+ CTHQP S+ WRIKQVLRWHQGAVQLL +KG+ +TS GG +PTIWHR+YAFD ATYYLQA+PGY+LL+MPI+YG+TG+ PF T + ++F++FTP+IV+A+LPT IS  WR  D+++L RDEQ WLSTTYVQ++AFL ++ TA+  + HENAW  K PTWPL  VF G+  A+ G ++WV  YGF  W  N  S++  A LA+ ALWPMV+  +GW IPS Y++K+ +W  LG
Sbjct:   12 QRTTPMSSHLLIRCVILANLAFSVLYLWWRVTSTITTINS------YFFGIKALPVQAWGWTFYAVEICLTIGIWIGHSQRLFAVS----------------SYNARVCILLPTAGERLDIVMLALLGCISQRMWACGRKSKSAMFKVIVLDEKRRKAVLQMCAAVYALATLARSPSIVQILQAENAASIDAKGLYEWWRDGGGHARRHLYNDSHLNRACQLLEFMLRLSLCEGNEGNLFNLTEMPEDQLQSP---------DQKKRSARHLVEGL----------LQALNIPQGAAKIPPAFMQSFST------NGA-------LPTLVYYTRRDPGTPRVSPKAGNMNSALFPIDYPDDESLVGDSTIIAVNDCRHQLQPNFLQRTVPYFFKLQQSAND-GSGLEYTWDRVAFVQTPQRFPKDMNAEDDPLGNNAAVQYDIINHGKDGIGAVSSSGHGSLWRVEALKGLAADGTRYADPTNRALIGSEVGFRSEMLIEDTHTSIDMFRHGWTSRYVNEPGEHLSTCTHQPDSIAWRIKQVLRWHQGAVQLLFYKGITFTSFGGKFPTIWHRVYAFDQATYYLQAIPGYILLLMPIIYGITGESPFNTEVAEFFLFFTPYIVSAMLPTLISGSWRGVDANKLQRDEQVWLSTTYVQVYAFLSMLATALRCQKHENAWAVKAPTWPLFAVFFGEFCAIGGALFWVARYGFDRWSQNLLSVLASAALAVFALWPMVAMQMGWRIPSAYHLKVLVWATLG 714          
BLAST of mRNA_H-elongata_contig12037.1570.1 vs. uniprot
Match: A0A835YHN4_9STRA (Cellulose synthase, family GT2 n=1 Tax=Tribonema minus TaxID=303371 RepID=A0A835YHN4_9STRA)

HSP 1 Score: 621 bits (1601), Expect = 5.080e-199
Identity = 355/821 (43.24%), Postives = 463/821 (56.39%), Query Frame = 1
Query:   10 QETRLFPSAYLVRILAFANVCLGCLYLHWRWTE-TFPDI------GRWEYTH----WQFYWWWCFFLAEIFLAIAVWIGLAQRLFPVQRIKVTMDDITSVDDQVGYNARVCILLPTAGENLEVVFKALVGSISQRLWDSGLPECQTLRVVVLDEKRRVEVYRVCAGLHRIGVLLAGRRVQQILMAEGVTELTPKGFIDWCRNGSGYERKHLYDDKKLNEAVQVLRLLDAMCL-ANGLTDAFALEARPSSATYNPITSAAWNAASRVSKANETTVETIADLNDSARSEAEAKMLGASAMNVTPGFYEIFGSGSNSGETGAGKDVQKGLPTLVYYSRKEAGSPKISPKAGNMNSAIFPLDDPQSEPLVGDATIVVVNDARHQLEANFLQRTVPYFFELTGGLPTVASGGRYRWAKVAFVQTPQRFRMELA-NDPLGNHAISQYDVINHGKDGIGAVSSSGQGSLWRVEALKGQQPDGKVVDDPKDLSLVGKKLGFRSEMLIEDTHTSVDLFRQGWRSVYVNEPGEVLAWCTHQPTSLTWRIKQVLRWHQGAVQLLLFKGLRYTSIG--GYYPTIWHRLYAFDLATYYLQALPGYVLLVMPIVYGVTGKPPFITRLKDYFMYFTPFIVTALLPTAISSQWRKSDSHRLTRDEQTWLSTTYVQIFAFLQVIWTAITRKSHENAWVAKVPTWPLVVVFLGQIVAVAGGVYWVIEYGF-------------------------------------------------------------VLWYANFFSIIVVAGLAMHALWPMVSQSLGWSIPSFYYIKLFLWIFLG 2244
            Q  R     YL+      N+     YL+WR T  +  DI       +W   +    W   + W FF +E  L I + IG +QRLF VQR  V MDD+  VD  + YNARV + LPTAGE  +VV KAL+G ++QR W +   +   +R++VLDEK+R  V  + A  +++   +    +Q+IL  EGV  L       W + G G+ R+ L+D   L E   ++ L+D +    NG                       W      SK     +E + D +   ++ A  + +    + + PG+ + + S           D+   LP ++YYSRKE G+PK+SPKAGNMN+AIFP+D P+  PL+GD+TIVVV+D RHQL+ +FLQRTVPYFFEL     T      Y WAKVAFVQTPQRF  +   +DPLGNHA  QYDVINHGKDGIGAV SSG GSLWRV AL+G   +G+   DP +L LVG KLGFRSEMLIEDTHTS+++FR GWRSVY+NEP E L+ CTHQP ++ WRIKQVLRWHQGAVQLL FKG  YT+      YPT+WHRLY FD  TYY+QA+PGY+LLVMPIVYGVTG+ PF   + D+F+ F PFIVTA+LPT I       D  RL+RDEQ WLSTTY+Q++AF  + W   T     +AW  K PTWPL V F G+ +A+ GG++W+I   F                                                             + W+ NF S++  A +A+ ALWPMV+   GW   S Y  KL  ++ +G
Sbjct:   44 QGKRFLRREYLIWATVLLNLATAAYYLYWRVTGGSITDIQNGMPGDQWVPDNPGPIWVRIYAWLFFASEACLIIGIMIGHSQRLFAVQRTVVNMDDLALVDSNITYNARVSVFLPTAGEKPDVVLKALLGCMAQRGWGAA-SKLSYMRIIVLDEKKRKGVLALTAAAYKLAECMLNPELQRILQFEGVLSLNAIDVFAWWKTGGGHARQFLHDHDLLYEICAIMELMDDIAKNENG-------------------GKGTWGKPKDPSKVRHFNLE-VGDKSYFEKNRATLEDIIMPNVTIDPGYIKTYES----------SDL---LPRVIYYSRKEPGTPKVSPKAGNMNAAIFPIDYPEQVPLIGDSTIVVVDDCRHQLQPDFLQRTVPYFFELHKPSNT------YTWAKVAFVQTPQRFPFQKEKDDPLGNHAAMQYDVINHGKDGIGAVGSSGHGSLWRVAALRGLDANGRCYADPSNLRLVGHKLGFRSEMLIEDTHTSLEMFRAGWRSVYINEPNENLSVCTHQPDNIAWRIKQVLRWHQGAVQLLWFKGPWYTTFSPCAQYPTMWHRLYGFDQCTYYMQAIPGYMLLVMPIVYGVTGQAPFSATIFDFFVRFIPFIVTAVLPTVILGNRPGVDMDRLSRDEQVWLSTTYIQMYAFFSMTWQIFTCAKAGDAWTVKAPTWPLFVAFYGEFLAILGGLFWLIYNNFQNNRIQNNSSNAAEAFNINSNKEQIRINNLRPDLINEATKNSTQLRMTNEFIISNLIGYPQIQWFLNFISVVASAAMAIFALWPMVAMQKGWKPLSLYQSKLVAYVIVG 824          
BLAST of mRNA_H-elongata_contig12037.1570.1 vs. uniprot
Match: D7FIF6_ECTSI (Cellulose synthase (UDP-forming), family GT2 n=1 Tax=Ectocarpus siliculosus TaxID=2880 RepID=D7FIF6_ECTSI)

HSP 1 Score: 512 bits (1318), Expect = 2.960e-148
Identity = 301/753 (39.97%), Postives = 432/753 (57.37%), Query Frame = 1
Query:   10 QETRLFPSAYLVRILAFANVCLGCLYLHWRWTETFPDIGRWEYTHWQFYWWWCFFLAEIFLAIAVWIGLAQRLFPVQRIKVTMDDITSVDDQVGYNARVCILLPTAGENLEVVFKALVGSISQRLWDSGLPECQTLRVVVLDEKRRVEVYRVCAGLHRIGVLLAGRRVQQILMAEGVTELTPKGFIDWCRNGSGYERKHLYDDKKLNEAVQVLRLLDAMCLANGLTDAFALEARPSSATYNPITSAAWNAASRVSKANETTVETIADLNDSARSEAEAKMLGASAMNVTPGFYEIFGSGSNSGETGAGKDVQKGLPTLVYYSRKEAGSPKISPKAGNMNSAIFPLDDPQSEPLVGDATIVVVNDARHQLEANFLQRTVPYFFELTGGLPTVASGGRYRWAKVAFVQTPQRF--RMELAN-DPLGNHAISQYDVINHGKDGIGAVSSSGQGSLWRVEALK-GQQPDG-KVVDDPKDLSLVGKK--LGFRSEMLIEDTHTSVDLFRQGWRSVYVNEPGEVLAWCTHQPTSLTWRIKQVLRWHQGAVQLLLFKGLRYTSIGGYYPTIWHRLYAFDLATYYLQALPGYVLLVMPIVYGVTGKPPFITRLKDYFMYFTPFIVTALLPTAISSQWRKSDSHRLTRDEQTWLSTTYVQIFAFLQVIWTAITRKSHENAWVAKVPTWPLVVVFLGQIVAVAGGVYWVIEYGFVLWYANFF-------SIIVVAGLAMHALWPMVSQSLGWSIPSFYYIKLF 2226
            Q T   PSA+ +R +   N+     YL WR T +   +   ++  W F     F  AE  +AI + +G + R FP  R KV MDD+T +D+ +G   +V +L+PT GE   V+ KAL G++  RLW S      TLR++VLDEKRR EV+++ + ++ +  ++  + V++ILM EGV  ++ KGF +   NG   +R  +YDD      ++V+  +D +   N            + + ++P       A SR+                    E   +        + PG  +++             +  K +PT+VYYSR +AG P+ISPKAGNMN AIF  + PQ EPL+G+A ++V+ND RH+L   FLQRTVPYFF  T   P       Y+WA +AF+QTPQRF  R +  + DPLGN A +Q+D++N G+DG G   S GQGS+WRV+ L+ G +PDG K V        VG++  LGFR+E+LIEDTHTS+DLFRQGW+SVYVN P E LA CT  P ++ WR KQVLRWHQGAVQL ++KG  Y  +G  + T + +++AFD  +Y+LQA  G +LL+ PIVYG T   PF T   ++ +YF PFI+T +LPT  +  W+K+ S ++ RDEQ W +T++VQI+A +  +W  ITRK   NAW  K P WPL + F+   +AV         +    W A  +       S I  A  A+H+LWP+VS  LG ++P  +Y ++F
Sbjct: 1320 QHTESAPSAWWIRTIGVINLLCMAAYLWWRITRSLKGV---DHIIWAF----IFLSAECIMAIGMIVGHSSRSFPAHREKVYMDDLTDIDEAIGA-LKVAVLIPTCGEKTAVMLKALFGNLQLRLWKSKNARRDTLRILVLDEKRREEVHKLVSLVYTLSEVVLDKTVREILMREGVAPISAKGFYEHFANGEHGQR--MYDDVNFIRGIEVVSEIDKLIAEND----------DNISRFSPSV-----AISRIK-------------------ERARRASCFDRKEIQPGQKKVW-------------NRNKYIPTIVYYSRIDAGQPRISPKAGNMNRAIFSFN-PQEEPLIGEAAVIVINDVRHELYPEFLQRTVPYFF--TFDKPRRC----YKWANIAFIQTPQRFHDRTDWNDPDPLGNQAATQFDIVNSGRDGAGGALSCGQGSVWRVQVLRDGIRPDGTKFVKKGMPEDQVGQQGGLGFRAEVLIEDTHTSIDLFRQGWKSVYVNFPNERLACCTLPPDTVKWRWKQVLRWHQGAVQLAMWKGWGYAVLGENWGTTFQKVFAFDAVSYFLQAFAGEILLIFPIVYGFTNSAPFNTWNIEFALYFFPFIITGVLPTVAALGWQKTPSAKVMRDEQIWFATSFVQIYAVMHAVWGTITRKDPSNAWECKCPVWPLYLHFVAITIAVC--------FNTADWAARSYEEPWVWVSCIGSALFALHSLWPVVSFGLGVTMPEAFYTRVF 2000          
BLAST of mRNA_H-elongata_contig12037.1570.1 vs. uniprot
Match: A0A835YIK8_9STRA (Cellulose synthase, family GT2 n=1 Tax=Tribonema minus TaxID=303371 RepID=A0A835YIK8_9STRA)

HSP 1 Score: 471 bits (1212), Expect = 1.060e-144
Identity = 296/710 (41.69%), Postives = 399/710 (56.20%), Query Frame = 1
Query:  157 WWWCFFLAEIFLAIAVWIGLAQRLFPVQRIKVTMDDITSVDDQVGYNARVCILLPTAGENLEVVFKALVGSISQRLWDSGLPECQTLRVVVLDEKRRVEVYRVCAGLHRIGVLLAGRRVQQILMAEGVTELTPKGFIDWCRNGSGYERKHLYDDKKLN--EAVQVLRLLDAMCLANGLTDAFALEARPSSATYNPITSAAWNAASRVSKANETTVETIADLNDSARSEAEAKMLGASAMN-VTPGFYEIFGSGSNSGETGAGKDVQKGLPTLVYYSRKEAGSPKISPKAGNMNSAIFPLDDPQSEPLVGDATIVVVNDARHQLEANFLQRTVPYFFELTGGLPTVASGGRYRWAKVAFVQTPQRFR--MELAN-DPLGNHAISQYDVINHGKDGIGAVSSSGQGSLWRVEALK-GQQPDG-KVVDDPKDLS-LVGKK--LGFRSEMLIEDTHTSVDLFRQGWRSVYVNEP----GEVLAWCTHQPTSLTWRIKQVLRWHQGAVQLLLFKGLRYTSIGGYYPTIWHRLYAFDLATYYLQALPGYVLLVMPIVYGVTGKPPFITRLKDYFMYFTPFIVTALLPTAISSQWRKSDSHRLTRDEQTWLSTTYVQIFAFLQVIWTAITRKSHENAWVAKVPTWPLVVVFLGQIVA-VAGGVYWVIEYGFV---LWYANFFSIIVVAGL-AMHALWPMVSQSLGWSIPSFYYIKLF 2226
            W + FF AE+ L + + +    R FP+ R +VTMD++   D Q G + +V ILLPTAGE L+V+ +AL G +  RLW S    C TLRV++LDEKRR +V ++ + ++ +  ++  + V+ IL  E V   T + F +   +G    R+H  +   L     V ++  +D + L +       L+   +++   P                                   A+       N ++PGF + +   +              LPTLVY+SR +AG P++SPKAGNMN AIF  D  + E L+  A ++VVNDARH L+  FLQR +PYFF            G Y WA VAFVQTPQRF    + A+ DPLGN A +Q+D++N G+DG   V S GQGSLWRV AL+ G +PDG K +D   D   L+G+   LGFRSE+LIEDTHTS+DL RQGWRSVYV  P    GEVLA CT  P S+TWR+KQVLRWHQGAVQL L  G  Y    G++ + W R++A D  TY LQA  G +LLV PIVYG T + PF      +  YF PF++TA LPT  +  W K+ S R+ RDEQ W +TTYVQ+ A   VIW  + R+   +AW A  P WPL   FL    A VA   YW I+ GF    +W +      + AGL A+H+LWP+VS  LG ++P  YY ++F
Sbjct:   27 WGYIFFGAEVLLIVGLLVSHVSRAFPIHRERVTMDELVDSDPQTG-DLKVAILLPTAGEKLQVMLQALFGVLQLRLWSSSRARCDTLRVIILDEKRRWQVQQLASLVYTLAEVVLDKGVRDILRREEVPASTARAFYELFSDGL---RRHTMNTDNLMFVRGVAIVDEIDKL-LHDSDGSVHRLDGTATTSLAPPX-------------------XXXXXXXXXXXXXVRARRASCFVQNTISPGFTKTWAKNAR-------------LPTLVYHSRTDAGMPRVSPKAGNMNCAIFRKDG-KGETLIAGAAVIVVNDARHALQPEFLQRALPYFFTRDA-----RRAGAYVWADVAFVQTPQRFDDVPQWADPDPLGNQAATQFDIVNPGRDGASGVLSCGQGSLWRVAALRDGIRPDGSKYIDTKADREGLIGRTGGLGFRSEVLIEDTHTSLDLLRQGWRSVYVVSPASSKGEVLARCTLPPDSVTWRVKQVLRWHQGAVQLALSHGFAYVFGSGHWASPWQRVFALDAITYVLQAFAGQILLVFPIVYGFTNQSPFNALNLQFATYFFPFLITAALPTMAALGWLKTSSDRVMRDEQVWFATTYVQLQAVCNVIWCKLLRRDPADAWTATCPVWPLYAQFLAIAAAMVANTGYW-IQRGFTSPWVWVSC-----MGAGLFALHSLWPLVSFGLGVTLPPAYYNRVF 687          
BLAST of mRNA_H-elongata_contig12037.1570.1 vs. uniprot
Match: D8LMC3_ECTSI (Cellulose synthase (UDP-forming), family GT2 n=2 Tax=Ectocarpus TaxID=2879 RepID=D8LMC3_ECTSI)

HSP 1 Score: 464 bits (1194), Expect = 5.400e-134
Identity = 299/762 (39.24%), Postives = 424/762 (55.64%), Query Frame = 1
Query:   28 PSAYLVRILAFANVCLGCLYLHWRWTETFPDIGRWEYTHWQFYWWWCFFLAEIFLAIAVWIGLAQRLFPVQRIKVTMDDITSVDDQVGYNARVCILLPTAGENLEVVFKALVGSISQRLWDSGLPECQTLRVVVLDEKRRVEVYRVCAGLHRIGVLLAGRRVQQILMAEGVTELTPKGFIDWCRNGSG--YERKHL--YDDKKLNEAV--QVLRLLDAMCLANGLTDAFALEARPSSATYNPITSAAWNAASRVSKANETTVETIADLNDSARSEAEAKMLGASAM-NVTPGFYEIFGSGSNSGETGAGKDVQKGLPTLVYYSRKEAGSPKISPKAGNMNSAIFPLDDPQSEPLVGD-ATIVVVNDARHQLEANFLQRTVPYFFELTGGLPTVASGGRYRWAKVAFVQTPQRFRMELANDPLGNHAISQYDVINHGKDGIGAVSSSGQGSLWRVEALKGQQPDGK-VVDDPKDLSLVGKKLGFRSEMLIEDTHTSVDLFRQGWRSVYVNEPGEVLAWCTHQPTSLTWRIKQVLRWHQGAVQLLLFKGLRYTSIGGYYPTIWHRLYAFDLATYYLQALPGYVLLVMPIVYGVTGKPPFITRLKDYFMYFTPFIVTALLPTAISSQWRKSDSHRLTRDEQTWLSTTYVQIFAFLQVIWTAITRKSHENAWVAKVPTWPLVVVFLGQIV-AVAGGVYWVI-----EYGFVLWYANFFSIIVVAGLAMHALWPMVSQSL-GW-SIPSFYYIKL-FLWIFLGFSAVV 2259
            P+++ +++ A  NV  G  Y+ WR T + PD  +         W W FF  E+ L   VW    QR FP  R   +MDD+  +D  V   A VCI++PTAGE ++ +   L+G+ SQRLW S LP    LR+ VLDEK R EV         +  L+A     +  M E  +  + +    W R  S   Y R     +D+  +   +       +DA+       D +          + P    A++ A R+   N T    +A  + S  S    K   A A+  +  GF ++F S  N             +P+++Y +R   G+PK+SPKAGNMN+AIFP + P  EP++GD A +VVVNDARH+L+  FLQRTVPYFF+L        +G +Y WA V FVQTPQRF      DPLGNHA+  + V N  KDG+G V+S GQGSLWRV+AL+G   DGK VVD      +VG   GFR+E+LIEDTHTS++ F+Q WRS YV E GE LA C  QP ++ WR+KQV RWH GAVQLLL  G+ +       PT  H+++  D  TYY+QA+ G+ +++MPI++ +  + PF T   ++  +F P+I+TA +PT ++  W+  + +R+  DEQ WLST YVQI+AF   +W  IT  + +NAW    P WPL ++F   IV A+   VYW       E G  ++ A+F + IVV    M+++WPMV     GW S+PS Y+ K  ++ IF+  ++V+
Sbjct:  833 PTSFWIKLSAVLNVVAGAAYIWWRATRSMPDNPK------SVVWNWLFFAGEVILTFGVWTSHLQRSFPSVRDVCSMDDLVEIDSNVSNEATVCIMVPTAGEKMKNLKHVLLGAYSQRLWVSRLPTSSQLRIAVLDEKGRREV--------SVTTLVA-----RGAMGERKSATSWRRCTVWPRPSSSPPYSRSCAPSFDEPFITPKIFMDYFNQMDAL-------DQY---------VFGPECHPAFDMAVRME--NYTGQAKLARASSS--SGVPGKKKAAKALPRLEEGFKKLFRSSPN-------------IPSMIYSARANPGTPKVSPKAGNMNAAIFP-NSPGEEPVIGDPARVVVVNDARHRLKTEFLQRTVPYFFKLDR-----RTGKKYEWADVGFVQTPQRFEDLGDGDPLGNHAVLTFFVSNVSKDGVGGVTSCGQGSLWRVDALRGMAADGKQVVDSVAKPDIVGHDCGFRAEVLIEDTHTSLEFFKQQWRSAYVCEAGETLAVCVEQPNTVAWRVKQVFRWHIGAVQLLLKDGVGFLCTSRM-PTPLHKMFGLDSLTYYIQAVGGFFIILMPIMFSIFQETPFNTVDLEFVYFFFPYIITATIPTILAVGWKNVNPNRVLTDEQFWLSTCYVQIWAFALGVWNRITCANPDNAWNLVCPVWPLGLLFGLLIVSAINTTVYWAFYLSFDEDGIWIFLASFGACIVV----MYSIWPMVKLWWPGWVSLPSAYHQKFCYILIFIALTSVL 1531          
The following BLAST results are available for this feature:
BLAST of mRNA_H-elongata_contig12037.1570.1 vs. uniprot
Analysis Date: 2022-09-19 (Diamond blastx: OGS1.0 vs UniRef90)
Total hits: 25
Match NameE-valueIdentityDescription
D7FSC3_ECTSI0.000e+084.41Cellulose synthase (UDP-forming), family GT2 n=2 T... [more]
D7FSC4_ECTSI1.520e-27054.87Cellulose synthase (UDP-forming), family GT2 n=2 T... [more]
A0A836CP13_9STRA6.220e-25753.79Glyco_trans_2-like domain-containing protein n=1 T... [more]
A0A835YSM9_9STRA2.330e-24751.41Cellulose synthase, family GT2 n=1 Tax=Tribonema m... [more]
A0A835ZCE1_9STRA1.870e-24551.30Cellulose synthase, family GT2 n=1 Tax=Tribonema m... [more]
A0A835YVP7_9STRA7.630e-23849.47Cellulose synthase, family GT2 n=1 Tax=Tribonema m... [more]
A0A835YHN4_9STRA5.080e-19943.24Cellulose synthase, family GT2 n=1 Tax=Tribonema m... [more]
D7FIF6_ECTSI2.960e-14839.97Cellulose synthase (UDP-forming), family GT2 n=1 T... [more]
A0A835YIK8_9STRA1.060e-14441.69Cellulose synthase, family GT2 n=1 Tax=Tribonema m... [more]
D8LMC3_ECTSI5.400e-13439.24Cellulose synthase (UDP-forming), family GT2 n=2 T... [more]

Pages

back to top
Alignments
The following features are aligned
Aligned FeatureFeature TypeAlignment Location
H-elongata_contig12037contigH-elongata_contig12037:156..8631 +
Analyses
This mRNA is derived from or has results from the following analyses
Analysis NameDate Performed
Diamond blastx: OGS1.0 vs UniRef902022-09-19
OGS1.0 of Himanthalia elongata Himel1 dioecious2021-02-24
Properties
Property NameValue
Taxonomic scopeEukaryota
Seed ortholog score750.7
Seed ortholog evalue5.7e-214
Seed eggNOG ortholog2880.D7FSC4
KEGG rclassRC00005
KEGG koko:K00694,ko:K10999,ko:K20924
KEGG TC4.D.3.1.2,4.D.3.1.4,4.D.3.1.5,4.D.3.1.6,4.D.3.1.7,4.D.3.1.9
KEGG ReactionR02889
KEGG Pathwayko00500,ko01100,ko02026,map00500,map01100,map02026
GOsGO:0000271,GO:0003674,GO:0003824,GO:0005575,GO:0005622,GO:0005623,GO:0005737,GO:0005739,GO:0005829,GO:0005938,GO:0005975,GO:0005976,GO:0006073,GO:0008150,GO:0008152,GO:0008194,GO:0009058,GO:0009059,GO:0009250,GO:0009653,GO:0009987,GO:0010927,GO:0016020,GO:0016043,GO:0016051,GO:0016740,GO:0016757,GO:0016758,GO:0016759,GO:0016760,GO:0022607,GO:0030154,GO:0030243,GO:0030244,GO:0030435,GO:0030587,GO:0031150,GO:0031154,GO:0032502,GO:0032989,GO:0033692,GO:0034637,GO:0034645,GO:0035251,GO:0042244,GO:0042546,GO:0043170,GO:0043226,GO:0043227,GO:0043229,GO:0043231,GO:0043934,GO:0044042,GO:0044085,GO:0044237,GO:0044238,GO:0044249,GO:0044260,GO:0044262,GO:0044264,GO:0044424,GO:0044444,GO:0044448,GO:0044464,GO:0045177,GO:0045179,GO:0045229,GO:0046527,GO:0048646,GO:0048856,GO:0048869,GO:0051273,GO:0051274,GO:0051703,GO:0051704,GO:0070590,GO:0070726,GO:0071554,GO:0071555,GO:0071704,GO:0071840,GO:0071944,GO:0090702,GO:0099120,GO:0099568,GO:0099738,GO:1901576
EggNOG free text desc.Cellulose synthase
EggNOG OGs2QQSH@2759,COG1215@1
EC2.4.1.12
COG Functional cat.M
CAZyGT2
Best tax levelEukaryota
Best eggNOG OGNA|NA|NA
BRITEko00000,ko00001,ko01000,ko01003,ko02000
Hectar predicted targeting categoryother localisation
Exons16
Model size4850
Cds size2025
Stop1
Start1
Relationships

The following polypeptide feature(s) derives from this mRNA:

Feature NameUnique NameSpeciesTypePosition
mRNA_H-elongata_contig12037.1570.1prot_H-elongata_contig12037.1570.1Himanthalia elongata Himel1 dioeciouspolypeptideH-elongata_contig12037 888..6061 +


The following UTR feature(s) are a part of this mRNA:

Feature NameUnique NameSpeciesTypePosition
1622929705.7210608-UTR-H-elongata_contig12037:155..2481622929705.7210608-UTR-H-elongata_contig12037:155..248Himanthalia elongata Himel1 dioeciousUTRH-elongata_contig12037 156..248 +
1691679126.0061011-UTR-H-elongata_contig12037:155..2481691679126.0061011-UTR-H-elongata_contig12037:155..248Himanthalia elongata Himel1 dioeciousUTRH-elongata_contig12037 156..248 +
1622929705.7643266-UTR-H-elongata_contig12037:532..6881622929705.7643266-UTR-H-elongata_contig12037:532..688Himanthalia elongata Himel1 dioeciousUTRH-elongata_contig12037 533..688 +
1691679126.018892-UTR-H-elongata_contig12037:532..6881691679126.018892-UTR-H-elongata_contig12037:532..688Himanthalia elongata Himel1 dioeciousUTRH-elongata_contig12037 533..688 +
1622929705.7749982-UTR-H-elongata_contig12037:881..8871622929705.7749982-UTR-H-elongata_contig12037:881..887Himanthalia elongata Himel1 dioeciousUTRH-elongata_contig12037 882..887 +
1691679126.0282164-UTR-H-elongata_contig12037:881..8871691679126.0282164-UTR-H-elongata_contig12037:881..887Himanthalia elongata Himel1 dioeciousUTRH-elongata_contig12037 882..887 +
1622929706.0290213-UTR-H-elongata_contig12037:6061..86311622929706.0290213-UTR-H-elongata_contig12037:6061..8631Himanthalia elongata Himel1 dioeciousUTRH-elongata_contig12037 6062..8631 +
1691679126.22202-UTR-H-elongata_contig12037:6061..86311691679126.22202-UTR-H-elongata_contig12037:6061..8631Himanthalia elongata Himel1 dioeciousUTRH-elongata_contig12037 6062..8631 +


The following CDS feature(s) are a part of this mRNA:

Feature NameUnique NameSpeciesTypePosition
1622929705.7895546-CDS-H-elongata_contig12037:887..9341622929705.7895546-CDS-H-elongata_contig12037:887..934Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 888..934 +
1691679126.0374165-CDS-H-elongata_contig12037:887..9341691679126.0374165-CDS-H-elongata_contig12037:887..934Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 888..934 +
1622929705.8107758-CDS-H-elongata_contig12037:1222..14481622929705.8107758-CDS-H-elongata_contig12037:1222..1448Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 1223..1448 +
1691679126.0517898-CDS-H-elongata_contig12037:1222..14481691679126.0517898-CDS-H-elongata_contig12037:1222..1448Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 1223..1448 +
1622929705.8261611-CDS-H-elongata_contig12037:1650..17641622929705.8261611-CDS-H-elongata_contig12037:1650..1764Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 1651..1764 +
1691679126.069936-CDS-H-elongata_contig12037:1650..17641691679126.069936-CDS-H-elongata_contig12037:1650..1764Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 1651..1764 +
1622929705.8432746-CDS-H-elongata_contig12037:1911..21491622929705.8432746-CDS-H-elongata_contig12037:1911..2149Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 1912..2149 +
1691679126.081404-CDS-H-elongata_contig12037:1911..21491691679126.081404-CDS-H-elongata_contig12037:1911..2149Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 1912..2149 +
1622929705.8586442-CDS-H-elongata_contig12037:2387..25291622929705.8586442-CDS-H-elongata_contig12037:2387..2529Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 2388..2529 +
1691679126.0912247-CDS-H-elongata_contig12037:2387..25291691679126.0912247-CDS-H-elongata_contig12037:2387..2529Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 2388..2529 +
1622929705.8703942-CDS-H-elongata_contig12037:2718..29081622929705.8703942-CDS-H-elongata_contig12037:2718..2908Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 2719..2908 +
1691679126.1009634-CDS-H-elongata_contig12037:2718..29081691679126.1009634-CDS-H-elongata_contig12037:2718..2908Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 2719..2908 +
1622929705.88291-CDS-H-elongata_contig12037:3155..32331622929705.88291-CDS-H-elongata_contig12037:3155..3233Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 3156..3233 +
1691679126.110549-CDS-H-elongata_contig12037:3155..32331691679126.110549-CDS-H-elongata_contig12037:3155..3233Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 3156..3233 +
1622929705.9008217-CDS-H-elongata_contig12037:3512..37251622929705.9008217-CDS-H-elongata_contig12037:3512..3725Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 3513..3725 +
1691679126.1232831-CDS-H-elongata_contig12037:3512..37251691679126.1232831-CDS-H-elongata_contig12037:3512..3725Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 3513..3725 +
1622929705.9199111-CDS-H-elongata_contig12037:3927..41491622929705.9199111-CDS-H-elongata_contig12037:3927..4149Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 3928..4149 +
1691679126.1407683-CDS-H-elongata_contig12037:3927..41491691679126.1407683-CDS-H-elongata_contig12037:3927..4149Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 3928..4149 +
1622929705.9389362-CDS-H-elongata_contig12037:4518..45921622929705.9389362-CDS-H-elongata_contig12037:4518..4592Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 4519..4592 +
1691679126.1587613-CDS-H-elongata_contig12037:4518..45921691679126.1587613-CDS-H-elongata_contig12037:4518..4592Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 4519..4592 +
1622929705.957694-CDS-H-elongata_contig12037:4921..50811622929705.957694-CDS-H-elongata_contig12037:4921..5081Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 4922..5081 +
1691679126.17755-CDS-H-elongata_contig12037:4921..50811691679126.17755-CDS-H-elongata_contig12037:4921..5081Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 4922..5081 +
1622929705.9732018-CDS-H-elongata_contig12037:5305..54411622929705.9732018-CDS-H-elongata_contig12037:5305..5441Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 5306..5441 +
1691679126.1898189-CDS-H-elongata_contig12037:5305..54411691679126.1898189-CDS-H-elongata_contig12037:5305..5441Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 5306..5441 +
1622929705.990511-CDS-H-elongata_contig12037:5610..57351622929705.990511-CDS-H-elongata_contig12037:5610..5735Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 5611..5735 +
1691679126.1995742-CDS-H-elongata_contig12037:5610..57351691679126.1995742-CDS-H-elongata_contig12037:5610..5735Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 5611..5735 +
1622929706.0082355-CDS-H-elongata_contig12037:6001..60611622929706.0082355-CDS-H-elongata_contig12037:6001..6061Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 6002..6061 +
1691679126.214509-CDS-H-elongata_contig12037:6001..60611691679126.214509-CDS-H-elongata_contig12037:6001..6061Himanthalia elongata Himel1 dioeciousCDSH-elongata_contig12037 6002..6061 +


Sequences
The following sequences are available for this feature:

protein sequence of mRNA_H-elongata_contig12037.1570.1

>prot_H-elongata_contig12037.1570.1 ID=prot_H-elongata_contig12037.1570.1|Name=mRNA_H-elongata_contig12037.1570.1|organism=Himanthalia elongata Himel1 dioecious|type=polypeptide|length=675bp
MDDITSVDDQVGYNARVCILLPTAGENLEVVFKALVGSISQRLWDSGLPE
CQTLRVVVLDEKRRVEVYRVCAGLHRIGVLLAGRRVQQILMAEGVTELTP
KGFIDWCRNGSGYERKHLYDDKKLNEAVQVLRLLDAMCLANGLTDAFALE
ARPSSATYNPITSAAWNAASRVSKANETTVETIADLNDSARSEAEAKMLG
ASAMNVTPGFYEIFGSGSNSGETGAGKDVQKGLPTLVYYSRKEAGSPKIS
PKAGNMNSAIFPLDDPQSEPLVGDATIVVVNDARHQLEANFLQRTVPYFF
ELTGGLPTVASGGRYRWAKVAFVQTPQRFRMELANDPLGNHAISQYDVIN
HGKDGIGAVSSSGQGSLWRVEALKGQQPDGKVVDDPKDLSLVGKKLGFRS
EMLIEDTHTSVDLFRQGWRSVYVNEPGEVLAWCTHQPTSLTWRIKQVLRW
HQGAVQLLLFKGLRYTSIGGYYPTIWHRLYAFDLATYYLQALPGYVLLVM
PIVYGVTGKPPFITRLKDYFMYFTPFIVTALLPTAISSQWRKSDSHRLTR
DEQTWLSTTYVQIFAFLQVIWTAITRKSHENAWVAKVPTWPLVVVFLGQI
VAVAGGVYWVIEYGFVLWYANFFSIIVVAGLAMHALWPMVSQSLGWSIPS
FYYIKLFLWIFLGFSAVVLANLLE*
back to top

mRNA from alignment at H-elongata_contig12037:156..8631+

Legend: UTRpolypeptideCDS
Hold the cursor over a type above to highlight its positions in the sequence below.
>mRNA_H-elongata_contig12037.1570.1 ID=mRNA_H-elongata_contig12037.1570.1|Name=mRNA_H-elongata_contig12037.1570.1|organism=Himanthalia elongata Himel1 dioecious|type=mRNA|length=8476bp|location=Sequence derived from alignment at H-elongata_contig12037:156..8631+ (Himanthalia elongata Himel1 dioecious)
GCGGGTGCCCAGGAAACAAGGCTCTTTCCGTCGGCCTACTTGGTTCGCAT CTTGGCGTTTGCTAACGTCTGTCTCGGCTGTTTGTACCTTCACGTGAGTC TTGCCTTGGTATGGTATCTTTCGAACGGCAAGGTCGTTATAGTTTCTATC GCTTTTGCTATCGATCGGCAGGTTGGACTGAACTGAGTGGCTGCCGGTGC TCGTTCGAGCCCTTGAAAGATTCGCGTGGCTGTTGCTAATCTGCCTTTTT TCTTTTATTCTTTTACAAACGTCTTCCTTAACTCCATGCCCTACCCTACC CTACCCCTCTCATTCCATGCCCTACCGCGCTGTGATACCGTTCTGTCATG TGCCCCTACCGTGCTGTCGCATCTCAGTGGCGCTGGACGGAAACCTTTCC GGATATAGGGCGTTGGGAATACACCCACTGGCAGTTCTACTGGTGGTGGT GTTTTTTTTTGGCAGAAATTTTCCTTGCCATCGCCGTGTGGATCGGTCTT GCGCAACGCCTCTTTCCTGTTCAGCGGATCAAGGTATAAACGTTGTTTGT TGCCATTCTAAGCCAAGAGACTGGAAAGGGTACTGGATACTGGAAAGGGT ACTAATAATAGCAGTGCTTTTAAAGGCAGTACATTATGTCCATTGTCTGG TCAGGCATTTTATCCTCTCGCGAGTTTGTTTGGCCCTGAAACATTACTTT TGGGTGCGTGTGCTTGGTGTTGTCAGGTCACGATGGACGACATCACTTCC GTTGACGACCAAGTTGGCTACAATGCACGGTAAGTATCACACCCATCATT ACTCATCACATTAAAAAGGTACCGTATCTAAAAAGGTATCTACCTCCAGC ATCCCGTCGTAGAAAGAAGATTGGCCTCAATTGTTGACCATTACCTTAGT ATAATGAAGAAAACATCGATCCGCCACACTGAAGCGTTCCGTGAGGATGT ACCACCCGCCTCGAAGCCATACCATCACGCTCATGAACAAAAGACAGTAC TGATTTTTGTTGTTTTTGTTTATTCGTCGGGTCCTTGGGTTGGATTGGAT TGAACTGAACTGTTCAGGGTGTGTATCCTGCTCCCCACCGCTGGTGAGAA TCTAGAGGTTGTCTTCAAGGCCCTCGTAGGATCTATTTCCCAGCGTCTTT GGGACTCGGGCCTGCCCGAGTGCCAGACGTTGCGGGTGGTGGTTTTGGAC GAGAAGCGTCGCGTCGAGGTATACAGGGTCTGCGCGGGGCTGCACCGGAT CGGAGTGCTGCTGGCAGGGAGGCGTGTCCAGCAGATTCTCATGGTGCGAC ATCGTGTTCTGTGGTGTGGTGTGGTGTACGGCTGCGCGGACCTTGGTTTG TCCTTGATCACGATGACTTTCCTTGGTTTTATTTTGTCATACGCCGTCCT GTCGAAAAAATGCGATAACACCCTCTGTGCCTCGAAGGCGTGTAAAAATT GATGTGTAAATGTTCCCATGCCAATATTGATGCCAATATTAATAGGCCGA GGGTGTGACGGAGCTGACCCCAAAGGGATTTATCGATTGGTGCCGCAATG GCAGTGGCTACGAGCGCAAGCACTTGTACGACGACAAGAAGCTTAACGAG GCCGTACAGGTCAGACGGAATTTCACCCGCTTCAACAGTCCTGTCATAAT TAATACCAAATAGTATTTAATAGTCGTTTCTCATCGCAAACTAACTGCCT CTTGTACTTTTGAACTCTTCAGTAAATAGTAAATAGTAATTGCCCTTTGG TTACAGGTGCTGCGTCTCCTGGATGCCATGTGTCTTGCCAACGGCTTGAC GGACGCCTTCGCTCTGGAGGCTCGTCCATCCTCGGCAACGTACAACCCTA TCACGTCTGCCGCTTGGAACGCGGCAAGTCGGGTGTCAAAGGCTAACGAG ACCACCGTGGAGACCATAGCAGACCTTAACGATTCTGCCAGGTCCGAGGC GGAGGCAAAAATGCTAGGGGCCAGCGCGATGAATGTCACCCCAGGTTCGT TTAGCGATGCACAGGGTTATGTTTTTTCAGGAGATTAAAAGCAAATTATG ACGTAGTGATGAGGTCGAGCGCACGGTGTGATGCGAGGCTTTTTGAGTGT AAAGAGTACATTGTCTAAGCGAATGAGGTGAAAAGTGTACATGGCGCGAG ACACTGGAAAGGTATCCTAGAGAGCCCAGGCGACGATGCTTTTTCAAGAC TTTGTGTGTCGATCACAAATGCTCTTCCGCAGGGTTTTACGAGATTTTTG GCTCGGGTTCCAATTCGGGTGAAACGGGCGCCGGCAAGGATGTACAAAAG GGACTACCCACCTTGGTGTACTATTCGAGGAAGGAAGCCGGTTCCCCCAA GATCAGCCCCAAGGCGGGGAACATGTGAGACTTCCTTTTGCCTGGGTTGT GCGTTATGGCATCCAGTATGACCCGGGTAGATGTTTTGGCATCGCGAAAA TAGAAATAGAAAGTATCCGAATCATGTCGTTGTCTTAGCGTTCTACGGTT TCTAATATAATGCCCCCTTTTAAGTCGTGTCCATGTTATGTCGTGCTATG TTGACGAGATCAGGAACTCTGCCATCTTTCCATTAGACGATCCCCAGTCG GAGCCTCTCGTCGGAGACGCCACCATCGTAGTGGTTAACGATGCGCGTCA TCAGCTGGAAGCCAACTTTCTGCAGAGAACCGTGCCCTATTTCTTCGAGC TGACAGGAGGCCTTCCTACTGTAGCTTCTGGCGGACGTTACCGTTGGGCC AAGGTGCGTCTTATCTCTCTCTCTCTCTGTCTCTCTCTCTCTGGTAGCTT ATGGTCTGTATTGTGTTGTATTGTAATATAGTATAGTATAGTGTAGTTTA TTATGTCCAGGAGAGGGAATGGCCCTGGTGATTGTTTTACCAGAGCTCAC AGCAATGATGTGTGGTGTTCTTCGTCTATGGCTATGACCTTGAAGGGCAT AATTAATGACCTTGGTGTATCTTGATGTTAAATATCTCTCGTGACCGCAG GTGGCCTTCGTGCAGACACCTCAGCGTTTTCGAATGGAGCTCGCCAATGA CCCGCTCGGCAACCACGCCATCTCGCAGGTACAGTGCCTTGCTACCGCCC TGTTGCCTATATGAGGGCGCTAGATGAGTGTGAAAACCCTGCCTCGCTTA GTTTTGCGTGCCATACTCACCTTGAAAGTTTTCCCTGCCCTAATCTGAGT CTTTCCCCTTGCTGACTATGCATAATTATTACTATACAGTATAGCGCACG ATACTGTTCATGACCATATGTGGAGCGTATGCCGTAAACCTTTCTTCTCT CTCGACACATTTTTTTTTAAAGTTTTTCTTTTGCCTCGTCTGGTCTCGTT TTGGCAGTACGACGTAATCAACCACGGAAAAGATGGCATTGGAGCCGTGT CCTCAAGCGGGCAGGGTAGCCTCTGGCGCGTAGAGGCTTTAAAAGGGCAG CAGCCAGACGGCAAGGTCGTGGACGATCCCAAGGACCTTAGCCTGGTCGG CAAGAAGCTCGGCTTCCGTTCCGAGATGCTCATCGAAGACACCCACACTT CCGTGGACCTCTTCCGACAGGTCTGGCAGATGTTTATCAAATCGAATTCG CCTCGAACTTTGAGTCAGGTTCTCCTCTATGGTGGATTCTGCCCCTTGGA TCATCAATTTTACCGTATTGTTATTTTTAAAATCTTGATTTTGGTATTGT TTCTCCTGTGTAATGTGTGCACTCCACGTACCCTTACGCTTCCTTATACG TACCACTCTCGTAACCACCCAGGGATGGCGCAGCGTATACGTGAATGAGC CGGGAGAGGTGCTGGCGTGGTGCACCCACCAGCCGACGAGCCTGACGTGG CGTATCAAGCAAGTGCTGCGGTGGCATCAAGGCGCCGTGCAGCTGCTCCT GTTCAAGGGCCTCCGTTACACAAGCATCGGCGGCTACTACCCTACCATTT GGCACCGCCTCTACGCCTTCGATCTCGCGACATACTACCTTCAGGTGGAA CATTTTACCGGATTAGCTAGAGAGATGCTCATGCCCCATACTCTGCATAG CGTCTGGGCATGTTCGATGCGTCGCGTGATTTTTTAATATTATTTTTTCT CCGAGCGAGCAGCGCACTAAGAGGACAGTGTGAAAAGGGCAGTGTGCTGC CAGCCTTTTGTTTTTTTGTTTTTCTCCCTGGGGATTAGCCACCGTGTAGA GTTCAGTAATATTTTCGGGTTGACAACCAATACGCTAAATGCGAGAAACA ACAACTTGCACGAAATTCGCTGTACTTGAAATCACGGTTAGTACGTGTGT AATTGAAACCACGTTGCTACCGTGTTGCTACCGTTCTAAACCACACAAAA AATCTTGTTGCAGGCCCTGCCAGGGTACGTCCTGCTTGTGATGCCGATCG TCTACGGCGTCACCGGCAAGCCCCCGTTTATCACTAGGTAAAAGATAACC AACATTTTGATATCGTTAATCGTGTATATGGCATGAAGCACGATAGGTCT AGCGGCAGGCTAGCGGAGCAGTTCGACGAGGAAAGCGCCTTGAGTTAAAT TGACTTTCCGGCGATTATAGAGTACTGTACTGTACTGTATAACAATATGT CTAATATGTGTCTTCTTAATAGTACAGGAGGTACTGTAGTATTAATATGT ATTTGTATTTGTATTTGTATTTCTTTTTTATTGGTACTAATTCCGTTATG TTTCGACTTGGTCGATACTAATTTTTGTGTGTCTTTTTCTGTCTTCGTCT ACACTGTGTTTCGCAGGCTGAAGGACTACTTCATGTACTTTACCCCGTTC ATCGTGACTGCACTGCTGCCTACGGCCATCTCAAGTCAATGGCGCAAGAG CGACTCTCACCGTCTTACACGAGACGAACAGACGTGGCTTTCTACAACTT ACGTGCAGATCTTTGCCTTCCTGCAGGTGATCGACGGCTCACGCTCATAT CAAATATATATATAGATATATGGATATAGATATCGATCTATTAAATACAG ATCATCATCAATCATCAATCGTAAATCATTTGCAGTAGTTCCTCATCATG CTTTAATCACCATGCGACCGGAATATCGCAGCATCCTAGAGTCGACCGAC CCTATTATTCCGCGTGTACCGTGGAAACTCCGTCATACCGCGTACCGCAG GTGATCTGGACGGCGATCACACGTAAGAGCCACGAGAACGCTTGGGTGGC CAAAGTTCCGACGTGGCCGCTTGTGGTGGTTTTCCTGGGCCAGATCGTCG CTGTTGCCGGAGGCGTTTACTGGGTCATTGAGTATGGTAAGGAACATCCA CGTTCTGTTTTTGTGGCCCACGACGGAGGCTGTCGCAGCGTCCTTCAGTA CGAAGGATAATGTCCTGTCGCGTGGGCGCCGTTGAGCTGATTTTTTTTTG TTTCTTGTTAATCGTACGCAACCTTCTTGACCGCGTCCTCCTCCCCTTCC CCCAGGGTTCGTGCTGTGGTACGCCAACTTCTTCTCCATTATCGTGGTGG CCGGTTTGGCCATGCACGCGCTGTGGCCCATGGTGTCGCAAAGCTTGGGA TGGTCGATTCCGTCATTCTACTACATCAAGGTAAGACGAAGTGCACGAAT AATCCTAGTAGTTATAATAGTAGTGCCGTGCGATGAGGCGATGAGGTGCA TGTAGAGACCTATCGGTATTTAATATAGACACTTCACCTCGCCTTGCCTT GTAATAATAAAAATGCGCTGTAGGCAAGTATACTTACTCCGTTTGGGCTC CTTGCTTTTGTCCTTTTTCGCACAGTTAAGTTTCACTATGCCCCTGCTCG CACCTTGCGCCCGTGGTCTACTCTACTCTACTATACCCCTCCTCAGCTTT TCTTGTGGATCTTCCTTGGCTTCTCGGCCGTCGTCCTTGCTAACCTTCTG GAGTAAAGCTCAAGTTGATCGATCTCCTTCATCCGCTGGGAGATGGCACG GCTGGGCTGGGCTGGGGTGGGGTGGGGTGGCACACATTGATAAGGTTCTT GAAAGCGTGCGTTTCCCTGAAAGAAAAACAGGGTTGCTTTTTGCTGGCGC GTTATTCGTTGGTACCATACCATATATACCCTGTACCGTTTCCTTTTTTC TCTTTTGGTTGTCTCCAAAAAGCGTTCGTTCGTTCGATCCTGGACCCGGT CTACGGTAGGATGGGGTGGTTCTGTAGGGGGGAGGGGACGGTACTGAGCG TTACTCTCTACTTCAGCAAAAGTTGCAGAGGTTGCGCAATCAGGTGTGGC CCCGTTCTATCGAACAGCGGCCCCTTTATGGTCGAAGATGCACGACCGGG CTGTGGGCTGCACCGATGGTATATTTTCCGCGTTCGGCAGGCGGAGGATG GGCTAGTGTTCTTGTGTTTTTGTATGACGTGTGATGGAATTAAAAGTATA TTATAGGGAAACGAGGTTCCTACAAACAAGTCCAGTTGGTTGTGCTTGCC ATCGATCGATCTACTTCATTTATTCCTTCTATATTAGTGATTTATTAGTG ATTGATGTATCATTGAGATAAAGCCGCCGAATAAGTTGCAACTGTCTATT AATGGGTACTGTAAGGCCTTGGCAATGCACTACCAATACCGAGAATGTCT GATGACGTCACTAAAAACCATGAACGGGTGTTTTTTTCGCGGAAACTTTT TTCTGTGTACGTATAAATGATTAATGATTGGGTCGTGTCTGCATCGTTTC GTTCTGAAATCTGTGAAATCGGCAGGTAGAGAGGTTGTGAGATAGGCTGG CCATGCAGGCACGATACTAACAAACGTTATAAGGGAGGCAGTAGGCAGGC CCCGTAGCGTTTTTCCTCGAATTCCTGACAACTACCTTCTTGAGCATGAC TGGGGGCGTGCTTTTCGGCATTGATTTATTCTGTCTTGTTTACCACAGAC ACTTACCATAGTATGTAAAGTTAAACTTCAAGTCCCGCGCAATCAGCTGA GTCGCGGCGGATCATTCCATAACCCCCTAACCTTGTATTTTCTTGTCTAC CTTAAGACAGGAGCAGTTTACTGCAAGGCGAAATATATGAACTCACCCTG GTATCATATAGTGGTAGTTGAAATCACGGAAGTACTTCTACCCCCGTTCA TTTGGACCCTTTACGAAAACGAGTTTAATCTCCTGTGCATGTTGCCCGTC CGTGATGTTTTTTGTTTTAGTGTAATCGGCAGATTCAACGCCTACCGTAC CGCACCGGTATTCCAGTCAATCTACTGTAGTCTAGTATAGTCTACTCTAG TGGGAGTGTAAAGATGTAGGAAGAGGAAGAGGAAGAATGAGCATCTTGTA ACCCTGGCCCCCTTGTGCTTGGTAACGTGTGTATTGGTTAGTGGTATATT GGTTGTATTGGTTGTATAGTTACTGTATAGAAGTTTCGTGTCTGAGGTTT TGTTTGCGGTAATGGCGATGCCTTCGGGGTTAGGGGTATCGAAGAATCTA CTGGGATCATCCGGCAGTATAGTATTTCTATTCTAATCGTTATGAGAAAA AGGGTATGTAGCTGTTGGATTTTATGTCTGTCCATTTGTGAAATTATATG TCGTCTATTTGAACGTCCGATTGTGGGATTTGTCGGTCGTCGATTTGTAG CTGAACAGGAGTACAGTATAGTACAGTACCGGTGTAATGCAGTACAGCTG TACAGTACAGTACAGTATTCGTCTGACCATCCATATTAAAAAAAAGTACA GTATATCCTTTCGTACACGATATTCGTGTGTGTATCTACAGACAAACATC ATTCGTGTAAGAAAAGTTTTAAAATGTGGTATATGCATCTTGATGTGTGA CGGACGGATACGTTTGGTTTTGGTGAGACGGTTGACTTCGAAATCCAAAC TGAACCAGGAAATATTTTATCGTGTATATGCATCTTCAAAAATATTATTC CTCATATTATAGCTCTATTTAACTCGTAGCTTTTATTTTAAAACATATGA ACTCATTTCGACCCTTCGAACATCAAGGGGACCTACAATCGTCAGGTTCG AATGTGGACATTACTACATTTAAGAACAAAATCGTCATATGTGATAATTC GTGTTCCCCGGTCGTAACTTCATCGAGTCAACAGTTACTAATGTTGATGC CGTCAATGTCCCGTACACTTCAATTATTGATGACGTCACCATATGGGGAC TATGACGCCAAGTAAGAGAGATTAGAGGGATTTGGGATTAGAAACATGAT TGCGTATACATCGATTGGTTTAAAATCTTTTCTGGAAGCGTATTATGGCC TAATGTGAAGAGGATTTGATTATTTTTAGCTCAACACTGTTAGCCCTTAG GGTACAAATGCCGTAATGGGTACAAATTGGTTCCATCTGACTTGGTCTTT GACGGCGGCACATCTAGCTTCGAGGACAGCCGTATGGATGTTGTGCGGAT AGCCTTGATCCGCCATGCTCACTGGTTATGCTGCTGCTGTGGATTGTCTA GCTCGTTTAGTACTCTCTGTTTTCCG
back to top

Coding sequence (CDS) from alignment at H-elongata_contig12037:156..8631+

>mRNA_H-elongata_contig12037.1570.1 ID=mRNA_H-elongata_contig12037.1570.1|Name=mRNA_H-elongata_contig12037.1570.1|organism=Himanthalia elongata Himel1 dioecious|type=CDS|length=4050bp|location=Sequence derived from alignment at H-elongata_contig12037:156..8631+ (Himanthalia elongata Himel1 dioecious)
ATGGACGACATCACTTCCGTTGACGACCAAGTTGGCTACAATGCACGATG
GACGACATCACTTCCGTTGACGACCAAGTTGGCTACAATGCACGGGTGTG
TATCCTGCTCCCCACCGCTGGTGAGAATCTAGAGGTTGTCTTCAAGGCCC
TCGTAGGATCTATTTCCCAGCGTCTTTGGGACTCGGGCCTGCCCGAGTGC
CAGACGTTGCGGGTGGTGGTTTTGGACGAGAAGCGTCGCGTCGAGGTATA
CAGGGTCTGCGCGGGGCTGCACCGGATCGGAGTGCTGCTGGCAGGGAGGC
GTGTCCAGCAGATTCTCATGGGTGTGTATCCTGCTCCCCACCGCTGGTGA
GAATCTAGAGGTTGTCTTCAAGGCCCTCGTAGGATCTATTTCCCAGCGTC
TTTGGGACTCGGGCCTGCCCGAGTGCCAGACGTTGCGGGTGGTGGTTTTG
GACGAGAAGCGTCGCGTCGAGGTATACAGGGTCTGCGCGGGGCTGCACCG
GATCGGAGTGCTGCTGGCAGGGAGGCGTGTCCAGCAGATTCTCATGGCCG
AGGGTGTGACGGAGCTGACCCCAAAGGGATTTATCGATTGGTGCCGCAAT
GGCAGTGGCTACGAGCGCAAGCACTTGTACGACGACAAGAAGCTTAACGA
GGCCGTACAGGCCGAGGGTGTGACGGAGCTGACCCCAAAGGGATTTATCG
ATTGGTGCCGCAATGGCAGTGGCTACGAGCGCAAGCACTTGTACGACGAC
AAGAAGCTTAACGAGGCCGTACAGGTGCTGCGTCTCCTGGATGCCATGTG
TCTTGCCAACGGCTTGACGGACGCCTTCGCTCTGGAGGCTCGTCCATCCT
CGGCAACGTACAACCCTATCACGTCTGCCGCTTGGAACGCGGCAAGTCGG
GTGTCAAAGGCTAACGAGACCACCGTGGAGACCATAGCAGACCTTAACGA
TTCTGCCAGGTCCGAGGCGGAGGCAAAAATGCTAGGGGCCAGCGCGATGA
ATGTCACCCCAGGTGCTGCGTCTCCTGGATGCCATGTGTCTTGCCAACGG
CTTGACGGACGCCTTCGCTCTGGAGGCTCGTCCATCCTCGGCAACGTACA
ACCCTATCACGTCTGCCGCTTGGAACGCGGCAAGTCGGGTGTCAAAGGCT
AACGAGACCACCGTGGAGACCATAGCAGACCTTAACGATTCTGCCAGGTC
CGAGGCGGAGGCAAAAATGCTAGGGGCCAGCGCGATGAATGTCACCCCAG
GGTTTTACGAGATTTTTGGCTCGGGTTCCAATTCGGGTGAAACGGGCGCC
GGCAAGGATGTACAAAAGGGACTACCCACCTTGGTGTACTATTCGAGGAA
GGAAGCCGGTTCCCCCAAGATCAGCCCCAAGGCGGGGAACATGGTTTTAC
GAGATTTTTGGCTCGGGTTCCAATTCGGGTGAAACGGGCGCCGGCAAGGA
TGTACAAAAGGGACTACCCACCTTGGTGTACTATTCGAGGAAGGAAGCCG
GTTCCCCCAAGATCAGCCCCAAGGCGGGGAACATGAACTCTGCCATCTTT
CCATTAGACGATCCCCAGTCGGAGCCTCTCGTCGGAGACGCCACCATCGT
AGTGGTTAACGATGCGCGTCATCAGCTGGAAGCCAACTTTCTGCAGAGAA
CCGTGCCCTATTTCTTCGAGCTGACAGGAGGCCTTCCTACTGTAGCTTCT
GGCGGACGTTACCGTTGGGCCAAGGAACTCTGCCATCTTTCCATTAGACG
ATCCCCAGTCGGAGCCTCTCGTCGGAGACGCCACCATCGTAGTGGTTAAC
GATGCGCGTCATCAGCTGGAAGCCAACTTTCTGCAGAGAACCGTGCCCTA
TTTCTTCGAGCTGACAGGAGGCCTTCCTACTGTAGCTTCTGGCGGACGTT
ACCGTTGGGCCAAGGTGGCCTTCGTGCAGACACCTCAGCGTTTTCGAATG
GAGCTCGCCAATGACCCGCTCGGCAACCACGCCATCTCGCAGGTGGCCTT
CGTGCAGACACCTCAGCGTTTTCGAATGGAGCTCGCCAATGACCCGCTCG
GCAACCACGCCATCTCGCAGTACGACGTAATCAACCACGGAAAAGATGGC
ATTGGAGCCGTGTCCTCAAGCGGGCAGGGTAGCCTCTGGCGCGTAGAGGC
TTTAAAAGGGCAGCAGCCAGACGGCAAGGTCGTGGACGATCCCAAGGACC
TTAGCCTGGTCGGCAAGAAGCTCGGCTTCCGTTCCGAGATGCTCATCGAA
GACACCCACACTTCCGTGGACCTCTTCCGACAGTACGACGTAATCAACCA
CGGAAAAGATGGCATTGGAGCCGTGTCCTCAAGCGGGCAGGGTAGCCTCT
GGCGCGTAGAGGCTTTAAAAGGGCAGCAGCCAGACGGCAAGGTCGTGGAC
GATCCCAAGGACCTTAGCCTGGTCGGCAAGAAGCTCGGCTTCCGTTCCGA
GATGCTCATCGAAGACACCCACACTTCCGTGGACCTCTTCCGACAGGGAT
GGCGCAGCGTATACGTGAATGAGCCGGGAGAGGTGCTGGCGTGGTGCACC
CACCAGCCGACGAGCCTGACGTGGCGTATCAAGCAAGTGCTGCGGTGGCA
TCAAGGCGCCGTGCAGCTGCTCCTGTTCAAGGGCCTCCGTTACACAAGCA
TCGGCGGCTACTACCCTACCATTTGGCACCGCCTCTACGCCTTCGATCTC
GCGACATACTACCTTCAGGGATGGCGCAGCGTATACGTGAATGAGCCGGG
AGAGGTGCTGGCGTGGTGCACCCACCAGCCGACGAGCCTGACGTGGCGTA
TCAAGCAAGTGCTGCGGTGGCATCAAGGCGCCGTGCAGCTGCTCCTGTTC
AAGGGCCTCCGTTACACAAGCATCGGCGGCTACTACCCTACCATTTGGCA
CCGCCTCTACGCCTTCGATCTCGCGACATACTACCTTCAGGCCCTGCCAG
GGTACGTCCTGCTTGTGATGCCGATCGTCTACGGCGTCACCGGCAAGCCC
CCGTTTATCACTAGGCCCTGCCAGGGTACGTCCTGCTTGTGATGCCGATC
GTCTACGGCGTCACCGGCAAGCCCCCGTTTATCACTAGGCTGAAGGACTA
CTTCATGTACTTTACCCCGTTCATCGTGACTGCACTGCTGCCTACGGCCA
TCTCAAGTCAATGGCGCAAGAGCGACTCTCACCGTCTTACACGAGACGAA
CAGACGTGGCTTTCTACAACTTACGTGCAGATCTTTGCCTTCCTGCAGGC
TGAAGGACTACTTCATGTACTTTACCCCGTTCATCGTGACTGCACTGCTG
CCTACGGCCATCTCAAGTCAATGGCGCAAGAGCGACTCTCACCGTCTTAC
ACGAGACGAACAGACGTGGCTTTCTACAACTTACGTGCAGATCTTTGCCT
TCCTGCAGGTGATCTGGACGGCGATCACACGTAAGAGCCACGAGAACGCT
TGGGTGGCCAAAGTTCCGACGTGGCCGCTTGTGGTGGTTTTCCTGGGCCA
GATCGTCGCTGTTGCCGGAGGCGTTTACTGGGTCATTGAGTATGGTGATC
TGGACGGCGATCACACGTAAGAGCCACGAGAACGCTTGGGTGGCCAAAGT
TCCGACGTGGCCGCTTGTGGTGGTTTTCCTGGGCCAGATCGTCGCTGTTG
CCGGAGGCGTTTACTGGGTCATTGAGTATGGGTTCGTGCTGTGGTACGCC
AACTTCTTCTCCATTATCGTGGTGGCCGGTTTGGCCATGCACGCGCTGTG
GCCCATGGTGTCGCAAAGCTTGGGATGGTCGATTCCGTCATTCTACTACA
TCAAGGGTTCGTGCTGTGGTACGCCAACTTCTTCTCCATTATCGTGGTGG
CCGGTTTGGCCATGCACGCGCTGTGGCCCATGGTGTCGCAAAGCTTGGGA
TGGTCGATTCCGTCATTCTACTACATCAAGCTTTTCTTGTGGATCTTCCT
TGGCTTCTCGGCCGTCGTCCTTGCTAACCTTCTGGAGTAACTTTTCTTGT
GGATCTTCCTTGGCTTCTCGGCCGTCGTCCTTGCTAACCTTCTGGAGTAA
back to top