BLASTP 2.11.0+ Reference: Stephen F. Altschul, Thomas L. Madden, Alejandro A. Schaffer, Jinghui Zhang, Zheng Zhang, Webb Miller, and David J. Lipman (1997), "Gapped BLAST and PSI-BLAST: a new generation of protein database search programs", Nucleic Acids Res. 25:3389-3402. Reference for composition-based statistics: Alejandro A. Schaffer, L. Aravind, Thomas L. Madden, Sergei Shavirin, John L. Spouge, Yuri I. Wolf, Eugene V. Koonin, and Stephen F. Altschul (2001), "Improving the accuracy of PSI-BLAST protein database searches with composition-based statistics and other refinements", Nucleic Acids Res. 29:2994-3005. Database: Tomato Genome proteins (ITAG release 4.0) 34,075 sequences; 11,664,535 total letters Query= Untitled_sequence Length=568 Score E Sequences producing significant alignments: (Bits) Value Solyc10g085070.3.1unnamed protein product 318 4e-101 Solyc09g014160.3.1unnamed protein product 315 1e-99 Solyc06g076700.1.1unnamed protein product 152 1e-39 >Solyc10g085070.3.1 unnamed protein product Length=601 Score = 318 bits (814), Expect = 4e-101, Method: Compositional matrix adjust. Identities = 250/567 (44%), Positives = 316/567 (56%), Gaps = 133/567 (23%) Query 24 RLSTSCDLHPEERFSGFCPSCLCDRLSVLDHNA--APPPSSSSRKPPSISAVSLKALF-K 80 R S SCD HP+E F+GFCP CLC+RL+ LD A + PSSSSR+P + SA ++KALF K Sbjct 21 RSSFSCDRHPDEDFTGFCPECLCERLTTLDQTAASSNNPSSSSRRPSTSSASAIKALFSK 80 Query 81 PSSSGTNNS-----NGNGRVRPGFFPELRRTKSFSAKNNEGFS----GGFEPQRRSCDVR 131 S+ T N FFPELRRTKSFSA NE S GFEPQR+SCDVR Sbjct 81 TSTFSTFNQKHPPLPPKPSKPTSFFPELRRTKSFSASKNEALSYLGGSGFEPQRKSCDVR 140 Query 132 LRDDERNLPINEAASVDKIEEEARESSVS-------------------------EIVLEV 166 +R+ +L + + + E+ ++ V+ ++V E+ Sbjct 141 VRNTLWSLFSLDGEAKNPHSEDTGDAFVNRPVIELKEEEEESPENDQISHIGNGDVVNEI 200 Query 167 TEEAEIEEDEENGEKDPGEIVEEKSSEIGEEE----EELKPMKDYMDLYSQTKKPS---- 218 TEE+ +E E SEI EEE + LKPMKD++DL SQ KKPS Sbjct 201 TEESPVE----------NSFCREVDSEIVEEELVNGDILKPMKDHIDLDSQVKKPSGGRD 250 Query 219 VKDFAGSFFSAASVFSKKLQKWKQKQKVKKPRNG-----VGGGRP--------QSEI--- 262 +K+ AGSF SAASVFSKK W++KQKVKK N + +P QSEI Sbjct 251 LKEIAGSFLSAASVFSKKWHNWRRKQKVKKRNNCENSSTLSLEKPISRKFRDTQSEIADY 310 Query 263 GVGRRSSDTDPRFSLDAGRFSVDIGRISMDDSRYSLDEPRASWDGHLIGRTTAARVPLPP 322 G GRRS DT+PRFSL DIGRIS+DD RYS DEPRAS D H +GR+ +P P Sbjct 311 GFGRRSCDTEPRFSL-------DIGRISIDDPRYSFDEPRASCDVHFMGRS----IPRVP 359 Query 323 SMLSVVENAP---LNRSDMQIP---SSPSIKPISGDSDPIIIIPGGSNQTRDYYTGPPSS 376 M+SV+E+AP + R+D QIP S S I ++D +PGGS QTRDYY SS Sbjct 360 PMVSVIEDAPVVHVQRADDQIPVEESPVSANCIGEETD----LPGGSAQTRDYYLD-SSS 414 Query 377 RRRKSLDRSNSIRK----IVTELEDVKSVSNS--------TTTIDSNSM----------- 413 RRRKSLDRSNSIRK +V E++++K+VSN+ + +SNS+ Sbjct 415 RRRKSLDRSNSIRKTAAAVVAEIDEMKAVSNAKVQPERDLNSISNSNSLRDDFSETFELT 474 Query 414 ---ETAENKGN--QNGDKKSRRWGKWSILGFIYRK--GKDDEEEDRYSRSNSAGMVERSL 466 +TA GN + G KKS++W W+I GFI+RK G DEE+DRYSRSN VERS Sbjct 475 GFKDTASGIGNGERKGSKKSKKWA-WNIWGFIHRKGNGNKDEEDDRYSRSNG---VERSF 530 Query 467 SESWPEMRNGEGGGPK------MRRSN 487 S SW +MR G K M RSN Sbjct 531 SGSWQDMRRETNGDLKGSLNRNMFRSN 557 >Solyc09g014160.3.1 unnamed protein product Length=660 Score = 315 bits (808), Expect = 1e-99, Method: Compositional matrix adjust. Identities = 285/672 (42%), Positives = 362/672 (54%), Gaps = 162/672 (24%) Query 24 RLSTSCDLHPEERFSGFCPSCLCDRLSVLD-----HNAAPPPSSSSRKPPSISAVSLKAL 78 R S SCD HP+E+F+GFCP CLC+RL+ LD +N + S S +A ++K+L Sbjct 23 RSSFSCDRHPDEQFTGFCPECLCERLTTLDNNSNNNNPSSSSRRPSTSSSSAAAAAIKSL 82 Query 79 FKPSSSGTNNSNGNGR------VRP-GFFPELRRTKSFSAKNNE--GF-SGGFEPQRRSC 128 F S +++++ V+P FFPELRRTKSFSA NE GF + FEPQR+SC Sbjct 83 FSKPSVPSSSTSVVVNNLPPKPVKPTSFFPELRRTKSFSASKNEALGFNTSAFEPQRKSC 142 Query 129 DVRLRD--------DERNLPINEAASVDKIEEEARESSVSEIVLEVTEEAEIEEDEENGE 180 DVR R+ D+ S+++ + + V V E EE + E+ E E Sbjct 143 DVRGRNTLWSLFSIDDETKTGKPTCSLNQNANDIGDGFVGRPVKEEEEEEDEFENGEEFE 202 Query 181 KDPGEIVEEK-------SSEIGEEEEELKPMKDYMDLYSQTKKPS----VKDFAGSFFSA 229 EI+EE+ EI EEE LKPMKD++DL SQ KK S +K+ AGSF+SA Sbjct 203 NVGDEIIEEELPVENEMQPEIVVEEEVLKPMKDHIDLDSQGKKGSGGKDLKEIAGSFWSA 262 Query 230 ASVFSKKLQKWKQKQKVKKPRNGVGGG-----RP--------QSEI---GVGRRSSDTDP 273 ASVFSKK W++KQK+KK NG G +P QSEI G GRRS DTDP Sbjct 263 ASVFSKKWHNWRKKQKLKKRNNGENSGTLPVEKPISRRYRDTQSEIADYGFGRRSCDTDP 322 Query 274 RFSLDAGRFSVDIGRISMDDSRYSLDEPRASWDGHLIGRTTAARVPLPPSMLSVVENAP- 332 RFSLDA GR+S DD RYS DEPRASWDG+LIGRT P P M+SV+E+AP Sbjct 323 RFSLDA-------GRMSFDDPRYSFDEPRASWDGYLIGRT----FPRMPPMVSVIEDAPV 371 Query 333 --LNRSDMQIP-SSPSIKPISGDSDPIIIIPGGSNQTRDYYTGPPSSRRRKSLDRSNSIR 389 + R D QIP P + S + D +PGGS QT++YY+ SSRRRKSLDRSNSIR Sbjct 372 VHIPRFDNQIPVEEPRLSMTSINEDE--SMPGGSTQTKEYYSD-SSSRRRKSLDRSNSIR 428 Query 390 K----IVTELEDVKSVSNST--------------------TTIDSNSM-----ETAENKG 420 K +V E++++KSVSN+ T +SNS+ ET E G Sbjct 429 KTAASVVAEMDEMKSVSNAKVLPAMGDQFLGAKVLVGERDTYSNSNSLRDDCSETFELTG 488 Query 421 NQNGD------------KKSRRWGKWSILGFIYRK--GKDDEEEDRYSRSNSAGMVERSL 466 ++ + KKSRRW W++ GFI R+ G DEE+DRYSRSN VERS Sbjct 489 FRDNNSSVIGNGERKDSKKSRRWA-WNLWGFINRRVSGNKDEEDDRYSRSNG---VERSF 544 Query 467 SESWPEMR-NGE---GGGPKMRRSNSNVSWRSSGG-----GSA----------------- 500 SESW ++R NG+ G K+ RSNS+VSWR+S G GS Sbjct 545 SESWQDLRTNGDVRGGVNRKVFRSNSSVSWRNSTGIGGSFGSMRKSSVDMNGHVKKKRDD 604 Query 501 ----RNKSSRYSSKDGENGMLRFYLTPMRRSWKTSGGSGGGGGGGGGGGWEKTAAKANSH 556 RN+SSRYS +NG+LRFYL PMR S + G G Sbjct 605 IVLERNRSSRYSPNHIDNGLLRFYLAPMRGSRRGLPGKSRPNG----------------- 647 Query 557 GHSIARRVMRLY 568 HSIAR + RLY Sbjct 648 SHSIARSLFRLY 659 >Solyc06g076700.1.1 unnamed protein product Length=634 Score = 152 bits (385), Expect = 1e-39, Method: Compositional matrix adjust. Identities = 124/343 (36%), Positives = 169/343 (49%), Gaps = 58/343 (17%) Query 27 TSCDLHPEERFSGFCPSCLCDRLSVLDHNA------APPPSSSSRKPPSISAVSLKALFK 80 ++C HP E +G C +CL +RLS LD +A P S+S P + + + F+ Sbjct 18 SACHRHPSEPVTGICAACLRERLSGLDTSADSELSIVPTFSNSFENPYADNGPGPEPGFE 77 Query 81 PSSSGTNNSNGNGRVRPGFFPELRRTKSFSAKNNEGFSGGFEPQRRSCDVRLRDDERNLP 140 S S S+ F P+LRR +S S EG EP+RRSCD R RN Sbjct 78 CSRSKAAISS--------FSPDLRRCRSVSTVRCEGSCSWSEPRRRSCDDR---SSRNTL 126 Query 141 INEAASVDK-------IEEEARESSVSEIVLEVTEEAEIEEDEENGEKDPGEIVEEKSSE 193 +N D+ E++ ++ + V + E+ E +V + + Sbjct 127 VNLFGVDDEAGGSNAGFTVESKNLGLTNLSDNVCQSIVEHEESEEVRVRADALVRIEDID 186 Query 194 IGEEEEELKPMKDYMDLYSQTKKPSVKDF---AGSFFSAASVFSKKLQKWKQKQKVKK-- 248 ++ ELK MK+++DL TK +DF A +F A SVFSKKLQKW+QKQ+ KK Sbjct 187 EDTQDGELKTMKEFIDLEFHTKNHKSRDFRDIAVNFREATSVFSKKLQKWRQKQREKKLN 246 Query 249 PRNGVGGGR---------------PQSEIG---VGRRSSDTDPRFSLDAGRFSVDIGRIS 290 RN G R +SEIG GRRS DT+PRFS+DAGRFS+D IS Sbjct 247 SRNAEGNDRFSAGNGKLIGYKSKDSRSEIGECATGRRSCDTEPRFSVDAGRFSLDGPGIS 306 Query 291 MDDSRYSLDEPRASWDGHLIGRTTAARVPLPPSMLSVVENAPL 333 +DEPRASWDG+++ RT +P MLSVVEN L Sbjct 307 -------IDEPRASWDGYMVART----IPRLTPMLSVVENVLL 338 Lambda K H a alpha 0.309 0.128 0.371 0.792 4.96 Gapped Lambda K H a alpha sigma 0.267 0.0410 0.140 1.90 42.6 43.6 Effective search space used: 3768021040 Database: Tomato Genome proteins (ITAG release 4.0) Posted date: Mar 21, 2024 4:18 PM Number of letters in database: 11,664,535 Number of sequences in database: 34,075 Matrix: BLOSUM62 Gap Penalties: Existence: 11, Extension: 1 Neighboring words threshold: 11 Window for multiple hits: 40