Protein
- Protein accession
- O64293 [UniProt]
- Representative
- 8n036
- Source
- UniProt (cluster: phalp2_11845)
- Protein name
- Orf1626 gp
- Lysin probability
- 97%
- PhaLP type
-
VAL
Probability: 99% (predicted by ML model) - Protein sequence
-
MAKVQATMSTEIALDTLQAANSIKRLTQLVNSSTNAWKAQESQMRSVGDYLGAAQAKYDGLGNSIQNQQQKIEKLKQEQSQLKGTTAETAEQFLKYQQQIDQATTRLASLESQQKKAKQSLDYHKSGLAELQKEYKPKNEASETYVKRLKAEGKEDEARQEQLKQYKGAISNLNKQYEKQKEMLERIAKQSGKTSDEYRKQKQRLDETATSMAHARNTAEKLNNEIKQIQHSRTIVGRLKNSFEHLGNEIDKTEQKPSRLKGLFGATFAANLISNGFQNALGAIKGKFDEIAQSSAEYVKCQQTMNATWLTLTGNAEEGKKMVDMTNQMAQAAANSTEMVDGMNQKFYAVTHNTELTKQQTQAILTLQDAFGQTDAAVENFSTQWAQMIANGKVQGQDMMSIINVFPEMKNQLKEVAAQELGIADMTQDKYAELQKDGKIPAEMAQKALFELQDKYKDATANFSTTIGGLERTIQSRMPAVVAAFRDPIDQMKNPFLQQIGNWVADPKTETKFKELGEHVSKGLGTIMDAFSKVFNLGNGTDKLNGFMDGLNKFVDNLSQKIANNAPKIVAFFKETKDSLIALFSIGKDFASGVWETAVFMIKGVAGAFNLMTGKGKKAKGKVTSLSKALGSIAEHKTAIKTVGSLFATYFVGSKVASGVMKVAKAINAVKNSTIATAAATKAAKAAQMAMAGAQKVATGVQWALNAAISANPIGAILVGITALIAGFVMLYKHNKKFKKLVDGMFNAAKKAFDKIFKVTKEIFGKIINFFKKDWKQVLLFIANPIAGAFALIYKHNKKFKKFVDGIAKSVKKAFGKVVNFFKKGWEKISGIFKAIKNGFSKVGELFSNVAKGLVKHAKNLGKGFAKHMSNLGKDWGKKWDGIKNSASNAWEKIKTSAGQGMTILGKNIDEHHKGISKNWSDGWENSKTFLSKKWDEIGELTQNKFGVNITKIITDALTSIADFFTNTWDNVKKGFGDMWDNLKSLARDGINAVIGIPNKGIDGINGLIHDFGGPKNAIGKIPEVPKFANGTGLFNGYRNPITKTTLALLNDGNDSPETGNQEAVIMPNGDIHPVPGRNTYAVLPAGAEVLNASEWAALSGAKPFAKGTGFWSKIWNTTTNVAGSVWNGLKNGVDKFKKMIDFVRDVIKDPVGTMAKKFSPNSDKLDGMFSHLGNALYKKPVEEAKNWWKELWSMANASMDEGTAAMGAKGDDYRFKNKAKDAGADPWGYYFRECVSFVASRLANLGVSSSLFSHLGDGRQWVNARVPHLSRPKPGSVAVYTGGPISSNHVDFVTAVHGDTYDGEEYNYGGNGQYHQYAGRHVKNAATFLDFGVRDSGSGDNGKPLKDRNNPLQSLIKRQVGGMFDWIKKTLGPLLSPAWGGEDGPQGTGVARWRDSVVKALEANGIEANNFRVSKILATIKRESNGNPNAQNNWDINALRGDPSIGLMQTIGRTFNAYKHPGHDNIRNGYDNLLAAINYIKHRYGTSDAAFNRVAAYGYANGGLVHKNGVYELAEGDMPEYVIPTDIAKRGRAWQLLTEAVARFAGDAPQSNHDTNSDRGRVSVLESKLDVMIGLLSQLVTNDSKPIEIQNIIDGRSVSNGLAPFMTKATNEYERRQALLGGSII
- Physico‐chemical
properties -
protein length: 1626 AA molecular weight: 178112,6 Da isoelectric point: 9,54 hydropathy: -0,45
Representative Protein Details
- Accession
- 8n036
- Protein name
- 8n036
- Sequence length
- 814 AA
- Molecular weight
- 89509,14050 Da
- Isoelectric point
- 9,70908
- Sequence
-
MRLVRPMQPLRIFATQWAQMIANGKVQGQDMMSIINVFPEMKNQLKEVAAQELGIADMTQEKYAELQKDGKITSEMAQKALFELQDKYKDATANFSTTIGGLERTIQSRMPAVVAAFRDPIDKMKNPFLQQIGNWVADPNTETKFKDLGEHVSKGLGTIMDAFSKVFNLGDGTDKLNGLMDGLNKFVDNLSKSIANNAPKIVAFFKEVKDSLASVFSIGKDFASGVWETAVGMIKGVAGAFNLMTGNGKKAKGPVTSLSKALGGIAKHKTAIKTVGSLFAAYFVGSKVAMGITAVVKGIHAWRTATVGMTAAQKLLNLAMASNPIGLIVVAVTTAITALVLLYKHNKKFKAFVDGMFNAAKKAFDKIFKVTKEIFGKIIDFFKKDWKQVLLFIANPIAGAFALIYKHNKKFKKFVDGIVKNIKDGFSNAGKWLGKTWDGMKKTWTGAMDTMAKSTKKGFEQTKNYFTGGEKGIKAFTNTAKKLLVISNPVVAGFKLMYEHNKPFKKFVDSTVDHVKDMAKGVAKHMSNLKKDWGEKWDNVKKFASKTWENIKGNASEAMIALGKDIDKHHKGINKNWFDGWENSKKFLSKKWDEIGALTQEKFGVNITKLITDALTNIAKFFKDTWDNVKKGFGEMWDGMKKLAGDGINAVIALPNAGIDGINKLISDFGGSKEAISKIPKVKFAGGTGMFSSYRNPITKPTLATLNDGYDSPETNNQEMVILPNGKSFLPQGRNVEYLLPAGSEVINASELAMLMGVERGAFAKGTGFWSKIWDTATNVAGSVWDTMKNGVDKFMKMIEFVGDVVKDPRWITS
Other Proteins in cluster: phalp2_11845
| Total (incl. this protein): 119 | Avg length: 1588,1 | Avg pI: 9,33 |
|
|
||
| Protein ID | Length (AA) | pI |
|---|---|---|
| 8n036 | 814 | 9,70908 |
| 3wAph | 1123 | 9,66060 |
| A0A286QRI3 | 1602 | 9,43445 |
| A0A4D6BI14 | 1598 | 9,68336 |
| Q9XJA8 | 1656 | 9,38977 |
| O36168 | 1554 | 9,43600 |
| A0A4D6BEZ5 | 1654 | 9,39499 |
| O64282 | 1560 | 9,29997 |
| F8HGU0 | 890 | 9,25329 |
| A0A4D6AVC9 | 1505 | 9,21745 |
| A0A4D6B1Z4 | 1582 | 9,33652 |
| A0A286QRZ7 | 1656 | 9,35915 |
| A0A1S5PRU1 | 1656 | 9,36650 |
| A0A2P0VH52 | 1656 | 9,36972 |
| A0A1S5PRY3 | 1591 | 9,22241 |
| A0A286QTA7 | 1656 | 9,39744 |
| A0A220GC82 | 1530 | 9,21951 |
| A0A2P0VJI3 | 1656 | 9,40241 |
| A0A286QQJ3 | 1656 | 9,28018 |
| A0A2P0VJ65 | 1656 | 9,37997 |
| A0A2I6QQX2 | 1592 | 9,34452 |
| A0A286QQ86 | 1594 | 9,18586 |
| A0A286QNS8 | 1594 | 9,24214 |
| A0A2P0VHL4 | 1656 | 9,38984 |
| A0A286QPV0 | 1591 | 9,30235 |
Similar Clusters (pHMM search)
| # | Cluster | # Members | Identity (%) | Alignment Length | E-value |
|---|---|---|---|---|---|
| 1 |
phalp2_7660
6v5eq
|
4 | 28,0% | 867 | 1.218E-94 |
| 2 |
phalp2_20979
7wDdb
|
23 | 27,8% | 687 | 2.655E-74 |
| 3 |
phalp2_10042
7lCpJ
|
2 | 24,7% | 776 | 1.523E-33 |
| 4 |
phalp2_10746
3nCzt
|
10 | 22,0% | 762 | 6.188E-16 |
| 5 |
phalp2_9735
456Ta
|
8 | 21,1% | 700 | 4.314E-12 |
Domains
Domains [InterPro]
No domain annotations available.
Taxonomy
| Name | Taxonomy ID | Lineage | |
|---|---|---|---|
| Phage |
Moineauvirus Sfi19 [NCBI] |
72638 | Aliceevansviridae > Moineauvirus > |
| Host |
Streptococcus thermophilus [NCBI] |
1308 | Firmicutes > Bacilli > Lactobacillales > Streptococcaceae > Streptococcus > |
Coding sequence (CDS)
Coding sequence (CDS)
CDS Source ID
CDS Source
AF115102
[NCBI]
CDS location
range 9963 -> 14843
strand +
strand +
CDS
ATGGCAAAAGTACAAGCTACCATGTCTACTGAAATAGCTTTAGACACGCTGCAGGCTGCTAACTCGATTAAACGTTTAACTCAGTTAGTCAATAGTTCTACTAACGCTTGGAAGGCTCAAGAAAGTCAGATGCGTAGCGTTGGGGACTACTTAGGTGCTGCACAAGCCAAATATGACGGTTTGGGTAATTCTATCCAAAATCAACAACAAAAAATTGAGAAACTGAAACAAGAACAGTCTCAACTCAAAGGGACTACTGCTGAAACTGCTGAACAATTCCTTAAGTACCAGCAACAGATTGACCAAGCTACTACACGCTTGGCATCGTTGGAAAGCCAACAGAAAAAAGCAAAGCAAAGCCTTGATTATCATAAGTCTGGTTTAGCAGAACTTCAAAAGGAATATAAGCCCAAAAACGAAGCATCTGAAACCTACGTTAAGCGTTTAAAAGCTGAGGGTAAGGAAGATGAAGCTAGACAAGAACAGCTTAAGCAATACAAGGGAGCAATTTCTAACTTAAACAAGCAGTATGAAAAACAAAAGGAAATGCTTGAGCGTATTGCTAAACAATCAGGGAAAACTAGCGATGAATACCGCAAGCAAAAGCAACGCTTAGACGAGACAGCGACAAGCATGGCTCATGCTCGCAATACTGCTGAAAAATTAAATAATGAGATTAAACAAATTCAACATTCAAGAACGATTGTTGGTCGTTTAAAAAATAGCTTTGAACATTTAGGGAATGAAATTGATAAGACTGAACAAAAACCTTCACGGTTGAAAGGTCTATTTGGTGCCACATTCGCAGCTAACTTAATTAGTAATGGCTTCCAGAACGCACTGGGAGCTATCAAGGGTAAGTTTGATGAAATAGCACAGTCTAGTGCTGAATACGTTAAATGCCAACAAACCATGAACGCCACTTGGTTGACTTTGACAGGTAATGCTGAAGAAGGTAAGAAGATGGTCGATATGACCAACCAGATGGCGCAGGCAGCGGCTAACTCTACTGAAATGGTTGACGGCATGAACCAAAAATTCTATGCCGTCACTCATAATACTGAGTTGACCAAACAACAAACGCAAGCTATCTTGACATTGCAAGATGCGTTTGGTCAGACTGATGCAGCTGTTGAGAATTTCTCTACTCAATGGGCTCAAATGATTGCCAATGGTAAAGTCCAAGGGCAAGACATGATGTCAATCATCAATGTCTTCCCAGAAATGAAGAATCAACTTAAAGAGGTAGCTGCACAAGAACTTGGGATTGCTGACATGACCCAAGATAAATATGCTGAATTGCAGAAAGATGGTAAGATTCCTGCCGAAATGGCTCAAAAAGCCTTGTTTGAGTTGCAAGACAAGTATAAAGATGCTACAGCTAACTTCTCAACTACTATCGGTGGTCTTGAAAGAACTATCCAATCTCGTATGCCCGCAGTAGTTGCGGCATTTCGTGACCCAATTGATCAAATGAAAAACCCATTCTTGCAACAGATTGGTAATTGGGTTGCTGATCCTAAAACTGAAACTAAATTCAAAGAATTAGGGGAGCACGTTTCTAAAGGTCTAGGCACTATCATGGATGCTTTCTCTAAGGTGTTTAATCTTGGAAATGGTACAGATAAGCTTAATGGCTTTATGGACGGTCTTAATAAGTTTGTCGATAATCTAAGTCAGAAAATTGCTAATAACGCACCTAAAATTGTAGCGTTTTTCAAGGAAACAAAAGATAGCCTAATTGCACTTTTTAGCATTGGTAAAGACTTCGCTAGCGGTGTTTGGGAAACTGCTGTTTTCATGATTAAAGGTGTCGCTGGAGCTTTCAATTTAATGACTGGCAAAGGTAAGAAGGCTAAAGGAAAAGTAACATCGCTATCCAAGGCTCTGGGCAGCATTGCAGAACATAAAACAGCTATTAAAACAGTTGGTTCTTTGTTTGCGACTTATTTTGTGGGTTCTAAAGTGGCCTCAGGTGTGATGAAAGTTGCTAAAGCCATTAACGCAGTTAAAAACTCAACGATAGCCACAGCTGCTGCAACGAAAGCAGCTAAAGCAGCTCAAATGGCTATGGCTGGTGCTCAAAAAGTTGCAACGGGAGTACAATGGGCATTGAATGCAGCGATTTCTGCCAACCCCATCGGAGCAATTTTGGTTGGAATAACAGCACTTATCGCAGGCTTTGTGATGCTTTACAAACACAACAAAAAATTCAAGAAGCTTGTAGATGGAATGTTCAATGCTGCTAAAAAAGCCTTTGATAAAATCTTCAAAGTCACCAAAGAAATCTTTGGTAAGATCATTAATTTCTTTAAAAAGGACTGGAAACAAGTCCTTTTATTTATTGCCAATCCAATTGCTGGAGCTTTCGCCTTAATTTACAAACACAATAAGAAATTCAAGAAATTTGTTGATGGCATTGCAAAATCTGTAAAGAAAGCATTTGGCAAGGTCGTTAATTTCTTTAAAAAGGGATGGGAAAAAATCTCTGGCATTTTTAAAGCAATCAAAAACGGTTTTAGTAAAGTTGGGGAGTTATTTTCTAATGTTGCAAAAGGACTGGTTAAGCATGCCAAAAACCTAGGAAAAGGTTTTGCCAAACACATGAGTAATCTCGGTAAAGACTGGGGCAAAAAATGGGACGGCATCAAAAATTCTGCTTCCAACGCATGGGAAAAAATAAAGACAAGTGCTGGTCAAGGGATGACTATACTTGGTAAGAATATTGACGAACATCATAAAGGTATCTCTAAGAATTGGTCTGACGGTTGGGAAAACTCTAAAACATTCCTATCGAAAAAATGGGATGAAATCGGAGAGTTAACACAAAATAAATTCGGTGTTAACATCACTAAAATAATCACTGACGCATTGACGAGTATCGCTGACTTTTTCACAAATACTTGGGATAACGTTAAAAAAGGTTTTGGCGACATGTGGGACAATTTAAAAAGTTTGGCGCGTGATGGTATTAATGCAGTCATCGGCATCCCAAATAAAGGTATTGATGGTATCAACGGTCTAATCCACGACTTCGGTGGTCCGAAAAATGCTATCGGTAAAATTCCAGAAGTTCCCAAGTTTGCAAATGGTACAGGGCTTTTCAATGGTTATCGCAATCCGATTACCAAGACTACGCTAGCTTTACTAAATGATGGTAACGACAGTCCCGAAACTGGCAACCAAGAAGCCGTAATTATGCCCAACGGCGACATTCATCCAGTTCCTGGCCGTAATACTTATGCAGTATTGCCAGCGGGTGCAGAGGTACTAAACGCAAGCGAGTGGGCTGCTTTATCAGGTGCAAAACCATTCGCCAAAGGTACTGGTTTCTGGTCTAAGATATGGAATACAACTACTAATGTAGCTGGCTCAGTTTGGAATGGGCTGAAAAACGGTGTCGACAAATTCAAAAAAATGATTGATTTTGTCCGCGACGTTATCAAAGACCCCGTTGGAACAATGGCTAAAAAATTCAGCCCTAACTCTGACAAGCTAGACGGTATGTTTAGCCATCTTGGTAATGCTCTTTACAAGAAGCCAGTAGAAGAAGCTAAAAACTGGTGGAAAGAACTCTGGTCAATGGCTAATGCTTCAATGGATGAAGGCACAGCGGCCATGGGTGCTAAAGGTGATGACTACCGCTTTAAAAATAAAGCGAAAGACGCTGGAGCAGACCCTTGGGGTTACTACTTCCGTGAATGTGTATCGTTCGTAGCTAGTCGTTTGGCCAACCTTGGTGTAAGTTCTAGTCTGTTCAGTCATTTAGGTGATGGCAGACAGTGGGTAAATGCAAGAGTGCCACACCTAAGCAGACCAAAACCAGGCTCGGTAGCGGTCTATACTGGTGGACCGATTTCAAGTAACCACGTTGATTTTGTAACAGCCGTTCATGGCGATACGTATGACGGTGAAGAGTACAATTATGGTGGTAATGGTCAGTACCATCAATATGCTGGACGGCACGTCAAAAACGCTGCTACTTTCCTTGATTTTGGCGTCCGAGATAGCGGAAGTGGAGATAATGGGAAACCACTCAAAGACAGAAACAATCCGCTTCAATCTTTGATTAAACGCCAAGTTGGCGGTATGTTTGACTGGATTAAGAAAACGCTCGGTCCATTGCTCAGCCCAGCTTGGGGCGGCGAAGACGGTCCTCAAGGAACTGGTGTAGCACGGTGGAGGGATTCAGTAGTTAAAGCGTTGGAAGCAAACGGTATTGAGGCAAACAACTTCCGTGTATCTAAAATCTTAGCTACTATCAAACGTGAATCAAATGGTAACCCTAACGCTCAAAACAACTGGGATATTAACGCTCTAAGAGGTGACCCGTCAATCGGTTTGATGCAAACAATAGGGCGTACTTTCAACGCATACAAGCACCCTGGTCACGACAATATCAGAAACGGTTACGATAACTTGCTCGCTGCAATCAACTACATCAAACACCGCTATGGAACGTCAGACGCAGCCTTTAACCGTGTGGCTGCTTATGGTTACGCAAACGGTGGCCTAGTCCACAAAAACGGTGTGTACGAATTAGCCGAGGGTGATATGCCAGAATACGTTATACCGACCGATATTGCTAAGCGTGGTAGAGCATGGCAATTACTTACTGAAGCAGTTGCACGCTTTGCAGGAGATGCCCCACAAAGCAACCACGATACTAATTCAGATCGTGGACGTGTTTCTGTACTGGAAAGCAAGCTAGACGTTATGATTGGTTTGCTAAGCCAGTTAGTAACGAATGATTCTAAGCCAATCGAGATTCAAAACATCATTGATGGTAGAAGCGTTTCAAACGGATTAGCACCATTTATGACAAAAGCAACTAACGAATATGAGCGCAGGCAAGCGCTGTTAGGAGGTAGCATTATTTGA
Gene Ontology
| Description | Category | Evidence (source) | |
|---|---|---|---|
| GO:0001897 | symbiont-mediated cytolysis of host cell | biological process | None (UniProt) |
| GO:0016020 | membrane | cellular component | None (UniProt) |
| GO:0098003 | viral tail assembly | biological process | None (UniProt) |
Enzymatic activity
No enzymatic activity data available.
Tertiary structure
PDB ID
upi000009b067_model
Method
AlphaFold3 (non-commercial)
Resolution
-
Chain position
-
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50
The structures below correspond to the cluster representative
(8n036)
rather than this protein.
Model Confidence
Very high
pLDDT > 90
pLDDT > 90
High
90 > pLDDT > 70
90 > pLDDT > 70
Low
70 > pLDDT > 50
70 > pLDDT > 50
Very low
pLDDT < 50
pLDDT < 50