Basic Information

Insect: Lordiphosa clarofinis
Gene Symbol: lolal_1
Assembly: GCA_018904275.1
Location: JAEIGQ010000195.1:504917-560068[+]

Transcription Factor Domain

TF Family: HTH
Domain: HTH_psq domain
PFAM: PF05225
TF Group: Helix-turn-helix
Description: This DNA-binding motif is found in four copies in the pipsqueak protein of Drosophila melanogaster [1]. In pipsqueak this domain binds to GAGA sequence [1].
Hmmscan Out: # of c-Evalue i-Evalue score bias hmm coord from hmm coord to ali coord from ali coord to env coord from env coord to acc

1 4 7.4e-12 1.8e-08 34.1 0.0 1 40 590 630 590 633 0.90

2 4 4.1e-14 9.8e-11 41.3 0.1 2 39 645 682 644 685 0.94

3 4 9.5e-18 2.3e-14 52.9 0.0 1 45 699 744 699 744 0.98

4 4 9.6e-20 2.3e-16 59.3 0.0 1 43 751 794 751 795 0.97

#	of	c-Evalue	i-Evalue	score	bias	hmm coord from	hmm coord to	ali coord from	ali coord to	env coord from	env coord to	acc
1	4	7.4e-12	1.8e-08	34.1	0.0	1	40	590	630	590	633	0.90
2	4	4.1e-14	9.8e-11	41.3	0.1	2	39	645	682	644	685	0.94
3	4	9.5e-18	2.3e-14	52.9	0.0	1	45	699	744	699	744	0.98
4	4	9.6e-20	2.3e-16	59.3	0.0	1	43	751	794	751	795	0.97

Sequence Information

Coding Sequence: ATGTGGAATGAAGACGAGTTTGTGGAACAGAAAGTCAACAGCAAAGATGTGGCTTCAGATGACCAAGAATATGCCGACGTCTATGGTACTGAAACACCTTCAGATGGTACGGCAATGGAAAGCGTCAATAATGGTGCAAAAATAGTGAGACGCATAATAGGCAGCAGCAGCAGCATCTACAGCCTTGAGCCACCCAATAACCACACAAGAAGAAGGAAATTGGAATCCTCTTCCACCTGCAAAATGGCTGCCGTACGTGGGCATCAATATTTCAGCCTACGCTGGAATAACTATCAAAACACAATGACCTCAGTGTTTCAACAGTTGCGCGAGGATCTATCCTTTGTCGATGTGACCTTGTCCTGTGAGCACGGTTCCCTCAAGGCGCACAAGGTCGTGCTGTCCGCCTGTTCAACGTATTTCCAAAAGCTTTTGCTCGAGAACCCCTGCAAACACCCTACAATCATTCTGCCTGCTGATATTATATTCACAGATCTGAAAACCATCATCGATTTTGTTTATCGCGGTGAGATCGATGTCACCGAATCGGAATTACAAGGTCTGCTCCGCACCGCCGAACAACTGAAAATCAAAGGCCTCTGCGAGACAGCTGAGAATGCGGATGATCTGAATGATGCTGCCACTGCAACAATAACTGTATCAGAGAACATACAACATAACGTTGCCCTGAGCGGTCAACTGCTGAGCACAGCGAGCGGCAGCAGCAGCAGTAGCGGTGCTGGCCAACTGCAGGCACAGCAGCAGACACAGTCCGCTGGTCTACAGCCTACGCTACGCAAGTCGCGCCTCAAGCGCTCTAAGTCGCCAGATCTGCAGCACCATCCGCAGACTATACTTATCCAGGGACAAAACCAAACGTCCATTGTGAGTCTGCAGCAGACGGTCGACGGCAATTATATACCAGTCGGCGGCAACGGCGACGACTCGGACGTGGATCAAGAGCACGAACACGAACACGTCGACGAGCACGAACACGATCACGATAGTAAGCCAGGGAAGATCTGCAAGACAGAGCACTCGGTGGCCTCACCAGCGTCCAACTCATCCAACGCCTCGAACAATGCAGCGGGTGTGAGCGGCGTGACAGCAGCAGGCCAAGCCATCGTCACACAAATTGTAGTAGCGCGCGACGGAAAAGATACAAAAAATATGACTAGTTTAGGCATGGGCATGAACGGCGGCCTGTTGGGCGTGCCCATGGGATTCCTGGATTTCACACCCGAGCCACCAGCACCATCTGCCACACCAGTCACCGTAACGGAACATGTCGACCTCTCGTGCAATCCGAGTACGGATACGCGAGACCTATCAAATCCCACCGAAGCGCTCGACATTGACAATCACCTGGCGCAACAAATCCATCGGCTTGATCAATCTCCCATGCATTCGATAGGTCATCATCACACTGGCGATGAGAGCAACTCGCAGCTAGTGCAGCACATCAAAATCATGGAGATTGATCCGAGTCAAATAAAGCATGAGCCAGGCATGATAATAACGCCAGAGATTGTCAACATGATGTCGTCGGGTCATATGGACATGTACAACTCGGATACGAGCGAGGACTCCATGATGATCGCTAATGGCTCTCCGCACGATCAAAAGGAGCCGCACTATACGAATTTGGATCAGCAACACGGCCTGGGTGGCAGCGTTTGCGGCCCTGGCCCAGGTGGTGCTGGTGGTGGCATTGGTGGTGGGGCTGGCTCTGGCGAGAAAGGTCAGTTTAATGGTCCCAAAGCTTGGACACAAGATGATATGAATTCAGCTTTAGATGCATTAAAGAATCAAAACATGAGCCTGACGAAAGCATCTGCCATTTATGGCATCCCCTCGACCACGCTGTGGCAACGGGCTCACCGTTTGGGCATCGAAACGCCCAAGAAGGAGGGCGGCACCAAATCATGGAACGAAGATGCATTACAGAATGCCTTGGAGGCATTGCGATCGGGTCAGATATCCGCGAATAAAGCATCGAAAGCCTTTGGCATACCCTCATCGACGCTGTACAAGATAGCGCGTCGGGAGGGCATCCGTTTGGCTGCACCATTTAATGCCGCCCCAACCACGTGGACACCCGAGGACTTGGAGCGTGCATTGGAGGCAATTCGAGCGGGTAATACGTCTGTACAGAAAGCGAGTGCCGAGTTTGGCATACCAACAGGAACACTTTACGGACGCTGCAAACGTGAGGGCATTGAATTGTCGCGGTCGAATCCCACACCATGGTCCGAAGATGCCATGAACGAGGCCTTGAACTCAGTGCGCGTTGGCCAAATGTCCATCAATCAGGCGGCGATACACTATAACCTGCCCTATAGCTCGCTGTACGGCCGCTTCAAACGTGGCAAATACGATGTGGTGGCGAATACAAGTGGAGTGGCGCTAATGAATACCTCGGGCAACACAACCGGCAGCATTGAGATTATCGAGCATAGTCAGGAAAATTCGTTATACCCCCTCCCCATTCCCGCACTCAAAAATGCCAGCTTTGACTAA
Protein Sequence: MWNEDEFVEQKVNSKDVASDDQEYADVYGTETPSDGTAMESVNNGAKIVRRIIGSSSSIYSLEPPNNHTRRRKLESSSTCKMAAVRGHQYFSLRWNNYQNTMTSVFQQLREDLSFVDVTLSCEHGSLKAHKVVLSACSTYFQKLLLENPCKHPTIILPADIIFTDLKTIIDFVYRGEIDVTESELQGLLRTAEQLKIKGLCETAENADDLNDAATATITVSENIQHNVALSGQLLSTASGSSSSSGAGQLQAQQQTQSAGLQPTLRKSRLKRSKSPDLQHHPQTILIQGQNQTSIVSLQQTVDGNYIPVGGNGDDSDVDQEHEHEHVDEHEHDHDSKPGKICKTEHSVASPASNSSNASNNAAGVSGVTAAGQAIVTQIVVARDGKDTKNMTSLGMGMNGGLLGVPMGFLDFTPEPPAPSATPVTVTEHVDLSCNPSTDTRDLSNPTEALDIDNHLAQQIHRLDQSPMHSIGHHHTGDESNSQLVQHIKIMEIDPSQIKHEPGMIITPEIVNMMSSGHMDMYNSDTSEDSMMIANGSPHDQKEPHYTNLDQQHGLGGSVCGPGPGGAGGGIGGGAGSGEKGQFNGPKAWTQDDMNSALDALKNQNMSLTKASAIYGIPSTTLWQRAHRLGIETPKKEGGTKSWNEDALQNALEALRSGQISANKASKAFGIPSSTLYKIARREGIRLAAPFNAAPTTWTPEDLERALEAIRAGNTSVQKASAEFGIPTGTLYGRCKREGIELSRSNPTPWSEDAMNEALNSVRVGQMSINQAAIHYNLPYSSLYGRFKRGKYDVVANTSGVALMNTSGNTTGSIEIIEHSQENSLYPLPIPALKNASFD

Similar Transcription Factors

Sequence clustering based on sequence similarity using MMseqs2

100% Identity: iTF_00915430; iTF_00919750; iTF_00919908;
90% Identity: iTF_00915430;
80% Identity: iTF_00915430;