Basic Information

Insect: Nomada ferruginata
Gene Symbol: GATA-B_1
Assembly: GCA_963583965.1
Location: OY757228.1:6588629-6601694[-]

Transcription Factor Domain

TF Family: zf-GATA
Domain: zf-GATA domain
PFAM: PF00320
TF Group: Zinc-Coordinating Group
Description: This domain uses four cysteine residues to coordinate a zinc ion. This domain binds to DNA. Two GATA zinc fingers are found in the GATA transcription factors. However there are several proteins which only contain a single copy of the domain.
Hmmscan Out: # of c-Evalue i-Evalue score bias hmm coord from hmm coord to ali coord from ali coord to env coord from env coord to acc

1 3 1.4e-17 3.8e-14 52.4 3.2 1 34 727 759 727 761 0.97

2 3 1.2e-17 3.3e-14 52.6 3.6 1 35 781 814 781 815 0.97

3 3 4.7 1.3e+04 -3.7 3.8 1 19 850 868 850 870 0.85

#	of	c-Evalue	i-Evalue	score	bias	hmm coord from	hmm coord to	ali coord from	ali coord to	env coord from	env coord to	acc
1	3	1.4e-17	3.8e-14	52.4	3.2	1	34	727	759	727	761	0.97
2	3	1.2e-17	3.3e-14	52.6	3.6	1	35	781	814	781	815	0.97
3	3	4.7	1.3e+04	-3.7	3.8	1	19	850	868	850	870	0.85

Sequence Information

Coding Sequence: ATGAAGGATGCCGGGGCGAGCATCGGCGAGGAGGACGACGGGGAAACGAGCAGGCTGCTGTGCTTGGACAAGCGGGAAACGGCAGGAGTCGTTGGAATTTTTCGGCGGTCGCGGCTAGACCGGCAACTagagcaacagcagcagcagcaacaacaacaacaacaacagcaacaacagctAGTGTACGGGAAGCGTGGAGACGACGAAGGCGGGGACACCGTGGGCGTGCTGGAGGCGGGACAGcaggaaattgaaaatggCGCGGTCTTAGGGGCGAGCAGCATCGAAGCGGCAGCGATTCCCGTTTCGACGTGCCAGGAAAACGACGACAGCGCCGCGTATGGTTTGAACGCGCTCGGATACGACTCCCACGACTCTGTCCTACGAGAAAGGAATTGCACGGATCGGGACTCGGGCAGCTACGGTGACGGCGATCTAGCCGGTGCTTCTGCGAAGCTGGAGGATCCCGAACGACAGCGtcagcaacaacagcaacaacagcaacaacagcaacaacaacaggaACAGCAAGAGCAGCCCCACCGCAATCACCAtcgccaccaccaccaccgatTCCTTCGTCACGAACAGCACGAGCATCGGTCGGCGTACGGTCAGCTGGGGGCGAGAGAAGTATCGGTTTCCGAGGGTGGGGATAACGGACAGCGGAGCGAGGCCTCCGTGTTGCCGGAGGAAAATCGGTCTGCCAGTCACGCGCTTCGTTCGACGATGCATCGTTACGGTACCGAAGCGCTCTCTCCGACTACGACCGACCATCAACAGAGCCACCACCACCACAACCCTCATCACCACCACCatcagcagcaacagcaacagcaacagcaacagcaacagcaccATCATCATCAGCACCATTTACAGTCGGCCACGACCGAACCCAGCGCGCTTTCGTCGGCCGGTCATCGTCAATTGGAGGAACGGGATACCCAGTCGCAACCGGCGGCGCATCGAGCACACGTAGACGAGGACGTGGAGAGAGTTAGTGGTATCGCGGCAGCAATGAGAGGCGCTCGTGGAGACTTTACTCTCGGTGTGCTGTTCCCGAACCTCGGCACTGCCGGTGCCAGCAGTGGCGGCAACGAGGTCGTAGCCAACGACAGCCATCATcatcagcagcagcagcagcaacagcagcagcaaccgCCGCACCACCATCACCACCATCACCATCATCATCACCACCACTTGGACGAGGTGCTGCCCGAGGACGCTTACCTCCAGCATCAGATACGAGGCAGCGGGGGCGCAGCAGGTGGTGGCGGAGGCAACGGCAACGGGAGCAACGGCGGCGGCGTGGAGGGCAGCGGCACAGGCGGTGCAGGTTCGCCGACTCTTCGAACCGGTAGTTCACCAGGTTCCAGTCGCAGCCCGCACGACGACCAAGGACTCTCCTCGCCGCACCGTCACGGCCAAACTGACGGAGGATACAGTCCCAGCGATCAGGGCAGGCAATCGTACGCGCACCTGACAGCGATGCAGCCGCCTCCGTCGGTGCAAACGAGCCACGGACTTGGCCAGGAGTCCGACAGGGTGTCCGATCAGCTGTACATGGATTCGATTTACGGTCATCACGCAGCTGGGACCGGTCATCATCATCAGGATCCGGAGCCCGGTTCGCCGCAGTCGCATTCACCGAACGGTACACTGTCCAGCCCGATGTATCGTTCGATGAGCGGGGTAGGCGGCATGGCAGCCGCGAACGCGGCAGGAACCGGAGGTACTTACGGTCTTGCGTACATGACCGGCAGCCCCACGGAATTGACCGCCTCGCCTCAGCAGCTGTGGAACGCGCAAGGTTTGGGCCTCGCGGCCATCTCCGAGGATTACGGAGGCGGCGGTAAATCGTCCGGATCGGTGACCCATCAGGCCCTCCCGGGCTTCTCGCAGCCGTTTTGCGGCAGGGCAAGCTTCCGAGGATACAGCCCGTCTTACTCGACTCAGCAGGGCGGTACCGGGGTCGGAGCTGGCGCGGTCGACGCATCCACGTGGACTTACGCTTCGCCGTCCAACGACTCTCTCACGACCCAGTACGCGACGCCGTCCAGACGACAGACCGTCAATCCGGCGTCGACGCCTACGCAGCATCAGCTCACCGCTACGGCCAATCTTAGCGCAATGCACAACATCGAGGCGGAATACTTTACGGAGGGCCGCGAGTGCGTAAATTGCGGCGCAATCTCCACTCCGCTATGGCGACGAGACGGCACCGGCCATTACCTGTGCAACGCATGCGGTCTCTACCACAAGATGAACGGAATGAATCGGCCCCTGGTGAAGCAGCCGCGGCGATTGTCGGCATCGAGACGGGTAGGCACTTCTTGCAGCAACTGTCAGACGACGATGACGTCGTTGTGGCGTCGGAACGCCCTCGGCGAGCCCGTGTGTAACGCGTGCGGCCTCTACTTCAAACTGCACAACGTGAACAGGCCGCAAACCATGAAGAAGGACAGCATCCAGACGCGAAAGCGGAAGCCCAAGGGTGGCATGAAGTCCACCGATACACCGATCTCTGGGGCGGTCACGATGTGCACGAACAACAACACCACCAACACCGCCAAcatcaacaacaacaacaacaacagcaataCCAACAACAACAATTTGAAACTGGAACCAGACACCTACGGGGCCTTGAGAATGAACCACTCCGGCGTGCCGGTTACCTACGGGAGCAACCTCTACGACAGCCCGCAGTCCTCCGCCCGGATCGTCTCCTATCAGTCGCCAACCACGCCCGGGATCTACTACGACATGATCACTTCTCAGCAGCAACAGCACCAGCCTCAGCACCAGCATCAGCATCACCAGCAGCTTCTCGAGACCCACTCCCCGAAAGTCGAGTGCCCGTCCCCGCCTTGCACGAATCGGTCGCCCGTTATGATGTCCGCTGGTCATTCGCCCGACCATCACCAGCTCGCTACCCCGCACATAGTTACGCTCGGCAATTCGTCGCCCAGCACGGCGGCAACCAAGATCATCCTCGACAACGGCCATCTGGACAGACCAACGGTCGTCTCGATATCGTCCTAA
Protein Sequence: MKDAGASIGEEDDGETSRLLCLDKRETAGVVGIFRRSRLDRQLEQQQQQQQQQQQQQQQLVYGKRGDDEGGDTVGVLEAGQQEIENGAVLGASSIEAAAIPVSTCQENDDSAAYGLNALGYDSHDSVLRERNCTDRDSGSYGDGDLAGASAKLEDPERQRQQQQQQQQQQQQQQEQQEQPHRNHHRHHHHRFLRHEQHEHRSAYGQLGAREVSVSEGGDNGQRSEASVLPEENRSASHALRSTMHRYGTEALSPTTTDHQQSHHHHNPHHHHHQQQQQQQQQQQQHHHHQHHLQSATTEPSALSSAGHRQLEERDTQSQPAAHRAHVDEDVERVSGIAAAMRGARGDFTLGVLFPNLGTAGASSGGNEVVANDSHHHQQQQQQQQQQPPHHHHHHHHHHHHHLDEVLPEDAYLQHQIRGSGGAAGGGGGNGNGSNGGGVEGSGTGGAGSPTLRTGSSPGSSRSPHDDQGLSSPHRHGQTDGGYSPSDQGRQSYAHLTAMQPPPSVQTSHGLGQESDRVSDQLYMDSIYGHHAAGTGHHHQDPEPGSPQSHSPNGTLSSPMYRSMSGVGGMAAANAAGTGGTYGLAYMTGSPTELTASPQQLWNAQGLGLAAISEDYGGGGKSSGSVTHQALPGFSQPFCGRASFRGYSPSYSTQQGGTGVGAGAVDASTWTYASPSNDSLTTQYATPSRRQTVNPASTPTQHQLTATANLSAMHNIEAEYFTEGRECVNCGAISTPLWRRDGTGHYLCNACGLYHKMNGMNRPLVKQPRRLSASRRVGTSCSNCQTTMTSLWRRNALGEPVCNACGLYFKLHNVNRPQTMKKDSIQTRKRKPKGGMKSTDTPISGAVTMCTNNNTTNTANINNNNNNSNTNNNNLKLEPDTYGALRMNHSGVPVTYGSNLYDSPQSSARIVSYQSPTTPGIYYDMITSQQQQHQPQHQHQHHQQLLETHSPKVECPSPPCTNRSPVMMSAGHSPDHHQLATPHIVTLGNSSPSTAATKIILDNGHLDRPTVVSISS

Similar Transcription Factors

Sequence clustering based on sequence similarity using MMseqs2

100% Identity: iTF_01070734;
90% Identity: iTF_01069324;
80% Identity: -