Basic Information

Insect: Aphaenogaster fulva
Gene Symbol: CSRNP3_1
Assembly: GCA_003063765.1
Location: NJRO01000138.1:305549-312923[-]

Transcription Factor Domain

TF Family: CSRNP_N
Domain: CSRNP_N domain
PFAM: PF16019
TF Group: Unclassified Structure
Description: This presumed domain is found at the N-terminus of cysteine/serine-rich nuclear proteins. These proteins act as transcriptional activators [1].
Hmmscan Out: # of c-Evalue i-Evalue score bias hmm coord from hmm coord to ali coord from ali coord to env coord from env coord to acc

1 3 1 2.4e+04 -6.7 8.8 54 97 90 132 66 157 0.45

2 3 2.9e-101 6.9e-97 324.0 9.0 1 218 760 972 760 972 0.92

3 3 0.71 1.7e+04 -4.2 0.5 63 87 1207 1231 1202 1243 0.37

#	of	c-Evalue	i-Evalue	score	bias	hmm coord from	hmm coord to	ali coord from	ali coord to	env coord from	env coord to	acc
1	3	1	2.4e+04	-6.7	8.8	54	97	90	132	66	157	0.45
2	3	2.9e-101	6.9e-97	324.0	9.0	1	218	760	972	760	972	0.92
3	3	0.71	1.7e+04	-4.2	0.5	63	87	1207	1231	1202	1243	0.37

Sequence Information

Coding Sequence: ATGGCAGAAACACCCGAGATGGAATCGCCTTCGGCCCGTCAGGACTGTTTCGTTGAGGCCCAAGAGGATTCCACCTCAGTGGAGGCCAAAGCGGAAAGTACATCGTCGCCAGGCGGGACGACATCAACAACGATAACGTCGGCAACAACGGAtgccgacgacgatgacgattaCGCGGTGCGTCCATCCGTCGTGCAGGACTCGCGCGAGGACTTGGTGATGGTGTGCGAGAGATTGGACGAGAGATTAGAAGACGAAGGATCTGAAGCGAGACAATCGAGTGATAAGCCAGAGAAGGATCAGgacgaaaaggaaaaagaagaaaaagaagcgaaTATGGGTCTAACGATAGCGAAGAAAGACAATGAGGACGAGAAAAATGAGAAGGACGAAATCGGCGCCAAGTCGACGGAAGATTCCCTTCATGAACTTGAAGAGTCACCAAGAACGCTCGATTCTCAGGATCGCGACATCGGAGAGTCCTCGGAAGTATGGGAGAATGGGATCGAGAAGTCCGGATCGTCGGATGTTTCCAGAAAGAGGCCGGCTACGGGTGATTTCCTGCCGATTGGTGCGGAGATCAAAAGGATCGGCATCGAGATCTCGGAGGAGCAGGCGACCCAGCTGAGGAACGATGTTAGGAGGCTGTCGCCGGTATTAGTGAGCCTGCGGGAGAGGACCCTGGGCGAGGTGTCCCTAACCTCGAAGTCCTGTCTCTTCGGAGAAGAGCTTGACGGTAGAATAATGCCGAGGTGCAACGACGTCTCAACGGGATTATTTGTGGCAAACGATTCCAAAATTCAGGACATCGCTGAGAATCGCGGGAAGCAGGATGTGAGCGAGAAGGAAGCGATCGACAGGATCAGCGCGGAGTGCACGAGCAGCGACAACATCGAGGGTACGTTAAATAGTGAGAGCAGAAAGATGGATTGCGACAGCAAGGGGGAAATTATGACGCTCGACGTTGAAGTGGCTTCTTCCATATTCTCGAGAAGCGACAATTTGGACGGGACGACGGAGTCGCGTCAAGACGACGTCGGAGGCACAAACGTGACCACGAATGCTGGAAGCGAGCCTTGCAGTCCGACCAAAAAGTGCATCATTGAATCGACGAGTCTTACGGTACCATCAAGTCCCATCTGTCGAAATTTAACTATTGTGTTGAATCGCATCGAGAATGATGATTTAAAGAAGAAGAGTGCCCTAATAAGTACGAACGTCGACGAGAACATATGGAACTACGTTGTCGAAGAGAGTTCGCCTTATTCCGGTGGAAGAAGGGATTTCATCGAGGAGGTGCGCGATTCGTTCGAAGAGACTTCGGAAGCTCAGGAGAAGAGCCCGAAGAAGCAACGATTGCAGGGCAGTTCCTCTCCGATGACCAGATCGAAGAAGTGCGAACTAACGGAGAGTGCTCGTAGTCCGAACAATGGACCGGCCCTGAAGAAATGTAAGGTGGTGCTAAAGCGAATCGGTGAGGTCATGGGGCATTCGTCACGATCGAAAAACGCCGAGGACAGCGAAACCTTGAGGGAGCTCGAGAAGGATGATGAGTCCGCGCCCGTCGCAGTGATCGGCAAACTCGAGGAGGATGAAGAGGTGGTATTGGCGAGTTCATCGTCCACGGTCGAGGACAGCCGCGTGTCCAACGAGCTGGACTCGTCGGAGACGATGCCGAGCTCGCCAGAGGAGACGCCGGAAGTATCGGCGGATGTTGCCGAAGGTGTCGACACCGAGACAGAAACGGAGACTGGCTCTGACAGTTCGGAGGTGTCGCCTATCACGAGCATCCGTCACGAGTTGCGCGACGTCGACATGGCGCCCGATCAGTTACCCTGCTCCGAGGGGGTCGCCCTATGCTGCGTGGAGGCGATGGCGCCGATCATAACGAGATTGGAGACCGACCGACCGGAAGCATACACAGAGGACTCCGCCGAGAGCTTGGCCTTGGCGACGGGCGCCAGAGACGAAGTCAGGTCCGATGGGAGTGACTCCGGTCTGGGGAACGAGATCCCTGGTGATCCAGGACCAGCGCCAGCACCGGAGAGCGATTCGGAGACCTCCTTCCTCGATAGGCTGCCGGACGATATCCTCTCCGACAAGGAGAAAGGCGTGAACCAGTTGGATGGCTACGCGACGTCCTCGGGGACGTCCGAGACGCCGGGCCAACTGCCCCTGACGAGCTTCCGGACGCTTCCGGCCAAGAGCAACCTGAAGCGCAGGTTGACCGACTGCATGGAGAGCGACGAGTCGCGGGGCAACGTCGACGAGCCCCTGAAGAAGAAGCGCAACATCCAGTTCGACGCGGTGACGGTCTATTATTTCCCCAGGGCGCAGGGTTTCACCTGCGTACCTTCCCAGGGCGGCAGCACCCTGGGCATGAGCgcgacgcacacgcacgcggagAGGTTCTCGTTGTCGGAACACGCAGCCGAGCAGAGGCGGATCCACCGCGCGCGTCTCGCGCAGCTGCGCTCCGAGCGCAACTGCGCGACCAACTGCGTGACCGAGACGGCGTCCAGTTCGGAGGATCCGAGCGATGACACCGACGAGGAGCCCAGCGACAACGAGGAGCTCGACATCGACAGCTACTACTTCTTACAGCCGGTGCCCACGTGGCAACGCCGGGCGCTCCTCAGGGCTGCCGGCGTGCGGAGGATAGACGCTGTCGAGAAGGACGAGTGTCGCGACATCCGCGCAAGCAGAGAACACTGCGGATGTGGCTGCAAGGGATACTGCGATCCGGAGAGCTGTCCTTGTAGCAGGGCCAATGTAAAATGCcagGTGGATCGACCGGGTTTCCCTTGCGGCTGTACGCGGGATGGTTGTGCAAACAGCACAGGCAGAATCGAATTCAATCCGGTTCGGGTGCGAACGCATTTTATTCACACGCTGATGCGACTAGAATTGGAGAAGAAGCAGCGCGAGGAGGACGGTGGCGGCGATCACGATCAGATAGTGGACAATCAGGGGCAGAACGGCAGGGGTGCTCGTCCCATGAGGGACATCGGTTCCCTGGGGATGGAAGCTACCATGGGTGGTGACGCGTGCGCGATTCCGGGTACAGGACCTGGAGGCGGAGGTGGCGGATTCACGACTTTGCATTACGAGACGAGTCACGAGGGTGTTGGGGCTGGTGTGGCCGGCTGCCAACCGGAGGTGCCCGGCACGCGGGAGGATAGTCTGGACTTATACGCCATCAGGGACGACTGTTACGCGAGCGAAGACGCAGTGGACAGCAGCCAATCAGTCGTCGTGCAGCGGAAGCTGCACCCGGAGTTCGGCCAGGCCTTCCAGAGCTTCTCGCCCGGCGTGCAAAGCGGCAGTGCCACCGGCAGTGGcagtggcggcggtggtggtagcAGCGGTAGCATGAGCTTCCAACAGTCCTCGTACCAGGACTACGGATCGCCGTACACGAGTCTGCCGTCCACATCGCGGATTCCGCAGTtccagccgccgccgccgcagttCCAGTCGCCACCCAATCCGGCCGCCTTTGCGCACTACGGGCCCTACGGCGGGCCCCAGGACACCGCAGGCACCGCTCTTCAGGGCGGCTGCGCCGCACAAGTGCATCAGatgccgcagccgccgccgccgccgcagagccagcagcagcaacagcaacaacagcagcactCGTCCTACGACGCGACAGTGTTCGCACAGGATGATGCCGTGAGTACCACGCAGTACACGAATCTCACCAACTCGGTGCAGCCGATGAACCCGACGGTGGTGCAGCAGATGCAGGGCAAGCTTGAACCCTTCTCGGAGCTACTCAGCGGCAGGTACTCGTACTATGGTGAGATGCACGAGCCGCAACAGCACCACAGTACTTACGGTACTCACGGTACGGCCGGCAAGGTCGCAGAGATGATCGAGCCCGGTCAGGTCACCGGCGAACAACAGCCCGATGGTGCGTCCGAGGATTGCGATGAGAATTTTGGCGAGATCATTAAGAAGTCCATGGTGGAGACCGTGTCTGCCTAG
Protein Sequence: MAETPEMESPSARQDCFVEAQEDSTSVEAKAESTSSPGGTTSTTITSATTDADDDDDYAVRPSVVQDSREDLVMVCERLDERLEDEGSEARQSSDKPEKDQDEKEKEEKEANMGLTIAKKDNEDEKNEKDEIGAKSTEDSLHELEESPRTLDSQDRDIGESSEVWENGIEKSGSSDVSRKRPATGDFLPIGAEIKRIGIEISEEQATQLRNDVRRLSPVLVSLRERTLGEVSLTSKSCLFGEELDGRIMPRCNDVSTGLFVANDSKIQDIAENRGKQDVSEKEAIDRISAECTSSDNIEGTLNSESRKMDCDSKGEIMTLDVEVASSIFSRSDNLDGTTESRQDDVGGTNVTTNAGSEPCSPTKKCIIESTSLTVPSSPICRNLTIVLNRIENDDLKKKSALISTNVDENIWNYVVEESSPYSGGRRDFIEEVRDSFEETSEAQEKSPKKQRLQGSSSPMTRSKKCELTESARSPNNGPALKKCKVVLKRIGEVMGHSSRSKNAEDSETLRELEKDDESAPVAVIGKLEEDEEVVLASSSSTVEDSRVSNELDSSETMPSSPEETPEVSADVAEGVDTETETETGSDSSEVSPITSIRHELRDVDMAPDQLPCSEGVALCCVEAMAPIITRLETDRPEAYTEDSAESLALATGARDEVRSDGSDSGLGNEIPGDPGPAPAPESDSETSFLDRLPDDILSDKEKGVNQLDGYATSSGTSETPGQLPLTSFRTLPAKSNLKRRLTDCMESDESRGNVDEPLKKKRNIQFDAVTVYYFPRAQGFTCVPSQGGSTLGMSATHTHAERFSLSEHAAEQRRIHRARLAQLRSERNCATNCVTETASSSEDPSDDTDEEPSDNEELDIDSYYFLQPVPTWQRRALLRAAGVRRIDAVEKDECRDIRASREHCGCGCKGYCDPESCPCSRANVKCQVDRPGFPCGCTRDGCANSTGRIEFNPVRVRTHFIHTLMRLELEKKQREEDGGGDHDQIVDNQGQNGRGARPMRDIGSLGMEATMGGDACAIPGTGPGGGGGGFTTLHYETSHEGVGAGVAGCQPEVPGTREDSLDLYAIRDDCYASEDAVDSSQSVVVQRKLHPEFGQAFQSFSPGVQSGSATGSGSGGGGGSSGSMSFQQSSYQDYGSPYTSLPSTSRIPQFQPPPPQFQSPPNPAAFAHYGPYGGPQDTAGTALQGGCAAQVHQMPQPPPPPQSQQQQQQQQQHSSYDATVFAQDDAVSTTQYTNLTNSVQPMNPTVVQQMQGKLEPFSELLSGRYSYYGEMHEPQQHHSTYGTHGTAGKVAEMIEPGQVTGEQQPDGASEDCDENFGEIIKKSMVETVSA

Similar Transcription Factors

Sequence clustering based on sequence similarity using MMseqs2

100% Identity: iTF_01409106;
90% Identity: iTF_00125918;
80% Identity: -