| Label | Gene | Product | Position | Strand | |
|---|---|---|---|---|---|
| AmpR | bla | beta-lactamase | 1606..2467 | Fwd | |
|
DNA Sequence
ATGAGTATTCAACATTTCCGTGTCGCCCTTATTCCCTTTTTTGCGGCATTTTGCCTTCCTGTTTTTGCTCACCCAGAAACGCTGGTGAAAGTAAAAGATGCTGAAGATCAGTTGGGTGCACGAGTGGGTTACATCGAACTGGATCTCAACAGCGGTAAGATCCTTGAGAGTTTTCGCCCCGAAGAACGTTTTCCAATGATGAGCACTTTTAAAGTTCTGCTATGTGGCGCGGTATTATCCCGTATTGACGCCGGGCAAGAGCAACTCGGTCGCCGCATACACTATTCTCAGAATGACTTGGTTGAGTACTCACCAGTCACAGAAAAGCATCTTACGGATGGCATGACAGTAAGAGAATTATGCAGTGCTGCCATAACCATGAGTGATAACACTGCGGCCAACTTACTTCTGACAACGATCGGAGGACCGAAGGAGCTAACCGCTTTTTTGCACAACATGGGGGATCATGTAACTCGCCTTGATCGTTGGGAACCGGAGCTGAATGAAGCCATACCAAACGACGAGCGTGACACCACGATGCCTGTAGCAATGGCAACAACGTTGCGCAAACTATTAACTGGCGAACTACTTACTCTAGCTTCCCGGCAACAATTAATAGACTGGATGGAGGCGGATAAAGTTGCAGGACCACTTCTGCGCTCGGCCCTTCCGGCTGGCTGGTTTATTGCTGATAAATCTGGAGCCGGTGAGCGTGGATCTCGCGGTATCATTGCAGCACTGGGGCCAGATGGTAAGCCCTCCCGTATCGTAGTTATCTACACGACGGGGAGTCAGGCAACTATGGATGAACGAAATAGACAGATCGCTGAGATAGGTGCCTCACTGATTAAGCATTGGTAA
Protein Sequence
MSIQHFRVALIPFFAAFCLPVFAHPETLVKVKDAEDQLGARVGYIELDLNSGKILESFRPEERFPMMSTFKVLLCGAVLSRIDAGQEQLGRRIHYSQNDLVEYSPVTEKHLTDGMTVRELCSAAITMSDNTAANLLLTTIGGPKELTAFLHNMGDHVTRLDRWEPELNEAIPNDERDTTMPVAMATTLRKLLTGELLTLASRQQLIDWMEADKVAGPLLRSALPAGWFIADKSGAGERGSRGIIAALGPDGKPSRIVVIYTTGSQATMDERNRQIAEIGASLIKHW
|
|||||
| EGFP | — | the original enhanced GFP (Yang et al.,… | 4462..5182 | Rev | |
|
DNA Sequence
ATGGTGAGCAAGGGCGAGGAGCTGTTCACCGGGGTGGTGCCCATCCTGGTCGAGCTGGACGGCGACGTAAACGGCCACAAGTTCAGCGTGTCCGGCGAGGGCGAGGGCGATGCCACCTACGGCAAGCTGACCCTGAAGTTCATCTGCACCACCGGCAAGCTGCCCGTGCCCTGGCCCACCCTCGTGACCACCCTGACCTACGGCGTGCAGTGCTTCAGCCGCTACCCCGACCACATGAAGCAGCACGACTTCTTCAAGTCCGCCATGCCCGAAGGCTACGTCCAGGAGCGCACCATCTTCTTCAAGGACGACGGCAACTACAAGACCCGCGCCGAGGTGAAGTTCGAGGGCGACACCCTGGTGAACCGCATCGAGCTGAAGGGCATCGACTTCAAGGAGGACGGCAACATCCTGGGGCACAAGCTGGAGTACAACTACAACAGCCACAACGTCTATATCATGGCCGACAAGCAGAAGAACGGCATCAAGGTGAACTTCAAGATCCGCCACAACATCGAGGACGGCAGCGTGCAGCTCGCCGACCACTACCAGCAGAACACCCCCATCGGCGACGGCCCCGTGCTGCTGCCCGACAACCACTACCTGAGCACCCAGTCCGCCCTGAGCAAAGACCCCAACGAGAAGCGCGATCACATGGTCCTGCTGGAGTTCGTGACCGCCGCCGGGATCACTCTCGGCATGGACGAGCTGTACAAGTAA
Protein Sequence
MVSKGEELFTGVVPILVELDGDVNGHKFSVSGEGEGDATYGKLTLKFICTTGKLPVPWPTLVTTLTYGVQCFSRYPDHMKQHDFFKSAMPEGYVQERTIFFKDDGNYKTRAEVKFEGDTLVNRIELKGIDFKEDGNILGHKLEYNYNSHNVYIMADKQKNGIKVNFKIRHNIEDGSVQLADHYQQNTPIGDGPVLLPDNHYLSTQSALSKDPNEKRDHMVLLEFVTAAGITLGMDELYK
|
|||||
| EGFP | — | the original enhanced GFP (Yang et al.,… | 4465..5182 | Rev | |
|
DNA Sequence
ATGGTGAGCAAGGGCGAGGAGCTGTTCACCGGGGTGGTGCCCATCCTGGTCGAGCTGGACGGCGACGTAAACGGCCACAAGTTCAGCGTGTCCGGCGAGGGCGAGGGCGATGCCACCTACGGCAAGCTGACCCTGAAGTTCATCTGCACCACCGGCAAGCTGCCCGTGCCCTGGCCCACCCTCGTGACCACCCTGACCTACGGCGTGCAGTGCTTCAGCCGCTACCCCGACCACATGAAGCAGCACGACTTCTTCAAGTCCGCCATGCCCGAAGGCTACGTCCAGGAGCGCACCATCTTCTTCAAGGACGACGGCAACTACAAGACCCGCGCCGAGGTGAAGTTCGAGGGCGACACCCTGGTGAACCGCATCGAGCTGAAGGGCATCGACTTCAAGGAGGACGGCAACATCCTGGGGCACAAGCTGGAGTACAACTACAACAGCCACAACGTCTATATCATGGCCGACAAGCAGAAGAACGGCATCAAGGTGAACTTCAAGATCCGCCACAACATCGAGGACGGCAGCGTGCAGCTCGCCGACCACTACCAGCAGAACACCCCCATCGGCGACGGCCCCGTGCTGCTGCCCGACAACCACTACCTGAGCACCCAGTCCGCCCTGAGCAAAGACCCCAACGAGAAGCGCGATCACATGGTCCTGCTGGAGTTCGTGACCGCCGCCGGGATCACTCTCGGCATGGACGAGCTGTACAAG
Protein Sequence
MVSKGEELFTGVVPILVELDGDVNGHKFSVSGEGEGDATYGKLTLKFICTTGKLPVPWPTLVTTLTYGVQCFSRYPDHMKQHDFFKSAMPEGYVQERTIFFKDDGNYKTRAEVKFEGDTLVNRIELKGIDFKEDGNILGHKLEYNYNSHNVYIMADKQKNGIKVNFKIRHNIEDGSVQLADHYQQNTPIGDGPVLLPDNHYLSTQSALSKDPNEKRDHMVLLEFVTAAGITLGMDELYK
|
|||||
| T2A | — | 2A peptide from Thosea asigna virus cap… | 5182..5236 | Rev | |
|
DNA Sequence
GAGGGCAGAGGAAGTCTTCTAACATGCGGTGACGTGGAGGAGAATCCCGGCCCA
Protein Sequence
EGRGSLLTCGDVEENPGP
|
|||||
| SV40 NLS | — | nuclear localization signal of SV40 (si… | 5251..5272 | Rev | |
|
DNA Sequence
CCTAAGAAGAAGAGAAAGGTG
Protein Sequence
PKKKRKV
|
|||||
| Cas9 | — | Cas9 (Csn1) endonuclease from the Strep… | 5287..9388 | Rev | |
|
DNA Sequence
ATGGATAAGAAGTATAGCATCGGCCTGGATATTGGAACTAACTCCGTGGGTTGGGCAGTGATTACAGACGACTACAAGGTCCCTAGCAAGAAATTTAAGGTGCTGGGTAACACCGACAGGCACAGCATCAAGAAAAATCTGATTGGAGCCCTGCTGTTCGGTTCTGGAGAGACTGCCGAAGCAACACGCCTGAAAAGAACAGCAAGAAGGCGCTATACCAGAAGGAAGAATAGAATCTGTTACCTGCAGGAGATTTTCTCTAACGAAATGGCTAAGGTGGACGATTCATTCTTTCATAGGCTGGAGGAAAGTTTCCTGGTCGAGGAAGATAAGAAACACGAGCGCCATCCTATCTTTGGAAACATTGTGGACGAGGTCGCCTATCACGAAAAATACCCAACCATCTATCATCTGCGCAAGAAACTGGCTGACTCTACTGATAAAGCCGACCTGAGACTGATCTATCTGGCTCTGGCCCACATGATTAAGTTCAGGGGTCATTTTCTGATCGAGGGCGATCTGAACCCCGACAATTCCGATGTGGACAAGCTGTTCATCCAGCTGGTCCAGATTTACAATCAGCTGTTTGAGGAAAACCCTATTAATGCTTCCAGAGTGGACGCAAAAGCTATCCTGTCAGCCAGGCTGTCCAAGTCACGCAGACTGGAGAACCTGATTGCACAGCTGCCCGGAGAAAAGAGGAACGGTCTGTTTGGAAATCTGATCGCTCTGAGTCTGGGCCTGACTCCTAACTTCAAAAGCAATTTTGATCTGGCTGAGGACGCCAAACTGCAGCTGTCAAAGGACACATATGACGATGACCTGGATAACCTGCTGGCACAGATCGGAGATCAGTACGCTGACCTGTTCCTGGCTGCCAAAAATCTGTCCGACGCAATCCTGCTGTCAGATATTCTGAGAGTGAACAGCGAGATTACAAAAGCTCCTCTGAGTGCCAGCATGATCAAGAGATATGACGAGCACCATCAGGATCTGACCCTGCTGAAGGCTCTGGTCAGGCAGCAGCTGCCAGAGAAGTACAAGGAAATTTTCTTTGATCAGTCCAAGAACGGCTACGCCGGTTATATCGACGGAGGCGCATCACAGGAGGAATTCTACAAGTTTATCAAACCTATTCTGGAGAAGATGGACGGAACTGAGGAACTGCTGGTGAAACTGAATAGAGAGGACCTGCTGAGGAAGCAGCGCACATTTGATAACGGTTCCATCCCACACCAGATTCATCTGGGAGAGCTGCACGCTATCCTGAGGCGCCAGGAAGACTTCTACCCCTTTCTGAAAGATAACCGCGAGAAGATCGAAAAAATTCTGACCTTCAGAATCCCTTACTATGTGGGTCCACTGGCTCGCGGAAACAGCAGATTTGCCTGGATGACTCGCAAATCCGAGGAAACCATTACTCCTTGGAACTTCGAGGAAGTGGTCGATAAGGGCGCCTCTGCACAGTCCTTCATCGAGAGAATGACTAATTTTGACAAAAACCTGCCCAATGAGAAAGTGCTGCCTAAGCACTCCCTGCTGTACGAGTATTTCACTGTCTATAACGAACTGACAAAGGTGAAATACGTCACCGAGGGCATGAGAAAGCCAGCCTTCCTGTCAGGAGAGCAGAAGAAAGCAATCGTGGATCTGCTGTTTAAAACCAACAGGAAAGTGACTGTCAAGCAGCTGAAGGAGGACTACTTCAAGAAAATTGAATGCTTCGATTCCGTGGAGATCAGCGGAGTCGAAGACAGATTTAACGCAAGCCTGGGCGCTTACCACGATCTGCTGAAGATCATTAAGGATAAAGACTTCCTGGACAACGAGGAAAATGAGGATATCCTGGAAGACATTGTGCTGACACTGACCCTGTTTGAGGACAGAGGAATGATCGAGGAAAGACTGAAAACCTATGCTCATCTGTTCGATGACAAGGTGATGAAACAGCTGAAGAGAAGGCGCTACACTGGCTGGGGTAGACTGAGCAGGAAGCTGATCAACGGCATTAGGGATAAACAGTCAGGAAAGACAATCCTGGACTTTCTGAAAAGTGATGGCTTCGCCAACCGCAATTTTATGCAGCTGATTCACGATGACAGTCTGACCTTCAAAGAGGACATCCAGAAGGCTCAGGTGTCTGGACAGGGCCACTCCCTGCATGAGCAGATTGCAAACCTGGCTGGAAGCCCAGCCATCAAGAAAGGCATTCTGCAGACAGTGAAAATCGTCGATGAGCTGGTGAAAGTCATGGGCCATAAGCCCGAAAACATCGTGATTGAGATGGCTCGCGAAAATCAGACAACCCAGAAGGGTCAGAAGAACAGTAGAGAGAGGATGAAAAGAATCGAGGAAGGCATTAAGGAGCTGGGTAGCCAGATCCTGAAAGAGCACCCAGTGGAAAACACACAGCTGCAGAATGAGAAGCTGTATCTGTACTATCTGCAGAATGGAAGAGATATGTACGTGGACCAGGAGCTGGATATTAACAGGCTGTCTGATTACGACGTGGATCATATCGTCCCCCAGAGTTTCATCAAAGATGACAGCATTGACAACAAGGTGCTGACCAGGTCCGACAAAAACAGAGGAAAATCAGATAATGTCCCTAGTGAGGAAGTGGTCAAGAAAATGAAGAACTACTGGAGACAGCTGCTGAATGCCAAACTGATCACTCAGAGGAAGTTTGATAACCTGACAAAAGCAGAGCGCGGTGGACTGTCAGAACTGGACAAAGCTGGATTCATCAAGAGGCAGCTGGTGGAAACACGCCAGATCACTAAACACGTCGCACAGATTCTGGATAGTCGCATGAACACAAAGTACGATGAGAATGACAAACTGATCAGAGAAGTGAAGGTCATTACCCTGAAGAGTAAACTGGTCAGCGACTTTAGGAAAGATTTCCAGTTTTATAAGGTCCGCGAGATTAACAATTATCACCATGCCCATGACGCATACCTGAACGCCGTGGTCGGTACCGCACTGATCAAGAAATACCCAAAACTGGAGAGCGAATTCGTGTACGGAGACTATAAGGTGTACGATGTCAGAAAAATGATCGCCAAGTCCGAGCAGGAAATTGGAAAAGCTACTGCCAAGTATTTCTTTTACTCAAACATCATGAATTTCTTTAAGACAGAGATCACCCTGGCCAATGGAGAAATCCGCAAAAGGCCCCTGATTGAGACAAACGGAGAGACAGGCGAAATCGTGTGGGACAAAGGCAGAGATTTTGCAACCGTGAGGAAGGTCCTGAGCATGCCTCAAGTGAATATCGTCAAGAAAACTGAGGTGCAGACAGGCGGTTTCTCAAAAGAAAGTATTCTGCCAAAACGCAACTCTGATAAGCTGATCGCTAGAAAGAAAGACTGGGACCCTAAGAAGTATGGAGGCTTTGACTCTCCCACTGTGGCATACTCCGTCCTGGTGGTCGCTAAGGTGGAGAAGGGCAAAAGCAAGAAACTGAAATCTGTCAAGGAGCTGCTGGGTATCACAATTATGGAGAGAAGCTCTTTCGAGAAGAACCCAATCGATTTTCTGGAGGCCAAAGGTTATAAGGAAGTGAAGAAAGACCTGATCATTAAACTGCCCAAGTACAGTCTGTTTGAGCTGGAAAACGGCAGGAAACGCATGCTGGCAAGCGCTGGAGAGCTGCAGAAAGGCAATGAACTGGCCCTGCCTTCTAAGTACGTGAACTTCCTGTATCTGGCAAGCCACTACGAGAAGCTGAAAGGATCTCCAGAGGATAACGAACAGAAACAGCTGTTTGTGGAGCAGCACAAGCATTATCTGGACGAGATCATTGAACAGATTAGCGAGTTCTCTAAAAGAGTGATCCTGGCCGACGCAAATCTGGATAAGGTCCTGTCTGCTTACAACAAACACAGAGATAAGCCCATCAGGGAGCAGGCCGAAAATATCATTCATCTGTTCACTCTGACAAACCTGGGCGCACCTGCAGCTTTCAAGTACTTCGACACTACAATCGATAGAAAGAGGTACACCTCCACTAAGGAGGTGCTGGACGCTACACTGATCCATCAGAGTATTACCGGCCTGTACGAAACAAGGATTGACCTGTCTCAGCTGGGTGGCGAC
Protein Sequence
MDKKYSIGLDIGTNSVGWAVITDDYKVPSKKFKVLGNTDRHSIKKNLIGALLFGSGETAEATRLKRTARRRYTRRKNRICYLQEIFSNEMAKVDDSFFHRLEESFLVEEDKKHERHPIFGNIVDEVAYHEKYPTIYHLRKKLADSTDKADLRLIYLALAHMIKFRGHFLIEGDLNPDNSDVDKLFIQLVQIYNQLFEENPINASRVDAKAILSARLSKSRRLENLIAQLPGEKRNGLFGNLIALSLGLTPNFKSNFDLAEDAKLQLSKDTYDDDLDNLLAQIGDQYADLFLAAKNLSDAILLSDILRVNSEITKAPLSASMIKRYDEHHQDLTLLKALVRQQLPEKYKEIFFDQSKNGYAGYIDGGASQEEFYKFIKPILEKMDGTEELLVKLNREDLLRKQRTFDNGSIPHQIHLGELHAILRRQEDFYPFLKDNREKIEKILTFRIPYYVGPLARGNSRFAWMTRKSEETITPWNFEEVVDKGASAQSFIERMTNFDKNLPNEKVLPKHSLLYEYFTVYNELTKVKYVTEGMRKPAFLSGEQKKAIVDLLFKTNRKVTVKQLKEDYFKKIECFDSVEISGVEDRFNASLGAYHDLLKIIKDKDFLDNEENEDILEDIVLTLTLFEDRGMIEERLKTYAHLFDDKVMKQLKRRRYTGWGRLSRKLINGIRDKQSGKTILDFLKSDGFANRNFMQLIHDDSLTFKEDIQKAQVSGQGHSLHEQIANLAGSPAIKKGILQTVKIVDELVKVMGHKPENIVIEMARENQTTQKGQKNSRERMKRIEEGIKELGSQILKEHPVENTQLQNEKLYLYYLQNGRDMYVDQELDINRLSDYDVDHIVPQSFIKDDSIDNKVLTRSDKNRGKSDNVPSEEVVKKMKNYWRQLLNAKLITQRKFDNLTKAERGGLSELDKAGFIKRQLVETRQITKHVAQILDSRMNTKYDENDKLIREVKVITLKSKLVSDFRKDFQFYKVREINNYHHAHDAYLNAVVGTALIKKYPKLESEFVYGDYKVYDVRKMIAKSEQEIGKATAKYFFYSNIMNFFKTEITLANGEIRKRPLIETNGETGEIVWDKGRDFATVRKVLSMPQVNIVKKTEVQTGGFSKESILPKRNSDKLIARKKDWDPKKYGGFDSPTVAYSVLVVAKVEKGKSKKLKSVKELLGITIMERSSFEKNPIDFLEAKGYKEVKKDLIIKLPKYSLFELENGRKRMLASAGELQKGNELALPSKYVNFLYLASHYEKLKGSPEDNEQKQLFVEQHKHYLDEIIEQISEFSKRVILADANLDKVLSAYNKHRDKPIREQAENIIHLFTLTNLGAPAAFKYFDTTIDRKRYTSTKEVLDATLIHQSITGLYETRIDLSQLGGD
|
|||||
| SV40 NLS | — | nuclear localization signal of SV40 (si… | 9394..9415 | Rev | |
|
DNA Sequence
CCTAAGAAGAAGAGAAAGGTG
Protein Sequence
PKKKRKV
|
|||||
| Label | Gene | Product | Position | Strand | |
|---|---|---|---|---|---|
| Shine-Dalgarno sequence | — | — | 5366..5375 | Fwd | |
|
DNA Sequence
ACCTCCTTA
|
|||||
| Label | Gene | Product | Position | Strand | |
|---|---|---|---|---|---|
| hsp70 promoter | — | — | 0..9671 | Rev | |
|
DNA Sequence
CCGGAGTATAAATAGAGGCGCTTCGTCTACGGAGCGACAATTCAATTCAAACAAGCAAAGTGAACACGTCGCTAAGCGAAAGCTAAGCAAATAAACAAGCGCAGCTGAACAAGCTAAACAATCTGCAGTAAAGTGCAAGTTAAAGTGAATCAATTAAAAGTAACCAGCAACCAAGTAAATCAACTGCAACTACTGAAATCTGCCAAGAAGTAATTATTGAATACAAGAAGAGAACTCTG
|
|||||
| T7 promoter | — | — | 786..805 | Rev | |
|
DNA Sequence
TAATACGACTCACTATAGG
|
|||||
| AmpR promoter | bla | — | 1501..1606 | Fwd | |
|
DNA Sequence
CGCGGAACCCCTATTTGTTTATTTTTCTAAATACATTCAAATATGTATCCGCTCATGAGACAATAACCCTGATAAATGCTTCAATAATATTGAAAAAGGAAGAGT
|
|||||
| lac promoter | — | — | 3549..3580 | Fwd | |
|
DNA Sequence
TTTACACTTTATGCTTCCGGCTCGTATGTTG
|
|||||
| SP6 promoter | — | — | 3645..3664 | Fwd | |
|
DNA Sequence
ATTTAGGTGACACTATAGA
|
|||||
| Label | Gene | Product | Position | Strand | |
|---|---|---|---|---|---|
| 5X UAS | — | — | 33..128 | Fwd | |
|
DNA Sequence
CTCGGAGGACAGTACTCCGCTCGGAGGACAGTACTCCGCTCGGAGGACAGTACTCCGCTCGGAGGACAGTACTCCGCTCGGAGGACAGTACTCCG
|
|||||
| CAP binding site | — | — | 3513..3535 | Fwd | |
|
DNA Sequence
TAATGTGAGTTAGCTCACTCAT
|
|||||
| lac operator | — | — | 3587..3604 | Fwd | |
|
DNA Sequence
TTGTGAGCGGATAACAA
|
|||||
| Label | Gene | Product | Position | Strand | |
|---|---|---|---|---|---|
| f1 ori | — | — | 968..1424 | Fwd | |
|
DNA Sequence
ACGCGCCCTGTAGCGGCGCATTAAGCGCGGCGGGTGTGGTGGTTACGCGCAGCGTGACCGCTACACTTGCCAGCGCCCTAGCGCCCGCTCCTTTCGCTTTCTTCCCTTCCTTTCTCGCCACGTTCGCCGGCTTTCCCCGTCAAGCTCTAAATCGGGGGCTCCCTTTAGGGTTCCGATTTAGTGCTTTACGGCACCTCGACCCCAAAAAACTTGATTAGGGTGATGGTTCACGTAGTGGGCCATCGCCCTGATAGACGGTTTTTCGCCCTTTGACGTTGGAGTCCACGTTCTTTAATAGTGGACTCTTGTTCCAAACTGGAACAACACTCAACCCTATCTCGGTCTATTCTTTTGATTTATAAGGGATTTTGCCGATTTCGGCCTATTGGTTAAAAAATGAGCTGATTTAACAAAAATTTAACGCGAATTTTAACAAAATATTAACGCTTACAATTT
|
|||||
| ori | — | — | 2637..3226 | Fwd | |
|
DNA Sequence
TTGAGATCCTTTTTTTCTGCGCGTAATCTGCTGCTTGCAAACAAAAAAACCACCGCTACCAGCGGTGGTTTGTTTGCCGGATCAAGAGCTACCAACTCTTTTTCCGAAGGTAACTGGCTTCAGCAGAGCGCAGATACCAAATACTGTTCTTCTAGTGTAGCCGTAGTTAGGCCACCACTTCAAGAACTCTGTAGCACCGCCTACATACCTCGCTCTGCTAATCCTGTTACCAGTGGCTGCTGCCAGTGGCGATAAGTCGTGTCTTACCGGGTTGGACTCAAGACGATAGTTACCGGATAAGGCGCAGCGGTCGGGCTGAACGGGGGGTTCGTGCACACAGCCCAGCTTGGAGCGAACGACCTACACCGAACTGAGATACCTACAGCGTGAGCTATGAGAAAGCGCCACGCTTCCCGAAGGGAGAAAGGCGGACAGGTATCCGGTAAGCGGCAGGGTCGGAACAGGAGAGCGCACGAGGGAGCTTCCAGGGGGAAACGCCTGGTATCTTTATAGTCCTGTCGGGTTTCGCCACCTCTGACTTGAGCGTCGATTTTTGTGATGCTCGTCAGGGGGGCGGAGCCTATGGAAA
|
|||||